@AYi_AInotes
清华大学和无问芯穹等团队开源 C2C(Cache-to-Cache)技术,让多智能体 LLM 之间无需人类文字即可直接交流,推理速度提升 2.0-2.5 倍,准确率最高提升 14.2%,比传统文字聊天 Agent 团队高 5%。
X / Twitter查看原文 →
@AYi_AInotes 介绍清华大学和无问芯穹等团队开源 C2C(Cache-to-Cache)技术(ICLR 2026,代码已开源),让多智能体 LLM 之间无需人类文字即可直接交流:通过 Neural Fuser 将模型 A 的 KV-Cache 高维旋转对齐直接嫁接到模型 B,并用可学习门控动态挑选关键层吸收增益;推理速度提升 2.0-2.5 倍,综合问答准确率最高提升 14.2%,比传统文字聊天 Agent 团队高 5%。
清华大学和无问芯穹等团队开源 C2C(Cache-to-Cache)技术,让多智能体 LLM 之间无需人类文字即可直接交流,推理速度提升 2.0-2.5 倍,准确率最高提升 14.2%,比传统文字聊天 Agent 团队高 5%。