缓存到缓存:LLM 间的直接语义通信(2025)

Hacker News 上有人提出,如果不同大模型的 KV 缓存可以互相理解,就能让模型之间直接“传缓存”通信,省掉重复预填充和交接延迟。帖子引用了 Ramp Labs 的相关讨论,但目前公开信息显示,这仍是一个概念设想,而非已落地的产品。

Hacker News 上有人提出,如果不同大模型的 KV 缓存可以互相理解,就能让模型之间直接“传缓存”通信,省掉重复预填充和交接延迟。帖子引用了 Ramp Labs 的相关讨论,但目前公开信息显示,这仍是一个概念设想,而非已落地的产品。

一篇发表在 ICLR'26 的论文提出 Cache-to-Cache(C2C),让多个大模型不再靠输出文字互相"对话",而是直接在 KV-Cache 层面传递语义,平均准确率比文本通信高约 3.1–5.4%,延迟快约 2.5 倍。

Hacker News 上围绕“语言不可读性对 LLM 安全的影响”展开讨论,核心争议是:大模型的推理链越来越不像人类语言,这种“不可读”究竟是安全隐患,还是后训练目标的自然结果。

安全厂商 Zimperium zLabs 发现一款名为 RedHat 的安卓银行木马,它内置 AI 助手实时识别屏幕内容,不再依赖固定的界面坐标,还能阻止用户卸载并自我恢复。这意味着移动端恶意软件开始用 AI 提升自动化与抗检测能力。

美国联邦航空管理局(FAA)准备上线名为 SMART 的 AI 空中交通辅助工具,先在华盛顿特区周边三大机场试点,再推向覆盖 2900 万平方英里的全国空域。这是 FAA 首次让 AI 参与预测空中交通流,也是其 8.75 亿美元、12 年期合同的第一步落地。

据《纽约时报》报道,以「AI 安全」为核心叙事的大模型公司 Anthropic 正在寻求 IPO。一家反复公开提示 AI 风险的公司走向公开市场,意味着它必须在安全立场与资本回报之间给出可被检验的答案。

Google 正在测试新版 AI agent 产品 CC,把它的定位从个人效率助手转向家庭协作管理助手。这意味着消费级 AI agent 的竞争,开始从"单人提效"走向"多人共享场景"。

伦敦 AI 基础设施公司 Nscale 已提交美国 IPO 申请,其 2026 年上半年营收同比暴涨 1252% 至 1.406 亿美元,但净亏损同时扩大到 10.2 亿美元。这既是算力需求爆发的注脚,也暴露了重资产扩张的代价。

美军一名分析员借助聊天机器人分析情报,把中国船只误判为运送核武器部件,军方一度准备派空中支援拦截登船,直到发现是 AI 幻觉。这是目前公开报道中最接近“因 AI 出错引发军事冲突”的一次警讯。

据 Techmeme 援引《纽约时报》报道,Anthropic 预计本年度年化收入将突破 1000 亿美元,而今年 7 月这一数字还是 650 亿美元;与此同时,公司正推进 IPO,并持续卷入 AI 安全议题的讨论。