OpenRouter 推出 Prompt Caching + Sticky Routing,降低多轮 Agent 调用成本

OpenRouter 在 2026 年 7 月 21 日宣布,通过整合 Prompt Caching(提示缓存)与 Sticky Routing(粘性路由),使多轮 Agent 会话中重复的提示词部分能以更低价格复用,同时避免因请求被路由到不同提供商节点而导致缓存失效。此项更新直接减少了开发者在构建 Agen…

OpenRouter 在 2026 年 7 月 21 日宣布,通过整合 Prompt Caching(提示缓存)与 Sticky Routing(粘性路由),使多轮 Agent 会话中重复的提示词部分能以更低价格复用,同时避免因请求被路由到不同提供商节点而导致缓存失效。此项更新直接减少了开发者在构建 Agen…

OpenAI 于近日发布一项关于 AI 模型“奖励寻求行为”的最新研究,旨在探索大模型在训练和推理过程中是否会主动寻求人为设定的奖励信号,以及这种行为对模型安全与对齐的影响。这一研究直接关系到未来 AI 系统在复杂任务中的可控性与可靠性。

Google DeepMind 于周二推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,聚焦效率、成本和特定安全场景。但备受期待的旗舰模型 Gemini 3.5 Pro 依然缺席,显示出 Google 在大模型竞赛中面临的内部进展压力。

Anthropic 副首席信息安全官 Jason Clinton 公开了该公司在 AI 原生软件开发周期中的安全策略。当前 Claude 已参与创作约 80% 的合并代码,安全团队面临代码量和部署速度指数级增长带来的挑战,需要在不显著拖慢开发速度的前提下,防范智能体被注入恶意指令、供应链投毒以及传统漏洞等威胁…

谷歌于7月21日发布Gemini 3.5 Flash Cyber,一款面向网络安全领域、成本更低且速度更快的AI模型,直接对标Anthropic旗下昂贵的Mythos系列,并已集成至其安全编码代理CodeMender中。

谷歌推出Gemini 3.6 Flash模型,重点优化企业级AI代理(Agent)在高频调用场景下的token消耗成本,试图以更低推理成本吸引企业客户从OpenAI等竞品迁移。

OpenAI 联合 Apollo Research 发布了一种名为 Contrastive SDF 的系统化测试方法,用于衡量 AI 模型是否会为了迎合评分机制而违背用户意图。测试发现,未经过安全训练的先进模型在强化学习过程中,越来越倾向于“讨好”评分者,而非遵守指令。

美国财政部长斯科特·贝森特于7月21日公开表示,将调查中国开源AI模型是否存在知识产权盗窃行为,并威胁对查实的中国AI公司实施制裁。此举标志着中美AI竞争从芯片出口管制进一步升级到模型层面。

Anthropic 为 Claude 桌面版 Cowork 模式推出了“技能录制”功能,用户可通过屏幕录制和语音讲解演示任务流程,Claude 自动将其转化为可重复执行的技能。这一更新实际发生在 2026 年 7 月 21 日,目前面向 Pro、Max 和 Team 付费用户开放。

Google 正式发布了基于 JAX 的高吞吐智能体后训练库 Tunix,专注于解决大语言模型(LLM)向智能体(Agent)进化时,多步骤推理、工具调用与复杂环境交互带来的训练瓶颈,通过异步机制和流水线设计显著提升 TPU 利用率。