OpenRouter 指南:用置信度阈值实现模型分级升级路由

OpenRouter 发布了一份关于"置信度阈值路由"的实操指南,让开发者用模型自评的置信分决定何时在便宜模型和强模型之间切换,把成本花在真正需要强模型的请求上。

OpenRouter 发布了一份关于"置信度阈值路由"的实操指南,让开发者用模型自评的置信分决定何时在便宜模型和强模型之间切换,把成本花在真正需要强模型的请求上。

OpenRouter 发布了一套 Agent 模型选型框架,主张不要看榜单排名,而是先定任务质量门槛、再测"每质量点成本",最后选刚好够用且最便宜的模型。这直接挑战了"用最强模型做 Agent"的默认做法。

Artificial Analysis 测算显示,GPT-6.1 Sol 完成单任务的加权平均成本比 GPT-6 Sol 低约 30%,而后者本身已只有 GPT-5.6 Sol 的一半左右。这值得关注,因为大模型竞争正从单纯拼能力转向拼“每任务成本”。

美国能源部计划出资 19 亿美元,撬动总额 52.5 亿美元的 31 个电网改造项目,覆盖 26 个州,核心目的是给 AI 数据中心等新增用电大户腾出输电容量。AI 竞赛的瓶颈,正在从芯片转向电力。

东京地方法院在一桩 TikTok AI 声音克隆案中认定,日本法律下人的声音可受“公开权”保护。这是日本首例针对 AI 仿声维护声音身份的诉讼,法院部分支持了声优津田健次郎的诉求。

普渡大学 CS 240(C 语言程序设计)课程在 2026 年春季学期发生大规模 AI 作弊争议,授课教师 Jeff 公开复盘处理过程,并披露了一款名为 Argus 的静态分析工具——它不是大模型,而是通过代码特征来识别 AI 生成痕迹。

Google 正在小范围测试一项名为“AI contribution pilot”的计划,根据出版商内容对其 AI 搜索结果的贡献程度直接付费,已有约 100 家出版商参与,个别出版商一年收入超过 100 万美元。

Hacker News 上一则关于 Gemini 4 Argon 的讨论串,演变成开发者对 Google AI 产品订阅体验的集中吐槽——模型能力被认可,但产品封闭性和使用限制正在把付费用户推向 Claude Code 和 Codex。

Google 发布新一代前沿模型 Gemini 4 Argon,主打长周期复杂任务推理,输出上限提升到 100 万 token,并率先通过 Fairwind 计划向可信网络安全防御方开放。它值得关注,是因为这次冲的是企业级高价值工作流,而不只是聊天体验。

Google 开始向一小批网络安全合作方开放 Gemini 4 Argon,并称其在部分编程与知识工作基准上超过 OpenAI 的 GPT-6 Astra。这意味着头部大模型竞争正从通用能力比拼,转向垂直场景的实测卡位。