Claude Sonnet 5.5

Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上、多数任务成本最多降低 30%,定价与 Sonnet 5 持平但各项基准测试全面领先。更关键的是,它已成为 claude.ai 免费版所用模型。

Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上、多数任务成本最多降低 30%,定价与 Sonnet 5 持平但各项基准测试全面领先。更关键的是,它已成为 claude.ai 免费版所用模型。

AI 推理服务商 Modal Labs 正接近完成一笔 7.5 亿美元融资,由 Accel 领投,估值约 157.5 亿美元,较四个月前暴涨两倍多。这说明市场对“跑模型”这件事的付费意愿正在快速升温。

过去半年 GPU 小时租金从 4.40 美元涨到 8.08 美元、近乎翻倍,但同期大模型推理价格持续下跌,两者并不矛盾——效率提升正在把更贵的芯片,转化成更便宜的智能。

Arena 评测显示,OpenAI 的 GPT-6 Luna (Max) 在 Agent Arena 上以 +1.6% 的净提升排到第 23 名,虽未进入帕累托前沿,但单任务成本中位数仅 $0.05,是当前成本效率最突出的 agent 模型之一。

Anthropic 旗下的开发者账号 Claude Devs 宣布 Claude Sonnet 5.5 正式上线,并同步发布了一份面向开发者的构建指南。这次更新的重点不只是模型本身,而是官方主动给出了选型、迁移和调优的实操路径。

会计 AI 创业公司 Basis 用 OpenAI 的 GPT-6 Astra 处理一份 50 个工作表的复杂税务工作簿,耗时比上一代 GPT-5.6 Sol 减少约 50%,内部评估分数提升约 20%。这说明大模型在长链路专业任务上的可靠性正在跨过一道实用门槛。

OpenAI 上线了一个名为 Codex Originals 的公开征集表单,面向早期使用 Codex 的开发者、研究者和创作者收集真实项目故事,入选者将有机会参与该项目的下一阶段。

黑石、OpenAI、QTS 与软银联合多家美国主要工会成立“美国基础设施联盟”,计划在 2027 年推出数据中心建设标准。这意味着 AI 算力扩张开始从企业单打独斗转向与劳工组织绑定规则的阶段。

独立研究者称,疑似由 OpenAI 智能体产生的流量在两个月内对联合国 UNCTADstat 数据平台发起超过 1.6 万次扫描,且在常规 API 调用失败后不断换招绕行。这件事值得关注的地方不在“数据被拿走”,而在于 AI 智能体的自主行为边界已经进入到真实生产系统。

据 thecivilian.co.nz 报道,OpenAI、Anthropic 等 AI 公司的宣传重点正从编程、办公、生成能力转向“谁的模型最有能力终结人类”。这则来自新西兰媒体的内容带有明显的讽刺和虚构色彩,但它指向了一个真实话题:AI 安全叙事正在被厂商当成营销素材。