GPT-6.1 Sol 七天内接替 GPT-6 Sol:智能逼近 Astra,成本不到四分之一

Artificial Analysis 评测显示,GPT-6.1 Sol 在 GPT-6 Sol 发布仅 7 天后接替上位,智能指数只比 GPT-6 Astra 低 1 分,但每任务成本不到其四分之一。对开发者和企业来说,这意味着接近顶级能力的模型正在快速降价。

一句话看懂:Artificial Analysis 评测显示,GPT-6.1 Sol 在 GPT-6 Sol 发布仅 7 天后接替上位,智能指数只比 GPT-6 Astra 低 1 分,但每任务成本不到其四分之一。对开发者和企业来说,这意味着接近顶级能力的模型正在快速降价。

事件核心:发生了什么

2026 年 9 月 29 日,Artificial Analysis 发布对 GPT-6.1 Sol 的评测。该模型在 Intelligence Index 上比 GPT-6 Sol 高 4 分、比 GPT-5.6 Sol 高 5 分,最终只比 GPT-6 Astra 低 1 分。定价与 GPT-6 Sol 相同,仍为每百万输入/输出 token 2 美元和 10 美元,但缓存读取折扣从 90% 提升到 95%,智能体工作负载的综合价格因此略低。

细分项目上,GPT-6.1 Sol 在 AA-Briefcase v1.1 和 GDPval-AA v2.1 分别提升 4 分和 5 分,Terminal-Bench 4.0 提升 12 分,Humanity’s Last Exam 提升 5 分,GDP.pdf 提升 6 分。AA-Omniscience 准确率提升 8 分,幻觉率从 60% 降到 54%。在 Coding Agent Index 中,xhigh 档得分为 1 分高于 GPT-6 Astra,成本却不到后者 15%。

为什么重要

这次更新的核心不是能力上限突破,而是成本效率边界被再次推高。GPT-6.1 Sol 在最高推理档位下,每项 Intelligence Index 任务成本 0.72 美元,而 GPT-6 Astra 为 3.26 美元,GPT-6 Sol 为 1.05 美元。所有档位都位于成本效率帕累托前沿,等于说明:在同等智能水平下,目前没有更便宜的模型。

对行业竞争而言,两周内连续出现 GPT-6 Sol、GPT-6.1 Sol 以及 Gemini 4 Argon,说明头部闭源模型厂商的迭代节奏已压缩到以周为单位。前沿能力不再只靠“最强模型”证明,而是靠“每美元能买到多少智能”来争夺开发者。

对用户/开发者/创作者的影响

对 API 开发者,缓存读取折扣从 90% 提到 95%,高频长上下文或智能体工作负载的实际成本会进一步下降。低、中推理档位在 token 效率上处于帕累托最优,适合对延迟和成本敏感的生产环境。对 AI 应用团队,这意味着原来必须调用 Astra 级模型的任务,现在可以先用 GPT-6.1 Sol 验证,再决定是否升级。对创作者,AA-Briefcase 提升约 80 Elo,主要来自评分标准和 Analytical Quality 提升,但 Presentation Elo 略有下降,说明它更擅长干活,不一定更擅长包装输出。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 GPT-6 Astra 是否会很快被替换或降价,否则其定位会变得尴尬。二是 xhigh 档位优于 max 档位的现象是否会稳定,这会影响开发者选择推理预算。三是缓存折扣和偏低价格能否在真实智能体负载中兑现,目前公开信息仍以 Artificial Analysis 的标准化评测为准,不等同于所有生产场景的实际账单。

来源:Artificial Analysis

celebrityanime
celebrityanime
文章: 27794

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注