Google Gemini 4 Argon 缩小了与 OpenAI 和 Anthropic 的差距,但并未取得明显领先

Google 发布新一代旗舰模型 Gemini 4 Argon,在多项基准上追平甚至小幅反超 OpenAI 的部分前沿模型,但仍落后于 Anthropic,且优势更多来自低价而非效率。

一句话看懂:Google 发布新一代旗舰模型 Gemini 4 Argon,在多项基准上追平甚至小幅反超 OpenAI 的部分前沿模型,但仍落后于 Anthropic,且优势更多来自低价而非效率。

事件核心:发生了什么

Google 在 2026 年 10 月 1 日前后推出 Gemini 4 Argon,这是继 Gemini 3.1 Pro 之后,Google 相隔七个多月才拿出的新一代前沿模型——此前已对外宣布的 Gemini 3.5 被整体跳过。Argon 首批只向参与 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,且不带网络安全护栏,之后才会逐步开放给付费 API 客户、Google AI Ultra 订阅用户,最终面向开发者、企业和普通消费者,官方未给出明确时间表。

几个关键数字:输出上限从 64,000 提升到 100 万 token,Google 称这是行业首次;上下文窗口维持 100 万 token,支持文本、图像、视频、音频输入,输出仅限文本。定价上,推广期输入每百万 token 2 美元、输出 10 美元,正常价升至 4 美元和 20 美元,缓存读取便宜约 95%。配套新增“Long Decode Continuation”功能,通过后续请求续接长回答,避免长推理超时。

为什么重要

Artificial Analysis 的早期独立测试显示,Argon 在最高推理档“High”下智能指数得 53 分,与 OpenAI GPT-6 Astra(max)和 Claude Fable 5.1 持平,比 GPT-6.1 Sol(max)高 1 分,但明显落后于 Claude Opus 5.5(58 分)和 Claude Sonnet 5.5(56 分)。相比自家 Gemini 3.1 Pro Preview,Argon 一口气涨了 23 分。也就是说,Google 重新回到前沿实验室第一梯队,但并未取得领先。更值得注意的是效率问题:Argon 每项任务平均消耗约 62,000 个输出 token,而 GPT-6 Astra 只需约 27,000 个。目前公开信息显示,其价格优势来自更低的 token 单价,而非更高的推理效率。

对用户/开发者/创作者的影响

对开发者而言,推广期价格确实有吸引力:Artificial Analysis 测算,完成一项智能指数任务,Argon 成本约 1.99 美元,是 GPT-6 Astra(3.26 美元)的六成,但仍比 GPT-6.1 Sol 贵约 1.7 倍;推广期结束后升至 3.98 美元,反而比 GPT-6 Astra 高约两成。100 万输出 token 对长链条推理、代码生成、长篇内容创作是实打实的便利,但高 token 消耗意味着账单可能比单价看起来更高。企业采购需要同时评估单价、实际消耗和安全护栏的开放节奏。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是 Google 何时向普通开发者和消费者全面开放 Argon,以及“Deep Think”等特殊推理模式是否跟进;二是推广期结束后价格上调,性价比是否还站得住;三是 Anthropic 与 OpenAI 是否在长输出、缓存定价上快速回应。此外,Argon 未带网络安全护栏先行用于防御场景,其安全机制的最终形态也值得留意。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 26611

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注