Google Gemini 4 “Carbon” 内部测试编码性能比肩 Anthropic Opus 5.5

据报道,Google 正在内部测试 Gemini 4 的多个变体,其中 "Carbon" 在编程任务上的表现被员工认为可媲美 Anthropic 的 Opus 5.5,但该测试仍处于早期阶段。

一句话看懂:据报道,Google 正在内部测试 Gemini 4 的多个变体,其中 “Carbon” 在编程任务上的表现被员工认为可媲美 Anthropic 的 Opus 5.5,但该测试仍处于早期阶段。

事件核心:发生了什么

根据 Business Insider 看到的内部文件、截图和聊天记录,Google 正在测试代号为 Argon、Barium、Carbon 的多个 Gemini 4 变体。其中 Carbon 过去几天被部署在 Google 内部编程平台 Jetski 上,据说在编程任务上主要优于 Argon。一名员工将 Carbon 与 Anthropic 最强的编码模型 Opus 5.5 相提并论,但指出还需更多测试。早期 Argon 版本则让另一名员工联想到较老的 Opus 5,尽管内部反馈整体积极。这些信息来自 2026 年 10 月的报道,不代表正式发布或最终性能。

为什么重要

Google 的模型分工已经明确:Argon 定位前沿推理,Flash 主打速度和吞吐,Omni 负责生成式媒体,Gemma 面向轻量开源边缘负载。Carbon 和 Barium 很可能属于 Argon 家族的检查点或更新,而非独立层级。一名员工内部称 Carbon 为“Gemini pro next model”,暗示其可能以 Argon 名义发布。这种快速迭代节奏与 Google 对 Flash 系列的操作类似,意味着 Google 可能已更擅长用 AI 辅助构建新模型。Google DeepMind 员工 Vedant Misra 在 X 上回应该报道时提及“递归自我改进”,即用 AI 构建更好的 AI,OpenAI 和 Anthropic 也报告过类似进展。目前 Gemini 4 尚无官方发布日期,但 Google 已在 Gemini 应用中增加“Automatic”模式和可调推理强度,AI Studio 出现“Ultra”模式,Logan Kilpatrick 确认团队正努力发挥 Argon 的最大潜力。

对用户/开发者/创作者的影响

目前公开信息显示,Carbon 尚未进入公开 API 或消费级产品,开发者无法调用。如果该性能在正式发布时得以保持,编程辅助、代码生成和复杂推理类 AI 应用可能获得一个与 Opus 5.5 竞争的新选项,进而影响闭源大模型的采购和集成决策。对创作者而言,更强的编码能力可能间接提升 AI 工具链的自动化水平,但具体影响取决于最终定价、可用性和速率限制。企业采购方应关注 Gemini 4 是否会以 Argon 品牌统一推出,以及是否影响现有 Gemini 3 系列模型的 API 价格和配额。开源社区则需观察 Gemma 系列是否同步更新。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

1. Gemini 4 的官方发布日期和正式命名,Carbon 是作为 Argon 更新还是独立模型推出。
2. Carbon 在公开基准测试中的实际表现,以及是否向开发者开放 API。
3. 定价策略和速率限制是否与 Opus 5.5 形成直接竞争,以及 OpenAI 和 Anthropic 的回应。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 28744

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注