Epoch AI 收录 Grok 4:xAI 2025 年 7 月 9 日发布的闭源模型,ECI 得分 146

Epoch AI 的评测数据库已收录 xAI 于 2025 年 7 月 9 日发布的闭源模型 Grok 4,其 ECI 综合得分为 146。发布时它在 148 个受追踪模型中排第 3,但随着更多新模型进入榜单,目前排名已回落至 253 个模型中的第 71 位。

一句话看懂:Epoch AI 的评测数据库已收录 xAI 于 2025 年 7 月 9 日发布的闭源模型 Grok 4,其 ECI 综合得分为 146。发布时它在 148 个受追踪模型中排第 3,但随着更多新模型进入榜单,目前排名已回落至 253 个模型中的第 71 位。

事件核心:发生了什么

根据 Epoch AI 的模型页面,Grok 4 是 xAI 推出的闭源权重模型,发布时间为 2025 年 7 月 9 日。Epoch AI 为其给出的 ECI(Epoch Capabilities Index)得分为 146。该指数并非单一基准,而是把多项评测结果折算到同一尺度上,用于横向比较不同厂商、不同代际模型的能力水平。

排名数据是这次收录中最值得注意的部分:Grok 4 发布时在 148 个受追踪模型中位列第 3,属于当时的第一梯队;而在当前 253 个受追踪模型的榜单中,它排在第 71 位。同一模型、不同时间、两个排名,反映的是榜单本身在快速扩容,而不是模型能力发生了变化。

为什么重要

第一,这给 Grok 4 提供了一个相对可比的坐标。xAI 的官方发布往往强调单项跑分或演示效果,而 Epoch AI 的收录意味着它被放进了统一口径的横评体系,外界可以更冷静地判断它在推理、知识等维度上大致处于什么位置。

第二,排名从第 3 滑到第 71,是当前大模型竞争节奏的一个缩影。头部模型的领先窗口正在以月为单位被压缩,新模型密集发布,任何一次登榜都很难长期停留。对 xAI 来说,闭源路线意味着它必须在算力和训练迭代上持续投入,才能维持发布时的位置。

第三,ECI 这类综合指数正在成为采购和选型的参考项之一。虽然它不能替代具体业务场景的实测,但对企业评估模型代际差距、判断是否需要迁移,提供了一个低成本的起点。

对用户/开发者/创作者的影响

对普通用户,这条消息的实用价值有限,Grok 4 的能力不会因为收录或排名变化而改变,使用体验仍取决于 xAI 自家的产品入口和订阅方案。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对开发者,ECI 排名更适合当作筛选信号而非决策依据。如果考虑通过 API 接入 Grok 4,建议在自己的任务集上跑一轮对比,尤其是长上下文推理、工具调用和成本这几项,这些往往是综合指数覆盖不到的。

对企业和创作者,闭源权重意味着无法本地部署或自行微调,数据流向和合规边界需要按供应商条款评估。目前公开信息显示,Epoch AI 只提供了评测与排名数据,未涉及定价、上下文长度或 API 配额等细节。

值得关注的后续

一是 xAI 是否会发布 Grok 4 的后续版本,以及新版本在 ECI 榜单上的位置能否回到前列。二是 Epoch AI 的追踪范围继续扩大后,头部模型的排名波动是否会进一步加剧。三是这套评测口径是否被更多企业纳入采购流程,从而影响闭源模型的商业化节奏。

来源:Epoch AI:研究、数据与评测

celebrityanime
celebrityanime
文章: 27141

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注