Meta Muse Spark 1.3 在 Artificial Analysis 编码智能体指数中与 Claude 组合对比评测结果公布

Meta 的 Muse Spark 1.3 模型在最新的第三方编码智能体评测中拿到高分,其最高配置版本已仅次于 Claude Opus 5,说明 Meta 在 AI 编程赛道上的实力正快速逼近头部闭源模型。

一句话看懂:Meta 的 Muse Spark 1.3 模型在最新的第三方编码智能体评测中拿到高分,其最高配置版本已仅次于 Claude Opus 5,说明 Meta 在 AI 编程赛道上的实力正快速逼近头部闭源模型。

事件核心:发生了什么

Scale AI 创始人兼 Meta 首席 AI 官 Alexandr Wang 在 X 平台上公布了 Muse Spark 1.3 的最新评测表现。根据 Artificial Analysis 发布的 Coding Agent Index(编码智能体指数),Muse Spark 1.3(max 版本)在 Muse Code 测试框架下取得 68 分,排名第二,仅次于搭载 Claude Code 的 Claude Opus 5(xhigh 配置)。目前面向 Meta 合作伙伴开放有限预览的 Muse Spark 1.3 普通可用版本(xhigh)得分为 64。Alexandr Wang 同时指出,Muse Spark 1.3 配合 Muse Code 评估工具,已能跟 Claude Code 搭配 Opus 5 或 Fable 5 的组合形成竞争。

为什么重要

这一结果传递出两个关键信号。第一,Meta 在 AI 编程智能体方向上的进展不再是“追赶者”姿态——它在第三方独立评测中已经与闭源头部模型站在同一梯队,且分数差距很小。考虑到 Claude Opus 5 是 Anthropic 当前最强编码模型,Muse Spark 1.3 能紧随其后,意味着 Meta 的模型训练和推理优化策略开始收到成效。第二,这次评测强调的是“模型 + 工具链”的综合能力,而非单纯参数大小。Muse Spark 搭配自家 Muse Code harness 才跑出高分,说明 Meta 正在构建从模型到编程环境的完整闭环,而非只卖一个裸模型。这种软硬一体的打法,对现有闭源 API 生态会形成更直接的竞争压力。

对用户/开发者/创作者的影响

对于开发者而言,最直接的变量是未来在编码智能体选型时多了一个 Meta 系选项。目前 Muse Spark 1.3 仍处于合作伙伴有限预览阶段,普通开发者还无法直接通过公开 API 调用,但评测分数意味着一旦开放,它在代码生成、仓库级任务理解和多文件修改等场景中可能具备接近 Claude 系产品的体验。企业采购方则可以把这次评测视为一个参考信号:Meta 的模型若持续在第三方基准上保持这个位置,后续商业授权和云服务接入将更有议价空间。对创作者和普通用户来说,短期内影响较小——这类编码智能体主要面向专业工程场景,而非图像生成或内容创作。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

接下来有三个具体观察点。第一,Muse Spark 1.3 何时从合作伙伴预览转为公开 API 或开源版本——Meta 过往在 Llama 系列上走开源路线,这次高性能编码模型是否延续开源策略,将直接影响开发者生态的走向。第二,Claude Opus 5(xhigh)目前仍是榜首,Anthropic 是否会针对 Muse 的反超压力加速推出更新版本或调整定价。第三,Artificial Analysis 的测试方法是否会被更多厂商接受为行业标准——如果 Muse Code harness 被广泛采用,Meta 在评测定义权上也会占据更有利位置。目前公开信息显示,Muse Spark 1.3 的具体参数规模、训练成本和推理资源需求尚未披露,这些数据会决定其实际部署门槛。

来源:X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang)

celebrityanime
celebrityanime
文章: 21560

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注