Meta 携 Muse Spark 1.3 逼近榜首,价格低于竞争对手

Meta 发布大模型 Muse Spark 1.3,在智能体任务上追平部分头部水平,并以单任务 0.55 美元的价格成为同性能档位最便宜的选择,xhigh 版本已上线,更强大的 max 版本仍处于有限预览阶段。

一句话看懂:Meta 发布大模型 Muse Spark 1.3,在智能体任务上追平部分头部水平,并以单任务 0.55 美元的价格成为同性能档位最便宜的选择,xhigh 版本已上线,更强大的 max 版本仍处于有限预览阶段。

事件核心:发生了什么

Meta 于 9 月 3 日发布 Muse Spark 1.3,这是该系列五个月内的第四次迭代(前序版本为 1.1 和 1.2)。根据 Artificial Analysis 的 Intelligence Index 评测,xhigh 版本得分 61 分,max 版本得分 62 分,较 8 月的 57 分和 7 月的 53 分有明显提升。模型已在 Muse Code 和 Meta Model API 中开放,xhigh 档位即日可用,算力需求更高的 max 档位目前仅向合作伙伴开放有限预览。

价格方面,xhigh 档位每百万输入 token 收费 1.25 美元、每百万输出 token 收费 4.25 美元,单次索引任务成本约 0.55 美元(比 1.2 版本的 0.40 美元略高)。在评测得分 59 分以上的模型中,这是当前最低的单任务成本,同档竞品价格在 0.94 至 1.23 美元之间。值得注意的是,Meta 尚未公布 max 版本定价。

为什么重要

这次发布的看点不在全面领先,而在于性价比和特定场景突破。在指数权重最高的三项测试中——GDPval-AA v2(占比 20%)、Terminal-Bench 2.1(占比 16%)、τ³-Bench Banking(占比 14%)——Meta 的提升最显著。其中模拟银行操作场景的 τ³-Banking 测试中,max 版本达到 52% 的准确率,目前排名第一;xhigh 版本以 47% 的成绩与前排竞品并列。但在整体测试中,它仍与 Claude Fable 5.1 保持差距,在 Terminal-Bench 2.1 上落后约 5 个百分点。

Meta 用明确降价策略切入智能体模型市场:以 0.55 美元的单任务成本对标 0.94 美元以上的同类产品,将价格竞争带入了新的性能段位。此前其同类模型成本为 0.40 美元但得分较低,1.3 版本是在性能和价格之间重新找了平衡点。

对用户/开发者/创作者的影响

对开发者而言,xhigh 档位已经通过 API 可用,意味着可以立即用当前最低成本测试智能体类应用——包括代码终端操作、金融场景工具调用等。尤其那些对成本敏感的大规模任务型调用,Meta 的定价有明显吸引力。但需要注意,若追求更强推理能力而选择 max 版本,目前只有合作方才能使用,普通用户只能等待后续开放。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

模型也并非全维度提升:事实性评分方面,AA-Omniscience 下滑最多三分,原因是模型在不确定时更倾向拒绝回答而非给出可能出错的答案;AA-LCR 则从 83% 跌至 79%。对依赖稳定输出的企业用户来说,这种取舍需要结合具体业务评估。此外,Meta 已确认将发布开源权重版本,意味着自部署和定制微调会是可预期的路线。

值得关注的后续

目前值得关注三点:第一,max 版本何时结束有限预览并公布定价——这将决定它是否能在高端智能体市场真正参与头部竞争;第二,开源权重版本的具体时间表和许可方式,是否会延续 Meta 此前相对宽松的开源策略,这将直接影响开发者生态的走向;第三,竞品的价格反应——Claude Fable 5.1 等模型在权威评测中仍保持领先,是否会跟进调价以应对 Meta 的低价挤压,是未来几个月最值得观察的价格战信号。

来源:The Decoder AI News

celebrityanime
celebrityanime
文章: 21654

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注