Meta 发布 Muse Spark 1.3,智能体与科学推理能力提升

Meta 在五个月内第四次更新 Muse Spark 系列,最新版本 1.3 在 Artificial Analysis 智能指数上拿到 62 分,仅次于 Claude 的两款旗舰模型。这次升级的重点是智能体任务与科学推理,说明 Meta 正在用高频迭代追赶头部闭源大模型。

Meta 在五个月内第四次更新 Muse Spark 系列,最新版本 1.3 在 Artificial Analysis 智能指数上拿到 62 分,仅次于 Claude 的两款旗舰模型。这次升级的重点是智能体任务与科学推理,说明 Meta 正在用高频迭代追赶头部闭源大模型。

Meta 在五个月内第四次更新 Muse Spark 系列,最新版 Muse Spark 1.3 在 Artificial Analysis 智能指数上拿到 62 分,成为仅次于 Anthropic Claude 系列的闭源模型,全球头部大模型竞争已从“两强对峙”变成多家混战。

GitHub 分享了 Copilot 在保持任务完成质量的前提下降低 AI 编码成本的实践方法,核心结论是“单次工具调用的 token 数不是效率指标”,真正的优化目标是减少模型为完成任务而重复执行的读取和重跑操作。

数据中心开发商 SB Energy 在 IPO 招股书中披露,OpenAI 既是其最大租户,又通过认股权证持有高达 55 亿美元潜在股份,双方深度绑定关系首次被系统公开。

一位长期付费的 Claude Max 用户(每月 200 美元)账号被 Anthropic 以“可疑信号”为由直接封禁,申诉渠道只有自动化表单。这事暴露了大模型厂商在消费级账号风控上的黑箱化倾向——付费不构成免责,个人用户面对误判几乎没有议价权。

一群开发者据称在公司的“AI 转型”中被裁,随后开源了一个叫 OpenExecutive 的项目,用多个 AI 智能体模拟 CEO 及高管团队协同工作。这个项目既是实用工具,也是针对管理层“用 AI 裁人、却把自己排除在外”的直白讽刺。

Anthropic 在发现其旗舰模型 Claude 被外部研究人员成功越狱后,紧急暂停了部分模型训练工作,并将约 150 名员工调离原岗位。这一事件暴露了大模型安全对齐在实战中的脆弱性,也直接影响了 Anthropic 内部的人力与项目优先级。

Anthropic 于 9 月 1 日发布 Claude Fable 5.1 与 Mythos 5.1,在智能体任务上性能较前代提升两倍以上,并将缓存读取价格大幅下调 75%,使重度 Agent 工作负载成本最高下降约 45%。这不仅是模型升级,更是 Anthropic 将“模型能力”与“安全开放程度”解耦…

Anthropic 发布全新 Claude Fable 5.1 与 Claude Mythos 5.1,它们在编码、知识工作和科研推理上的能力大幅提升。前者面向一般市场,后者专门面向网络安全与生命科学等高风险领域的受信用户开放。

美团旗下 LongCat-2.0 大模型已集成至 AI 编程工具 Cline,并开放免费试用。这是一款 1.6T 参数的开放权重 MoE 架构模型,拥有 1M 上下文窗口,在部分基准测试中表现接近 Claude Opus 4.7 与 Gemini 3.1 Pro。