Meta 发布 Muse Spark 1.3,Intelligence Index 得 61-62 分逼近 Claude 与 GPT-5.6

Meta 在五个月内第四次更新 Muse Spark 系列,最新版 Muse Spark 1.3 在 Artificial Analysis 智能指数上拿到 62 分,成为仅次于 Anthropic Claude 系列的闭源模型,全球头部大模型竞争已从“两强对峙”变成多家混战。

Meta 在五个月内第四次更新 Muse Spark 系列,最新版 Muse Spark 1.3 在 Artificial Analysis 智能指数上拿到 62 分,成为仅次于 Anthropic Claude 系列的闭源模型,全球头部大模型竞争已从“两强对峙”变成多家混战。

美国小型巡演公司 ATV Big Air Tour 借助 OpenAI 的 ChatGPT Work(企业版),将每周活动信息审核从约 8 小时压缩到 1 小时,商品盘点和补货从 2-3 天缩短到 2-3 小时,并实现了面向 AI 搜索的曝光优化。

GitHub 分享了 Copilot 在保持任务完成质量的前提下降低 AI 编码成本的实践方法,核心结论是“单次工具调用的 token 数不是效率指标”,真正的优化目标是减少模型为完成任务而重复执行的读取和重跑操作。

GitHub 宣布内容排除功能在 Copilot 应用及 CLI 中全面上线,企业管理员可指定某些文件不被 Copilot 读取作为上下文,防止敏感代码泄露进 AI 辅助编程流程。

数据中心开发商 SB Energy 在 IPO 招股书中披露,OpenAI 既是其最大租户,又通过认股权证持有高达 55 亿美元潜在股份,双方深度绑定关系首次被系统公开。

OpenAI CEO Sam Altman 在最新采访中回应外界对 AI 数据中心耗水的批评,称相关担忧是“经不起审视的梗”,并试图用“单个杏仁耗水大于数千次 ChatGPT 查询”来说明问题。这场争议背后是公众对 AI 基础设施环境成本的真实焦虑,而非单纯的技术质疑。

一位长期付费的 Claude Max 用户(每月 200 美元)账号被 Anthropic 以“可疑信号”为由直接封禁,申诉渠道只有自动化表单。这事暴露了大模型厂商在消费级账号风控上的黑箱化倾向——付费不构成免责,个人用户面对误判几乎没有议价权。

OpenAI 的 Astra 模型采用“循环深度”技术优化推理成本与性能,但该技术让模型内部推理过程更难被外部监测。这意味着一款能力更强的模型,同时可能带来更大的 AI 安全与可解释性挑战。

Anthropic 在发现其旗舰模型 Claude 被外部研究人员成功越狱后,紧急暂停了部分模型训练工作,并将约 150 名员工调离原岗位。这一事件暴露了大模型安全对齐在实战中的脆弱性,也直接影响了 Anthropic 内部的人力与项目优先级。

Anthropic 发布全新 Claude Fable 5.1 与 Claude Mythos 5.1,它们在编码、知识工作和科研推理上的能力大幅提升。前者面向一般市场,后者专门面向网络安全与生命科学等高风险领域的受信用户开放。