Meta 超级智能实验室发布 Muse Spark 1.1:基于 Meta Model API 的代理任务多模态推理模型

Meta 超级智能实验室于近日推出了 Muse Spark 1.1,这是一款专为代理任务(Agent Tasks)设计的轻量级多模态推理模型,通过 Meta Model API 对外提供服务,旨在提升 AI 在复杂环境下的感知与决策能力。

Meta 超级智能实验室于近日推出了 Muse Spark 1.1,这是一款专为代理任务(Agent Tasks)设计的轻量级多模态推理模型,通过 Meta Model API 对外提供服务,旨在提升 AI 在复杂环境下的感知与决策能力。

Cognition 发布了新模型 SWE-1.7,它在多项编程基准测试中的表现已逼近 OpenAI 的 GPT-5.5 和 Anthropic 的 Opus 4.8,但推理成本大幅降低。这一进展挑战了“强化学习后训练存在天花板”的行业共识,并直接提升了 Devin 这一 AI 编程助手的能力上限。

OpenAI 宣布,其最新大语言模型 GPT‑5.6 已被设定为微软 365 Copilot 的默认首选模型。这意味着全球数亿 Office 用户日常使用的 AI 助手将在后台获得一次模型升级,涵盖 Word、Excel、PowerPoint 等核心办公场景。

OpenAI 于本周四正式发布 GPT-5.6 系列模型(Sol、Terra 和 Luna),其中旗舰模型 Sol 在智能体编程任务中的标记效率提升 54%;与此同时,CEO 山姆·奥特曼对今年是否进行首次公开募股(IPO)明确表示“不知道”。

OpenAI 宣布将关闭去年 10 月才推出的 AI 浏览器 Atlas,距离它正式上线不到一年。这款被寄予厚望的“智能助理浏览器”将被并入新的桌面超级应用“ChatGPT Work”,也反映出 OpenAI 在 AI 工具策略上的急转弯。

红杉资本合伙人David Cahn更新了AI基础设施投入的账本:到2026年,行业需产生3万亿美元收入才能收回所有芯片和数据中心投资。然而,当前头部AI公司的收入与这一目标差距巨大,而开源模型崛起和token价格下跌正在进一步动摇“烧钱-回报”逻辑。

OpenAI 正在测试一项名为“ChatGPT Sites”的新功能,让用户通过自然语言对话,直接将创意或描述转化为一个可公开发布的网站。这意味着,AI 生成网站的门槛从“会写代码”降至“会说话”。

Meta 发布了迄今为止在智能体和编程领域能力最强的 AI 模型 Muse Spark 1.1,并在性能上宣称超越谷歌 Gemini。同时,Meta 首次为旗舰模型设立付费 API,以激进定价进入商业市场,直接挑战 OpenAI 和 Anthropic。

地产经纪公司 Redfin 发布分析称,OpenAI 和 Anthropic 员工在 IPO 后持有的税后股权价值理论上足以买下旧金山都会区约 29% 的房屋。这一极端假设揭示了 AI 头部公司即将上市所催生的巨大个人财富,并已提前扰动当地楼市。

Anthropic 宣布从 7 月 12 日起,旗下最强消费级模型 Claude Fable 5(基于 Mythos 5 架构)将对现有订阅用户(月费 20、100、200 美元)额外按用量收费,费率与开发者 API 一致——每百万输入 Token 10 美元、每百万输出 Token 50 美元。这是主要 A…