Meta 超级智能实验室发布 Muse Spark 1.1:基于 Meta Model API 的代理任务多模态推理模型

Meta 超级智能实验室于近日推出了 Muse Spark 1.1,这是一款专为代理任务(Agent Tasks)设计的轻量级多模态推理模型,通过 Meta Model API 对外提供服务,旨在提升 AI 在复杂环境下的感知与决策能力。

Meta 超级智能实验室于近日推出了 Muse Spark 1.1,这是一款专为代理任务(Agent Tasks)设计的轻量级多模态推理模型,通过 Meta Model API 对外提供服务,旨在提升 AI 在复杂环境下的感知与决策能力。

OpenAI 宣布,其最新大语言模型 GPT‑5.6 已被设定为微软 365 Copilot 的默认首选模型。这意味着全球数亿 Office 用户日常使用的 AI 助手将在后台获得一次模型升级,涵盖 Word、Excel、PowerPoint 等核心办公场景。

本文以一位大模型从业者的视角,梳理了在2026年7月这个时间点转行进入大模型领域所需关注的行业现状、技术栈变化与竞争格局,为潜在入行者提供了一个判断窗口。

OpenAI 正在测试一项名为“ChatGPT Sites”的新功能,让用户通过自然语言对话,直接将创意或描述转化为一个可公开发布的网站。这意味着,AI 生成网站的门槛从“会写代码”降至“会说话”。

OpenAI 于 2026 年 7 月 10 日发布由前沿旗舰模型 GPT-5.6 驱动的 “ChatGPT Work” 智能体,可在桌面应用中跨应用、跨文件执行多步骤任务,并能持续数小时跟进大型项目。此举将 ChatGPT 从对话助手升级为可自主交付完整工作成果的工具。

OpenAI 最新的 GPT-5.6 模型家族(Sol、Terra、Luna)已开始逐步集成到 GitHub Copilot 中,为开发者提供了从大型代码库推理到低成本快速辅助的三种差异化选择,标志着 AI 编程助手进入更精细化的模型分层时代。

OpenAI 于北京时间 7 月 9 日推出新一代语音模型 GPT-Live 系列(含 GPT-Live-1 和 GPT-Live-1 mini),核心升级为“全双工架构”,让 AI 能够同时处理听与说,在对话中自然插入“嗯”“yeah”等回应并可以安静等待用户思考。这意味着语音 AI 从“轮流发言”走向更接…

北京时间7月9日,OpenAI推出GPT-Live实时语音模型,为ChatGPT语音模式换上全双工架构,实现边听边说。虽然字节跳动豆包和Google Gemini更早支持类似能力,但GPT-Live通过将思考任务外包给GPT-5.5,在对话深度和复杂推理上拉开差距。

OpenAI 在对广泛使用的 AI 编码测试 SWE-Bench Pro 进行内部审查后,发现大约 30% 的测试任务存在缺陷,并因此撤销了对该基准测试的公开背书。这一发现揭示了当前衡量 AI 编程能力的工具存在系统性偏差,可能误导行业对模型真实能力的判断。

在WF26大会上,技术领袖@theo用一套手绘风格的幻灯片完成了闭幕演讲。这并非单纯的视觉偏好,而是在AI创业项目遍地是“简单的Markdown文件+定时任务”的当下,用刻意追求“人味”的简练表达,试图激发开发者思考更大的格局。