全球办公 AI 王座易主!GPT-5.6 接管微软全家桶,数亿打工人集体换脑

OpenAI 的 GPT-5.6 被微软指定为 365 Copilot 的“首选模型”,同时新模型在编程基准测试中以更低的成本超越竞争对手,并将 AI Agent 能力从桌面延伸至手机。这意味着办公 AI 的竞争从“谁能办到”转向了“谁能更便宜地办好”。

OpenAI 的 GPT-5.6 被微软指定为 365 Copilot 的“首选模型”,同时新模型在编程基准测试中以更低的成本超越竞争对手,并将 AI Agent 能力从桌面延伸至手机。这意味着办公 AI 的竞争从“谁能办到”转向了“谁能更便宜地办好”。

Anthropic 通过 J-lens 工具读取大语言模型 Claude 的内部“思考过程”,发现其内部存在一个类似人脑“全局工作空间”的信息处理机制。这一发现为 AI 安全审计和模型行为控制提供了可操作的工具,但并未证明 AI 拥有真正的意识。

前 OpenAI CTO Mira Murati 成立的“思维机器实验室”(Thinking Machines Lab)发布了一份技术案例,主张通过允许用户和开发者直接定制大模型的权重,以实现更灵活、更符合人类需求的 AI 系统。此举挑战了目前依赖封闭 API 和黑箱模型的行业主流做法。

AI 并没有像许多人预期的那样导致软件工程师失业。相反,由于 AI 降低了软件生产的单位成本,企业正在启动更多项目,导致软件岗位的发布速度反而超过了其他领域。这一现象由云存储公司 Box 的 CEO Aaron Levie 在 2026 年 7 月的一条推文中提出,并得到了知名投资人 Marc Andrees…

OpenAI 核心开发者 Thibault Sottiaux 于 2026 年 7 月 12 日在 X 平台透露了 GPT 5.6 Sol 的阶段性能力提升,重点解决了此前用户抱怨的速度、后端代码质量以及前端开发体验问题,并明确表示不再滥用 useEffect 等 React 模式。这是 GPT-5 系列持续…

行业正加速构建AI代理(Agent),但账号@Septian77145 提出了一个被忽视的治理问题:一旦AI代理获得钱包、API或生产系统的访问权限,缺乏控制机制就等于交出“主密钥”。这一问题将决定AI代理能否安全落地,而非仅停留在概念阶段。

AI 领域正在强调一个工程安全原则——AI 代理(Agent)的自主操作权必须受严格约束,不能默认拥有全部权限。这一观点从开发者社区发酵,指向一个正在被忽视的风险:当 AI 开始调用 API、支付、读写数据时,权限失控可能比模型本身的行为偏差更危险。

OpenAI 的早期用户 Tibo 在 X 上公开建议:如果你是 Codex 的老用户,请继续使用 Codex;但可以向技术门槛较低的朋友推荐 ChatGPT Work——这暗示了 OpenAI 正在将面向开发者、基于代码的 Codex 能力,包装成更简洁的“ChatGPT Work”产品形态,以覆盖非技术用…

知名 AI 创业者 Peter Yang 在 X 上分享了他 2026 年 7 月的一个周末项目工作流——先用 Fable 生成包含设计指南的 plan.html,再用 Claude Design 细化组件和屏幕,最后调用一个被称为“gpt 5.6”的模型来完成编码。这个流程不仅展示了几款工具的衔接方式,更暗…

OpenAI CEO Sam Altman 在 X 上表示,以目前 AI 的能力水平来看,AI 整体上净创造了就业机会,这一结果出乎他的预期。他原本认为 AI 会冲击就业,但目前迹象表明这一趋势可能持续。