预览超快模式:GPT-5.6 Sol 速度最高提升 14 倍

OpenAI 于 2026 年 8 月 13 日发布 GPT‑5.6 Sol 的“超快模式”预览,借助 Cerebras 的算力将输出速度提升至最高每秒 750 token,比标准处理快 14 倍,率先在 OpenAI API 中开放。这是前沿大模型首次在同等智能

OpenAI 于 2026 年 8 月 13 日发布 GPT‑5.6 Sol 的“超快模式”预览,借助 Cerebras 的算力将输出速度提升至最高每秒 750 token,比标准处理快 14 倍,率先在 OpenAI API 中开放。这是前沿大模型首次在同等智能

Google DeepMind 发布 Gemini 3.7 Flash,距离上一代 3.6 Flash 仅三周,性能全面提升而 API 价格砍半。这是 Google 加速模型迭代、同时用性价比抢占 agent 开发市场的一次直接动作。

微软宣布将消费者版 Copilot 应用与 Microsoft 365 Copilot 应用合并,同时砍掉一批表现不佳的 AI 功能,8 月 18 日起陆续生效。这说明微软正在从“广撒网式”的 AI 功能堆叠,转向更务实的产品整合,以应对 ChatGPT、Claude 和 Gemini 的竞争。

OpenAI 于 2026 年 8 月 13 日任命 Dali Rajic 为首任首席营收官,负责搭建可规模化的全球营收体系;原营收负责人 Denise Dresser 在交接期结束后离职。此次人事调整发生在企业 AI 采用加速、OpenAI 周活跃用户突破 10 亿的节点,直接关系到其下一阶段商业化节奏。

英伟达联合Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR六家机构,计划为AI数据中心建设投入最高5000亿美元;同时用自己的钱为抵押的GPU提供部分价值担保,为老旧芯片建立二手市场。这既是为了给算力扩张找新资金来源,也是一场高风险的下注。

Anthropic 宣布将根据欧盟《人工智能法案》要求,为所有新版 Claude 模型处理的文本和文件添加不可见水印——不仅包括 AI 生成内容,也包括经过 AI 润色、翻译或转换的内容。这项政策全球适用,且范围比法律要求更广,可能改变人们对 AI 输出内容的信任方式。

芝加哥商品交易所(CME)将于10月5日推出追踪Nvidia GPU小时租金的期货合约,算力首次拥有公开透明的参考价格。这是AI算力从私下议价走向标准化商品交易的关键一步。

Google 宣布 Gemini 将在未来数周内接入 Pandora、OpenTable(英国)、Ticketmaster 等一批第三方应用,让用户在一个对话界面里直接完成订餐、购票、播放音乐等操作。这是 Gemini 从聊天工具向数字生活入口扩展的关键一步。

Netlify 与 OpenRouter 达成合作,在其 AI Gateway 和 Agent Runners 中接入大量第三方大模型,并用同一提示测试了 11 个模型。结果显示不同模型生成的网站差别明显,这提醒开发者:选择哪个模型,正在成为 AI 编码工具里最实际的工程决策之一。

微软宣布将消费者版 Copilot 与 Microsoft 365 Copilot 合并为单一应用,不再让用户在任务栏里看到两个 AI 图标。这一步既解决了产品入口碎片化问题,也为微软计划在今年晚些时候推出的“超级应用”搭好底层框架。