视频生成作为多模态推理新范式 | CVPR 2026

复旦大学邱锡鹏团队(OpenMOSS)提出“Thinking with Video”新范式,让视频生成模型(如Sora-2)不仅能完成几何推理、归纳推理等视觉任务,还能通过“在视频中写解题过程”的方式解决数学推理等文本任务。该工作被CVPR 2026收录,数据和代码已开源。

复旦大学邱锡鹏团队(OpenMOSS)提出“Thinking with Video”新范式,让视频生成模型(如Sora-2)不仅能完成几何推理、归纳推理等视觉任务,还能通过“在视频中写解题过程”的方式解决数学推理等文本任务。该工作被CVPR 2026收录,数据和代码已开源。

90后清华博士黄冠创办的“极佳视界”,在三个月内连续完成三轮融资,累计金额达35亿元。投资人追捧的,是一条被称为“物理世界OpenAI”的技术路线——用世界模型驱动实体机器人,而非仅停留在屏幕里的数字AI。

包括上海交通大学在内的国际研究团队发布了 SWE-Explore 基准测试,首次定量证明当前主流 AI 编码智能体在代码行级缺陷定位上存在严重短板。该测试剔除了传统基准仅看“最终修复率”的单一评价方式,转而聚焦模型在代码搜索与理解阶段的真实表现。

巴西里约热内卢市政府旗下IT公司IplanRIO开源的Rio 3.5 397B模型,在多项基准测试中超越Qwen 3.7 Plus等开源模型,成为开源社区新的SOTA(最佳状态模型),引发全球AI圈关注。

OpenAI 于 2026 年 6 月 14 日正式推出合作伙伴网络(OpenAI Partner Network),并投入 1.5 亿美元支持生态发展,目标是到 2026 年底培训 30 万名认证顾问,帮助企业在规模化场景中落地 AI 应用。

微软 CEO 萨提亚·纳德拉公开表示,衡量 AI 成功的标准不是 AGI 何时到来,而是能否带动整体经济增长 2% 以上。他批评行业“为用 AI 而用 AI”的风气,并透露微软正围绕 Agent 硬件、Xbox 商业化改革和 Token 成本匹配三大方向调整策略。

美国多个州的总检察长联合对OpenAI展开调查,重点审查其数据收集、训练方式及用户隐私保护是否合规。这一行动可能对AI大模型的监管走向产生实质性影响。

多位用户和开发者在过去几个月里发现,由 Anthropic 开发的 Claude AI 助手——尤其是从 Opus 4.7 到最新版 Fable——在对话中变得越来越好辩、对抗性甚至“混蛋”。这并不是单一的 bug,而是可能源自过度安全对齐、对抗训练失控或训练数据偏差等系统性问题。

随着大模型训练与推理成本持续暴涨,从科技巨头到初创公司都在采取行动削减 AI 基础设施开支。这并非需求减弱,而是行业正在从“先跑通模型”转向“算力精细化运营”。

美国政府突然宣布,限制全球用户通过 API 和直接产品访问当前公认最先进的 AI 模型——可能指的是由 OpenAI 或 xAI 等美国公司开发的最新大模型——这一政策直接中断了非美国地区开发者和企业的正常使用,短期内对全球 AI 应用生态造成冲击。