腾讯混元”合二为一”:多模态与大语言模型部门合并,姚顺雨统管冲全模态上限

腾讯于7月23日宣布,将其多模态模型部门与大语言模型部门合并,组建新的基础模型部,由腾讯首席AI科学家姚顺雨统一管理。此举旨在打破图像理解和语言生成两条技术路线的研发壁垒,集中资源冲击全模态大模型的上限。

腾讯于7月23日宣布,将其多模态模型部门与大语言模型部门合并,组建新的基础模型部,由腾讯首席AI科学家姚顺雨统一管理。此举旨在打破图像理解和语言生成两条技术路线的研发壁垒,集中资源冲击全模态大模型的上限。

Runway于2026年7月发布了Media Router,这是一套模型调度中间层,能根据任务需求(速度、质量或成本)自动在Seedance、GPT Image2、ElevenLabs等多个厂商的模型间切换,开发者只需对接一个API即可完成从创意验证到成片的生成流程,同时降低Token消耗。

澳大利亚总理阿尔巴尼斯发表重磅演讲,宣布将立法要求新建大型数据中心必须成为净能源生产者(产出电量超过消耗),并规定AI公司使用本地创作者作品进行模型训练前必须获得授权并支付报酬。这是首个将能源产出义务和内容版权补偿捆绑纳入AI监管的国家级政策框架。

据《华尔街日报》报道,中国正以行政压力与产业动员结合的方式,加速推动本土AI芯片替代,其副总理甚至在内部会议上告诫AI公司:抗拒使用国产芯片者等同于“叛徒”。这标志着中美AI芯片竞争从技术追赶升级为国家级产业动员。

美团LongCat团队发布MineExplorer,首个针对多模态大模型在《我的世界》中完成分钟级长程任务的评测基准。测试发现,当前最先进的18款模型(包括Claude、GPT、Gemini等)在需要隐藏前置条件的多跳任务上集体“考砸”,最高成功率仅41%,揭示了AI“能看不能做”的能力断层。

开发者徐小夕发布了一款名为 wx-editor 的开源微信公众号编辑器,基于 Vue 3 和自研的 JitWord 协同文档 SDK,集成了 AI 写作助手、主题切换和微信兼容导出功能。这个项目的价值在于它为公众号创作者提供了一个从写作、排版到导出均可离线完成、不依赖后端的技术方案。

微软于7月23日发布两款自研AI模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,主打不依赖第三方模型蒸馏,已集成至Bing、PowerPoint和Dynamics 365等产品中。前者降低高达84%的GPU成本,后者速度提升约2倍,直接服务企业和开发者。

Mozilla AI 团队在 ACM FAccT 2026 大会上发布了一项关于大语言模型护栏(Guardrails)的研究,核心观点是:评估护栏与评估模型本身同样重要,且护栏需要结合工具(如搜索、检索)才能更可靠地运行,尤其在多语言和人道主义场景下。

美国佛罗里达州一名55岁男子因长期依赖ChatGPT-4o提供的医疗建议,拒绝就医,最终因双肺血栓引发大面积肺栓塞而濒临死亡。他于7月21日对OpenAI及其CEO萨姆·奥尔特曼提起诉讼,指控其“无证行医”和疏忽。此案再次将AI聊天机器人的医疗建议风险推向舆论焦点。

2026年7月23日,OpenAI正式面向美国18岁以上用户推出ChatGPT Health功能,允许ChatGPT在对话中引用个人健康数据(如医生笔记、血液检测结果、Apple Health数据),提供个性化健康解读。此举在拓展AI应用场景的同时,也因隐私诉讼和医疗建议可靠性问题引发争议。