黑森林实验室放出 Flux3:首个原生生成音频的多模态基础模型,20 秒音画同步一次成型

德国 AI 初创公司黑森林实验室(Black Forest Labs)发布了 Flux3,这是首个原生支持音频生成的多模态基础模型,能以一次推理方式输出最长 20 秒的音画同步内容,在评测中胜过了多家头部竞品。这意味着多模态模型首次将“听”和“看”完整融合到一个统一底座中。

德国 AI 初创公司黑森林实验室(Black Forest Labs)发布了 Flux3,这是首个原生支持音频生成的多模态基础模型,能以一次推理方式输出最长 20 秒的音画同步内容,在评测中胜过了多家头部竞品。这意味着多模态模型首次将“听”和“看”完整融合到一个统一底座中。

2026年菲尔兹奖得主、数学家雅各布·齐默尔曼在获奖后宣布将加盟OpenAI,专注于AI安全研究。这位解决了数论核心猜想的顶尖学者跨界转向,释放出AI安全领域对基础数学人才的吸引力已达到顶级的信号。

腾讯于7月23日宣布,将其多模态模型部门与大语言模型部门合并,组建新的基础模型部,由腾讯首席AI科学家姚顺雨统一管理。此举旨在打破图像理解和语言生成两条技术路线的研发壁垒,集中资源冲击全模态大模型的上限。

2026年7月23日,新晋菲尔兹奖得主、IMO满分得主Jacob Tsimerman在获奖后公开宣布将研究重心转向AI安全,并已加入OpenAI。这一举动表明,顶尖数学人才正在向AI安全领域加速流动,OpenAI正在借顶级数学家的推理能力强化其安全对齐研究。

快手正式推出“AI互动内容”创作功能,面向首批创作者开放招募,标志着短视频平台的竞争从时长争夺转向交互体验。此举旨在通过AI驱动的互动内容(如角色对话、分支剧情、轻应用)延长用户停留时间,并为平台推荐算法提供更丰富的行为数据。

小鹏汽车旗下人形机器人已在广州工厂进入小批量试生产阶段,量产线进入最后集成环节,公司内部计划2026年实现量产,并从2027年起逐步部署到门店等商业场景。这标志着小鹏正将造车积累的硬件研发、AI大模型、供应链等能力系统性地复用至人形机器人业务,推动具身智能从研发走向商业化落地。

Runway于2026年7月发布了Media Router,这是一套模型调度中间层,能根据任务需求(速度、质量或成本)自动在Seedance、GPT Image2、ElevenLabs等多个厂商的模型间切换,开发者只需对接一个API即可完成从创意验证到成片的生成流程,同时降低Token消耗。

Google 母公司 Alphabet 在 2026 年第二季度资本支出达到破纪录的 449.2 亿美元,同比增长 100%,几乎全部投入 AI 基础设施。同时,Google Cloud 收入猛增 82% 至 248 亿美元,营业利润率从约 18% 几乎翻倍至 35.6%,验证了 AI 投入与商业化回报之间的…

亚马逊云科技推出全新集成安全平台 AWS Continuum,以智能体(Agent)形式自动执行渗透测试、代码审查、威胁建模和漏洞检测,意图将安全修复流程从人工审批转向自动化执行,但产品线混乱引发开发者困惑。

Snowflake 提出一套名为“6C”的 AI 数据就绪度评估框架,用于解决 AI 项目因数据质量而非模型本身失败的核心问题,并已将框架封装为开源智能体,帮助开发团队系统化判断数据是否适合 RAG、智能体、模型训练等特定工作负载。