黑森林实验室FLUX3 多模态模型登场:单次生成 20 秒音视频,胜率碾压Grok与Seedance

黑森林实验室(Black Forest Labs)推出了全新的多模态基础模型FLUX3,该模型采用统一架构,可一次性生成最长20秒的视频及原生同步音频,并在人工评测中取得了显著优于Grok Imagine Video和Seedance的胜率,标志着视频生成领域从纯视觉向“音画同步”多模态输出的重要跃迁。

黑森林实验室(Black Forest Labs)推出了全新的多模态基础模型FLUX3,该模型采用统一架构,可一次性生成最长20秒的视频及原生同步音频,并在人工评测中取得了显著优于Grok Imagine Video和Seedance的胜率,标志着视频生成领域从纯视觉向“音画同步”多模态输出的重要跃迁。

2026年7月24日,红果短剧发布《关于规范AI剧集角色创作的公告》,明确要求AI生成的角色必须具有高辨识度,禁止跨剧复用相似角色面容,同时划定三条版权红线。这是短剧平台首次针对AI生成内容的同质化与侵权问题出台专项治理规则,意味着AI短剧行业正从野蛮增长转向精细化运营。

Box 的 CEO Aaron Levie 在 X 上发帖认为,AI 最有效的用法是作为已有专业领域的“力量倍增器”,只有专家才能驾驭 AI 产出高质量成果,而缺乏判断力和兴趣的“第三类人”只能制造大量低效的“垃圾内容”。这一观点与剑桥学者 Henry Shevlin 的“内化知识是 AI 时代的创造性原材料…

Black Forest Labs 于 2026 年 7 月 23 日以 Early Access 形式推出 FLUX 3 多模态基础模型,首次将图像、视频和音频统一到一个训练框架中,支持单次生成最长 20 秒的带原生音频视频,并已在视频生成人工评测中超过 Grok Imagine Video 等竞品。

德国 AI 初创公司黑森林实验室(Black Forest Labs)发布了 Flux3,这是首个原生支持音频生成的多模态基础模型,能以一次推理方式输出最长 20 秒的音画同步内容,在评测中胜过了多家头部竞品。这意味着多模态模型首次将“听”和“看”完整融合到一个统一底座中。

德国AI初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型Flux3,支持原生音频生成和最长20秒的同步音视频输出,在评测中对部分竞品取得了显著优势,并已开始向机器人领域拓展应用。

Amazon 要求第三方卖家对使用 AI 生成人物的商品广告进行明确标识,以遵守纽约州即将生效的法规。这部法规要求广告中必须披露“合成表演者”(synthetic performers),这意味着 AI 生成的人物形象在商业广告场景中将不再被视为普通素材,而是一个需要单独告知的合规要素。

2026年7月24日,马斯克亲自宣布Grok 4.5在所有平台上线。他明确将该模型定位为“不如Fable,但非常快、成本低、能干活”,直接以实用性和性价比作为卖点,而非追求顶尖性能。

谷歌母公司Alphabet在2026年第二季度财报电话会议上披露,其AI助手Gemini的月活跃用户已超过9.5亿,正向10亿用户俱乐部冲刺;与此同时,ChatGPT在2026年6月达到月活十亿,但市场份额首次跌破50%,Gemini则回升至27.7%。

在2025年6月至2026年6月的一年内,谷歌母公司Alphabet净增员工11,830人,总员工数从187,103人增至198,933人。这一扩张发生在多家科技巨头持续裁员的背景下,显示出谷歌在AI基础设施上的大规模投资并未导致人力收缩,反而驱动了新一轮招聘。