Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频

Black Forest Labs 于 2026 年 7 月 23 日以 Early Access 形式推出 FLUX 3 多模态基础模型,首次将图像、视频和音频统一到一个训练框架中,支持单次生成最长 20 秒的带原生音频视频,并已在视频生成人工评测中超过 Grok Imagine Video 等竞品。

Black Forest Labs 于 2026 年 7 月 23 日以 Early Access 形式推出 FLUX 3 多模态基础模型,首次将图像、视频和音频统一到一个训练框架中,支持单次生成最长 20 秒的带原生音频视频,并已在视频生成人工评测中超过 Grok Imagine Video 等竞品。

德国AI初创公司黑森林实验室(Black Forest Labs)于7月23日发布多模态基础模型Flux3,首次实现原生音频与视频同步生成,最长可达20秒。这一技术突破意味着AI视频生成从单纯“画面模拟”迈入“音画一体”阶段,可能重新定义视频内容生产与机器感知能力。

Palmier Pro 是一款专为 macOS 26 打造的 Swift 原生开源视频编辑器,核心亮点在于将生成式 AI 模型和内嵌的智能体工具直接集成到时间线编辑流程中,并通过 MCP 协议与 Claude、Codex、Cursor 等主流 AI 开发工具协同工作。这意味着视频编辑正从手工剪辑走向“人机协作…

Runway 推出面向生成式媒体的基础设施产品“Media Router”,宣称是行业内首个为此类媒体定制的流量路由方案,标志着这家以 AI 视频生成知名的公司正在从应用层向底层基础设施层扩张。

埃隆·马斯克因不满克里斯托弗·诺兰新片《奥德赛》的改编与选角,公开表示将使用xAI旗下的视频生成工具Grok Imagine,制作一部更忠实于荷马原著的影片。这一表态将经典改编的审美争议直接导向了AI生成内容领域。

小红书技术团队开源了 BigMac,一种针对多模态大模型训练的流水并行新方案。它通过“嵌套流水线”设计,在不显著增加显存占用和计算空泡的前提下,将训练速度提升了 1.08 到 1.9 倍,解决了当前多模态模型训练中“要快就得费显存、要省显存就得慢”的两难问题。

英伟达近日推出了名为SVD(合成视频检测服务)的新工具,能通过逐帧分析视频内容,以92%的准确率判断视频是否为AI生成。该服务已集成到英伟达的推理微服务平台中,旨在解决AI生成视频(深度伪造)日益泛滥带来的鉴别难题。

一项来自学术团队的新研究ABot-World-0,首次实现在单张桌面级GPU(如NVIDIA RTX 5090)上以16FPS实时生成720P的无限交互式视频世界,用户可通过键盘直接操控场景漫游与角色动作,让“世界模型”从理论落地到普通消费级硬件。

《第九区》导演 Neill Blomkamp 用字节跳动的 Seedance 2.0 模型生成了一部 13 分钟 AI 短片《Nightborne》,但即便是专业剪辑和真人演员授权也没能掩盖其内容生硬、画面混乱的“AI 味”,被认为是一次缺乏创造力的技术表演。

开发者dawndrain公开了一套名为movie-gen的端到端AI电影制作流程,利用Claude Code作为编排主力,整合Seedance 2.0视频生成、ElevenLabs语音、Sonilo音乐等多项服务,已产出三部片长5-12分钟的短片。这不是简单的Demo,而是一套已验证超过10部影片、包含80余…