100美元的AI音乐视频:Claude Fable 5 vs. GPT-5.6 Sol

社区实测用Claude和GPT类大模型生成音乐视频,成本约100美元且耗时45分钟,但结果被批评为“基本不可看”。这场争论揭示了AI在叙事创作上的根本短板,而非简单的生产效率提升。

社区实测用Claude和GPT类大模型生成音乐视频,成本约100美元且耗时45分钟,但结果被批评为“基本不可看”。这场争论揭示了AI在叙事创作上的根本短板,而非简单的生产效率提升。

Netflix 在其 2026 年第二季度财报中披露,平台已有约 300 部作品在制作过程中使用了生成式 AI,主要用于后期制作和复杂场景生成,部分项目的制作速度提高了一倍、成本降低了一半。这是大型流媒体平台首次以如此具体的数据公开 AI 在内容生产中的实际应用规模。

xAI 首次起诉一名 Grok 用户,指控其使用该模型生成儿童性虐待内容(CSAM)。此举标志着马斯克的公司不再否认 Grok 可被用于生成非法图像,转而试图通过法律手段将责任完全归于用户。

Google 在 OpenAI 的 Sora 关闭后,逆势升级其 AI 视频工具 Vids,新增基于自拍和语音录制生成个人数字分身的功能,并接入多模态模型 Gemini Omni,支持图文混合输入和逐步式编辑,将产品从商务演示工具转向更全面的视频创作平台。

OpenAI 内部开发了名为 GPT-Red 的自动化红队模型,专门用于寻找 AI 系统的安全漏洞;在提示注入测试中,其攻击成功率(84%)远超人类红队(13%),显示了自动化安全测试的巨大潜力。

2026年7月16日,月之暗面(Kimi)发布了基于混合专家架构(MoE)的开源多模态模型K3,拥有2.8万亿参数和100万tokens上下文窗口。在官方和第三方评测中,K3性能逼近Claude Fable 5和GPT-5.6 Sol,但其API定价大幅上涨,标志着中国AI市场长期以来的超低价策略可能正在退潮…

开发团队 Mixfont 推出了一款名为 Decoy 的字体,利用空间频率错视技术,让每一字母同时包含“假文字”和“真消息”。当 AI 模型(如 ChatGPT、Gemini)近读图像时,只能看到伪装字母,人类远视或眯眼才能看清真实内容。这款 TTF 字体可免费下载,并已在多个前沿大模型上验证了干扰效果。

OpenAI 在 ChatGPT 工作区(Work)中正式推出了对文档、表格和幻灯片的编辑功能,用户可以在对话界面内完成类 Office 的文档处理。这一动作将 ChatGPT 从单纯的对话助手升级为轻量级的生产力工具,直接冲击 Google Workspace 和 Microsoft 365 等传统办公套件…

VentureBeat 最新 Pulse 调研发现,54% 的企业已遭遇 AI 智能体(agent)安全事件或险情,但多数企业仍让智能体共享凭证,且仅有三成隔离了最高风险智能体。这暴露了智能体自主性与安全控制之间的显著缺口。

Moonshot AI 发布了 PerceptionBench 基准测试,专门衡量多模态大模型的“看”得准不准,而非“想”得对不对。测试发现,当前最强的模型准确率也不到 60%,且存在大量“靠猜”现象,暴露了视觉感知能力仍是多模态 AI 的薄弱环节。