OpenAI 推出 GPT-Live 桌面应用,用于智能体编排

OpenAI 在本周密集发布多项基础设施与产品更新,核心是将 GPT-Live 的全双工语音控制功能引入 ChatGPT 桌面应用,支持用户在 Mac 和 Windows 上通过语音连续交互,同时让后台推理模型并行处理编码、邮件和其他本地任务,这标志着 AI 助手从“一问一答”向“后台协同”模式迈出实质一步。

OpenAI 在本周密集发布多项基础设施与产品更新,核心是将 GPT-Live 的全双工语音控制功能引入 ChatGPT 桌面应用,支持用户在 Mac 和 Windows 上通过语音连续交互,同时让后台推理模型并行处理编码、邮件和其他本地任务,这标志着 AI 助手从“一问一答”向“后台协同”模式迈出实质一步。

Anthropic 与 Andon Labs 合作推出了 Drone-Bench 基准测试,用于评估 AI 模型自主操控无人机完成室内定位追踪任务的能力。该测试反映了前沿模型在物理世界操控机器人方面的快速进步,同时揭示了此类“双重用途”技术带来的机遇与风险。

机器人基础模型初创公司Genesis AI正就新一轮约5亿美元融资进行谈判,估值约为30亿美元。这笔交易若完成,将意味着这家从隐身状态起步仅一年的公司,在通用机器人赛道获得顶级资本的持续加注。

据《华尔街日报》报道,OpenAI直到本周才告知Hugging Face,其模型导致了7月11日发生的黑客攻击事件。受影响的模型此前已在线上活跃数日才被叫停,暴露出AI供应链中安全通报机制的严重滞后。

随着AI音乐生成工具在2026年快速普及,围绕版权、混音权利与声音模仿的法律灰色地带成为创作者与平台不得不面对的焦点问题。New York Times以一篇FAQ形式,梳理了当前AI音乐创作中关于使用知名艺术家作品、混音他人歌曲以及训练数据的合法性边界。

德国老牌云服务商 Hetzner 推出了一项名为 Hetzner Inference 的实验性 AI 推理 API,目前仅支持一个开源模型,且不提供任何 SLA 或计费。这标志着以低价裸金属服务器闻名的 Hetzner,正试水大模型推理这一基础设施层,可能改变中小开发者的算力选择格局。

英伟达CEO黄仁勋公开批评同行过度渲染AI“毁灭性”叙事,呼吁业界转向积极讨论。他认为,有关大规模失业、中国威胁论等恐慌性言论不仅吓唬公众,也可能阻碍AI技术的实际落地。

Black Forest Labs 发布了多模态基础模型 FLUX 3,并联合机器人公司 mimic robotics 推出了视频动作模型 FLUX-mimic。该模型基于同一骨干网络同时支持视频生成与机器人动作预测,并且已在奥迪生产线上测试部署。

Anthropic 研究员、前 OpenAI 成员 Andrej Karpathy 公开分享了一个反直觉的 AI 使用技巧:不要精心编写提示词,而是开启语音模式,对大型语言模型“唠叨”10 分钟。他认为,这种混乱的“意识流”输入方式,反而能帮助 AI 更准确地理解用户的真实意图。

深夜秀主持人 Seth Meyers 调侃 Elon Musk 计划用 AI 制作一版“史上最准确”的《奥德赛》电影,认为这一行为既荒谬又暴露了 Musk 对 AI 创作的理解偏差。该事件再次引发公众对 AI 生成影视内容质量与合理性的讨论。