Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力

Anthropic 与 Andon Labs 合作推出了 Drone-Bench 基准测试,用于评估 AI 模型自主操控无人机完成室内定位追踪任务的能力。该测试反映了前沿模型在物理世界操控机器人方面的快速进步,同时揭示了此类“双重用途”技术带来的机遇与风险。

Anthropic 与 Andon Labs 合作推出了 Drone-Bench 基准测试,用于评估 AI 模型自主操控无人机完成室内定位追踪任务的能力。该测试反映了前沿模型在物理世界操控机器人方面的快速进步,同时揭示了此类“双重用途”技术带来的机遇与风险。

英伟达CEO黄仁勋公开批评同行过度渲染AI“毁灭性”叙事,呼吁业界转向积极讨论。他认为,有关大规模失业、中国威胁论等恐慌性言论不仅吓唬公众,也可能阻碍AI技术的实际落地。

Anthropic 研究员、前 OpenAI 成员 Andrej Karpathy 公开分享了一个反直觉的 AI 使用技巧:不要精心编写提示词,而是开启语音模式,对大型语言模型“唠叨”10 分钟。他认为,这种混乱的“意识流”输入方式,反而能帮助 AI 更准确地理解用户的真实意图。

Elon Musk在7月23日接受《经济学人》总编辑90分钟专访,就AI超级智能、政府效率改革及个人政治参与发表坦率看法。他预测AI将在五年内超越人类集体智能,并罕见承认自己在政治参与上"忘乎所以"。

欧洲知名云服务商 Hetzner 正在研发大型语言模型(LLM)推理服务,这意味着开发者将多一个兼具性价比与合规多样性的模型部署选择,同时暗示欧洲正试图在 AI 基础设施领域找到自己的生态位。

Anthropic 将 Claude 的语音模式从轻量级 Haiku 扩展至更强大的 Opus 和 Sonnet 模型,用户可以在移动端、桌面端和网页端中随时切换模型,并支持通过语音调用 Gmail、Google Calendar 和 Slack 等外部工具。

英美两家AI安全机构联合发布评测,显示月之暗面Kimi K3在漏洞利用和网络攻击模拟两项测试中,得分仅为美国前沿模型的40%左右,但依然领先国内同行智谱GLM-5.2。评测结果与近期“用Anthropic Fable模型输出蒸馏训练K3”的指控形成交叉印证,引发对开源模型安全能力真实水平的讨论。

Claude 语音模式已升级,现在支持接入更强大的模型(如 Opus 和 Sonnet),并能在对话中调用用户已连接的第三方工具(如邮箱和日历),同时新增对西班牙语、法语、印地语、日语等多语言支持,即日起在公开测试版中向所有用户开放。

Anthropic 旗下 Claude 的语音模式于 2026 年 7 月 23 日更新,正式使用 Claude Opus 和 Sonnet 等更强的模型进行对话,同时支持在对话过程中调用用户已连接的邮件、日历等工具。该功能已作为公开测试版在移动端、桌面端和网页端上线。

Anthropic 已将 Claude 的语音模式升级至更强大的模型(包括 Opus 和 Sonnet),并在所有套餐中新增西班牙语、法语、印地语和日语支持。该功能已进入公开测试阶段,用户可在移动端、桌面端和网页端使用。