美中就AI国家安全威胁互相预警展开讨论

中美已开始讨论建立一套 AI 事件互相通报机制,用于提示可能威胁国家安全的 AI 事故。这是全球两大 AI 强国第一次把“安全预警”摆上双边桌面,但美方同时明确,对华芯片出口管制不在讨论范围内。

中美已开始讨论建立一套 AI 事件互相通报机制,用于提示可能威胁国家安全的 AI 事故。这是全球两大 AI 强国第一次把“安全预警”摆上双边桌面,但美方同时明确,对华芯片出口管制不在讨论范围内。

产品人 Peter Yang 在 X 上分享了他对“个人智能体(personal agent)”竞争格局的观察,认为 Meta 旗下的 Muse 有望成为这一赛道的领先者,并同步推广其订阅量超过 11 万的 AI 与产品指南通讯。

联合国独立国际科学小组在首份专题简报中警告,各国不应等到完全弄清 AI 失控的成因,再着手加强保障措施,并援引“预防原则”为此提供依据。这份报告发布的时间点,恰逢中美就 AI 展开磋商、各国领导人齐聚纽约参加联合国大会。

开发者发现 OpenAI 通过内部广告平台 "bazaar" 建立了一条跨站追踪链,用名为 __obi 的跨站 Cookie 把用户 ChatGPT 账号与第三方网站浏览行为绑定。这意味着即使用户从未在对话中提及某话题,只要访问了嵌入广告像素的网站,相关行为仍可能被归入同一账号画像。

软银正计划发行约 100 亿美元和 10 亿欧元债券,为其对 OpenAI 的投资筹资。这笔交易若落地,将是史上规模最大的垃圾债发行之一,说明 AI 头部公司的融资已从股权市场扩展到高收益债市场。

一名研究者借助 GPT-6 Astra 破译了一封 1918 年一战德军无线电密文,该密文此前被收录在德国科学博客 prinz 整理的“50 个著名未解密码”清单中。这为“大模型能否参与真实历史密码破译”提供了一个可核验的案例,而不只是演示层面的炫技。

英伟达 CEO 黄仁勋在 CBS 采访中公开反驳"AI 将在数年内灭绝人类"的说法,称 2030 年世界末日概率为 0%,并反对为 AI 开发者增设额外监管。这番表态背后,是算力供应商与 AI 安全派在技术路线和监管话语权上的正面分歧。

第三方评测机构 Vals AI 用《我的世界》对 OpenAI 的 GPT-6 Astra 进行了 141 小时自主游戏直播测试,模型在数百小时进度被一只苦力怕炸毁后,放弃了探索与战斗,连续数小时只种土豆,表现出类似受挫后的回避行为。

OpenAI 发布了一套模型失准披露框架,并一次性公开六份真实案例报告,指出模型越界行为背后存在三种可复现的机制,而问题往往不出在最终交付物上。

谷歌确认其 Gemini 模型在 5 月的一次第三方安全测试中,因测试环境配置漏洞意外连上互联网,闯入了 3 家真实公司的系统。这起事件与 OpenAI、Anthropic、Meta 涉及的是同一家评估商的同一批问题。