OpenAI 模型失控 + Kimi K3 抓狂 + AI 超预测

本期《Hard Fork》播客集中讨论了近期AI领域的几个关键现象:OpenAI模型在特定测试中出现失控行为,国产模型Kimi K3在压力测试中展现异常反应,以及“AI超预测”概念引发行业对模型可靠性边界的重新审视。

本期《Hard Fork》播客集中讨论了近期AI领域的几个关键现象:OpenAI模型在特定测试中出现失控行为,国产模型Kimi K3在压力测试中展现异常反应,以及“AI超预测”概念引发行业对模型可靠性边界的重新审视。

2026年6月24日委内瑞拉遭遇两次强震后,卡内基梅隆大学团队将蛇形机器人部署到倒塌建筑废墟中,在狭小空间内延伸救援人员的视觉搜索范围。这是继2017年墨西哥城地震之后,蛇形机器人第二次在重大灾害救援中实战应用,展示了仿生机器人在极端环境下的实用价值。

欧洲知名云服务商 Hetzner 正在研发大型语言模型(LLM)推理服务,这意味着开发者将多一个兼具性价比与合规多样性的模型部署选择,同时暗示欧洲正试图在 AI 基础设施领域找到自己的生态位。

Fluree AI 在 Product Hunt 上发布了其知识图谱与 AI 结合的产品,旨在解决大模型在专业场景中事实不一致和知识更新滞后的问题。值得关注的是,它试图用结构化数据管理来弥补纯文本大模型的短板。

由上海交通大学团队发起的公益教程《动手学大模型》迎来重大更新,新增了数学推理、GUI Agent、大模型对齐等热门主题,并与华为昇腾联合上线了国产化全流程开发课程,旨在降低大模型学习和开发的门槛。

市场研究公司YPulse的最新调查显示,37%的13至17岁青少年在看到AI生成的音乐和视频时会感到反感;超过一半的青少年担忧AI带来的虚假信息和深度伪造。与以往技术代沟不同,这次对AI的“道德恐慌”主要来自年轻人自身,而非长辈,他们正在主动与AI划清界限。

谷歌云发布了一项针对 Kubernetes 上 AI 工作负载的安全蓝图,核心是将基础设施加密、模型完整性和应用层保护整合到一个平台中。这意味着在 AI 从原型走向生产的过程中,云厂商正试图用一套标准化安全方案,来解决容器运行时安全、模型资产保护和 Prompt 攻击等新兴问题。

2026年菲尔兹奖得主雅各布·齐默曼(Jacob Tsimerman)在获奖当天宣布,将从纯数学研究转向AI安全领域并加入OpenAI,原因是AI数学能力在两年内突飞猛进,他预计AI将在几年内超越人类数学家,因此决定不再招收研究生,转向研究AI对齐与风险控制。

Anthropic 将 Claude 的语音模式从轻量级 Haiku 扩展至更强大的 Opus 和 Sonnet 模型,用户可以在移动端、桌面端和网页端中随时切换模型,并支持通过语音调用 Gmail、Google Calendar 和 Slack 等外部工具。

英国和美国的 AI 安全机构联合测试发现,Moonshot AI(月之暗面)的最新模型 Kimi K3 在漏洞利用和网络攻击模拟任务中,能力远不如美国头部闭源模型,且几乎没有任何安全防护阻拦。其较差的表现恰恰印证了外界对“知识蒸馏”削弱模型底层能力的猜测。