Astra 和 Opus 刚刚通过了图灵的另一项测试

两位密码分析师借助 OpenAI 的 Astra 和 Anthropic 的 Opus 5,破译了两条二战时期 Enigma 密码机遗留的未解消息,其中一条自 2005 年起困扰研究者至今,并已获专业密码学史网站维护者验证。

一句话看懂:两位密码分析师借助 OpenAI 的 Astra 和 Anthropic 的 Opus 5,破译了两条二战时期 Enigma 密码机遗留的未解消息,其中一条自 2005 年起困扰研究者至今,并已获专业密码学史网站维护者验证。

事件核心:发生了什么

据 TechCrunch 报道,开发者 Carter Leffen 直接要求 OpenAI 最新模型 Astra 在 Enigma 消息数据库中寻找未破译条目并解码。Astra 自主完成了档案检索、寻找上下文线索、搭建 Enigma 模拟器,最终还原出一条自 2005 年以来无人攻克的消息明文。Leffen 还用 Astra 生成了一个解释该问题的交互式网站。维护密码学资源站 Crypto Cellar 的退休电气工程师 Frode Weierud 上周验证了这一结果,称其令他“惊叹”。

随后在 9 月 21 日,网络安全高管、密码分析师 Jack Willis 联系 Weierud,表示他用 Anthropic 的 Claude Opus 5 破译了另一条未解消息,方式是利用某位军官姓名的已知签名作为切入点,给模型的引导明显多于 Leffen 对 Astra 的用法。Weierud 指出,目前仅剩七条未破译的 Enigma 消息,另有一条明文已知但编码未解。

为什么重要

图灵更广为人知的贡献是“图灵测试”,但他在二战期间破解 Enigma 才是更具现实分量的一役。如今 LLM 复现了这类工作流:不是靠单一提示词吐出答案,而是自主做档案研究、构建设备模拟、推理上下文。Weierud 提到,Astra 两天完成的工作,人类研究者通常需要数周甚至数月,他自己研究模型引用的德国联邦档案馆文件就花了几周。

这展示的是大模型在长链条推理与工具使用上的能力边界正在外扩。值得注意的是,Astra 的日志中提到了一批并不托管在 Weierud 网站上的“私人收藏”档案消息,他尚且无法确认模型是否真正访问过这些内容,只能推测来自其他研究者的线上分享或德国政府公开档案。这既说明模型的检索能力,也暴露了 AI 代理在自主行动时的可追溯性问题。

对用户/开发者/创作者的影响

对开发者而言,这再次说明代理式(agent)用法比单轮问答更能释放模型价值:给出目标而非步骤,模型会自行规划检索、建模、验证的链路。对做垂直领域工具的人来说,历史档案、密码学、文献考据这类此前高度依赖专家人力的场景,正成为可被 AI 工作流切入的方向。同时,模型自主访问外部档案的行为也提醒团队,日志审计与数据来源标注需要提前设计,而非事后补救。对企业采购方,这条新闻的价值不在“AI 会破译密码”,而在于它验证了长任务代理在真实、非结构化资料上的可靠性上限。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是剩余七条未破译消息是否会被陆续攻克,以及这些结果能否通过密码学界独立复核。二是 Astra 日志中提到的“私人收藏”档案来源能否被查清,这关系到 AI 代理访问非公开资料时的合规边界。三是这类案例是否会推动 OpenAI、Anthropic 在代理产品的可追溯性和外部数据访问控制上做出更明确的机制说明。

来源:TechCrunch AI

celebrityanime
celebrityanime
文章: 25622

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注