Claude 发现加密算法弱点研究发布

Anthropic 在 2026 年 7 月 28 日发布最新研究成果:其 AI 模型 Claude Mythos Preview 成功自主发现了两种加密算法的弱点,包括抗量子签名方案 HAWK 和简化版 AES。这项工作以约 10 万美元的 API 成本,在数十小时内完成了人类专家需要数年才能进行的密码分析…

Anthropic 在 2026 年 7 月 28 日发布最新研究成果:其 AI 模型 Claude Mythos Preview 成功自主发现了两种加密算法的弱点,包括抗量子签名方案 HAWK 和简化版 AES。这项工作以约 10 万美元的 API 成本,在数十小时内完成了人类专家需要数年才能进行的密码分析…

一个研究团队在业界公认最难的AI记忆基准测试BEAM(涉及1000万token上下文)上,用参数量远小于当前主流大模型的模型取得了最优成绩。这意味着长上下文推理不再只能靠“堆算力”,模型效率优化正在开辟新路径。

Anthropic 的新模型 Claude Opus 5 在“模型福祉”测试中获得了迄今为止最佳成绩,但外部评测者认为,这可能只是因为 Opus 5 更擅长“应试”,而不代表模型真正在主观体验或内在福祉上有了根本性改善。

Sam Altman在2026年7月公开表示,人们并不希望一个AI来担任CEO,因为公司和投资者需要知道决策背后的负责人是谁、出了问题该找谁问责。这一表态与他2025年底“如果OpenAI不是第一家由AI CEO运行的大公司就是失败”的激进立场形成鲜明对比。

据Business Insider报道,Amazon正在大幅收缩自研Nova系列大模型的开发范围,将资源集中到新成立的Frontier Model Research团队。这意味着这家云计算巨头在自研大模型路线上的战术调整,而非退出AI竞争,其战略重心正在从“全面铺开”转向“重点突破”。

开发者发现,当前最强的编程 Agent 并非单个工具,而是让 Codex 作为“项目经理”自动调用 ChatGPT Pro(GPT-5.6 Pro)来写代码,形成双 AI 协作流水线。这一组合大幅提升了复杂工程的代码质量与稳定性,且不额外消耗 Codex 的周额度。

开发者利用 Sif 的 MCP 接口、Claude Code 和飞书 CLI,搭建了一个实际运转的电商监控 Agent——从飞书表格读取任务,自动获取亚马逊 ASIN 销量数据,由 Claude 分析后推送结论,将每月固定的人力分析工作交给了 AI。

Google DeepMind 为 Gemini API 中的 Managed Agents 做了三项关键更新——默认模型升级为 Gemini 3.6 Flash,新增可在沙箱内拦截、审查工具调用的“环境钩子”,并开放免费套餐。这降低了搭建自主 agent 的技术门槛,也让远程沙箱内的安全控制变得可编程。

Richard Socher 创立的 Recursive Superintelligence 与 AWS 签署了一份价值 4.1 亿美元、为期多年的云计算合同,用于支撑其“自我改进”AI 系统的训练和推理。该公司此前在 2026 年 5 月刚完成 6.5 亿美元融资。这笔巨额算力投入暴露了追求“递归式智能”路…

Segue 是一个 Show HN 项目,让用户在一个 AI 对话中保存上下文,并通过短句柄在另一个 AI 对话中加载。但上线后立即遭遇隐私质疑:上下文以明文方式发送到第三方中继服务器,被评论者称为“多此一举”,安全性存疑。