Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1

Anthropic 发布全新 Claude Fable 5.1 与 Claude Mythos 5.1,它们在编码、知识工作和科研推理上的能力大幅提升。前者面向一般市场,后者专门面向网络安全与生命科学等高风险领域的受信用户开放。

一句话看懂:Anthropic 发布全新 Claude Fable 5.1 与 Claude Mythos 5.1,它们在编码、知识工作和科研推理上的能力大幅提升。前者面向一般市场,后者专门面向网络安全与生命科学等高风险领域的受信用户开放。

事件核心:发生了什么

Anthropic 正式发布两款新模型:Claude Fable 5.1 与 Claude Mythos 5.1。两款模型技术同源,区别在于安全策略——Fable 5.1 为通用版本,即日可用;Mythos 5.1 仅通过“受信访问计划”提供,其安全机制针对网络安全与生命科学研究场景特别设计,并已与美国政府合作建立生物学能力准入机制,科学家注册通道预计近期开放。

成本方面,Fable 5.1 在按 token 计费的典型负载下,比 Fable 5 便宜约 25%。降低来自缓存读取定价的调整,对高强度的 Agent 类工作(如自动编码、多步推理任务),综合节省最高可达约 45%。Anthropic 同时宣布了“企业前沿安全机制”(EFS):客户数据存放在由企业完全控制的云基础设施内,效果等同于零数据留存策略,但仍保留业界领先的防滥用能力。EFS 将于今年秋季分阶段向企业开放,在此之前,符合条件的客户可直接使用零数据留存方案运行 Fable 5.1。

在安全误报率方面,新模型的网络安全拦截误报率较前代下降了 60%。Anthropic 还明确了一点:Fable 5.1 现在可以用于“发现”软件漏洞,但系统设计上不支持据此开发漏洞利用代码。

为什么重要

这次发布最值得关注的是 Anthropic 在“能力”与“安全”之间的重新定价。过去一年,前沿大模型常面临一个矛盾:越是强大的通用推理能力,越容易在网络安全、生物等敏感领域造成不可控风险。Anthropic 给出的方案是把模型做成“同一大脑、两副面孔”——通用版本自由使用,受限版本在安全机制更精细的前提下向专业机构开放,用降低误报率的方式减少安全机制对正常工作的干扰。

性能数据也值得留意。Fable 5.1 在 Terminal-Bench-Science 0.1(Agent 科学推理测试)和 CursorBench 3.2.0(Agent 编码测试)上均高于前代 Fable 5;Humanity‘s Last Exam 中,即使不使用外部工具,Fable 5.1 的通过率也明显优于带工具的 Fable 5。换句话说,这一代的性能提升不依赖工具外挂,其“思考本身”更扎实。基准之外还有一个实际案例:投资机构 Millennium 的内部系统出现罕见崩溃,工程师数年未查明原因,Fable 5.1 定位到了根因。

对行业而言,这意味着大模型竞争的焦点正从“单次生成质量”转向“长时间无人值守任务中的稳定推理能力”。同时,推理成本明显下降——缓存读取的价格调整对于高频调用 Agent 场景的用户有直接财务影响。

对用户/开发者/创作者的影响

开发者是本次更新的第一受益者。Fable 5.1 在 Claude Code、Claude Cowork 及 Claude.ai 中默认开启高推理强度(High/Medium),在低至中等推理强度档位测得的效果已接近甚至超过上一代 Fable 5 的最高强度,而费用更低。对大量使用 API、运行自主编码与终端操作的团队来说,直接降低单任务成本。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

企业客户关注的是数据安全条款:EFS 把推理过程的所有中间数据存放在企业自己的云环境中,理论上达到零留存效果,这消除了不少敏感行业(金融、医疗、政务)在合规层面采用大模型的障碍。值得注意的是 EFS 能力是分批开放,当前可用的是零数据留存版本。

科研工作者短期内能在 Agent 型科学推断、软件漏洞定位等方面获得明显助力。前提是需要遵守各自机构的安全/审查要求,尤其是生物学方面,Claude Mythos 5.1 的能力高,但渠道目前属于受信准入制,不是公开开放的通用工具。

值得关注的后续

第一,EFS 的实际落地时间与效果。秋季后是否能按期推广到全部企业客户、定价如何,是观察重点。理论上它先于行业把“零留存”落实成默认配置,而不是合规附加选项。

第二,生物学的准入计划将很快开放,哪些机构、哪些科研项目能通过审核是重要信号。

第三,竞品反应。OpenAI 的 GPT-5.6 Sol 在同榜对比中数据不及 Fable 5.1(但官方尚未回应),Google 的新模型也随时可能跟上。若后续 Fable 5.1 在行业测评中持续领先,Anthropic 在“深度 Agent 工作负载”这一细分场景的定价优势会进一步放大,可能带动新一轮 API 价格调整。

来源:Anthropic:Newsroom(网页)

celebrityanime
celebrityanime
文章: 21465

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注