“白月光”回归秒变“吞金兽”?Claude Fable 5限时限额,口碑两极分化

Anthropic的旗舰模型Claude Fable 5在被美国出口管制封禁19天后重新上线,但立即实行了限时50%额度使用和7天后转为纯按量付费的新规则,同时升级了安全风控。用户实测发现,模型能力未缩水,但token消耗成本极高且正常需求易被误拦截,引发口碑两极分化。

Anthropic的旗舰模型Claude Fable 5在被美国出口管制封禁19天后重新上线,但立即实行了限时50%额度使用和7天后转为纯按量付费的新规则,同时升级了安全风控。用户实测发现,模型能力未缩水,但token消耗成本极高且正常需求易被误拦截,引发口碑两极分化。

Anthropic 为证明其最新模型 Claude Fable 5 的安全性,公开了一份包含 8 款模型的内部安全测试名单。名单中除自家的 Fable 5 和 OpenAI 的 GPT-5.5 外,唯一入选的中国模型是 Kimi K2.7,这被外界视为对中国大模型底层能力的一次间接认可。

浙江大学与阿里巴巴的联合研究团队发布了两篇论文,提出了一套让 AI Agent(智能体)在没有人工干预的情况下,自主迭代生成、修正并优化自身“技能包”(Skill)的方法。其核心创新在于用一个“代理验证器”替代真实测试反馈,驱动 Agent 通过多轮自我进化,最终生成的技能包不仅比人工编写的更有效,还能跨模型…

阿里达摩院联合人大高瓴人工智能学院、中国科学院大学,发布了专攻超导材料发现的AI智能体“ElementsClaw”(元素虾)。它仅用28个GPU小时,就从240万种稳定晶体中预测出6.8万种可能超导的材料,并在实验验证中发现了4种人类此前完全未知的新超导体,大大提升了超导材料筛选效率。

大晓机器人首席科学家陶大程在公开技术分析中提出,当前行业对世界模型的评价应从“像素逼真度”转向“能否有效支撑机器人行动”,并系统阐述了具身世界模型应以“行动代价最小化”为设计核心。这一观点直接挑战了通用生成式世界模型的主流评价标准,为具身智能从实验室走向产业化提供了更聚焦落地的底层判断框架。

OpenAI 已推出自研推理芯片 Jalapeño,Anthropic 也接触三星探讨芯片合作。两家头部大模型公司正从“买算力”转向“定义算力”,目的不是取代英伟达,而是通过定制硬件优化推理成本,为大规模 AI 产品商业化铺路。

用户在 Ollama 中尝试加载 Seed-OSS-36B-Instruct-GGUF 的 Q4_K_M 量化版本时出现 500 内部错误,相同环境下载入 Seed-Coder-8B-Instruct 则无问题。社区反馈该模型在 LM Studio(非 Ollama)上可以运行,但工具调用(Tool

用户从 Hugging Face 下载了所有可用的 plamo-2-translate-gguf 模型,尝试通过 ollama run hf.co/mmnga/plamo-2-translate-gguf:Q8_0 等命令在 Ollama 中运行,但触发错误。

用户在 Ollama 中运行 mirage335/NVIDIA-Nemotron-Nano-9B-v2-virtuoso 模型(一个基于 NVIDIA Nemotron Nano 9B 的 MoE 模型)时,通过 --verbose 参数发起推理请求,模型加载失败并返回 500 错误。该问题在之前的

Anthropic 在最新演讲中透露,已将 Claude Code 的系统提示词删减 80%,并推出更高效的 Fable 5 模型。此举背后是 AI 行业 token 成本失控的现实——Anthropic 花在算力上的钱已是薪资支出的 2.3 倍,大公司如 Uber、花旗已开始严格管控 AI 使用预算,行业正…