v2.1.281

Anthropic 为 Claude Code 发布 v2.1.281 版本,这次更新没有新模型,而是一次以稳定性、企业网关和会话恢复为主的大修补,修掉了多个可能导致会话崩溃、重试失控和历史丢失的底层问题。

Anthropic 为 Claude Code 发布 v2.1.281 版本,这次更新没有新模型,而是一次以稳定性、企业网关和会话恢复为主的大修补,修掉了多个可能导致会话崩溃、重试失控和历史丢失的底层问题。

用 AI 从植物和微生物里找新药的 Enveda 完成 3.11 亿美元 E 轮融资,估值达 20 亿美元,一年内翻倍。它手里的候选药物已经推进到人体临床试验阶段,这在至今没有 FDA 批准 AI 药物的行业里属于少数派。

公众号作者“卡尔的AI沃茨”开源了 awesome-seedance 项目,将 463 条 AI 视频提示语重新实测复现,整理成 14 个提示语模版与 25 个 AI 视频 Skills,试图给混乱的提示语分享生态补上一套可验证、可打分的样本库。

开发者苍何开源了 WeChatBridge(微信流),可以把微信聊天记录一键批量投喂给 Codex、Claude Code、豆包等 Agent,或沉淀到 Obsidian 做个人知识库,目前已在 GitHub 完全开源。

2026年9月15日,TypeSafe AI 发布首个 System One Model——Jev,一个不生成文本、只输出选项、分数、概率和置信度的决策模型,主张把 Agent 里"做判断"的环节从昂贵的大模型中拆出来,交由受约束的专用模型处理,规则、权限与执行仍留在代码中。

Artificial Analysis 的评测显示,OpenAI 新发布的 GPT-6 Sol 和 Luna 在 Intelligence Index 得分与前代 GPT-5.6 系列相近的情况下,把每次评测任务的成本压低了约一半,主要来自 token 定价下调约 50%。

Anthropic 和 OpenAI 在一天内接连降价,但真正激烈争夺的不是最强模型,而是够用又便宜的中端市场——最贵的 Fable 5.1 上线十二天只拿到 3.7% 的网关支出。

Modal 官方工程博客披露,他们为 Moonshot AI 的 Kimi K2.6 编码 Agent 搭建的推理服务,在单副本上把单用户性能提升 2.8 倍、整体吞吐提升 5.6 倍,并把这套方案扩展到日均处理数百亿、累计数万亿 token 的规模。这给高成本的大模型推理服务如何做到可商用,提供了一份可复用…

小米 MiMo 团队发布 MiMo-V2.6 的 Pro 与 Flash 两款全模态开源模型,官方称 Pro 在多数 Agent 基准上对标 Claude Opus 5 与 GPT-5.6 Sol。Perplexity CEO Aravind Srinivas 转发并评论"永远不要低估开放权重模型"。

Arena 实测显示,OpenAI 的 GPT-6 Sol(Max)在 Code Arena: WebDev 榜单以 1689 分排名第 4,用不到 Claude Opus 5(Max)一半的价格跑出同档成绩,同时刷新了性价比的帕累托前沿。