得益于 Anthropic 的新雅可比镜头,克劳德隐藏的内心独白现在可以被阅读

Anthropic 发布了名为“J-Lens(雅可比镜头)”的新型可解释性分析工具,发现其 Claude 模型在内部形成了一个类似人类工作记忆的“J-Space”空间。该空间存储模型在输出前没有说出口的“思考”内容,且能因果性地控制模型的最终结论。基于这一发现,Anthropic 已开发出新的训练方法,显著减…

Anthropic 发布了名为“J-Lens(雅可比镜头)”的新型可解释性分析工具,发现其 Claude 模型在内部形成了一个类似人类工作记忆的“J-Space”空间。该空间存储模型在输出前没有说出口的“思考”内容,且能因果性地控制模型的最终结论。基于这一发现,Anthropic 已开发出新的训练方法,显著减…

苹果机器学习研究团队发表论文指出,大型语言模型(LLM)的安全对齐机制极度脆弱——只需操控模型中的一个神经元,即可绕过安全限制,让模型输出有害内容。这一发现挑战了当前主流的安全对齐思路,即认为安全行为是大规模参数协同作用的结果。

Anthropic 在 Claude Code 中引入“模型选择”与“努力级别”两个独立设置,帮助开发者在不同任务场景下合理分配算力和成本;模型决定能力上限,努力级别控制任务执行深度。

安全公司 Blackpoint 近日披露,黑客利用生成式 AI 构建了一款名为 Avalon 的模块化恶意框架,能按需加载勒索、窃密等不同攻击组件。这是首个被公开报道的、由 AI 协助开发的、具备完整模块化架构的恶意软件框架,标志着 AI 降低了开发复杂攻击工具的门槛。

OpenAI、Anthropic 及云服务商正以价值数百万美元的免费算力和 token 额度争夺早期初创公司,尤其是 Y Combinator 孵化的企业,以此锁定开发者生态并抢占 IPO 前的市场份额。

中国AI初创公司Deepseek正着手自研AI芯片,专用于推理而非训练,目的是减少对英伟达和华为的依赖。这一动作处于早期阶段,同时也伴随公司首次向外部寻求融资,目标估值520亿至590亿美元。

中国 AI 模型在美国聚合平台 OpenRouter 上的流量占比自 2 月以来稳定超过 30%,最高达 46%,而去年平均仅为 11%。核心原因是 DeepSeek、Z.ai 等中国模型在性能接近的同时,推理成本比 OpenAI、Anthropic 低 60% 到 90%,促使部分企业客户大规模切换。

Mozilla AI 发布了一个名为 Otari 的开源 LLM 网关代理服务器,允许开发者通过一个统一入口管理和路由 40 多家模型供应商的 API 调用,同时提供密钥管理、预算控制和用量追踪功能,旨在解决多模型使用场景下的碎片化问题。

OpenAI已于2026年6月向SEC秘密提交S-1注册文件,正式启动IPO进程,但因近期市场波动,上市时间可能推迟至2027年。投资者可以通过微软、亚马逊、英伟达、软银等公开交易股东间接持股,或通过Ark Venture Fund等基金获取更集中的敞口,但每种路径都存在费率、仓位比例和不确定性风险。

智普AI在2026年7月发布AI编程工具ZCode,基于其开源模型GLM-5.2,提供类似Claude Code和OpenAI Codex的代码生成与调试能力,但使用成本大幅降低,新用户每日可获得500万token免费额度。