得益于 Anthropic 的新雅可比镜头,克劳德隐藏的内心独白现在可以被阅读

Anthropic 发布了名为“J-Lens(雅可比镜头)”的新型可解释性分析工具,发现其 Claude 模型在内部形成了一个类似人类工作记忆的“J-Space”空间。该空间存储模型在输出前没有说出口的“思考”内容,且能因果性地控制模型的最终结论。基于这一发现,Anthropic 已开发出新的训练方法,显著减…

Anthropic 发布了名为“J-Lens(雅可比镜头)”的新型可解释性分析工具,发现其 Claude 模型在内部形成了一个类似人类工作记忆的“J-Space”空间。该空间存储模型在输出前没有说出口的“思考”内容,且能因果性地控制模型的最终结论。基于这一发现,Anthropic 已开发出新的训练方法,显著减…

苹果机器学习研究团队发表论文指出,大型语言模型(LLM)的安全对齐机制极度脆弱——只需操控模型中的一个神经元,即可绕过安全限制,让模型输出有害内容。这一发现挑战了当前主流的安全对齐思路,即认为安全行为是大规模参数协同作用的结果。

GitHub 宣布其 Copilot 桌面应用程序正式对所有计划用户(包括免费版和教育版)开放,支持 macOS、Windows 和 Linux,并首次允许用户自带模型密钥(BYOK)独立使用,彻底降低了 AI 辅助编程的入门门槛。
![[问与答] 有没有什么 vcc 虚拟卡推荐,用于充值 openai 的 apikey](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_4-172-768x403.jpg)
V2EX 社区用户正在寻求可充值 OpenAI API Key 的虚拟信用卡推荐,核心诉求是支持支付宝支付,这反映出开发者在 AI 工具使用中对跨境支付便利性的直接需求。

安全公司 Blackpoint 近日披露,黑客利用生成式 AI 构建了一款名为 Avalon 的模块化恶意框架,能按需加载勒索、窃密等不同攻击组件。这是首个被公开报道的、由 AI 协助开发的、具备完整模块化架构的恶意软件框架,标志着 AI 降低了开发复杂攻击工具的门槛。

由前 OpenAI 研究员利奥波德·阿申布伦纳管理的对冲基金 Situational Awareness,与 Baillie Gifford 等机构一起,可能在 SK 海力士本周进行的 280 亿美元美国 IPO(增发 ADS)中认购大量份额。这意味着全球顶级 AI 算力硬件——HBM 存储芯片的龙头公司,正…

前华为天才少年、AI Infra 专家李博杰在朋友圈公开批评 DeepSeek 面试流程拖沓、面试官态度轻佻且质疑其作弊,引发行业对其招聘管理和扩张节奏的讨论。事件暴露了 DeepSeek 在快速扩张期的人力流程短板,但其严格的筛选标准(如非清北本科不录)也反映了基座模型公司对人才的高门槛要求。

2026年世界杯期间,一段由AI生成的挪威前锋哈兰德在餐厅吃饭的假视频在X平台获得超过3100万次观看,即便已被核实为AI伪造内容,仍被大量球迷主动传播。这揭示了体育明星从“形象管控”到“开源角色”的转变,AI生成内容正在变成粉丝文化的新载体。

北京智源人工智能研究院发布世界模型“悟界·RoboBrain Orca”,通过无意识与有意识两条路径学习世界规律,将视觉、语言、动作统一到一个潜在表征空间中,为通用世界基础模型奠定基础。

OpenAI 于2026年7月发布 GPT-Realtime-2.1 及轻量级版本 GPT-Realtime-2.1-mini,专为实时语音交互场景优化,旨在通过 API 直接支持低延迟的语音代理(Voice Agent)应用。这标志着 OpenAI 在实时多模态对话领域的模型迭代进入新阶段。