NVIDIA Vera CPU 提高 AI 工厂吞吐量以加速代理工作负载

NVIDIA 发布了新一代 Vera CPU,通过提升单核性能 1.8 倍,解决 AI 代理和强化学习场景中 CPU 成为 GPU 算力瓶颈的问题,直接加速模型训练与用户响应速度。

NVIDIA 发布了新一代 Vera CPU,通过提升单核性能 1.8 倍,解决 AI 代理和强化学习场景中 CPU 成为 GPU 算力瓶颈的问题,直接加速模型训练与用户响应速度。

Anthropic 发布了名为“J-Lens(雅可比镜头)”的新型可解释性分析工具,发现其 Claude 模型在内部形成了一个类似人类工作记忆的“J-Space”空间。该空间存储模型在输出前没有说出口的“思考”内容,且能因果性地控制模型的最终结论。基于这一发现,Anthropic 已开发出新的训练方法,显著减…

苹果机器学习研究团队发表论文指出,大型语言模型(LLM)的安全对齐机制极度脆弱——只需操控模型中的一个神经元,即可绕过安全限制,让模型输出有害内容。这一发现挑战了当前主流的安全对齐思路,即认为安全行为是大规模参数协同作用的结果。

沃顿商学院教授 Ethan Mollick 引用路透社独家报道,认为中国可能限制顶级 AI 模型出海,并据此判断前沿开放权重模型的持续供应将面临挑战,开发者需为开源生态的收紧做好准备。

Anthropic 在 Claude Code 中引入“模型选择”与“努力级别”两个独立设置,帮助开发者在不同任务场景下合理分配算力和成本;模型决定能力上限,努力级别控制任务执行深度。

DAIR.AI 创始人 Elvis Saravia 提出了一种结合“人在回路”(HITL)与第三方 MCP 服务器 DialAgent 的方法,让 AI Agent 在自动化循环遭遇瓶颈时,能通过电话直接向开发者请求决策,从而显著提升复杂工作流的可靠性。

据最新消息,中国政府正计划限制国外用户访问其最先进的AI模型,包括尚未发布的闭源模型与开放权重的系统。这一信号意味着全球AI市场可能将按国籍分裂:未来的顶尖中国模型将仅供国内使用,海外开发者与企业将无法获取低成本、高性能的中国AI模型。

GitHub 宣布将于 2026 年 8 月 3 日停用 Copilot Billing Preview 应用,原因是其账单设置已内置更完善的用量管理功能。用户需要提前迁移到原生账单界面,否则将无法通过该应用查看 Copilot 消费。

GitHub 宣布其 Copilot 桌面应用程序正式对所有计划用户(包括免费版和教育版)开放,支持 macOS、Windows 和 Linux,并首次允许用户自带模型密钥(BYOK)独立使用,彻底降低了 AI 辅助编程的入门门槛。

在2026年微软Build大会上,微软宣布Hugging Face的开源模型已入驻Microsoft Foundry平台的托管计算服务,用户可一键部署超过300万个模型,享受企业级安全与治理,且模型权重预置在Azure上,每周刷新。