Nvidia 开放权重模型 Nemotron 3.5 Lightning 优先速度而非极致智能

英伟达发布开放权重模型 Nemotron 3.5 Lightning,用不到同级模型四分之一的活跃参数,在智能基准上与 OpenAI 的 gpt-oss-120b 打平,同时跑出同类最快的推理速度——这是在算力成本压力下,大模型竞赛从“拼参数”转向“拼效率”的又一个信号。

英伟达发布开放权重模型 Nemotron 3.5 Lightning,用不到同级模型四分之一的活跃参数,在智能基准上与 OpenAI 的 gpt-oss-120b 打平,同时跑出同类最快的推理速度——这是在算力成本压力下,大模型竞赛从“拼参数”转向“拼效率”的又一个信号。

GitHub在2026年8月11日为Copilot的AI使用报告新增了按模型拆分的token用量明细,用户可以精确查看每个模型消耗的输入、输出、缓存读取和缓存写入token,以及对应的AI积分(AI credits)。这是AI编程工具在费用透明度方面一次非常务实的改进。

一款在人类眼中完全正常的字体,却能让 AI 视觉模型在识别时出现明显混乱。它虽然不改变人类阅读体验,却可能让 OCR 系统、多模态大模型“看错字”,折射出当前 AI 视觉理解能力的脆弱边界。

TechRadar 刊文提出判断 AI 技术栈控制权的五个问题。核心观点是:一家公司能下载模型、在自己的云上运行,并不等于真正掌控 AI 系统;从模型来源、依赖组件到法律合同和退出机制,每一步都需要可验证的能力,否则所谓“自主可控”只是假设。

由前 DeepMind、Apple、OpenAI 和 Meta 员工创立的 AI 公司 Trajectory,完成 4000 万美元融资,估值达 3 亿美元,专注“持续学习”模型方向。值得注意的是,这并非又一家做大模型的明星创业公司,而是瞄准了当前 AI 模型“训练完就固定”的短板。

OpenAI伦理主管Chloé Bakalar离职,引发关于AI公司内部伦理角色是否只是“安全公关”的讨论。HN用户认为,OpenAI与Anthropic将AI描述为“可能带来无限危害或收益的独特技术”,伦理团队的实际约束力存疑。

安全研究者展示了一种针对专有大语言模型 API 的攻击思路:通过精心构造的查询,可以诱导模型暴露内部推理轨迹,从而在未接触权重的前提下,低成本获取闭源模型最核心的“思考过程”。

安全研究机构 A Security 用不到 20 条公开 AI 模型提示,发现并复现了 Zoom 的严重漏洞,可让攻击者远程接管会议中所有设备。Zoom 已于周二发布修复补丁,这件事真正值得关注的是:AI 正在把“国家级”漏洞挖掘能力交到个人研究者手里。

英伟达被曝正在开发新一代开源大模型 Nemotron 4,最大版本预计拥有至少一万亿参数,目标直指全球顶级开源模型。这不仅是模型竞赛,也是英伟达用开放生态拉动其 GPU 算力需求的关键布局。

Spotify 推出 AI Persona 标签,用于区分真实艺术家与 AI 伪造或虚拟的创作者身份,目标是提升平台可信度;但该机制针对的是“人设与身份”而非音频内容本身。