英伟达想包揽AI数据中心里的所有芯片

英伟达在本周高调发布新一代Vera Rubin芯片系统,不仅升级GPU,还首次将自研CPU作为独立产品力推,意图从AI算力提供商转型为数据中心全栈芯片供应商。这标志着AI行业对“智能体”系统需求激增,正在改变服务器内部的芯片分工格局。

英伟达在本周高调发布新一代Vera Rubin芯片系统,不仅升级GPU,还首次将自研CPU作为独立产品力推,意图从AI算力提供商转型为数据中心全栈芯片供应商。这标志着AI行业对“智能体”系统需求激增,正在改变服务器内部的芯片分工格局。

NVIDIA 发布了 Vera CPU 的技术细节,其核心“Olympus”专为 Agentic AI 工作负载设计。与通用云 CPU 不同,它追求极致的单线程性能与可预测的低延迟,以应对大模型执行工具调用、代码解释等复杂任务时对CPU性能提出的新要求。

NVIDIA 正式发布 Rubin GPU 架构,这是专为“代理型 AI(Agentic AI)”设计的下一代数据中心 GPU,能效比当前 Blackwell 架构提升 10 倍,目标是解决多步推理、长上下文和工具调用带来的大规模算力瓶颈。

网络安全公司 CrowdStrike 发现了一款专门攻击 AI 软件供应链的蠕虫病毒,它能伪装成正常的 AI 编码工具行为,在受害者无法察觉的“盲区”中窃取凭证、破坏系统。这表明针对 AI 开发流程的新型攻击正在成为一类明确的威胁。

百时美施贵宝(Bristol Myers Squibb, BMS)正在采购 Nvidia 的专用 AI 硬件和软件,以加速药物发现和分子设计,这是制药巨头在 AI 算力投资上的最新案例。此举表明,大药企正在从“试用 AI 工具”转向“部署 AI 基础设施”。

生成式AI驱动的信息流正在将用户注意力转变为“老虎机式”的随机奖励循环,破坏深度工作能力。这一效应揭示了AI产品设计中的注意力经济学陷阱,以及个人与组织如何应对这种认知侵蚀。

谷歌于7月21日发布Gemini 3.5 Flash Cyber,一款面向网络安全领域、成本更低且速度更快的AI模型,直接对标Anthropic旗下昂贵的Mythos系列,并已集成至其安全编码代理CodeMender中。

微软与法国AI独角兽Mistral签署了一项价值数十亿美元的合作协议,计划在欧洲大规模扩建AI算力基础设施。微软将使用Mistral新增的数千块英伟达Vera Rubin GPU算力,Mistral的最新模型则被集成到微软云服务中,面向金融、医疗、制造等监管严格的行业销售。

阿里巴巴 Qwen 团队于 7 月 21 日发布 Qwen-Image-3.0,该模型可在单次生成中输出包含多面板信息图、可读十像素小字、数学公式和十二种语言的复杂图像,直接服务于报纸排版、考试试卷等实用场景,但目前仅通过邀请制 API 开放。

谷歌推出Gemini 3.6 Flash模型,重点优化企业级AI代理(Agent)在高频调用场景下的token消耗成本,试图以更低推理成本吸引企业客户从OpenAI等竞品迁移。