借助NVIDIA Vera CPU解决Agentic AI集群挑战

NVIDIA 基于超过 16 万次真实 Agentic AI 会话的遥测数据,提出用一颗平衡设计的 Vera CPU 应对 AI 工厂中智能体工作负载的高度不确定性,而不是靠多款专用芯片拼凑集群。

NVIDIA 基于超过 16 万次真实 Agentic AI 会话的遥测数据,提出用一颗平衡设计的 Vera CPU 应对 AI 工厂中智能体工作负载的高度不确定性,而不是靠多款专用芯片拼凑集群。

NVIDIA 发布 Vera Rubin NVL72 的 AgentX 基准测试预览结果,宣称其在智能体 AI 推理场景下每兆瓦 AI 工厂吞吐量比上一代 GB300 NVL72 高出最高 30 倍,同时 Blackwell GB300 NVL72 也保持了对前代产品数量级的能效优势。

Google Gemini 应用在 iPhone 上的完整功能演示显示,它已从单纯的聊天机器人升级为能处理语音、图像识别、实时问答的日常 AI 助手。更重要的是,这意味着 Google 正在绕过传统的搜索引擎入口,把大模型服务直接铺到苹果用户的手上。

亚马逊被指控在未经许可的情况下,使用 Twitch 主播的直播视频训练自家 AI 模型,目前正面临集体诉讼。这起案件直接把“平台用户生成内容是否可以被默认用于 AI 训练”这一行业灰色地带推到了法律聚光灯下。

一家名为 Corkmac 的独立开发团队公开声明“任何情况下都不使用 AI”,并称 AI 行业是“拉地毯骗局”的早期阶段,这一立场在 Hacker News 上引发讨论,折射出开发者群体中对 AI 依赖性的深层疑虑。

TechRadar 发文指出,企业 AI 项目大量失败并非模型能力不足,而是因为输入数据碎片化、格式混乱且缺乏统一逻辑。信息越多不一定决策越好,行业正从追求数据规模转向重视上下文理解与跨系统整合。

TIME 杂志撰文指出,硅谷核心人物对 AI 的终极设想——从奥特曼的“世界末日论”到马斯克的“星际移民保险”,本质上是一种新的“末世论”。理解这套信仰,是看懂巨头们敢在算力、模型和监管上豪赌、且对注意力流失无动于衷的关键。

美国商学院正在密集开设“首席AI官(Chief AI Officer)”相关课程,试图为这一新兴高管岗位提前培养人才,尽管企业对这一职位的职责边界仍在探索之中。

The New York Times 报道了一起无人机攻击事件,称该无人机在完全由 AI 操控的模式下执行任务并造成三名乌克兰人死亡。此事首次让“致命性自主武器系统”从技术讨论变成有明确伤亡记录的现实案例,引发对 AI 作战伦理与监管的强烈关注。

中国台湾地区检方近日起诉了九名涉嫌违规向中国大陆出口高端AI服务器的人员,其中包括英伟达和超微(Super Micro)员工。这起案件表明,即便美国已放宽部分旧款AI芯片的限制,出口管制在实际执行层面依然存在严重漏洞和风险。