Nvidia says its Groq 3 LPX is four times faster than Cerebras, but the math is more complicated

英伟达宣布 Groq 3 LPX 推理加速卡进入全面量产,并在独立测试中跑出每秒 3400 token 的速度,号称是 Cerebras 的四倍。但考虑到实现这一成绩需要至少 64 颗芯片,而 Cerebras 只需一两颗,这场速度之争实际并不像数字看起来那么悬殊。

英伟达宣布 Groq 3 LPX 推理加速卡进入全面量产,并在独立测试中跑出每秒 3400 token 的速度,号称是 Cerebras 的四倍。但考虑到实现这一成绩需要至少 64 颗芯片,而 Cerebras 只需一两颗,这场速度之争实际并不像数字看起来那么悬殊。

高盛执行合伙人 Chris Chapman 公开警告,华尔街将推理过程外包给 AI,可能导致新一代金融从业者出现“认知萎缩”,失去从第一性原理思考问题的能力。

AI 数据中心的电力需求正在倒逼一种名为“固态变压器”的新技术加速商业化,它用半导体替代铜线圈,能直接输出数据中心所需的直流电,或将缓解电网变压器短缺和交付延误的问题。

JetBrains 的一项研究发现,重度依赖 AI 编程助手的初级开发者往往跳过关键思考步骤,产生“能力错觉”,长期看可能导致编程专业能力衰退。

NVIDIA 公布 Vera Rubin NVL72 在智能体 AI(Agentic AI)工作负载下的实测推理性能,宣称每兆瓦吞吐量最高可达 GB300 NVL72 的 30 倍,每百万 token 成本降低至 1/35。这意味着下一代 AI 工厂有望用同等电力运行更多智能体任务。

北京举行的 2026 年世界人形机器人运动会上,双足机器人在百米短跑和跳高项目中刷新了人类世界纪录,但急停失败暴露了运动控制与 AI 推理能力的短板,成为人形机器人从实验室走向实用化的关键瓶颈。

多数组织正在以“外部打补丁”的方式应对 AI 安全风险,而 AI 的决策链路是动态且连续的,传统防护手段难以覆盖运行时的真实威胁。F5 解决方案工程总监 Paul Dignan 指出,这种错位正在扩大,安全团队疲于应对漏洞,问题很快会集中爆发。

随着 AI 智能体在企业网络中自主执行任务,传统“人工审批”环节正在沦为形式化的点击动作,反而成为责任界定模糊和风险累积的温床。企业需要从“人在环中”转向“人在环上”的治理模式。

乌克兰官方称,一架由 AI 引导、具备完全自主能力的俄罗斯无人机,在扎波罗热市对一处加油站实施打击,造成三名平民死亡。这被认为是公开报道中首次出现 AI 自主决策完成致命攻击的实战案例。

乌克兰方面称,俄罗斯在自主 AI 引导的无人机中使用了英伟达 Jetson Orin 计算模块;英伟达回应称该产品在二手市场广泛流通,并非受控军用器件。此事暴露了消费级/边缘 AI 算力在冲突场景中的实际渗透,也让“AI 硬件出口管制是否有效”成为新的讨论点。