MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议

Meta 正式发布专为 AI 训练和推理场景设计的全新 RDMA 传输协议 MetaRoCE,并将其规范、参考实现和测试套件通过 OCP 开源。这套协议不再依赖交换机的无损保障,而是把重排序、路径选择等智能全部下沉到网卡,试图解决百万 GPU 规模下以太网集群的传输瓶颈。

Meta 正式发布专为 AI 训练和推理场景设计的全新 RDMA 传输协议 MetaRoCE,并将其规范、参考实现和测试套件通过 OCP 开源。这套协议不再依赖交换机的无损保障,而是把重排序、路径选择等智能全部下沉到网卡,试图解决百万 GPU 规模下以太网集群的传输瓶颈。

科技顾问 Monty McCoy 在 The Next Web 发文指出,AI 取代工作并非最值得担心的问题,真正的风险在于当自动化移除日常“琐事风暴”后,人们能否建立新的意义来源。如果做不到,社会可能被娱乐、愤怒和分裂填满,而非创意与联结。

安全研究者提出,恶意大模型有可能通过构造特殊 token 序列,利用 vLLM、SGLang 等推理引擎的解析漏洞,在加载其权重的宿主机上执行任意代码。这相当于把“模型输出”从数据变成了攻击指令,威胁的是 AI 算力基础设施本身。

AMD 宣布其机架级 AI 系统能效已比 2024 年基线提升约 4 倍,超过原定 3 倍的阶段目标。这意味着到 2030 年,同样的电力可以支撑 20 倍的 AI 计算量,但行业总耗电量未必会下降。

Hacker News 上有讨论声称大模型可能利用推理引擎漏洞控制宿主机,但多位技术人员指出该说法在技术细节上站不住脚,尤其在多 GPU 集群架构下,攻击路径和动机都缺乏可信解释。

Y Combinator 创始人 Paul Graham 在 X 上表示,如果自己 17 岁,会从零开始学习构建大语言模型(LLM),并用能获得的算力训练尽可能强的模型。这条推文引发 Meta 首席 AI 科学家 Yann LeCun 的回应,背后是关于 AI 人才成长路径和技术路线选择的讨论。

小鹏旗下人形机器人 IRON 获得实体 AI(Physical AI)领域创纪录融资,反映出资本正从纯软件大模型加速流向具身智能与机器人赛道。

内蒙古呼和浩特签约12个绿色算力项目,总额约270亿美元,并启动中国AI服务出海平台建设。这是“东数西算”政策下,中国将西部绿电与东部AI产业需求对接、并试图将算力资源输出为全球服务的关键一步。

越来越多普通用户开始用 LLM 撰写政府福利申请材料,导致公共服务系统需要同时处理大量由 AI 生成的高质量申请与对抗性材料,行政成本和社会公平问题正在浮出水面。

英国成为首个获得乌克兰实战战斗数据访问权限的外国,这些数据将用于训练 AI 模型以识别和打击俄罗斯目标。此举将军事 AI 从实验室推向了真实战场的验证阶段,也标志着 AI 军事合作从技术共享升级为数据共享。