分类: AI 资讯

小红书开源 BigMac:多模态大模型训练新范式

小红书开源 BigMac:多模态大模型训练新范式

小红书技术团队开源了 BigMac,一种针对多模态大模型训练的流水并行新方案。它通过“嵌套流水线”设计,在不显著增加显存占用和计算空泡的前提下,将训练速度提升了 1.08 到 1.9 倍,解决了当前多模态模型训练中“要快就得费显存、要省显存就得慢”的两难问题。

不靠最强模型也能赢?谷歌正用一款“冷冻”芯片复制搜索时代的“全栈碾压”

不靠最强模型也能赢?谷歌正用一款“冷冻”芯片复制搜索时代的“全栈碾压”

谷歌正在设计一款代号“Frozen v2”的服务器芯片,计划将Gemini模型的部分信息固化进硬件,目标是在2028年实现比现有自研AI芯片高出6至10倍的每瓦Token效率。这并非简单的芯片迭代,而是谷歌试图通过硬件极度契合自有模型、压缩推理成本来巩固其搜索和AI产品帝国的全栈策略。

看起来一夜之间,我们从OpenAI vs. Anthropic变成了地缘政治。又或许从一开始就是地缘政治。

看起来一夜之间,我们从OpenAI vs. Anthropic变成了地缘政治。又或许从一开始就是地缘政治。

AI 行业长期的商业竞争叙事,正在被地缘政治框架所取代。Peter Yang 在 X 上的一则简短观察,折射出 AI 圈对格局变化的集体感知:过去用户关注的是模型能力、定价、开源 vs 闭源,而现在讨论焦点正迅速转向芯片出口管制、主权 AI 投资、跨境数据规则与国家安全审查。