celebrityanime

celebrityanime

聊天中的AI Agents

聊天中的AI Agents

CometChat 在 ProductHunt 上推出了聚焦“聊天中的 AI Agents”的产品更新,旨在将 AI 智能体直接嵌入到即时通讯场景中,让用户能在对话中调用 AI 完成任务,而不仅仅是聊天机器人式的问答。

小红书开源 BigMac:多模态大模型训练新范式

小红书开源 BigMac:多模态大模型训练新范式

小红书技术团队开源了 BigMac,一种针对多模态大模型训练的流水并行新方案。它通过“嵌套流水线”设计,在不显著增加显存占用和计算空泡的前提下,将训练速度提升了 1.08 到 1.9 倍,解决了当前多模态模型训练中“要快就得费显存、要省显存就得慢”的两难问题。

不靠最强模型也能赢?谷歌正用一款“冷冻”芯片复制搜索时代的“全栈碾压”

不靠最强模型也能赢?谷歌正用一款“冷冻”芯片复制搜索时代的“全栈碾压”

谷歌正在设计一款代号“Frozen v2”的服务器芯片,计划将Gemini模型的部分信息固化进硬件,目标是在2028年实现比现有自研AI芯片高出6至10倍的每瓦Token效率。这并非简单的芯片迭代,而是谷歌试图通过硬件极度契合自有模型、压缩推理成本来巩固其搜索和AI产品帝国的全栈策略。