NVIDIA Personal AI Router 将 AI 任务分配到本地计算资源上

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。

韩国 AI 芯片公司 FuriosaAI 公布了第三代推理加速器的技术细节,算力和内存带宽都做到上一代的 32 倍,并与博通合作采用 2nm 计算芯片加 HBM4(E) 内存。它代表推理专用芯片正在向更高带宽、更大内存的方向加速演进。

阿里平头哥在 2026 云栖大会发布自研 AI 芯片真武 V900,算力达到上一代 M890 的三倍,单集群可扩展至 50 万卡,同时 M890 AI 超节点已支持 2 万亿参数大模型推理并上线阿里云数据中心。

阿里巴巴已任命资深 AI 研究员刘大一恒出任 Qwen(通义千问)大模型项目负责人,这一安排在本年度多轮组织调整后进一步明确了通义千问团队的管理归属。

在 2026 年杭州云栖大会上,阿里宣布正在筹备 5 万亿至 10 万亿参数的新一代大模型,同时发布自研 AI 芯片真武 V900,算力达到前代 M890 的三倍,并计划到 2032 年把全球数据中心总容量扩至 20 吉瓦以上。

据报道,高瓴创投(H Capital)合伙人严文韬已于 9 月 21 日加入 DeepSeek 出任 CFO,补上了公司成立三年来一直空缺的财务负责人岗位,而这一任命恰好发生在 DeepSeek 第二轮融资接近完成的时间窗口。

小米在 9 月 22 日正式发布并开源原生多模态模型 MiMo-V2.6 系列(Pro/Flash),Pro 版在 Artificial Analysis 综合智能指数拿到 46 分,超过 Kimi K3 和 Qwen3.8Max,成为当前最强开源模型,同时把大规模强化学习的训练路径和成本一并公开。

上海AI Lab与上海交大LUMIA Lab提出"下一概念预测"(NCP)预训练任务,发布8.9B参数的离散隐空间基座模型NCP-ArchPreview,用约一半Token预算追平OLMo-3-7B的预训练Loss,收敛速度提升1.95倍。

SpaceXAI 于 9 月 21 日发布 Grok 4.7,官方称推理速度达到同类模型的两倍,价格降至竞争对手的一半,输入每百万 Token 仅 2 美元。速度与成本同时下探,直接冲击当前大模型 API 的性价比基准。

在 2026 云栖大会上,阿里宣布下一代架构的 Qwen4 已进入训练,并公开了向 5000 亿至 1 万亿参数、乃至 10 万亿参数演进的路线图,同时披露大模型递归自我改进(RSI)已落地到训练、推理和芯片协同环节。