NVIDIA Personal AI Router 将 AI 任务分配到本地计算资源上

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。
先解决问题,再了解资讯。选择你现在要完成的任务。

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。

当 llama-server 以 router 模式启动并从 preset.ini 加载模型时,如果模型的 model 路径字段被双引号包裹,会导致加载失败,而同一模型用命令行单独启动却正常。优先检查 preset.ini 里的路径是否带了多余引号。

这个报错通常出现在 Linux 下用 CUDA 后端编译 llama.cpp 的时候,触发点是 ggml/src/ggml-cuda/fattn.cu 里 flash attention 的 MMA 模板实例化失败,导致整个编译中断在 96 个错误。最优先排查的是你当前 checkout 的 com

华为云码道 CodeArts 在 9 月 21 日为鸿蒙开发者上线鸿蒙编码大模型、码道鸿蒙智能体和鸿蒙开发实践中心,把模型、工具链和云端开发环境打包进同一条研发流程。这意味着鸿蒙开发正从“能不能做”转向“做得快不快、准不准”。

阶跃星辰发布新旗舰 Step 5 Preview,在 Artificial Analysis 智能指数上拿到 44 分,追平 Kimi K3(max),但每个任务成本只有后者的约 1/2.8。这意味着中端价格带开始出现接近顶级推理能力的模型,但它在智能体(Agent)类评测上明显落后。

韩国 AI 芯片公司 FuriosaAI 公布了第三代推理加速器的技术细节,算力和内存带宽都做到上一代的 32 倍,并与博通合作采用 2nm 计算芯片加 HBM4(E) 内存。它代表推理专用芯片正在向更高带宽、更大内存的方向加速演进。

阿里平头哥在 2026 云栖大会发布自研 AI 芯片真武 V900,算力达到上一代 M890 的三倍,单集群可扩展至 50 万卡,同时 M890 AI 超节点已支持 2 万亿参数大模型推理并上线阿里云数据中心。

阿里巴巴已任命资深 AI 研究员刘大一恒出任 Qwen(通义千问)大模型项目负责人,这一安排在本年度多轮组织调整后进一步明确了通义千问团队的管理归属。

在 2026 年杭州云栖大会上,阿里宣布正在筹备 5 万亿至 10 万亿参数的新一代大模型,同时发布自研 AI 芯片真武 V900,算力达到前代 M890 的三倍,并计划到 2032 年把全球数据中心总容量扩至 20 吉瓦以上。

苹果零售业务早期负责人 Ron Johnson 公开质疑 AI 代理购物的可行性,认为消费者不会把上千美元的购买决策完全交给机器;与此同时,Google 和 OpenAI 正在加速把 AI 变成购物入口,这场分歧关系到代理电商究竟能走多远。