NVIDIA Personal AI Router 将 AI 任务分配到本地计算资源上

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。

NVIDIA 推出 Personal AI Router(PAIR)测试版,可把本地网络中多台机器的推理能力整合起来,自动分配 AI 请求,缓解单个 GPU 在多代理负载下的瓶颈。

华为云码道 CodeArts 在 9 月 21 日为鸿蒙开发者上线鸿蒙编码大模型、码道鸿蒙智能体和鸿蒙开发实践中心,把模型、工具链和云端开发环境打包进同一条研发流程。这意味着鸿蒙开发正从“能不能做”转向“做得快不快、准不准”。

阶跃星辰发布新旗舰 Step 5 Preview,在 Artificial Analysis 智能指数上拿到 44 分,追平 Kimi K3(max),但每个任务成本只有后者的约 1/2.8。这意味着中端价格带开始出现接近顶级推理能力的模型,但它在智能体(Agent)类评测上明显落后。

韩国 AI 芯片公司 FuriosaAI 公布了第三代推理加速器的技术细节,算力和内存带宽都做到上一代的 32 倍,并与博通合作采用 2nm 计算芯片加 HBM4(E) 内存。它代表推理专用芯片正在向更高带宽、更大内存的方向加速演进。

阿里平头哥在 2026 云栖大会发布自研 AI 芯片真武 V900,算力达到上一代 M890 的三倍,单集群可扩展至 50 万卡,同时 M890 AI 超节点已支持 2 万亿参数大模型推理并上线阿里云数据中心。

阿里巴巴已任命资深 AI 研究员刘大一恒出任 Qwen(通义千问)大模型项目负责人,这一安排在本年度多轮组织调整后进一步明确了通义千问团队的管理归属。

在 2026 年杭州云栖大会上,阿里宣布正在筹备 5 万亿至 10 万亿参数的新一代大模型,同时发布自研 AI 芯片真武 V900,算力达到前代 M890 的三倍,并计划到 2032 年把全球数据中心总容量扩至 20 吉瓦以上。

苹果零售业务早期负责人 Ron Johnson 公开质疑 AI 代理购物的可行性,认为消费者不会把上千美元的购买决策完全交给机器;与此同时,Google 和 OpenAI 正在加速把 AI 变成购物入口,这场分歧关系到代理电商究竟能走多远。

腾讯混元发布 Image 3.5 预览版(Hy Image3.5preview),在文字渲染、排版和多图编辑上做了一次集中升级,同时把 2K 图像的 API 价格压到 0.15 元一张,主打“便宜好用”。

纯 Go 语言 Agent 框架 covonaut 发布 v1.1.4,带来滚动并行池调度、文本/图像/PDF/Notebook/视频五路多模态读取,以及删除文件统一进系统回收站的安全机制,老用户无需改动接口代码即可升级。