AMD 发布锐龙AI Max PRO 400 系列,端侧智能体走向多模型协同

AMD 9 月 10 日在北京发布锐龙 AI Max PRO 400 系列处理器,重点不在堆算力,而是用最高 128GB 统一内存(其中 96GB 可划为显存)让大模型和多个智能体尽量跑在本地设备上。

一句话看懂:AMD 9 月 10 日在北京发布锐龙 AI Max PRO 400 系列处理器,重点不在堆算力,而是用最高 128GB 统一内存(其中 96GB 可划为显存)让大模型和多个智能体尽量跑在本地设备上。

事件核心:发生了什么

此次发布的锐龙 AI Max PRO 400 系列,以锐龙 AI Max+ 395 为代表,核心卖点是统一内存架构:CPU 与 GPU 共享同一内存池,避免数据在内存和显存之间反复搬运。AMD 同时展示了 Mini PC、紧凑型工作站、笔记本、平板、一体机和 AI NAS 等终端形态。六联智能的 AXB88P-02 1L AI 工作站和 AXB35-03 2L Mini AI PC 将采用锐龙 AI Max+ PRO 495,目前公开信息显示计划于 2026 年第四季度量产。

为什么重要

端侧 AI 的瓶颈正在从“算得多快”转向“装不装得下”。参数量大的模型、长上下文 RAG 和多个智能体并发运行时,内存容量往往先于算力触顶。AMD 平台集成 CPU、GPU、NPU 三类计算单元,理论上可由 GPU 承担批量推理、NPU 处理低功耗常驻任务、CPU 负责智能体编排和工具调用,但实际效果取决于操作系统、推理框架和应用层的任务拆分能力。生态层面,星漪科技 Flowy AI PC 做统一调度,首界科技 Nova 工具链结合 ROCm 和 PyTorch 覆盖图像生成、语音识别与 OCR,“春雷计划”已覆盖投标、保险、投资、影视、医疗、教育科研等领域,形成 20 余种解决方案,“春雨计划”进入百余所高校。

对用户/开发者/创作者的影响

对开发者,本地能同时加载多个模型意味着智能体工作流不必频繁往返云端,向量数据库、RAG、权限管理可放在同一台设备上。对金融、法律、科研等敏感场景,本地运行提供了更明确的数据边界,但模型仍主要做意图理解和流程组织,量化计算与合规校验交给确定性工具完成。创作者可参考 ViPro 影视智能体的端云协同思路:脚本、素材、提示词本地处理,视频渲染按需上云。对企业采购而言,硬件门槛下降不等于部署简单,推理框架适配和整机价格仍是关键变量。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是搭载锐龙 AI Max+ PRO 495 的终端能否在 2026 年第四季度如期量产并给出有竞争力的价格;二是推理框架和异构调度能否真正把 CPU、GPU、NPU 的潜力释放出来,而不是停留在演示;三是随着新一代 RTX 产品进入市场,端侧 AI 硬件的竞争重点是否会从峰值算力和内存容量,转向能效、软件兼容性和模型运行效率。

来源:InfoQ CN

celebrityanime
celebrityanime
文章: 22847

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注