极摩客EVO-X5 Pro迷你主机亮相,192GB内存支持本地流畅运行300B大模型

极摩客在 IFA 2026 发布 EVO-X5 Pro 迷你主机,最高 192GB 统一内存中可分配 160GB 作显存,现场用 Qwen 模型跑出每秒几十个 token,让 300B 级大模型在本地推理成为可能。

一句话看懂:极摩客在 IFA 2026 发布 EVO-X5 Pro 迷你主机,最高 192GB 统一内存中可分配 160GB 作显存,现场用 Qwen 模型跑出每秒几十个 token,让 300B 级大模型在本地推理成为可能。

事件核心:发生了什么

硬件品牌极摩客(E-MoKe)在 IFA 2026 展会上发布旗舰迷你主机 EVO-X5 Pro。核心配置为 AMD Ryzen AI Max+ PRO 495 处理器,Zen5 架构,16 核 32 线程,最高加速频率 5.2GHz;集成 RDNA3.5 架构的 Radeon 8065S 核显,40 个计算单元;另有 XDNA2 架构 NPU,提供 55TOPS 算力,整机总算力达 131TOPS。内存是这台机器最突出的部分:最高 192GB LPDDR5X-8533 统一内存,带宽 273GB/s,其中最多 160GB 可动态划给 GPU 当显存使用。由于 CPU 与核显共享同一物理内存,省去了传统架构的数据搬运开销。官方现场用 Qwen3.8-Flash-Next 模型演示,输出速度达到每秒几十个 token。接口方面提供 2 个前置 USB4、2 个后置 USB4V2,可外接显卡坞或组建分布式集群,另配双 10Gbps 网口。目前仅规划 192GB 顶配版本,预计 2026 年 10 月上市,价格未公布。

为什么重要

长期以来,本地运行大模型的瓶颈不在 CPU 算力,而在显存容量与带宽。300B 参数级模型即使做量化,也需要远超消费级显卡 24GB—48GB 的显存空间,普通用户只能依赖云端 API。EVO-X5 Pro 的思路是把统一内存做大,让核显直接访问 160GB 内存池,这是一条与“堆独显”不同的技术路线。它意味着在桌面级设备上做中等规模、低并发的私有推理成为现实。不过也要看到,这是一种权衡:统一内存带宽(273GB/s)仍明显低于高端独显,单次推理速度和并发能力有限。目前公开信息显示,这类产品更适合个人开发者、小团队做本地验证和隐私敏感场景,而不是替代云端的规模化推理。

对用户/开发者/创作者的影响

对开发者,192GB 统一内存加 USB4V2 扩展,让本地跑量化后的大模型、做微调实验或多机分布式推理都有了硬件基础,不必再为显存不足频繁切分模型。对创作者,如果能在本地流畅跑通图像生成、语音转写或长上下文文本处理,就可以避免把敏感素材上传到云端 API。但需要提醒的是,官方演示的是 300B 级模型的流畅交互,未披露具体量化精度、上下文长度和并发数,实际体验可能因模型和任务类型差异较大。定价将直接决定这类设备是极客玩具还是可规模采购的生产力工具。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一,10 月上市时的实际定价和 192GB 版本是否真能按计划交付;第二,第三方实测中 300B 模型的量化方案、token 速度和长上下文表现是否与现场演示一致;第三,AMD Strix Halo 及后续平台、英特尔和苹果是否会跟进类似的大统一内存方案,推动本地大模型推理的硬件竞争。

来源:AIbase

celebrityanime
celebrityanime
文章: 22839

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注