
一句话看懂:创业公司 Acrab 于 2026 年 7 月 23 日发布了其首款边缘 AI 系统级芯片(SoC)GΞLIX 1,采用 5nm 制程,在单芯片上提供 650TOPS 的 AI 算力,目标是让高达 1000 亿参数的大模型实现在本地设备上运行,无需将数据上传至云端。这一算力水平大幅超越了当前主流移动和 PC 平台的 NPU,标志着边缘 AI 推理在性能上迈出了实质性的一步。
事件核心:发生了什么
Acrab 公司正式推出 GΞLIX 1 芯片,这是一款面向边缘终端的异构计算 SoC。硬件上,它集成了 20 核 Arm CPU、3TFLOPS GPU、专用 NPU 以及音视频处理引擎,整体 AI 算力达到 650TOPS。这一数字是当前主流竞品(如高通骁龙 X Elite 的约 45TOPS、英特尔酷睿 Ultra 系列的约 40TOPS)的近十倍。为了支持大模型推理对内存带宽的高需求,该芯片配备了 8MB L1 缓存、带宽达 768GB/s 的 L2 缓存,并连接 256 位宽、速率为 8533MT/s 的 LPDDR5X 内存。Acrab 特别强调了芯片在模型预填充(Prefilling)阶段的性能表现——该阶段决定了长文本输入的首 Token 延迟。在官方测试中,GΞLIX 1 在 Gemma 26B A4B 配置下,以 40K KV Cache 和 10K Token 输入,达到了 1416.8 Token/s,速度是 Apple M4 Pro Mac Mini 的 7.5 倍。软件层面,Acrab 同步发布了完整软件栈和智能体参考设计,并展示了首款终端设备 Agent Box,供开发者评估和原型验证。
为什么重要
这项发布的意义在于直接挑战了“大模型必须依赖云端算力”的既有范式。GΞLIX 1 将 650TOPS 的算力压缩到一颗 5nm 芯片内,并针对大模型推理中的内存带宽瓶颈(如权重读取和 KV Cache 访问)做了专门优化,使得在本地运行 100B 参数模型成为可能。这不仅减少了对云服务的依赖、降低了用户的数据隐私风险,也意味着高智能的 AI 助理、实时内容生成等应用可以脱离网络延迟和连接限制,在手机、PC、机器人等边缘设备上稳定运行。对于 AI 芯片行业而言,Acrab 提供的是一种“专用大模型推理芯片”的差异化方案,直接对标了高通、英特尔等通用平台上的 NPU 性能。
对用户/开发者/创作者的影响
对于普通用户,未来可能体验到无需联网就能运行复杂大模型应用的设备,例如本地语音助手、实时图像生成或高级文本编辑助手,隐私保护和响应速度都会显著提升。对于开发者而言,Acrab 发布的完整软件栈和 Agent Box 参考设计降低了适配门槛,可以基于此快速开发针对特定场景的 AI 应用,而不必自行优化底层推理引擎。对于内容创作者,本地运行大模型意味着可以在无网络环境下进行高效的文本生成、代码辅助或图像处理,创作工具的可用性和稳定性会增强。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
首先,GΞLIX 1 何时进入量产阶段、首批搭载该芯片的消费级产品何时上市,将决定其技术参数能否真正落地。其次,Acrab 能否吸引足够多的软件生态合作伙伴、提供易于上手的开发工具链,并保持对主流大模型格式的兼容性,是开发者社区是否愿意跟进的关键。最后,高通、苹果、英特尔等现有平台是否会针对大模型推理需求,在下一代芯片中显著提升 NPU 算力和缓存带宽以应对竞争,也是行业格局演变的重要观察点。目前公开信息显示,Acrab 的客户与应用场景仍处于验证阶段。
来源:AIbase


