一句话看懂:小米发布了一款本地 AI 主机,搭载自研的 O3、O100 和 D100 三款芯片,支持 120B 和 3B 双模型运行,并可在快慢系统间切换。这是小米在端侧算力与本地化大模型部署上一次具体落地。
事件核心:发生了什么
据 @op7418 在 X 平台发布的信息,小米于 2026 年 8 月 24 日推出了一款面向本地部署的 AI 主机。该主机的核心是三款小米自研芯片:O3、O100 和 D100。其中,O3 与 O100 负责推理计算,D100 则可能承担数据调度或辅助处理的职责。
在模型支持层面,这款主机可以同时运行参数规模为 120B(约 1200 亿参数)和 3B(约 30 亿参数)的双模型。这种“大模型+小模型”的组合,配合所谓“快慢系统的切换”,意味着设备能在高精度复杂任务与低延迟简单响应之间动态调配算力资源。目前公开信息显示,该产品定位为本地 AI 主机,尚未公布具体售价、上市时间或消费级与开发者级的具体区分。
为什么重要
这一动作的关键不在于“发了一款硬件”,而在于小米将 AI 计算的核心环节——芯片、模型调度与本地推理——收拢到自己的体系内。通过自研芯片结合双模型切换机制,小米试图在端侧或半端侧场景中提供一种不依赖云端的高可控性算力方案。
从行业竞争格局看,这标志着国内头部硬件厂商在 AI 推理层的布局从“接入大模型 API”向“自研算力底座”延伸。120B 级别的本地模型支持意味着许多中小型 AI 应用、私有化部署需求无需依赖大规模云端集群即可完成推理,这将对现有的云算力租赁和 API 调用模式构成潜在的替代性选择。同时,双模型与快慢切换的设计路径,也为端侧 AI 的功耗和性能平衡提供了一种新的工程解法。
对用户/开发者/创作者的影响
对企业用户和开发者而言,这款主机提供了一个将数据保留在本地的 AI 推理环境,适合对数据隐私要求较高的场景,例如企业内部知识库处理、合规审查或涉密内容的本地分析。120B 模型在本地运行后,开发者可以将其视为一台专属的 AI 推理服务器,减少对云端 API 的依赖,并规避按量计费带来的成本不确定性。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对普通用户或内容创作者来说,快慢系统的切换意味着日常轻量交互(如语音助手、简单问答)由 3B 小模型快速响应,而复杂创作任务(如长文生成、图像生成或深度分析)则会自动切换到 120B 大模型。不过,本地主机的形态决定了它更偏向固定场景使用,不会替代手机或轻量移动设备上的 AI 功能,而是承担更强的算力输出角色。
值得关注的后续
1. 产品落地时间与价格区间:目前官方尚未公布上市节奏,若定价贴近工作站而非服务器级别,将直接影响中小团队的采购决策。
2. 自研芯片的开放程度:O3、O100 和 D100 是否会对外开放给第三方硬件厂商,决定了小米能否借此构建更广泛的生态,而非仅作为单一产品存在。
3. 竞品的跟进路径:在本地大模型推理赛道,小米这套“双芯片+双模型+快慢切换”方案能否形成示范效应,值得观察其他硬件厂商是否会推出类似架构的产品,以及开源社区对此类硬件的适配速度。
来源:@op7418


