一句话看懂:一款代号 Ox Alpha 的神秘中国大模型正在 OpenRouter 和 OpenCode 上匿名内测,具备 100 万上下文窗口和原生多模态能力,且承诺测试期间零数据保留。社区根据 Tokenizer 指纹和行为特征,正猜测它来自小米 MiMo 系列或智谱 GLM 家族。
事件核心:发生了什么
8 月 21 日,OpenRouter 官方账号发布消息,宣布一款名为 Ox Alpha 的“隐身模型”上线匿名测试,定位为“面向高效编码、持续 Agent 任务和生产环境使用的前沿模型”,并确认其支持 100 万 Token 上下文窗口,以及文本、图片、视频三种输入模态。与以往匿名测试不同,Ox Alpha 在内测期间承诺厂商不保留用户数据,即“零数据保留”政策。
目前社区对 Ox Alpha 的出身形成了两种主要猜测。第一种指向小米:小米 MiMo 系列此前就曾以 Hunter Alpha 的代号在 OpenRouter 匿名测试 MiMo-V2-Pro,且后来官方承认了这一对应关系;Ox Alpha 在上下文长度、多模态和 Coding 能力上的配置也与 MiMo 的技术方向吻合。第二种猜测指向智谱:有开发者用 25 组不同的 Prompt 对比 Token 数后发现,Ox Alpha 的原始 Token 数与 GLM-5.3 几乎一致,每次仅固定多出 75 个 Token,底层 Tokenizer 指纹高度重合;此外,智谱此前已公开征集下一代 GLM 的视觉和多模态能力方向,并有员工透露正在开发全新多模态模型。
为什么重要
Ox Alpha 的匿名测试之所以引发关注,在于它同时踩中了当前大模型竞赛的两个关键节点。第一,100 万上下文窗口加原生视频输入,意味着模型正在从“处理长文本”向“处理长视频时序信息”迁移,这直接关系到 AI Agent 能否在真实生产环境中持续工作,而非局限于单轮问答。第二,零数据保留的政策在匿名测试中并不常见,这可能是厂商为了吸引企业级用户而做出的合规让步,也反映出在数据隐私监管趋严的背景下,模型服务商正将数据安全作为差异化竞争力。
从竞争格局看,如果 Ox Alpha 最终被证实来自智谱,则说明 GLM 系列在多模态和长上下文方向的迭代速度正在明显加快,而国产大模型在 OpenRouter 这类国际分发渠道上以“匿名测试”方式收集反馈、打磨产品,已经成为一种常见的预发布策略。
对用户/开发者/创作者的影响
对于开发者而言,Ox Alpha 的匿名测试提供了一个低成本验证模型能力的窗口:1M 上下文意味着可以将整份代码库或长文档直接放入提示词,配合视频输入能力,Agent 类应用可以处理更复杂的视觉和时序任务。编码场景下,这类模型更适合作为自动编程助手的推理后端;而在多模态内容理解方面,视频输入能力也值得关注——不过内测期间能力稳定性未知,不建议直接用于生产环境。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于企业用户来说,零数据保留承诺是一个加分项,可以降低在合规敏感场景(如医疗、金融)中试用新模型的顾虑。但需要注意,匿名测试阶段的模型行为可能存在较大变动,API 定价、限流策略和正式版能力是否会缩水,目前都还没有明确信息。
对于普通创作者,多模态输入和长上下文结合,意味着未来可以用单次请求让模型“看完”一段较长的视频素材并生成分析或剪辑脚本,这在视频内容创作和批量素材处理上可能带来效率提升。但现阶段这些能力仍处于测试探索期,实际效果需要通过试用来验证。
值得关注的后续
首先是身份确认:Ox Alpha 到底来自小米还是智谱,或者另有其人,可能需要等到正式发布时官方才会揭晓,但也有可能通过模型后续的行为特征变化露出更多线索。其次是价格与开放策略:如果 Ox Alpha 是某个头部模型的早期版本,正式发布后的 API 定价、开源与否将直接影响开发者社区的使用意愿。最后是能力落地:当前宣传的 1M 上下文和视频输入在实际长视频处理中的速度、成本和准确性如何,需要看到更多第三方评测数据才能做出判断。
来源:@MaxForAI


