Architect 推出 Liquid Inference:LLM 推理按请求实时竞价

金融交易公司 Architect 推出 Liquid Inference,一个面向大模型推理的实时拍卖路由:每次请求由多家提供商竞价,最低合规报价胜出,价格在生成第一个 token 前锁定。

一句话看懂:金融交易公司 Architect 推出 Liquid Inference,一个面向大模型推理的实时拍卖路由:每次请求由多家提供商竞价,最低合规报价胜出,价格在生成第一个 token 前锁定。

事件核心:发生了什么

2026 年 10 月 8 日,Architect Financial Technologies 发布 Liquid Inference,定位为 LLM 推理的交易所式路由。开发者只需替换 API base URL,继续使用 OpenAI 或 Anthropic 兼容调用,请求便会在所有报价该模型的提供商之间拍卖,胜出者是满足买方规则的最低报价。买方还可设置单任务成本上限、首 token 时延和最低吞吐,并指定可用地区、零数据保留及提供商/模型白名单。据其 LinkedIn 帖文,平台支持路由规则预设和多模态,账户内可查看实时订单簿、各提供商与模型的报价以及成交记录。首批 500 名注册用户可获 20 美元免费推理额度,推荐返利分别为一级 20%、二级 10%。

为什么重要

目前主流推理路由(如 OpenRouter)多按价格加权或固定顺序调度,而 Liquid Inference 把每一笔推理请求当作一次竞价撮合。Architect 本身运营 AX 永续合约交易所,并于 2026 年 5 月收购了一家美国指定合约市场,计划在监管审核后上线 GPU 算力期货。将交易所的双边价格发现机制搬到推理环节,意味着买方可以拿到“锁价收据”,也意味着拥有闲置 GPU 的提供商可以选择性出售算力。目前公开信息显示,平台费用、提供商名单和时延数据尚未披露,这限制了它与 OpenRouter、Hugging Face Inference Providers 等现有方案进行完整对比。

对开发者与创作者的影响

对使用 Claude Code、Codex、Cursor、Cline 等 Agentic 编程工具的开发者来说,替换 base URL 即可接入,代码改动小,并且可以用成本上限约束单次任务支出。对内容创作者和中小团队,竞价机制可能压低保价,但模型质量、稳定性与合规选项仍需逐项验证。对企业采购,零数据保留、地区限制和白名单是加分项,但费用结构和提供商资质目前不透明,建议先小额试用,确认计量口径和账单明细后再放量。

值得关注的后续

一是平台手续费、结算方式和提供商准入标准何时公开;二是竞价结果在延迟和稳定性上是否可靠,能否经受生产负载;三是 GPU 算力期货能否通过监管审核,以及会不会有推理平台跟进类似拍卖机制。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

来源:MarkTechPost Research

celebrityanime
celebrityanime
文章: 28629

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注