一句话看懂:Spotify 工程师用自家 Portal 平台的 AiKA Modes 功能,把 Claude Code 的 token 消耗降低了 90%——方法是把“读文件、写测试”这类低难度 I/O 任务路由给 Gemini 2.5 Flash 等廉价模型,让 Claude 专注处理复杂推理。
事件核心:发生了什么
Spotify 工程团队在官方博客中披露了一个内部实践:他们构建了一套名为 Portal 的 AI 代理调度系统,其核心组件 AiKA Modes 支持开发者以声明式配置创建“任务模式”——指定指令、模型、温度参数及 MCP 工具,并可通过 CLI 或 API 调用。该团队利用此机制开发了两个工作模式:一个负责批量读取大文件并回答具体问题(bulk-reader),另一个负责按既有代码模式生成测试文件和脚手架代码(code-writer)。
为让 Claude Code 主动将这类任务“外包”出去,工程师编写了一个名为“shunt”的 Claude Code 插件。该插件注册了两个 PreToolUse 钩子:当 Claude 尝试读取超过 350 行(阈值可配置)的文件时,系统会拦截该读取请求,并引导 Claude 改用 Portal 的批量读取技能。通过将大量 token 消耗转移到 Gemini 2.5 Flash 上,Claude 的上下文窗口不再被无关文件内容填满,总体 token 成本下降了约 90%。
为什么重要
这一案例直接回应了当前 AI 编程成本失控的行业痛点。文中提到,到 2028 年 AI 编程成本预计将超过开发者平均薪资;已有四分之一的工程管理者每月为每位开发者支付 200 至 500 美元的 token 费用,部分团队甚至超过 2000 美元。Spotify 的方案证实了一个关键判断:前沿模型(如 Claude)的大量消耗其实花在了低价值的文件读取和模式匹配上,并非真正的“推理”。
这为行业提供了一种可行的成本控制范式——不是放弃高端模型,而是通过“模型路由”将匹配难度的任务分配给更便宜的模型(如 Gemini 2.5 Flash)。其意义在于:未来 AI 编程工具竞争的关键可能不只是模型能力,还包括对异构模型资源的调度效率。Claude Code 的插件机制也展示了生态开放性——代理工具能够通过钩子(hooks)主动改变模型的行为路径,这在过去并不常见。
对用户/开发者/创作者的影响
对开发者而言,这提供了一套可落地的省钱策略:不必等待平台官方降价,也不一定需要自建复杂的模型网关。通过类似 Portal 的代理平台或自建脚本,就能在 Claude Code 中嵌入任务路由规则,将重复性工作引导至 API 价格更低的模型上。对于使用其他 AI 编程工具(如 Cursor、Continue 等支持自定义命令或插件的 IDE)的开发者,这一思路同样具有移植价值——例如设置文件大小阈值,让 AI 在小文件场景下自动切换轻量模型。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于企业团队,它提示了一个采购视角:AI 编程工具的真实成本瓶颈往往不是订阅席位费,而是 token 消耗量。在评估代码助手时,应关注其是否支持模型级的路由策略、是否允许用户自定义某类操作的模型偏好。目前公开信息显示,Portal 是 Spotify 内部平台,尚未向公众开放,但 Claude Code 插件与相关脚本逻辑思路是完全公开的。
值得关注的后续
第一,Spotify 是否会将该能力产品化——Portal 若对外开放 API 或推出 SaaS 版本,将直接冲击现有的 AI 编程网关市场(如 OpenRouter 等模型路由服务)。第二,Anthropic 是否会为 Claude Code 增加原生的“低成本模型自动路由”能力——若如此,这类由用户主导的插件方案将被官方能力覆盖。第三,其他大型科技公司(如 Google、Meta)内部是否已有类似的 token 削减方案并流出,值得关注其基础设施设计是否会被更多团队采纳。
来源:Hacker News


