OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

API 聚合平台 OpenRouter 于 2026 年 7 月 21 日上线了谷歌最新的 Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite 模型。这两个模型均面向 Agent 场景优化,推理速度超过 150 tok/s,意味着开发者可以更低延迟地运行复杂任务和大量子代理,对…

OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

一句话看懂:API 聚合平台 OpenRouter 于 2026 年 7 月 21 日上线了谷歌最新的 Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite 模型。这两个模型均面向 Agent 场景优化,推理速度超过 150 tok/s,意味着开发者可以更低延迟地运行复杂任务和大量子代理,对 Agent 应用开发和高频调用场景有直接影响。

事件核心:发生了什么

OpenRouter 官方于 2026 年 7 月 21 日晚间宣布,在其平台上正式推出 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 两款模型。前者是谷歌 Gemini 3 系列的最新轻量级迭代,强调编码与知识工作场景的 Token 效率;后者则定位为更极致的低延迟、高吞吐子代理(subagent)模型。两项模型均支持每秒超过 150 个 Token 的输出速度,且可在 OpenRouter 上直接通过 API 调用,无需自行搭建谷歌云环境。目前公开信息显示,OpenRouter 尚未公布具体的定价细节,但预计将延续其按量计费、不锁定供应商的模式。

为什么重要

这次上线有两个信号值得注意。第一,谷歌正加速将 Gemini 模型家族向 Agent 化方向推进——Flash 系列不再仅是“廉价模型”的代名词,而是明确指向了 agentic workflow(代理工作流)中不同角色的分工:主力 Agent 用 3.6 Flash 处理复杂任务,大量并行的子代理用 3.5 Flash-Lite 跑低延迟决策。第二,OpenRouter 同时提供两款模型,进一步将模型选择的决策权交给开发者,避免单一平台绑定。这对行业竞争格局意味着,API 聚合层正在从“中间商”演变为“模型路由器”,其选品策略会直接影响开发者生态对谷歌模型的采用率。

对用户/开发者/创作者的影响

对开发者而言,最直接的变化是可调度更多并发 Agent 而不被推理速度卡脖子。例如,使用 3.6 Flash 完成代码审查或文档总结,同时让 3.5 Flash-Lite 运行大量监控性、分类性的子任务,两层模型在成本和响应速度上可形成互补。对普通用户而言,短期内感知不到直接变化,但使用基于这两个模型构建的工具(如 AI 编程助手、自动化工作流)时,可能体验到更快的反馈。对内容创作者来说,这两款模型偏向代码和文本处理,并非多模态生成方向,因此对图像、视频生成的直接影响有限。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

首先,定价将是关键变量——3.5 Flash-Lite 是否能做到比现有 Gemini Flash 系列更低的价格,直接决定它能否成为 Agent 部署的首选“工人模型”。其次,OpenRouter 是否会进一步引入 gemini-3.5-pro 等更大参数量的模型,形成从 Lite 到 Pro 的完整 Agent 模型层级,值得持续跟踪。最后,谷歌早已将 Gemini 模型在 Vertex AI 上深度集成,OpenRouter 此次快速同步上线,可能会促使 AWS Bedrock 或 Microsoft Azure 等其他聚合平台加快引入节奏,从而加速整个 API 市场上 Agent 模型的价格竞争。

来源:X:OpenRouter (@OpenRouter)

celebrityanime
celebrityanime
文章: 14577

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注