
一句话看懂:Google 于 7 月 21 日发布了三款 Gemini Flash 系列新模型,分别针对效率、速度和网络安全场景,但备受期待的旗舰模型 Gemini 3.5 Pro 仍未正式上线,且 Google 已开始训练 Gemini 4,引发外界对其旗舰产品进度的担忧。
事件核心:发生了什么
Google 宣布推出三款新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber。其中,3.6 Flash 在 DeepSWE 等基准测试中输出 token 使用量较 3.5 Flash 减少约 17%,特定情况下节省高达 65%,价格降至每百万输入 token 1.50 美元、每百万输出 token 7.50 美元,且内置了计算机操作(Computer Use)客户端工具。3.5 Flash-Lite 则是轻量版,每秒可生成 350 个输出 token,面向高吞吐低延迟的批量任务。3.5 Flash Cyber 基于 3.5 Flash 进行安全专项优化,在 CyberGym 基准测试中得分 83.2%,仅落后 OpenAI 的 GPT-5.5-Cyber 约 2.4 个百分点,目前仅限政府和合作伙伴使用。与此同时,Google 确认 Gemini 3.5 Pro 仍在与合作伙伴进行内部测试,发布日期未定,而 Gemini 4 已开始训练。
为什么重要
这次发布反映出 Google 在旗舰模型上的尴尬处境。在 OpenAI、Anthropic、Meta 等竞争对手接连推出更强的前沿模型时,Google 的 Gemini 3.5 Pro 迟迟不能交付,转而靠“增量迭代”的 Flash 系列维持产品线热度。虽然 3.6 Flash 和 Flash-Lite 的性价比优势明显(尤其是 3.6 Flash 在多项 agentic 基准上超越老款 Pro 模型),但这也表明 Google 目前主要在用“效率提升”而非“能力突破”来应对竞争。Cyber 模型的封闭策略则进一步说明,Google 在某些高风险领域仍然谨慎,这可能影响其企业级市场拓展速度。
对用户/开发者/创作者的影响
对于普通用户和开发者,最直接的变化是 价格下降和效率提升:3.6 Flash 的 token 成本显著降低,且内置计算机操作能力,适合开发自动化工作流;Flash-Lite 的极高吞吐量非常适合批量处理、日志分析和简单代码生成等场景。但若你需要顶级推理能力(如复杂代码重构、长文档理解),目前 Google 仍未提供可公开使用的旗舰模型,可能不得不转向 OpenAI 的 GPT 系列或 Anthropic 的 Claude 系列。网络安全领域的企业和政府部门则可关注 Flash Cyber,但其受限的访问模式意味着短期内不会成为公共 API 的一部分。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
- Gemini 3.5 Pro 能否在 2026 年内落地:如果继续延迟,Google 可能在中高端市场进一步失去份额,尤其是面对 OpenAI 的 GPT-5 系列和 Anthropic 的 Claude Opus 系列。
- Gemini 4 的定位:Google 称其为“最雄心勃勃的训练运行”,但具体架构、能力范围和发布时间均未透露。如果 Gemini 4 能带来显著性能突破,Google 或许能在 2027 年前重回第一梯队。
- Flash Cyber 是否会开放:目前仅限政府等机构使用,但若后续证明其安全风险可控,Google 可能会以更细粒度的安全策略面向企业开放,从而拓展行业应用。


