谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber:更便宜、更省 token 的 Flash 系列
谷歌于 2026 年 7 月 21 日发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。Flash 系列主打更低成本与更高 token 效率,3.6 Flash 输出 token 减少 17%,输出价格降至每百万 $7.50。Flash-Lite 速度达 350 tokens/秒,而受限的 Flash Cyber 驱动…
一句话看懂
谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,Flash 系列更便宜、更快、更省 token,专为高并发的 Agent 工作负载设计。
详细发生了什么
2026 年 7 月 21 日,谷歌发布三款新 Gemini 模型:3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。它们都属于 Flash 系列,针对速度、成本和高并发 Agent 任务优化,而非追求极致推理深度。
Gemini 3.6 Flash 是新的默认主力模型,在 3.5 Flash 基础上改进,专注于编码、知识工作和多模态任务。核心优势是效率:据 Artificial Analysis Index,3.6 Flash 比 3.5 Flash 减少 17% 输出 token;在 Datacurve 的 DeepSWE 基准上,谷歌报告最高减少 65%。定价也随之下调:输入每百万 token $1.50,输出每百万 token $7.50(此前 3.5 Flash 为 $9.00)。质量也有提升:DeepSWE 得分 49%(3.5 Flash 为 37%),MLE Bench 得分 63.9%(此前 49.7%)。Computer use 现已成为 Gemini API 和 Gemini Enterprise 的内置客户端工具。
Gemini 3.5 Flash-Lite 主打低延迟和高吞吐,目标场景包括 Agent 搜索和文档处理。据 Artificial Analysis 测量,速度达 350 输出 tokens/秒。定价为输入每百万 $0.30,输出每百万 $2.50。在多个基准上大幅超越前代 3.1 Flash-Lite,甚至在某些评估上击败了更老的 3 Flash。它支持可配置的思考级别(minimal、low、higher),开发者可根据任务需求在成本和延迟之间权衡。
Gemini 3.5 Flash Cyber 是最具专业性的发布。它基于 3.5 Flash 微调,专门用于发现、验证和修补软件漏洞。在谷歌的代码安全 Agent CodeMender 中,多个 3.5 Flash Cyber Agent 并行运行,最多调用五次,然后合并子 Agent 的发现。在谷歌内部 Big Sleep 评估中,Flash Cyber 显著超越主流的 3.5 Flash 和 3.6 Flash;在 V8 JavaScript 引擎上,它发现了 55 个独特确认问题(3.5 Flash 为 47 个,Claude Opus 4.6 为 36 个),其中 10 个是其他模型遗漏的。
中文圈视角
对中文开发者而言,这三款模型带来几个值得关注的要点:
-
价格与效率优势明显:3.6 Flash 输出价格降至 $7.50/百万 token,比 3.5 Flash 的 $9.00 低了近 17%,且 token 消耗更少。对于需要大量调用 API 的国内开发者(如做 Agent、RAG 应用),这能显著降低成本。不过,谷歌 API 在国内访问仍需梯子,且存在数据出境合规问题。国内替代方案包括 DeepSeek、Kimi 等,它们价格更低且无访问障碍,但在多模态和 Agent 能力上可能仍有差距。
-
Flash-Lite 的高吞吐适合中文场景:350 tokens/秒的速度非常适合中文文档处理、搜索摘要等实时性要求高的任务。国内类似产品如百度文心一言的轻量版、阿里通义千问的快速模式,但具体性能对比尚缺公开数据。
-
Flash Cyber 的安全双刃剑:自动漏洞挖掘工具对安全研究者是利器,但也引发滥用担忧。国内类似工具如腾讯的 Xcheck、360 的 Vulcan,但 Flash Cyber 的并行多 Agent 架构和低成本是亮点。不过,该模型目前仅限政府及可信合作伙伴使用,国内开发者短期内无法直接获取。
-
中文圈盲点:国内媒体多聚焦于 3.5 Pro 的延迟发布,忽略了 Flash 系列在 Agent 工作负载上的优化。对于正在构建复杂 Agent 系统的团队,3.6 Flash 的 token 节省和内置 computer use 能力值得关注。
几条值得记住的细节
- Gemini 3.6 Flash 输出 token 减少 17%(DeepSWE 上最高 65%),输出价格从 $9.00 降至 $7.50/百万。
- Gemini 3.5 Flash-Lite 速度达 350 tokens/秒,定价 $0.30/$2.50 每百万,在 SWE-Bench Pro 和 OSWorld-Verified 上超越老款 3 Flash。
- Gemini 3.5 Flash Cyber 在 V8 引擎上发现 55 个独特漏洞,超过 Claude Opus 4.6 的 36 个。
- Flash Cyber 因双重用途风险,目前仅限政府及可信合作伙伴的有限访问试点。
- 3.6 Flash 和 3.5 Flash-Lite 即日起可通过 Gemini API、Google AI Studio 等渠道使用。
一句话总结
谷歌 Flash 系列新模型更便宜、更快、更省 token,尤其适合 Agent 工作负载,但中文用户需权衡访问门槛与合规问题。