Google 发布 Gemini 3.6 Flash 三款轻量模型:更快、更省、还多了个「资安版」
Google 发布 Gemini 3.6 Flash 三款轻量模型:更快、更省、还多了个「资安版」
来源:Google 官方博客 / TechNews / Gate 新闻(2026-07-21 发布)
新闻概要
Google 于 7 月 21 日一口气推出三款 Gemini 轻量模型,重点全部放在效率与成本:
- Gemini 3.6 Flash —— 新一代主力工作模型
- Gemini 3.5 Flash-Lite —— 3.5 系列中速度最快、成本最低
- Gemini 3.5 Flash Cyber —— 专为网络安全设计的安全模型
同时官方披露:Gemini 3.5 Pro 正在与合作伙伴测试,已启动迄今最大规模的 Gemini 4 预训练。
三款模型速览
| 模型 | 定位 | 定价(美元/百万 tokens) | 亮点 |
|---|---|---|---|
| Gemini 3.6 Flash | 主力工作模型 | 输入 $1.5 / 输出 $7.5 | 编码、多模态、知识工作提升;token 用量最多减少 17%(DeepSWE 场景最高减 65%);已是 Gemini 应用默认模型 |
| Gemini 3.5 Flash-Lite | 最快最便宜 | 输入 $0.3 / 输出 $2.5 | 每秒约 350 tokens 输出;面向高吞吐任务(搜索、大量文档处理) |
| Gemini 3.5 Flash Cyber | 资安专用 | 试点(政府/可信伙伴) | 快速发现并修复代码漏洞;Google 自家 CodeMender 以它高频多次调用扫描代码路径 |
关键信息
- 成本优势:据 Artificial Analysis 数据,Gemini Flash 系列成本已优于 Anthropic、OpenAI 及中国竞品;3.6 Flash 单次任务成本低于 GPT-5.6 Terra Max、Kimi K3 与 Qwen 3.7 Max,3.5 Flash-Lite 仅需其中一小部分成本。
- 3.5 Pro 动向:原承诺 6 月推出,因故延后(据称编码能力未达目标,一度引发 Alphabet 股价波动);官方口径为「正在与合作伙伴测试,准备就绪后尽快广泛推出」。
- Gemini 4:官方首次透露已启动预训练,暂无确切时程。
对开发者的意义
- 推理成本直接下降:3.6 Flash 减少 token 用量 + 更低的单 token 价格,Agent 场景成本可观地降低。
- 分级选型更灵活:轻量任务用 Flash-Lite(极致性价比)、主力任务用 3.6 Flash、安全审计场景可关注 Flash Cyber。
- 生态地位提升:3.6 Flash 已成为 Gemini 应用默认模型,是 Agent 构建的主流选择之一。
如何使用
- 通过 Google AI Studio / Gemini API 使用;模型名:
gemini-3.6-flash、gemini-3.5-flash-lite - 3.5 Flash Cyber 目前仅限政府与受信任合作伙伴试点
参考链接
- TechNews 报道:https://technews.tw/2026/07/22/google-introduces-gemini-3-6-flash-gemini-3-5-flash-lite-and-gemini-3-5-flash-cyber/
- vocus 科技時事:https://vocus.cc/article/6a709859fd8978000104298c