返回教程列表

Google 发布 Gemini 3.6 Flash 三款轻量模型:更快、更省、还多了个「资安版」

AI瑶·2026-08-14Gemini

Google 发布 Gemini 3.6 Flash 三款轻量模型:更快、更省、还多了个「资安版」

来源:Google 官方博客 / TechNews / Gate 新闻(2026-07-21 发布)

新闻概要

Google 于 7 月 21 日一口气推出三款 Gemini 轻量模型,重点全部放在效率与成本

  1. Gemini 3.6 Flash —— 新一代主力工作模型
  2. Gemini 3.5 Flash-Lite —— 3.5 系列中速度最快、成本最低
  3. Gemini 3.5 Flash Cyber —— 专为网络安全设计的安全模型

同时官方披露:Gemini 3.5 Pro 正在与合作伙伴测试,已启动迄今最大规模的 Gemini 4 预训练

三款模型速览

模型定位定价(美元/百万 tokens)亮点
Gemini 3.6 Flash主力工作模型输入 $1.5 / 输出 $7.5编码、多模态、知识工作提升;token 用量最多减少 17%(DeepSWE 场景最高减 65%);已是 Gemini 应用默认模型
Gemini 3.5 Flash-Lite最快最便宜输入 $0.3 / 输出 $2.5每秒约 350 tokens 输出;面向高吞吐任务(搜索、大量文档处理)
Gemini 3.5 Flash Cyber资安专用试点(政府/可信伙伴)快速发现并修复代码漏洞;Google 自家 CodeMender 以它高频多次调用扫描代码路径

关键信息

  • 成本优势:据 Artificial Analysis 数据,Gemini Flash 系列成本已优于 Anthropic、OpenAI 及中国竞品;3.6 Flash 单次任务成本低于 GPT-5.6 Terra Max、Kimi K3 与 Qwen 3.7 Max,3.5 Flash-Lite 仅需其中一小部分成本。
  • 3.5 Pro 动向:原承诺 6 月推出,因故延后(据称编码能力未达目标,一度引发 Alphabet 股价波动);官方口径为「正在与合作伙伴测试,准备就绪后尽快广泛推出」。
  • Gemini 4:官方首次透露已启动预训练,暂无确切时程。

对开发者的意义

  1. 推理成本直接下降:3.6 Flash 减少 token 用量 + 更低的单 token 价格,Agent 场景成本可观地降低。
  2. 分级选型更灵活:轻量任务用 Flash-Lite(极致性价比)、主力任务用 3.6 Flash、安全审计场景可关注 Flash Cyber。
  3. 生态地位提升:3.6 Flash 已成为 Gemini 应用默认模型,是 Agent 构建的主流选择之一。

如何使用

  • 通过 Google AI Studio / Gemini API 使用;模型名:gemini-3.6-flashgemini-3.5-flash-lite
  • 3.5 Flash Cyber 目前仅限政府与受信任合作伙伴试点

参考链接

  • TechNews 报道:https://technews.tw/2026/07/22/google-introduces-gemini-3-6-flash-gemini-3-5-flash-lite-and-gemini-3-5-flash-cyber/
  • vocus 科技時事:https://vocus.cc/article/6a709859fd8978000104298c