Gemini 3.6 Flash是什么
Gemini 3.6 Flash 是 Google DeepMind 最新推出的主力干活模型,定位大规模 AI Agent 场景。相比 Gemini 3.5 Flash,输出 token 减少 17%,价格降至 7.5 美元/百万 token,代码基准 DeepSWE 从 37% 提升至 49%,MLE-Bench 从 49.7% 拉升至 63.9%。同时代码、知识工作与计算机操作能力全面提升,内置 Computer Use 工具,已面向开发者、企业和普通用户开放。
阅读目录

Gemini 3.6 Flash的主要功能
-
主力干活模型:定位workhorse,专为大规模 AI Agent 场景优化,比 3.5 Flash 输出 token 减少 17%,账单更薄。
-
代码能力升级:DeepSWE 从 37% 提升到 49%,MLE-Bench 从 49.7% 拉到 63.9%,生成代码更贴近生产环境。
-
计算机操作内置:OSWorld-Verified 从 78.4% 升到 83%,”Computer Use”成为 API 和企业版开箱即用工具。
-
知识工作增强:GDPval-AA v2 从 1349 涨到 1421,文档解析、图表分析、报告起草等多模态任务表现突出。
-
安全升级:Frontier Safety 防护强化,重点盯防 CBRN 和网络攻击滥用,抗越狱能力更强。
Gemini 3.6 Flash的技术原理
- Token 效率优化:通过改进推理策略,模型在执行多步任务时减少不必要的中间输出,DeepSWE 场景下输出 token 可节省 65%,同等成本下完成更多有效工作。
- Agent 架构精简:优化工具调用链路,降低推理步数和执行循环长度,使代码生成更贴近生产环境要求,减少冗余改动。
- 安全对齐强化:部署升级版 Frontier Safety 防护,针对 CBRN 和网络攻击两类滥用场景进行专项对齐,增强抗越狱能力的同时降低正常需求误拒率。
如何使用Gemini 3.6 Flash
-
Gemini App:打开 Gemini 应用,在模型下拉菜单中选择”3.6 Flash”即可使用。
-
Google AI Studio:登录 studio,在模型选择器里切换至 3.6 Flash 进行开发和测试。
-
API 调用:通过 Gemini API 指定模型名
gemini-3.6-flash,输入价格 1.5 美元/百万 token,输出 7.5 美元/百万 token。 -
企业版:Workspace 和 Cloud 企业用户可直接在控制台启用,Computer Use 工具开箱即用。
Gemini 3.6 Flash的核心优势
-
更省:输出 token 减少 17%,DeepSWE 场景甚至省 65%,单任务成本更低。
-
更快:推理步数和工具调用减少,响应速度提升。
-
更强:代码、机器学习工程、计算机操作、知识工作等 Agent 基准全面超越前代。
-
更便宜:输出价格从 9 美元降至 7.5 美元/百万 token,性价比进一步拉升。
-
更安全:升级 Frontier Safety 防护,抗越狱能力增强且减少误拒。
Gemini 3.6 Flash的同类竞品对比
| 维度 | Gemini 3.6 Flash | GPT-5.6 Luna |
|---|---|---|
| 输入价格 | 1.5 美元/百万 token | 1.0 美元/百万 token |
| 输出价格 | 7.5 美元/百万 token | 6.0 美元/百万 token |
| SWE-Bench Pro | 58.7% | 62.7% |
| DeepSWE v1.1 | 49% | 67% |
| Terminal-Bench 2.1 | 78.0% | 84.7% |
| MLE-Bench | 63.9% | 47.6% |
| OSWorld-Verified | 83.0% | 72.6% |
| GDPval-AA v2 | 1421 | 1584 |
Gemini 3.6 Flash的应用场景
-
软件开发:开发者可借助其提升的代码能力完成长周期软件工程任务、自动化代码审查及测试脚本生成。
-
机器学习研究:研究人员可用它在 MLE-Bench 类任务中辅助模型训练、实验设计与数据分析工作。
-
文档智能处理:企业用户能对海量合同、财报、研报进行多模态解析、图表提取与报告自动起草。
-
计算机自动化:通过内置 Computer Use 工具自动操作浏览器、填写表单、执行系统级重复任务。
-
企业知识工作:可嵌入 Figma、JetBrains 等工具链辅助设计迭代、代码补全及电商数据特征抽取。
