深色模式
Gemini 3.6 Flash 国内使用指南:Google最新模型、API与Gemini 3.5 Flash对比【2026年8月更新】
更新时间:2026年7月31日
Google 于 2026 年 7 月 21 日发布 Gemini 3.6 Flash,同时推出 Gemini 3.5 Flash-Lite 和面向特定安全场景的 Gemini 3.5 Flash Cyber。Gemini 3.6 Flash 是本轮更新中的主力型号,重点提升代码、知识工作、多模态、Computer Use 和 Agent 任务效率。
相比 Gemini 3.5 Flash,新型号不仅提高多项任务表现,还减少输出 tokens 和工具调用步骤,并将官方 API 价格降至输入 1.50 美元、输出 7.50 美元 / 100 万 tokens。
国内使用入口先看
| 平台与网址 | 平台性质 | Gemini 3.6 Flash 状态 | 适合人群 |
|---|---|---|---|
| https://gemini.google.com | Google 官方 Gemini App | 官方已上线,具体显示受账号和地区影响 | 普通用户、中文对话和文件分析 |
| https://aistudio.google.com | Google 官方 AI Studio | 可通过 Gemini API 测试与开发 | 开发者、提示词调试和 API 用户 |
| https://gptcat.cc | 第三方中文多模型平台 | 已知支持 Gemini 3.1 Pro;是否已接入 3.6 Flash,请登录后核对实时模型列表 | 需要国内邮箱、中文界面和多模型切换的用户 |
| https://snakegpt.vip | 第三方中文多模型平台 | 已知支持 Gemini 3.1 Pro;是否已接入 3.6 Flash,请登录后核对实时模型列表 | 主要进行文字、办公、学习和编程的用户 |
第三方平台说明
GPTCat、SnakeGPT 不是 Google 官方网站,账号、余额、聊天记录和套餐不与 Gemini App 或 Google AI Studio 互通。新模型接入速度由平台决定,付费前应核对完整型号、上下文、文件、视频、工具和计费规则。
一、Gemini 3.6 Flash 是什么?
Gemini 3.6 Flash 是 Google 面向大规模 Agent 和生产工作流的新一代主力 Flash 模型。它延续 Flash 系列对速度、成本和质量平衡的定位,同时加强复杂代码、知识工作、多模态理解和电脑操作能力。
Google 官方发布资料强调了四个方向:
- 更高 token 效率:Artificial Analysis Index 中,输出 tokens 比 3.5 Flash 少 17%;
- 更少执行步骤:完成多步骤流程时减少推理步骤和工具调用;
- 更强代码和知识工作:在 DeepSWE、MLE Bench、GDPval-AA v2 等评测中提升;
- Computer Use:通过 Gemini API 和 Gemini Enterprise 提供内置的客户端工具能力。
基准成绩不能替代真实业务测试,但对需要大量工具调用、代码迁移、文档分析和 Agent 自动化的开发者来说,token 数量与执行循环减少会直接影响成本和延迟。
二、Gemini 3.6 Flash 官方价格
Google 公布的 Gemini 3.6 Flash API 价格为:
| 计费项 | 价格 |
|---|---|
| 输入 | $1.50 / 100万 tokens |
| 输出 | $7.50 / 100万 tokens |
官方明确称该价格低于 Gemini 3.5 Flash 的对应输出单价,并且 3.6 Flash 在多个工作流中使用更少输出 tokens。因此,实际单任务成本可能同时受益于“单价降低”和“token 使用减少”。
Google 同期发布的 Gemini 3.5 Flash-Lite 价格为输入 $0.30、输出 $2.50 / 100 万 tokens,适合高吞吐、低延迟的分类、搜索和文档处理。它不是 3.6 Flash 的直接替代,而是更偏成本和吞吐的型号。
三、Gemini 3.6 Flash 和 3.5 Flash 有什么区别?
| 对比项 | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| 主要定位 | 新一代主力 Agent、代码和知识工作模型 | 上一代 Flash 主力型号 |
| token 效率 | 官方称输出 tokens 平均减少 17% | 作为对比基线 |
| 代码任务 | 更少无关改动和执行循环 | 能力较强,但新型号进一步提升 |
| Computer Use | Gemini API 与 Enterprise 提供内置工具 | 依具体产品和工具配置 |
| API 输入 / 输出 | $1.50 / $7.50 | 官方发布称 3.6 的输出单价更低 |
| 使用建议 | 新 Agent 和生产任务优先评测 | 现有稳定流程可继续作为基线 |
Google 公布的部分对比结果包括:
- DeepSWE:49% 对 37%;
- MLE Bench:63.9% 对 49.7%;
- OSWorld-Verified:83.0% 对 78.4%;
- GDPval-AA v2:1421 对 1349。
不同基准的工具、预算和运行环境不同,不应把百分比分数直接等同于所有真实任务的成功率。迁移前应使用自己的代码、文档和 Agent 流程做 A/B 测试。
四、Gemini 3.6 Flash 官方入口
| 官方入口 | 网址 | 主要用途 |
|---|---|---|
| Gemini App | https://gemini.google.com | 普通用户对话、文件、图片和研究任务 |
| Google AI Studio | https://aistudio.google.com | 模型测试、提示词调试、API Key 与代码生成 |
| Gemini API 文档 | https://ai.google.dev | 查看实时模型 ID、SDK、参数和限制 |
| Gemini Enterprise | https://cloud.google.com/gemini-enterprise | 企业 Agent、权限和治理 |
| Vertex AI | https://cloud.google.com/vertex-ai | 企业云部署、日志、权限和数据控制 |
Google 公布的可用范围包括 Gemini App、Gemini API、Google AI Studio、Android Studio、Google Antigravity,以及 Gemini Enterprise Agent Platform。具体地区、账号和产品权限应以实时页面为准。
五、国内使用 Gemini 3.6 Flash 的三种方式
方式一:使用 Gemini App
- 打开 https://gemini.google.com;
- 使用自己的 Google 账号登录;
- 查看模型选择器是否显示 Gemini 3.6 Flash;
- 阅读数据和活动记录设置;
- 先使用非敏感中文内容测试;
- 再尝试文件、图片和复杂任务。
实际可用性受支持地区、账号类型、Workspace 管理规则和 Google 产品政策影响。不要购买共享 Google 账号。
方式二:使用 Google AI Studio 和 Gemini API
AI Studio 适合开发者测试模型、编写 System Instructions、调整参数、上传多模态输入并生成 API 示例代码。正式开发前,应在 Gemini API 模型文档 核对实时模型 ID、上下文、速率限制和支持的工具。
方式三:检查第三方中文平台
GPTCat、SnakeGPT 当前已知提供 Gemini 3.1 Pro 等模型,但本文不直接宣称它们已经接入 3.6 Flash。检查步骤:
- 登录后打开完整模型选择器;
- 确认完整名称是 Gemini 3.6 Flash;
- 查看是否支持文件、图片、视频和联网;
- 检查上下文、输出长度和计费单位;
- 用相同的脱敏任务与官方结果比较;
- 小额测试后再购买长期套餐。
六、Gemini 3.6 Flash API 怎么用?
Google 会在模型文档中公布实时可调用的模型 ID。由于 Preview、稳定版和别名可能调整,本文不硬编码一个未经实时控制台确认的 ID。开发时请先在 AI Studio 复制当前模型名称,再填入 SDK。
Python 通用示例:
python
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="从 AI Studio 复制当前 Gemini 3.6 Flash 模型 ID",
contents="分析这份产品需求,列出技术风险、依赖和验收标准。",
)
print(response.text)生产环境建议:
- API Key 放在服务端环境变量或密钥管理系统;
- 对 Computer Use 设置域名、操作和权限白名单;
- 付款、删除、发送和发布动作保留人工确认;
- 记录工具调用、失败原因和重试次数;
- 用真实任务评估每次成功成本,而不是只看 tokens 单价。
七、Gemini 3.6 Flash 适合哪些任务?
1. 代码开发与迁移
Google 强调 3.6 Flash 能减少无关代码修改和执行循环,适合大型代码迁移、Bug 定位、测试修复和多 Agent 编程流程。
2. 文档、图表和知识工作
适合解析报告、财务资料、图表和多模态文档,再输出结构化摘要、风险清单或草稿。重要数字仍需回到原文复核。
3. Computer Use 和业务 Agent
适合浏览器操作、跨系统录入和多步骤工作流。必须限制权限、防范网页提示注入,并为高风险动作设置确认点。
4. 高频生产工作流
当 3.6 Flash 的能力超过需求时,可将分类、提取和简单转换交给 3.5 Flash-Lite,让 3.6 Flash 处理需要计划和工具的复杂部分。
八、中文提示词怎么写?
text
你是负责交付结果的技术分析师。
任务:阅读我提供的需求与日志,定位最可能的根因。
要求:
1. 区分已知事实、推断和待验证项;
2. 先给证据,再给结论;
3. 提供最小修复方案,不做无关重构;
4. 列出验证步骤、失败回退和剩余风险;
5. 使用简体中文,保留必要英文术语。对于 Agent 任务,再补充允许使用的工具、禁止访问的范围、最大步骤数和必须人工确认的动作。
九、常见问题 FAQ
Gemini 3.6 Flash 什么时候发布?
Google 于 2026 年 7 月 21 日发布 Gemini 3.6 Flash。
Gemini 3.6 Flash 比 3.5 Flash 更便宜吗?
Google 官方发布资料称 3.6 Flash 的输出 token 单价更低,定价为输入 $1.50、输出 $7.50 / 100 万 tokens,同时在相关测试中减少输出 token 使用。
Gemini 3.6 Flash 支持中文吗?
支持中文输入和输出。专业任务建议明确语言、格式、证据标准和需要保留的英文术语。
GPTCat 和 SnakeGPT 已经支持 Gemini 3.6 Flash 吗?
本文只确认它们已知提供 Gemini 3.1 Pro 等型号,不对 3.6 Flash 接入作未经确认的承诺。请登录后核对实时模型列表。
3.6 Flash 和 3.5 Flash-Lite 怎么选?
代码、知识工作、Computer Use 和复杂 Agent 优先测试 3.6 Flash;高吞吐分类、提取、搜索与轻量文档处理可优先测试 3.5 Flash-Lite。
十、总结
Gemini 3.6 Flash 的重点不是单一榜单提升,而是让生产 Agent 用更少 tokens、更少工具步骤完成更复杂的代码、知识工作和电脑操作。普通用户可先在 Gemini App 查看账号是否开放;开发者从 AI Studio 和 Gemini API 开始;使用第三方中文平台时,应先确认实时模型列表与功能边界。