立即咨询

电话咨询

微信咨询

立即试用
商务合作
Google DeepMind

Google DeepMind Gemini 3.7 Flash

Gemini 3.7 Flash是Google DeepMind于2026年8月13日发布的最新主力工作模型,距上一代Gemini 3.6 Flash发布仅三周。该模型并非全新预训练,而是在3.6 Flash推理基础上的算法改进,通过开发者反馈和算法创新实现快速迭代。

💬
Google DeepMind Gemini 3.7 Flash
Google DeepMind 提供
💬 对话与文本生成 付费API

Gemini 3.7 Flash是Google DeepMind于2026年8月13日发布的最新主力工作模型,距上一代Gemini 3.6 Flash发布仅三周。该模型并非全新预训练,而是在3.6 Flash推理基础上的算法改进,通过开发者反馈和算法创新实现快速迭代。谷歌将其定位为迄今智能的主力工作模型,重点压在编程和Agent两个关键词上。在FrontierCode 1.1 Main生产级代码质量评测中,3.7 Flash得43.6%,较3.6 Flash的34.4%显著提升。在DeepSWE v1.1长周期软件工程任务中,成绩从约49%提升到65.3%。WebDev Arena上Elo分数从1538提升到1588。Agent能力变化明显:Terminal-bench 2.1终端Agent编码测试达85.8%(前代78.0%),更困难的Terminal-bench 3.0从5.4%提到14.9%,AutomationBench企业真实工作流自动化从17.0%提升到30.4%,OSWorld 2.0计算机使用从33.8%提升到47.9%。在Artificial Analysis Intelligence Index上得分56,接近Claude Sonnet 5的55和GPT-5.6 Terra的57。FrontierCode 1.1中超越Sonnet 5的42.7%和Terra的41.3%。模型引入可调思考级别low/medium(默认)/high,取消了minimal级别。上下文窗口100万Token,最大输出65536 Token,输入支持文本、图像、视频、音频、PDF,输出仅文本。思考Token按输出费率计费。定价为介绍期输入$0.75/百万Token、输出$3.75/百万Token(至2026年12月31日),之后恢复为$1.50/$7.50。缓存读取$0.075/百万Token,批量半价。该模型发布当天即部署到Gemini Spark个人AI智能体,覆盖160余国家和地区,处理Google Workspace等工具调用。开发者可通过Gemini API、Google AI Studio、Android Studio、Google Antigravity和企业Agent平台使用。

{'name': '生产级代码生成', 'desc': 'FrontierCode 1.1 Main得43.6%,较3.6 Flash的34.4%显著提升'}{'name': '长周期软件工程', 'desc': 'DeepSWE v1.1达65.3%,较前代约49%大幅提升'}{'name': '终端Agent编码', 'desc': 'Terminal-bench 2.1达85.8%,Terminal-bench 3.0从5.4%提到14.9%'}{'name': '企业工作流自动化', 'desc': 'AutomationBench从17.0%提升到30.4%'}{'name': '计算机使用', 'desc': 'OSWorld 2.0从33.8%提升到47.9%'}{'name': 'Web开发', 'desc': 'WebDev Arena Elo从1538提升到1588,用更少prompt生成更完整可用Web应用'}

📋 技术规格

厂商 Google DeepMind
模型分类 对话与文本生成
参数规模 算法改进(非全新预训练),基于Gemini 3.6 Flash推理基础
上下文窗口 1048576 tokens(100万)
最大输出 65536 tokens
知识截止 未公开
API定价 输入: $0.75/百万tokens(介绍期至2026-12-31),之后$1.50输出: $3.75/百万tokens(介绍期至2026-12-31),之后$7.50

⭐ 核心能力详解

迄今智能的主力工作模型,聚焦编程和Agent

100万Token上下文,6.5万最大输出

FrontierCode 1.1达43.6%超越Claude Sonnet 5和GPT-5.6 Terra

思考模式low/medium/high三档(minimal已取消)

介绍期定价$0.75/$3.75为3.6 Flash原价一半

发布当天即接入Gemini Spark覆盖160余国家和地区

🎯 典型应用场景

生产级代码生成和调试排错

长周期软件工程和多步骤Agent任务

Web应用开发和设计系统还原

企业真实工作流自动化

计算机使用和桌面操作自动化

知识密集型任务(金融、法律、生物科学)

💪 技术优势与差异化

  • 编程和Agent能力较前代大幅提升,部分超越竞品
  • 介绍期定价仅为3.6 Flash原价一半,性价比突出
  • 100万上下文支持完整代码库和长文档处理
  • 发布当天即进入Gemini Spark产品落地
  • 缓存读取$0.075/百万Token为Agent工作流大幅降本
  • 三周快速迭代体现工程化节奏提速

⚠️ 使用局限与注意事项

  • 介绍期定价2027年1月1日恢复双倍
  • minimal思考级别已取消,low为最低推理档
  • 部分评测仍落后竞品(如DeepSWE v1.1落后GPT-5.6 Terra 69.6%)
  • Artificial Analysis报告幻觉率高于3.6 Flash
  • 闭源API-only,不支持自托管
  • 部分任务Token消耗可能高于3.6 Flash

💰 价格分析与成本建议

Gemini 3.7 Flash介绍期定价输入$0.75/百万Token、输出$3.75/百万Token,为3.6 Flash原价一半。缓存读取$0.075/百万Token,为新鲜输入的十分之一,对Agent工作流中稳定系统prompt大幅降本。2027年1月1日恢复为$1.50/$7.50。批量半价。思考Token按输出费率计费,输出成本取决于选择的思考级别。这一定价策略使3.7 Flash成为大规模跑Agent的高性价比选择。

👥 适用人群与企业

软件开发者、Agent应用开发者、企业技术团队、Web开发者、AI应用架构师、Google Workspace用户

🏭 行业适配度评估

软件开发★★★★★

FrontierCode 1.1达43.6%超越竞品,DeepSWE 65.3%和Terminal-bench 85.8%适合编码和Agent

⚠ 幻觉率略高,生产环境需验证

金融★★★★☆

GDP.pdf基准从22%提升到34%,知识密集型任务能力增强

⚠ 金融数据敏感,需评估合规适配

法律★★★★☆

知识密集型任务覆盖法律领域,长上下文适合法律文档分析

⚠ 法律结论需人工复核

教育★★★★☆

编程教育场景适配度高,介绍期半价降低成本门槛

⚠ 2027年恢复双价后需重新评估

制造★★★☆☆

AutomationBench 30.4%适合工作流自动化,但制造业IT适配需定制

⚠ OT环境接入需评估

🔧 技术架构解析

Gemini 3.7 Flash基于3.6 Flash推理基础进行算法改进,非全新预训练。模型ID为gemini-3.7-flash(稳定版无preview后缀)。上下文100万Token,最大输出65536 Token。输入支持文本、图像、视频、音频、PDF,输出仅文本。思考级别low/medium(默认)/high,思考Token按输出费率计费。迁移注意事项:需移除自定义temperature/top_p/top_k/candidate_count(已弃用),用thinking_level字符串参数替代thinking_budget数值,minimal替换为low或改用Flash-Lite。可通过Gemini API、Google AI Studio、Android Studio、Google Antigravity和企业Agent平台使用。OpenRouter和kie.ai已上架。不支持temperature等参数自定义。

🔒 安全合规与数据隐私

数据训练策略 基于Gemini 3.6 Flash推理基础算法改进
合规认证 Google标准数据处理、Gemini安全防御机制(防CBRN和网络攻击滥用)
数据驻留 Google标准数据中心
加密方式 Google标准加密
Gemini 3.7 Flash引入全新安全防御机制,在严防化学、生物、放射性、核领域和网络攻击滥用的同时确保合法有益应用。遵循Google标准数据处理和合规框架。

🏢 同厂商模型矩阵

Google DeepMind的Gemini Flash系列进入月度迭代节奏,3.7 Flash距3.6 Flash仅三周

模型 定位 品类 特色
Gemini 3.6 Flash 前代主力 chat FrontierCode 34.4%,$1.50/$7.50定价
Gemini 3.7 Flash当前 当前主力 chat FrontierCode 43.6%,介绍期$0.75/$3.75半价
Gemini 3.5 Flash-Lite 低成本档 chat 最低成本选择,适合高量分类抽取
Gemini 3.7 Flash体现谷歌Flash系列月度迭代节奏,通过算法改进而非全新预训练实现快速提升,用接近旗舰的能力和更低价格争夺Agent工作负载

🧭 选型决策指南

需要编程和Agent能力Gemini 3.7 Flash

FrontierCode 43.6%和Terminal-bench 85.8%领先,介绍期半价

高量分类和抽取管线Gemini 3.5 Flash-Lite

最低成本,minimal级别取消后Lite为低成本路线

需要旗舰级能力等待Gemini 3.5 Pro

3.5 Pro仍在测试中,旗舰能力更强

预算敏感的长周期SWE任务考虑GPT-5.6 Terra或DeepSeek V4-Pro

Terra DeepSWE 69.6%更高,V4-Pro开源成本低

Gemini 3.7 Flash适合需要编程和Agent能力且关注成本的场景,介绍期半价性价比突出。高量简单任务可用Flash-Lite,旗舰能力等3.5 Pro。DeepSWE等长周期任务可考虑Terra或开源的V4-Pro。

🏆 真实使用案例

📌 企业级Web应用开发

应用场景:某开发团队使用Gemini 3.7 Flash从设计系统截图生成完整可用的Web应用
实际效果:用更少prompt生成功能更完整的页面布局,WebDev Arena Elo达1588
对截图、图片和完整设计系统的还原能力均有改善

📌 多步骤Agent工作流

应用场景:某企业使用Gemini 3.7 Flash构建自动化Agent处理Workspace工具调用
实际效果:模型在遇到执行障碍时主动调整策略,必要时澄清用户意图,减少人工监督和重复重试
AutomationBench从17.0%提升到30.4%,Terminal-bench 2.1达85.8%

💬 用户真实评价

全栈开发者
⭐⭐⭐⭐⭐

3.7 Flash在编码和Web开发上的提升很明显,介绍期半价让Agent工作流的成本大幅下降,缓存读取十分之一的价格很实用

Agent应用架构师
⭐⭐⭐⭐

Terminal-bench和AutomationBench的提升让多步骤Agent任务更可靠,但幻觉率比3.6 Flash略高需注意

企业技术团队负责人
⭐⭐⭐⭐

100万上下文加缓存机制让长文档和代码库处理成本可控,但2027年恢复双倍价格后需重新评估

✅ 实践建议与使用技巧

1. 思考级别选择:简单分类抽取用low,日常Agent任务用medium(默认),复杂推理用high。思考Token按输出费率计费
2. 缓存机制利用:Agent工作流中保持系统prompt和工具schema前缀一致,利用$0.075缓存读取大幅降本
3. 批量推理:批量任务半价,非实时任务可调度到批量模式
4. 迁移参数清理:从3.6 Flash迁移时移除已弃用参数,用thinking_level替代thinking_budget

💡 Prompt工程建议

思考级别匹配任务

3.7 Flash的思考级别直接影响输出成本和质量,需根据任务复杂度选择

示例:简单分类用low,日常Agent用medium,复杂推理和代码生成用high

利用缓存机制降本

Agent工作流中保持系统prompt和工具schema前缀一致可触发缓存读取,成本降至十分之一

示例:将固定的工具定义和系统指令放在prompt最前面,动态内容放在后面

Web开发从设计系统出发

3.7 Flash对截图、图片和完整设计系统的还原能力提升,建议从设计素材出发生成Web应用

示例:基于以下设计系统截图,生成对应的React组件和页面布局:[附设计图]

🔄 替代方案分析

高量分类抽取管线
gemini-3-5-flash-lite

minimal取消后Flash-Lite为最低成本路线

长周期SWE任务
gpt-5-6-terradeepseek-v4-pro

Terra DeepSWE 69.6%更高,V4-Pro开源且DeepSWE 62.7%接近

需要开源模型
qwen3-8-maxglm-5-3

Qwen3.8-Max和GLM-5.3均开源,编程和安全能力突出

旗舰级能力
 

等待Gemini 3.5 Pro正式发布,目前3.5 Pro仍在合作伙伴测试中

❓ 常见问题解答

Q: Gemini 3.7 Flash和3.6 Flash有什么区别?
A: 3.7 Flash是3.6 Flash的算法改进版(非全新预训练),FrontierCode 1.1从34.4%到43.6%,DeepSWE从约49%到65.3%,Terminal-bench 2.1从78%到85.8%,OSWorld从33.8%到47.9%。思考级别取消minimal新增三档。请以官方为准。
Q: Gemini 3.7 Flash的定价是多少?
A: 介绍期(至2026-12-31)输入$0.75/百万Token、输出$3.75/百万Token,为3.6 Flash原价一半。2027年1月1日恢复为$1.50/$7.50。缓存读取$0.075。请以官方为准。
Q: minimal思考级别还能用吗?
A: 不能。3.7 Flash取消了minimal级别,可用low/medium(默认)/high三档。原来用minimal的高量分类和抽取管线建议改用Gemini 3.5 Flash-Lite。请以官方为准。
Q: Gemini 3.7 Flash支持自托管吗?
A: 不支持。3.7 Flash为闭源API-only模型,无可自托管的权重。可通过Gemini API、Google AI Studio、企业Agent平台等使用。请以官方为准。
Q: 迁移到3.7 Flash需要注意什么?
A: 需移除temperature/top_p/top_k/candidate_count(已弃用),用thinking_level替代thinking_budget,minimal替换为low。同价格但Token消耗可能不同。请以官方为准。
Q: Gemini 3.5 Pro什么时候发布?
A: 截至3.7 Flash发布,谷歌仍未公布3.5 Pro正式发布时间。3.5 Pro正在与合作伙伴测试。请以官方为准。