project
Gemini 3.7 Flash - Google DeepMind 推出最新的主力模型
Gemini 3.7 Flash 是 Google DeepMind 推出的新一代主力 AI 模型。模型专为 Coding 与 Agent 工作流设计,在软件工程、网页开发和企业自动化等基准上大幅跃升...
Gemini 3.7 Flash是什么
Gemini 3.7 Flash 是 Google DeepMind 推出的新一代主力 AI 模型。模型专为 Coding 与 Agent 工作流设计,在软件工程、网页开发和企业自动化等基准上大幅跃升,部分指标超越 Claude Sonnet 5 与 GPT-5.6 Terra。模型首发价仅为 3.6 Flash 原价的一半,定位高频 Agent 与企业工作流的”性价比杀手”。
Gemini 3.7 Flash的主要功能
- 软件工程:支持生成高质量生产级代码,在 FrontierCode 与 DeepSWE 基准上大幅提升,首遍准确率与调试能力显著增强。
- Web 开发:支持从截图、图片或完整 Design System 输入,一键生成高保真交互式网页,Code Arena Elo 评分领先竞品。
- Agent 自动化:执行复杂多步骤企业工作流,自动规划、调用工具并在遇到障碍时自适应调整,AutomationBench 表现大幅跃升。
- 知识密集型工作:处理金融、法律、生物科学等领域的复杂文档推理,GDP.pdf 等长文档理解能力显著增强。
- 多模态创作:配合 Nano Banana 将文字提示实时转化为可玩的 3D 游戏,或将静态 PDF 转化为带交互图表的动态网页。
- Gemini Spark 集成:作为 24/7 个人 Agent 的后台模型,驱动 Google Workspace 内的文件整理、邮件起草与状态更新等自动化操作。
Gemini 3.7 Flash的技术原理
- 算法迭代与快速演进机制:模型针对 Coding 和 Agent 场景的后训练优化与能力定向增强,非单纯依赖预训练规模扩张,从而在保持 Flash 系列速度优势的同时,实现软件工程与知识工作质量的跨越式提升。
- 多步骤规划与严谨推理执行:模型内置更主动的推理资源分配机制,面对复杂任务时会投入更多计算资源进行多步骤规划与工具调用,在执行过程中遇到路障时自适应调整策略、澄清意图;这种”更严谨的执行力”大幅减少了人工监督需求与反复重试次数,是其 Agent 与企业自动化能力跃升的核心技术支撑。
- 原生多模态统一理解:3.7 Flash 具备跨文本、音频、图像、代码和视频的统一理解能力,使其能在 3D 游戏生成、机器人训练闭环和文档智能转换等场景中,将视觉输入(如截图、设计稿)与语言指令融合处理,实现从静态 PDF 到交互网页、从文字描述到可运行 3D 资产的端到端生成。
- Agent 工作流与 Sub-Agent 编排:针对高频 Agent 场景进行底层优化,通过改进的指令遵循精度与路障适应能力,支持主模型调度多个 sub-agents 协同完成任务;编排能力使其在 Web 开发等场景中可并行处理布局生成、交互逻辑编写与视觉组件渲染,成为支撑长期在线、大规模调用的企业自动化后端基础设施。
如何使用Gemini 3.7 Flash
- 开发者接入:开发者可通过 Gemini API 或 Google AI Studio 直接调用模型。
- 快速体验:在 Google AI Studio 中可零成本创建项目并选择 gemini-3.7-flash 模型,快速测试文本、代码与多模态能力。
- 移动集成:Android Studio 已集成该模型,开发者可在移动应用开发流程中获得代码辅助与生成功能。
- Agent 编排:通过 Google Antigravity 这一 Agent-first 开发环境,可编排 sub-agents 构建复杂自动化工作流。
- 企业部署:企业用户可通过 Gemini Enterprise Agent Platform 自定义业务流程与工具集成,实现规模化高频调用。
- 企业使用:企业员工也可直接通过 Gemini Enterprise App 统一入口,用内置的 3.7 Flash 能力处理文档与自动化任务。
Gemini 3.7 Flash的核心优势
- 极致迭代节奏:Flash 系列从 3.5 进化到 3.7 仅用了 3 个月,3.6 到 3.7 更是压缩到 3 周,Google 对开发者反馈和市场竞争的响应速度在主流模型中无出其右。
- Coding 能力跃升:FrontierCode 1.1 Main 从 34.4% 提升至 43.6%,DeepSWE v1.1 从 49% 跃升至 65.3%,首遍代码准确率与长周期软件工程能力均获得跨越式增强,已具备生产级主力模型的代码输出质量。
- Agent 与企业自动化绝对领先:AutomationBench 得分 30.4%,不仅较自身上一代近乎翻倍,更大幅甩开 Claude Sonnet 5(10.7%)和 GPT-5.6 Terra(23.6%),成为当前企业工作流自动化场景的最强模型。
- 部分基准超越旗舰竞品:在 FrontierCode 1.1(43.6%)和 WebDev Code Arena(1588 Elo)两项关键 Coding 基准上,3.7 Flash 已反超 Claude Sonnet 5 和 GPT-5.6 Terra,打破了”Flash 只做轻量辅助”的刻板印象。
- 极致性价比壁垒:推广价输入 $0.75、输出 $3.75 每百万 Tokens,仅为 3.6 Flash 原价的一半,更是 Claude($2/$10)和 GPT($2/$12)的三分之一到四分之一;在高频 Agent 和企业级工作流中,这一成本优势随调用量指数级放大。
- 原生多模态端到端创作:支持文字直接生成可玩的 3D 游戏、截图/Design System 一键转化为交互网页、静态 PDF 自动变为带实时图表的动态数据故事,创作链路完整且无需多模型拼接。
Gemini 3.7 Flash的项目地址
- 项目官网:https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/
Gemini 3.7 Flash的同类竞品对比
| 对比维度 | Gemini 3.7 Flash | GPT-5.6 Terra |
|---|---|---|
| 发布方 | Google DeepMind | OpenAI |
| 定位 | Coding + Agent 主力模型 | 通用旗舰模型 |
| FrontierCode 1.1 | 43.6% | 41.3% |
| DeepSWE v1.1 | 65.3% | 69.6% |
| Code Arena Elo | 1588 | 1523 |
| AutomationBench | 30.4% | 23.6% |
| Terminal-bench 2.1 | 85.8% | 87.4% |
| GDP.pdf | 34.0% | 24.7% |
| 输入价格 / 1M | $0.75 | $2.00 |
| 输出价格 / 1M | $3.75 | $12.00 |
| 迭代节奏 | 3 周一更 | 数月周期 |
| 核心优势 | 性价比 + Agent 自动化 | 绝对 Coding 性能 |
Gemini 3.7 Flash的应用场景
-
智能 Coding 助手:自动生成生产级代码、调试复杂 Bug、完成长周期软件工程任务,首遍准确率较上一代大幅提升。
-
交互式 Web 开发:从截图或 Design System 输入一键生成高保真交互网页,支持多 agent 协作与视差动效。
-
企业工作流自动化:驱动 RPA 与业务系统,自动完成跨平台数据录入、审批流转、报告生成等高频重复任务。
-
3D 游戏与内容生成:配合 Nano Banana 将文字描述实时转化为可玩的 3D 游戏,动态生成角色、道具与纹理。
-
文档智能转换:将静态 PDF 年报、研报自动转化为带实时图表、数据汇总与交互功能的动态网页或数据故事。