跳到正文
原文
Google DeepMind·· 2026-08-14精选AI 评分78

Google DeepMind 发布面向编码与智能体的 Gemini 3.7 Flash

Introducing Gemini 3.7 Flash

AI 导读

Google DeepMind 发布 Gemini 3.7 Flash,面向编码与智能体,距 3.6 Flash 仅三周,入门价为原先每百万 token 成本的一半。

推荐理由

Gemini 3.7 Flash 在 3.6 Flash 发布仅三周后推出,编码调试、网页生成和复杂文档处理基准均有提升,同时入门价定为原先每百万 token 成本的一半。

正文 · AI 翻译

Aug 13, 2026

|

我们迄今为止最智能的编程与智能体主力模型。



Spark icon next to the text "Gemini 3.7 Flash", all on a light blue backgorund

收听文章

[[duration]] 分钟

本内容由 Google AI 生成。生成式 AI 为实验性功能

今天,我们在广受使用的 Flash 系列进展基础上,推出 Gemini 3.7 Flash,这是我们迄今为止最智能的编程与智能体主力模型。

此次发布距 Gemini 3.6 Flash 仅三周,直接源于开发者反馈与算法创新,我们期待将这些创新带入未来的模型。3.7 Flash 在软件工程、知识工作与 Web 开发工作流方面均有显著提升——每百万 token 的入门价格为原 3.6 Flash 成本的一半。

面向复杂工作流的更强智能

a chart showing production code quality

a chart showing long-horizon software engineering

a chart showing web development

a chart showing Expert PDF document comprehension

a chart showing enterprise workflow automation

在调试与问题修复等编程任务上,3.7 Flash 相较 3.6 Flash 有明显提升。它还实现了更高的一次通过代码准确率,并在生成可用于生产的代码方面表现更好,如 FrontierCode 1.1 Main(43.6% vs 34.4%)和 DeepSWE v1.1(65.3% vs 49.0%)所示。

在 Web 开发中,3.7 Flash 能以更少的提示生成功能更完整的布局与功能齐全的应用。在 UI 生成方面,无论参考输入是截图、图片还是完整设计系统,该模型都展现出高度的设计遵循度与还原一致性。它在 Arena.ai 的 WebDev Arena 上以 1588 对 1538 的 Elo 分数超越 3.6 Flash。

在金融、法律和生物科学等知识密集型领域,3.7 Flash 带来了更强的推理能力与更高的准确率。它在 GDP.pdf 基准测试上显著超越 3.6 Flash(34.0% vs 22.0%),该评测用于检验模型处理复杂文档的能力。它在 AutomationBench 上也超越了 3.6 Flash,表明其能更有效地完成真实世界的业务工作流(30.4% vs 17.0%)。

更好的开发者体验与价格

相较 3.6 Flash,Gemini 3.7 Flash 带来了明显更好的开发者体验。它能更好地应对障碍,在需要时澄清意图,并以更高的保真度遵循指令。它思考更为认真,在多步规划与工具调用上投入更多努力。更有纪律的执行意味着在工程工作流中更少的人工监督与更少的重试。

3.7 Flash 将以入门价格供应至今年年底 1 ,输入为 $0.75/1M token,输出为 $3.75/1M token。该价格结合增强的模型性能,使开发者和客户能够以高性价比扩展可用于生产的智能体。

an image of a performance to cost comparison chart

早期客户反馈凸显了 3.7 Flash 的性能与精确度,能以低成本取得显著优于 3.6 Flash 的结果。

Quote from Box

Quote from Browser Use

Quote from Cartwheel

quote from databricks

Quote from emergent

Quote from Harvey

Quote from Hebbia

Quote from LangChain

Quote from Nunu.ai

Quote from Open Code

Quote from Pydantic

Quote from Stanford Department of Biology

借助 3.7 Flash 改进 Gemini Spark

Gemini Spark 面向超过 160 个国家 的 Google AI Pro 与 Ultra 订阅用户提供,即日起将使用 Gemini 3.7 Flash。我们在 I/O 上推出 Spark,作为 24/7 运行的个人 AI 智能体,在你的指导下代你采取行动。此次模型更新借助对 Google Workspace 应用更出色的工具使用,使 Spark 在知识工作上更高效,并为复杂的多技能工作流带来更高的准确率与输出质量。

借助 3.7 Flash,Gemini Spark 可以更高效地将想法付诸行动,包括整合文件、起草邮件以及更新状态文档。

以安全为先构建

我们持续致力于提升 Frontier Safety 防护措施 的覆盖范围与稳健性。Gemini 3.7 Flash 推出时配备了更新后的防护措施,以防范化学、生物、放射性与核(CBRN)以及网络攻击领域的滥用,同时支持有益的使用场景,这符合 我们的生物韧性方法 以及我们的 网络安全计划。

如需了解更多信息,请参阅 3.7 Flash 模型卡。

立即试用

详细基准测试

a chart displaying AI model benchmarks

在收件箱中获取来自 Google 的最新资讯

订阅我们的新闻简报,获取产品更新、活动信息、特别优惠等内容。

你的信息将按照 Google 隐私政策。 使用。你可以随时选择退出。

来源:Google DeepMind · deepmind.google