跳到正文
北京时间
原文
Google DeepMind:Blog(RSS)·· 2026-08-14精选AI 评分72

Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

Introducing Gemini 3.7 Flash

AI 导读

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。

推荐理由

相比 3.6 Flash,价格减半且 FrontierCode 和 DeepSWE 分数提升,让成本敏感型编码智能体团队有了新的性价比基线。

正文 · AI 翻译

这是我们迄今最智能的主力模型,专为编程和智能体打造。

Image 1: Spark icon next to the text "Gemini 3.7 Flash", all on a light blue backgorund

今天,我们在广泛使用的 Flash 系列所取得的进展之上,推出 Gemini 3.7 Flash——这是我们迄今最智能的主力模型,专为编程和智能体打造。

此次发布距离 Gemini 3.6 Flash 仅过去三周,它是开发者反馈与算法创新的直接成果,我们期待将这些创新带入未来的模型。3.7 Flash 在软件工程、知识工作和网页开发工作流方面都带来了大幅提升——其每百万 token 的 introductory 价格为 3.6 Flash 原价的一半。

为复杂工作流带来更强的智能

Image 2: a chart showing production code quality

Image 3: a chart showing long-horizon software engineering

Image 4: a chart showing web development

Image 5: a chart showing Expert PDF document comprehension

Image 6: a chart showing enterprise workflow automation

在调试和问题解决等编程任务上,3.7 Flash 相比 3.6 Flash 展现出显著提升。它还实现了更高的首次通过代码准确率,并在生成可用于生产的代码方面表现更佳,这一点在 FrontierCode 1.1 Main(43.6% 对 34.4%)和 DeepSWE v1.1(65.3% 对 49.0%)中均有体现。

在网页开发方面,3.7 Flash 能用更少的提示词生成更多可用的布局和功能完整的应用。在 UI 生成方面,该模型基于参考输入——无论是截图、图像还是完整的设计系统——都展现出高度的设计遵循度和一致性。它在 Arena.ai 的 WebDev Arena 上以 1588 对 1538 的 Elo 分数超越 3.6 Flash。

对于金融、法律和生物科学等知识密集型领域,3.7 Flash 提供了更强的推理能力和准确性。在 GDP.pdf 基准测试(一项用于测试模型处理复杂文档能力的评测)上,它显著优于 3.6 Flash(34.0% 对 22.0%)。它在 AutomationBench 上也超越了 3.6 Flash,表明它能够更有效地完成真实世界的业务工作流(30.4% 对 17.0%)。

从简单的文本提示词到完全可玩的 3D 游戏。我们使用 Gemini 3.7 Flash 结合 Nano Banana 实时动态生成角色、物品和纹理。

一次生成令人惊艳的交互式落地页。我们使用 Gemini 3.7 Flash 来编排子智能体,并使用 Gemini Omni 创建流畅的交互式视差组件。

一个机器人模型正在使用 Gemini 3.7 Flash 进行训练,利用多模态理解,在 3 个智能体组成的图循环中帮助机器人更快地学习。

从静态 PDF 到交互式数据故事。看看复杂的年度报告如何被转化为引人入胜的网页体验,配有实时图表和聚合洞察。

更好的开发者体验和价格

Gemini 3.7 Flash 相比 3.6 Flash 带来了明显更出色的开发者体验。它能更好地应对阻碍,在需要时厘清意图,并更忠实地遵循指令。它思考得更加勤勉,在多步规划和工具调用上投入更多精力。更严谨的执行意味着工程工作流中更少的人工监督和更少的重试。

3.7 Flash 将以推介价 1 提供至年底,即每 100 万输入 token 收费 $0.75、每 100 万输出 token 收费 $3.75。这一价格结合增强的模型性能,使开发者和客户能够以低成本扩展可用于生产的智能体。

Image 7: an image of a performance to cost comparison chart

早期客户反馈凸显了 3.7 Flash 的性能与精度,其取得的结果显著优于 3.6 Flash,且成本低廉。

Image 8: Quote from Cartwheel

Image 9: Quote from Harvey

Image 10: Quote from Hebbia

Image 11: Quote from LangChain

Image 12: Quote from Nunu.ai

Image 13: Quote from Open Code

Image 14: Quote from Stanford Department of Biology

用 3.7 Flash 改进 Gemini Spark

面向 Google AI Pro 和 Ultra 订阅用户、覆盖 160 多个国家 的 Gemini Spark,将从今天起使用 Gemini 3.7 Flash。我们在 I/O 上推出 Spark,作为你的个人 AI 智能体,它全天候运行,在你的指导下代表你采取行动。此次模型更新让 Spark 在知识工作中更高效,改进了对 Google Workspace 应用的 工具使用,为复杂的多技能工作流带来更高的准确性和输出质量。

借助 3.7 Flash,Gemini Spark 可以通过整合文件、起草邮件和更新状态文档,更高效地将想法转化为行动。

以安全为核心构建

我们持续努力提升 前沿安全防护措施的覆盖范围和稳健性。Gemini 3.7 Flash 在发布时配备了更新的防护措施,以防范化学、生物、放射和核(CBRN)以及网络攻击领域的滥用,同时依据 我们的生物韧性方案和我们的 网络安全项目,支持有益的用例。

如需了解更多信息,请参阅 3.7 Flash 模型卡。

立即体验

详细基准测试

Image 15: a chart displaying AI model benchmarks

来源:Google DeepMind:Blog(RSS) · deepmind.google