跳到正文
北京时间
原文
Google DeepMind:Blog·· 2026-02-13精选AI 评分69

Google DeepMind 发布 Gemini 3 Deep Think 重大升级

Gemini 3 Deep Think: Advancing science, research and engineering

AI 导读

Google DeepMind 发布 Gemini 3 Deep Think 专项推理模式重大升级,面向科研与工程难题。

推荐理由

原文给出多个基准分数和开放渠道,读者可以据此评估这一推理模式在科研与工程场景的可用性。

正文 · AI 翻译

2026年2月12日

|

我们最专业的推理模式现已更新,以解决现代科学、研究和工程领域的挑战。


Deep Think 团队


Gemini 3 Deep Think logo

收听文章

[[duration]] 分钟

此内容由 Google AI 生成。生成式 AI 仍处于实验阶段

今天,我们发布了对 Gemini 3 Deep Think 的重大升级,这是我们专门的推理模式,旨在推动智能的前沿,并解决科学、研究和工程领域的现代挑战。

我们与科学家和研究人员密切合作,更新了 Gemini 3 Deep Think,以应对棘手的研究挑战——这些问题往往缺乏明确的边界或单一正确答案,数据也常常杂乱或不完整。通过将深厚的科学知识与日常工程实用性相结合,Deep Think 超越了抽象理论,推动了实际应用。

新的 Deep Think 现已在 Gemini 应用中面向 Google AI Ultra 订阅者开放,并且我们首次通过 Gemini API 向部分研究人员、工程师和企业提供 Deep Think。请在此表达早期访问意向。

以下是我们的早期测试者如何使用最新 Deep Think 的:

以数学和算法的严谨性提升推理能力

去年,我们展示了 Deep Think 的专门版本能够成功应对一些最艰难的推理挑战,在数学和编程世界锦标赛上达到了金牌标准。最近,Deep Think 使专门的智能体能够进行研究级数学探索。

更新后的 Deep Think 模式继续推动智能的前沿,在最严格的学术基准测试中达到新高度,包括:

  • 在 Humanity's Last Exam 上树立新标准(无工具辅助下达到 48.4%),该基准旨在测试现代前沿模型的极限
  • 在 ARC-AGI-2 上取得前所未有的 84.6%,并经 ARC Prize Foundation 验证
  • 在 Codeforces 上达到惊人的 3455 Elo,该基准由竞技编程挑战组成
  • 在 2025 年国际数学奥林匹克竞赛中达到金牌水平表现

Gemini 3 Deep Think evaluations charts

驾驭复杂的科学领域

除了数学和竞技编程之外,Gemini 3 Deep Think 现在还在化学和物理等广泛的科学领域表现出色。我们更新后的 Deep Think 模式在 2025 年国际物理奥林匹克竞赛和化学奥林匹克竞赛的笔试部分展示了金牌水平的结果。它还展示了在高级理论物理方面的能力,在 CMT-Benchmark 上取得了 50.5% 的分数。

Gemini 3 Deep Think evaluation table

加速现实世界的工程应用

除了其最先进的性能外,Deep Think 还旨在推动实际应用,使研究人员能够解读复杂数据,工程师能够通过代码对物理系统进行建模。最重要的是,我们正在努力将 Deep Think 带给最需要它的研究人员和从业者——首先从 Gemini API 等界面开始。

借助更新后的 Deep Think,你可以将草图变为可 3D 打印的现实。Deep Think 分析图纸,对复杂形状进行建模,并生成文件以通过 3D 打印创建实物。

通过我们的早期访问计划,面向 Google AI Ultra 订阅者和 Gemini API 开放

Google AI Ultra 订阅用户从今天起可在 Gemini 应用中访问更新后的 Deep Think 模式。科学家、工程师和企业现在也可以通过 Gemini API 表达兴趣,加入我们的早期访问计划来测试 Deep Think。

我们迫不及待想看到你的发现。

来源:Google DeepMind:Blog · deepmind.google