# 带 Deep Think 的 Gemini 高级版本在 IMO 中正式达到金牌标准

- 来源：Google DeepMind：Blog（RSS）
- 作者：Thang Luong
- 发布时间：2025-10-24 11:12
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmnwsdqal004gslag6nhxcao0
- 原文链接：https://deepmind.google/blog/advanced-version-of-gemini-with-deep-think-officially-achieves-gold-medal-standard-at-the-international-mathematical-olympiad

## 精选理由

Gemini Deep Think在IMO数学竞赛达到金牌标准，推理能力获重大突破

## AI 摘要

集成 Deep Think 的 Gemini 高级版本在国际数学奥林匹克（IMO）中达到金牌水平。IMO 自1959年起每年举办，是全球最顶尖的青年数学家竞赛，各国派出6名精英学生角逐代数、组合、几何和数论领域的6道极难题目。

## 正文

国际数学奥林匹克竞赛（IMO）是全球最负盛名的青年数学家赛事，自1959年起每年举办。每个参赛国由六名顶尖的大学预科阶段数学家组成代表队，角逐代数、组合数学、几何和数论领域六道极具挑战性的难题。奖牌授予排名前一半的参赛者，其中约8%能获得含金量极高的金牌。

近年来，IMO也成为人工智能系统的一项理想挑战，用以测试其高级数学解题与推理能力。去年，谷歌DeepMind的AlphaProof与AlphaGeometry 2组合系统达到了银牌水平，成功解答了六道题中的四道，获得28分。通过利用专业形式语言，这一突破表明AI已开始接近人类精英级别的数学推理能力。

今年，我们成为首批由IMO协调员按照与学生解答相同标准正式评分并认证模型结果的团队之一。在认可今年学生参赛者所取得显著成就的同时，我们也很高兴分享Gemini突破性表现的消息。

Gemini Deep Think在2025年IMO上取得突破性表现

一个高级版本的Gemini Deep Think完美解答了六道IMO题目中的五道，共获得35分，达到了金牌水平。解答可在此处在线查阅。

我们可以确认，谷歌DeepMind已实现这一备受期待的里程碑，在满分42分中获得了35分——这是一个金牌分数。他们的解答在许多方面都令人惊叹。IMO阅卷人员认为这些解答清晰、精确，且大部分易于理解。

IMO主席Gregor Dolinar教授博士

这一成就相比去年的突破性成果实现了显著进步。在2024年国际数学奥林匹克竞赛（IMO）中，AlphaGeometry和AlphaProof需要专家先将问题从自然语言翻译成领域特定语言（如Lean），再将证明过程反向翻译回来。此外，计算过程也需要两到三天时间。而今年，我们先进的Gemini模型以端到端方式在自然语言环境下运行，直接从官方问题描述中生成严谨的数学证明——全部在4.5小时的竞赛时限内完成。

充分发挥深度思考模式的优势

我们今年取得的成果得益于Gemini Deep Think的进阶版本——这是一种针对复杂问题的增强推理模式，融合了我们最新的多项研究技术，包括并行思考。该机制使模型能够在给出最终答案之前，同时探索并整合多种可能的解决方案，而非遵循单一的线性思维链。

为充分利用Deep Think的推理能力，我们额外采用新颖的强化学习技术对该版本Gemini进行了训练，这些技术能够利用更多多步推理、问题求解和定理证明数据。我们还为Gemini提供了经过精选的高质量数学问题解答语料库，并在其指令中补充了关于如何应对IMO题目的一般性提示与技巧。

我们将向包括数学家在内的一批可信测试者提供该Deep Think模型的某个版本，随后再向Google AI Ultra订阅用户开放。

人工智能与数学的未来

Google DeepMind与数学界保持着持续合作，但人工智能对数学领域的贡献潜力仍处于起步阶段。通过教导我们的系统以更灵活、更直观的方式进行推理，我们正逐步接近构建能够解决更复杂、更高等数学问题的AI。

虽然我们今年采用的方法完全基于 Gemini 的自然语言处理，但我们在形式化系统 AlphaGeometry 和 AlphaProof 方面也持续取得进展。我们相信，将自然语言流畅性与严谨推理（包括形式化语言中的验证推理）相结合的智能体，将成为数学家、科学家、工程师和研究人员不可或缺的工具，帮助我们在通往 AGI 的道路上拓展人类知识。

致谢

我们感谢国际数学奥林匹克竞赛组织方的支持。

本项目是一项大规模协作，其成功归功于众多个人和团队的共同努力。Thang Luong 负责 IMO 2025 工作的整体技术方向，并与 Edward Lockhart 共同负责整体协调工作。

IMO 2025 团队的负责人和主要贡献者如下：Dawsen Hwang、Junehyuk Jung、Jonathan Lee、Nate Kushman、Pol Moreno、Yi Tay、Lei Yu、Golnaz Ghiasi、Garrett Bingham、Lalit Jain、Vincent Cohen-Addad 和 Theophane Weber、Ankesh Anand、Steven Zheng、Vinh Tran、Vinay Ramasesh、Andreas Kirsch、Jieming Mao、Zicheng Xu、Wilfried Bounsi、Vahab Mirrokni、Hoang Nguyen、Fred Zhang、Mahan Malihi、Yangsibo Huang、Yuri Chervonyi、Trieu Trinh、Junsu Kim、Mirek Olšák、Marcelo Menegali、Xiaomeng Yang、Richard Song、Miklós Z. Horváth、Aja Huang、Goran Žužić。

用于 IMO 的、具备 Deep Think 能力的先进 Gemini 模型，建立在 Deep Think 团队的基础研究之上，并获得了 GDM 思考领域的赞助，以及相应的后训练工作，包括：Archit Sharma、Shubha Raghvendra、Tong He、Pei Sun、Tianhe (Kevin) Yu、Eric Ni、Siamak Shakeri、Hanzhao (Maggie) Lin、Cosmo Du、Sid Lall、Le Hou、Yuan Zhang、Yujing Zhang、Yong Cheng、Luheng He 和 Chenxi Liu。

此项工作由 Quoc Le 和 Pushmeet Kohli 担任顾问，Kristen Chiafullo 和 Alex Goldin 负责项目管理。

我们还要感谢各位专家提供数据和评估：Insuk Seo（负责人）、Jiwon Kang、Donghyun Kim、Junsu Kim、Jimin Kim、Seongbin Jeon、Yoonho Na、Seunghwan Lee、Jihoo Lee、Younghun Jo、Yongsuk Hur、Seongjae Park、Kyuhyeon Choi、Minkyu Choi、Su-Hyeok Moon、Seojin Kim、Yueun Lee、Taehun Kim、Jeeho Ryu、Seungwoo Lee、Dain Kim、Sanha Lee、Hyunwoo Choi、Aiden Jung、Youngbeom Jin、Jeonghyun Ahn、Junhwi Bae、Gyumin Kim、Nam Dung Tran、Quoc Ba Can Vo、Van Huyen Nguyen、Tuan Anh Nguyen、Thanh Dat Vo、Nguyen Nam Hung Tran、Van Khai Luong、Son Vu、Son Tra Dao、Dai Dinh Phong Tran、Thanh Dat Le、Cheng-Chiang Tsai、Kari Ragnarsson、Kiat Chuan Tan、Yahya Tabesh、Hamed Mahdavi、Azin Nazari、Chu-Lan Kao、Steven Creech、Tony Feng、Daogao Liu 和 Ciprian Manolescu。

此外，还要感谢以下各位提供的支持、协作与建议：Omer Levy、Timothy Lillicrap、Jack Rae、Yifeng Lu、Heng-tze Cheng、Denny Zhou、Ed Chi、Vahab Mirrokni、Tulsee Doshi、Madhavi Sewak、Melvin Johnson、Fernando Pereira、Benoit Schillings、Koray Kavukcuoglu、Oriol Vinyals、Jeff Dean、Demis Hassabis、Sergey Brin、Jessica Lo、Sajjad Zafar、Tom Simpson、Jane Labanowski、Andy Forbes、Sean Nakamoto、Jonathan Lai、Fabian Pedregosa、Samuel Albanie、Alex Zhai、Sara Javanmardi、Divy Thakkar、YaGuang Li、Nigamaa Nayakanti、Chenjie Gu、Chenkai Kuang、Swaroop Mishra、Filipe Miguel de Almeida、Silvio Lattanzi、Ashkan Norouzi Fard、Tal Schuster、Ziwei Ji、Honglu Fan、Xuezhi Wang、Aditi Mavalankar、Tom Schaul、Rosemary Ke、Xiangzhuo Ding、Adam Brown、Emanuel Taropa、Charlie Chen、Joe Stanton、Cip Baetu、Alvin Abdagic、Federico Lebron、Ioana Mihailescu、Soheil Hassas Yeganeh、Ashish Shenoy 和 Minh Giang。

最后，我们感谢国际数学奥林匹克（IMO）委员会 Gregor Dolinar 教授的支持与认可。

IMO 已确认我们提交的答案是完整且正确的解答。需要特别指出的是，他们的审核范围不包括验证我们的系统、流程或底层模型（详见更多信息）。
