0

0

谷歌数学AI在Nature发表文章:证明超越1978年吴文俊法定理,展示世界级几何水平

王林

王林

发布时间:2024-01-18 18:18:20

|

1152人浏览过

|

来源于51CTO.COM

转载

谷歌deepmind再发nature,alpha系列ai重磅回归,数学水平突飞猛进。

AlphaGeometry,无需人类演示达到IMO金牌选手的几何水平。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

有当年AlphaZero无需人类知识学围棋《Mastering the game of Go without human knowledge》的感觉了。

AlphaGeometry在30道IMO难度的几何定理证明题中做对了25道,而人类金牌选手平均做对了25.9道。此外,之前SOTA方法(1978年的吴文俊法)仅能做对10道。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

IMO金牌得主陈谊廷(Evan Chen)负责评估AI生成的答案,他评价到:

AlphaGeometry的输出令人印象深刻,既可靠又干净。过去的人工智能解决方案存在偶然性,导致输出有时需要人工检查。

AlphaGeometry的解决方案具有可验证的结构,既可以由机器验证,也可以由人类理解。它使用经典几何规则,如角度和相似三角形,就像学生一样。

除成绩亮眼之外,这项研究中还有三个重点引起业界关注:

  • 无需人类演示,也就是只用了AI合成数据训练,延续了AlphaZero自学围棋的方式。
  • 大模型结合其他AI方法,与AlphaGo和OpenAI Q*传闻相似。
  • 与许多先前方法不同,AlphaGeometry可以生成人类可读的证明过程,且模型和代码都开源。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

团队认为,AlphaGeometry提供了一个实现高级推理能力、发现新知识的潜在框架。

这可能有助于推动人工智能的定理证明——被视为构建AGI的关键一步。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

另外,量子位在与作者团队交流过程中,打听到了是否真的会让AlphaGeometry去参加一届IMO竞赛,就像当年AlphaGo挑战人类围棋冠军一样。

他们表示正在努力提高系统的能力,还需要让AI能解决几何之外更广泛的数学问题。

AI证明几何也画辅助线

此前AI系统不能很好解决几何问题,卡就卡在缺乏优质训练数据。

人类学习几何可以借助纸和笔,在图像上使用现有知识来发现新的、更复杂的几何属性和关系。

谷歌团队为此用生成了10亿个随机几何对象图,以及其中点和线间的所有关系,最终筛选出1亿不同难度的独特定理和证明,AlphaGeometry在这些数据上完全从头训练。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

系统由两个模块组成,相互配合寻找复杂的几何证明。

  • 语言模型,预测可用来解决问题的几何结构(也就是添加辅助线)
  • 符号推理引擎,使用逻辑规则推导出结论。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

一作Trieu Trinh介绍,AlphaGeometry的运作过程类似人脑分为快与慢两种类型。

也就是诺贝尔经济学奖得主丹尼尔·卡尼曼的畅销书《思考快与慢》中普及的“系统1、系统2”概念。

沁言学术
沁言学术

你的论文写作AI助理,永久免费文献管理工具,认准沁言学术

下载

系统1提供快速、直观的想法,系统2提供更加深思熟虑、理性的决策。

一方面,语言模型擅长识别数据中的模式和关系,可以快速预测潜在有用的辅助结构,但通常缺乏严格推理或解释其决策的能力。

另一方面,符号推理引擎基于形式逻辑并使用明确的规则来得出结论。它们是理性且可解释的,但它们缓慢且不灵活,尤其是在独自处理大型、复杂的问题时。

例如在解决一道IMO 2015年的竞赛题时,蓝色部分为AlphaGeometry的语言模型添加的辅助结构,绿色部分是最终证明的精简版,共有109个步骤。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

在做题过程中,AlphaGeometry还发现了2004年IMO竞赛题中一个未使用的前提条件,并因此发现了更广义的定理版本。

不需要O是BC的中点这个条件,就能证明P、B、C共线。

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

另外研究还发现,对于人类得分最低的3个问题,AlphaGeometry也需要非常长的证明过程和添加非常多的辅助结构才能解决。

但在相对简单的问题上,人类平均得分和AI生成的证明长度之间没有显著相关性 (p = −0.06)

谷歌数学AI登Nature:IMO金牌几何水平,定理证明超越1978年吴文俊法

One More Thing

对于AlphaGeometry与AlphaGo的联系和区别,在与团队交流过程中,谷歌科学家Quoc Le介绍到:

他们都是在一个非常复杂的决策空间中搜索,但AlphaGo的方法更传统(注:神经网络负责模式识别),AlphaGeometry中的神经网络负责建议下一步要采取的行动,指导搜索算法在决策空间中向正确的方向移动。

虽然这次成果随Alpha系列命名,第一单位也是Google DeepMind,但其实作者主要是前谷歌大脑成员。

Quoc Le大神不用过多介绍,一作Trieu Trinh与通讯作者Thang Luong都在谷歌工作了六七年,Thang Luong自己高中时也是IMO选手。

两位华人作者中,何河是纽约大学助理教授。吴宇怀此前参与了谷歌数学大模型Minerva研究,现在已经离开谷歌加入马斯克团队,成为xAI的联合创始人之一。

论文地址:https://www.nature.com/articles/s41586-023-06747-5。

参考链接:
[1]https://www.nature.com/articles/d4186-024-00141-5。

[2]https://deepmind.google/discover/blog/alphageometry-an-olympiad-level-ai-system-for-geometry。

相关专题

更多
页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

403

2023.08.14

人工智能在生活中的应用
人工智能在生活中的应用

人工智能在生活中的应用有语音助手、无人驾驶、金融服务、医疗诊断、智能家居、智能推荐、自然语言处理和游戏设计等。本专题为大家提供人工智能相关的文章、下载、课程内容,供大家免费下载体验。

411

2023.08.17

人工智能的基本概念是什么
人工智能的基本概念是什么

人工智能的英文缩写为AI,是研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的一门新的技术科学;该领域的研究包括机器人、语言识别、图像识别、自然语言处理和专家系统等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

304

2024.01.09

人工智能不能取代人类的原因是什么
人工智能不能取代人类的原因是什么

人工智能不能取代人类的原因包括情感与意识、创造力与想象力、伦理与道德、社会交往与沟通能力、灵活性与适应性、持续学习和自我提升等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

628

2024.09.10

Python 人工智能
Python 人工智能

本专题聚焦 Python 在人工智能与机器学习领域的核心应用,系统讲解数据预处理、特征工程、监督与无监督学习、模型训练与评估、超参数调优等关键知识。通过实战案例(如房价预测、图像分类、文本情感分析),帮助学习者全面掌握 Python 机器学习模型的构建与实战能力。

34

2025.10.21

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

1989

2024.08.16

高德地图升级方法汇总
高德地图升级方法汇总

本专题整合了高德地图升级相关教程,阅读专题下面的文章了解更多详细内容。

72

2026.01.16

全民K歌得高分教程大全
全民K歌得高分教程大全

本专题整合了全民K歌得高分技巧汇总,阅读专题下面的文章了解更多详细内容。

131

2026.01.16

C++ 单元测试与代码质量保障
C++ 单元测试与代码质量保障

本专题系统讲解 C++ 在单元测试与代码质量保障方面的实战方法,包括测试驱动开发理念、Google Test/Google Mock 的使用、测试用例设计、边界条件验证、持续集成中的自动化测试流程,以及常见代码质量问题的发现与修复。通过工程化示例,帮助开发者建立 可测试、可维护、高质量的 C++ 项目体系。

54

2026.01.16

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
550W粉丝大佬手把手从零学JavaScript
550W粉丝大佬手把手从零学JavaScript

共1课时 | 0.2万人学习

尚硅谷JavaScript高级视频教程
尚硅谷JavaScript高级视频教程

共48课时 | 14.6万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号