0

0

多模态慢思考:分解原子步骤以解决复杂数学推理

聖光之護

聖光之護

发布时间:2024-11-30 21:24:02

|

1005人浏览过

|

来源于php中文网

原创

中山大学、香港科技大学、上海交通大学和华为诺亚方舟实验室的研究人员提出了一种名为 atomthink 的新框架,旨在提升多模态大语言模型 (mllm) 解决高级数学推理问题的能力。该框架通过将“慢思考”策略融入mllm,显著提高了模型在基准数学测试中的性能,并具有良好的可迁移性。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

AtomThink 框架的核心在于其对“原子步骤”的关注。“原子步骤”指的是语义上不可再分的最小推理单元。该框架包含三个关键组件:多模态注释引擎、原子步骤指令微调和策略搜索。

挑战与创新:

现有方法通常依赖于精心设计的提示来激发模型的思维链 (CoT),但忽略了推理链中中间步骤的质量。AtomThink 则通过原子步骤质量评估策略,对每个步骤进行细致分析,从而识别并改进薄弱环节。该策略借鉴了GPT-4o的推理行为,构建了一个规范的推理能力集合,并利用结果监督和重映射来评估模型在不同能力项上的得分。

图片

AtomThink 框架详解:

  1. 多模态注释引擎: 该引擎利用动态提示和短 CoT 增强策略,从现有数据集中生成高质量的长 CoT 数据。它通过GPT-4o辅助,将原始推理过程分解成多个原子步骤,并创建了 AtomMATH 数据集 (包括AMATH-SFT 和 AMATH-PRM 两个子集)。

图片

Sologo AI
Sologo AI

SologoAI 是一款AI在线LOGO生成工具,帮助用户快速创建独特且专业的品牌标识和配套VI设计。

下载
  1. 原子步骤微调: 该步骤对 MLLM 进行指令微调和过程监督训练 (PRM),以增强其解码能力,并使其学习近似马尔可夫决策过程的输出格式。

  2. 策略搜索: 为了从多个候选步骤中选择最佳路径,AtomThink 框架采用了路径维度搜索 (多数投票、Best-of-N) 和步骤维度搜索 (贪心算法、Beam Search)。

实验结果与结论:

实验结果表明,AtomThink 框架在 MathVista 和 MathVerse 两个基准测试中显著提升了模型的性能。与基线模型相比,AtomThink 在 QuickThink (快速推理) 模式下已经取得了显著改进;而在 SlowThink (慢速推理,利用 Beam Search) 模式下,性能提升更为显著,甚至超过了一倍。 Best-of-N 策略结合平均得分聚合,取得了最佳性能。 研究还验证了 Test-time scaling law 在多模态数学推理任务中的存在。

该研究为构建更强大的慢思考模型提供了新的思路,也为解决复杂数学推理问题提供了有效的解决方案。论文及代码即将开源:

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

376

2026.01.21

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

405

2023.08.14

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2057

2024.08.16

c++ 根号
c++ 根号

本专题整合了c++根号相关教程,阅读专题下面的文章了解更多详细内容。

25

2026.01.23

c++空格相关教程合集
c++空格相关教程合集

本专题整合了c++空格相关教程,阅读专题下面的文章了解更多详细内容。

29

2026.01.23

yy漫画官方登录入口地址合集
yy漫画官方登录入口地址合集

本专题整合了yy漫画入口相关合集,阅读专题下面的文章了解更多详细内容。

117

2026.01.23

漫蛙最新入口地址汇总2026
漫蛙最新入口地址汇总2026

本专题整合了漫蛙最新入口地址大全,阅读专题下面的文章了解更多详细内容。

178

2026.01.23

C++ 高级模板编程与元编程
C++ 高级模板编程与元编程

本专题深入讲解 C++ 中的高级模板编程与元编程技术,涵盖模板特化、SFINAE、模板递归、类型萃取、编译时常量与计算、C++17 的折叠表达式与变长模板参数等。通过多个实际示例,帮助开发者掌握 如何利用 C++ 模板机制编写高效、可扩展的通用代码,并提升代码的灵活性与性能。

16

2026.01.23

php远程文件教程合集
php远程文件教程合集

本专题整合了php远程文件相关教程,阅读专题下面的文章了解更多详细内容。

70

2026.01.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 18.9万人学习

Node.js 教程
Node.js 教程

共57课时 | 9.3万人学习

CSS3 教程
CSS3 教程

共18课时 | 4.8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号