0

0

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

王林

王林

发布时间:2023-11-29 14:17:20

|

1278人浏览过

|

来源于51CTO.COM

转载

在计算机图形学领域,三角形网格是表示3D几何物体的主要方式,也是游戏、电影和虚拟现实界面中最常用的3D资源表达方法。业界通常使用三角形网格来模拟复杂物体的表面,例如建筑物、车辆、动物等。同时,常见的几何变换、几何检测和渲染着色等操作也需要基于三角形网格进行

相较于点云或体素等其他的3D形状表示法,三角形网格提供了更加连贯的表面表示法:更加可控,更加易于操作,更加紧凑,并且可以直接应用于现代渲染流水线中,通过更少的基元获得更高的视觉质量

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

以前有研究人员尝试使用体素、点云和神经场等表示方法来生成3D模型,这些表示方法还需要经过后处理转换成网格,以便在下游应用中使用,比如使用Marching Cubes算法进行等值面处理

不幸的是,这种方法会导致网格过于密集,网格划分过于细致,经常会出现由过度平滑和等值曲面化引起的凹凸不平的错误,就像下图所示的那样:

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

相比之下,3D 建模专业人员建模的 3D 网格在表示上更加紧凑,同时以更少的三角形保持了清晰的细节。

一直以来,很多研究者都希望解决自动生成三角形网格的任务,以进一步简化制作 3D 资产的流程。

在最近的一篇论文中,研究者提出了新的解决方案:MeshGPT,将网格表示直接生成为一组三角形。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

论文链接可参考:https://nihalsid.github.io/mesh-gpt/static/meshgpt.pdf

在 Transformer 语言生成模型的启发下,他们采用了一种直接的序列生成方法,将三角形网格合成为三角形序列

按照文本生成的范式,研究者首先学习了三角形词汇,三角形被编码为潜在量化嵌入。为了鼓励学习到的三角形嵌入保持局部几何和拓扑特征,研究者采用了图卷积编码器。然后,这些三角形嵌入由 ResNet 解码器解码,该解码器将其处理表示三角形的 token 序列,生成三角形的顶点坐标。最终,研究者在所学词汇的基础上训练基于 GPT 的架构,从而自动生成代表网格的三角形序列,并获得了边缘清晰、高保真度的优势。

在 ShapeNet 数据集上进行的多个类别的实验表明,与现有技术相比,MeshGPT 显著提高了生成 3D 网格的质量,形状覆盖率平均提高了 9%,FID 分数提高了 30 个点。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

在社交媒体平台上,MeshGPT 也引发了热议:

有人曾说过:“这才是真正具有革命性的创意。”

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

一位网友指出,该方法的亮点在于克服了其他 3D 建模方法的最大障碍,即编辑能力。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

有人大胆预测,也许自上世纪90年代以来未被解决的所有难题都可以从Transformer中得到启示:

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

也有从事 3D / 电影制作相关行业的用户对自己的职业生涯表示担忧:

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

然而,也有人指出,根据论文中提供的生成示例来看,这种方法还没有达到大规模应用的阶段。一个专业的建模人员完全可以在5分钟内创建这些网格

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

这位评论者表示,下一步可能是由 LLM 控制 3D 种子的生成,并将图像模型添加到架构的自回归部分。走到这一步后,游戏等场景的 3D 资产制作才能实现大规模的自动化。

接下来,就让我们看看 MeshGPT 这篇论文的研究细节。

方法概述

受大语言模型进步的启发,研究者开发了一种基于序列的方法,将三角形网格作为三角形序列进行自回归生成。这种方法能生成干净、连贯和紧凑的网格,具有边缘锐利和高保真的特点。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

研究者首先从大量的 3D 物体网格中学习几何词汇的嵌入,从而能够对三角形进行编码和解码。然后,根据学习到的嵌入词库,以自回归下索引预测的方式训练用于网格生成的 Transformer。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

为了学习三角形词汇,研究者采用了图形卷积编码器,对网格的三角形及其邻域进行操作,以提取丰富的几何特征,捕捉 3D 形状的复杂细节。这些特征通过残差量化被量化为 codebook 中的 Embedding,从而有效减少了网格表示的序列长度。这些内嵌信息在排序后,在重建损失的指导下,由一维 ResNet 进行解码。这一阶段为 Transformer 的后续训练奠定了基础。

接下来,研究人员使用这些量化的几何嵌入,训练出一种类似于 GPT 的纯解码器 transformer。他们通过提取网格三角形中的几何嵌入序列,并训练 transformer 来预测序列中下一个嵌入的 codebook 索引

训练完成后,transformer 可以自回归采样,以预测嵌入序列,然后对这些嵌入进行解码,生成新颖多样的网格结构,显示出与人类绘制的网格类似的高效、不规则三角形。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

MeshGPT 采用图卷积编码器处理网格面,利用几何邻域信息捕捉表征 3D 形状复杂细节的强特征,然后利用残差量化方法将这些特征量化成 codebook 嵌入。与简单的向量量化相比,这种方法能确保更好的重建质量。在重建损失的指导下,MeshGPT 通过 ResNet 对量化后的嵌入进行排序和解码。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

本研究使用Transformer模型从预先训练的codebook词汇库中生成网格序列作为token索引。在训练过程中,图像编码器从网格表面提取特征,并将其量化为一组表面嵌入。这些嵌入被平铺,用开始和结束的token标记,然后输入到上述GPT类型的Transformer模型。解码器通过交叉熵损失进行优化,预测每个嵌入的后续codebook索引

实验结果

该研究将 MeshGPT 与常见的网格生成方法进行了比较实验,包括:

  • Polygen,通过首先生成顶点,然后生成以顶点为条件的面来生成多边形网格;
  • BSPNet,通过凸分解来表征网格;
  • AtlasNet,将 3D 网格表征为多个 2D 平面的变形。

此外,该研究还将 MeshGPT 与基于神经场的 SOTA 方法 GET3D 进行了比较。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

如图 6、图 7 和表 1 所示,在全部的 4 个类别中,MeshGPT 都优于基线方法。MeshGPT 可以生成尖锐、紧凑的网格,并具有较精细的几何细节。

具体来说,与 Polygen 相比,MeshGPT 能生成具有更复杂细节的形状,并且 Polygen 在推理过程中更容易积累错误;AtlasNet 经常出现折叠瑕疵(folding artifact),导致多样性和形状质量较低;BSPNet 使用平面的 BSP 树往往会产生具有不寻常三角测量模式的块状形状;GET3D 可生成良好的高层次形状结构,但三角形过多,且平面不完美。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea


Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

如表 2 所示,该研究还让用户对 MeshGPT 生成网格的质量进行了评估,在形状和三角测量质量方面,MeshGPT 明显优于 AtlasNet、Polygen 和 BSPNet。与 GET3D 相比,大多数用户更喜欢 MeshGPT 生成的形状质量(68%)和三角测量质量(73%)。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

重写后的内容是:新颖的形状。如图8所示,MeshGPT能够生成超出训练数据集的新颖形状,确保模型不仅仅是检索现有形状

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea


Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea

形状补全。如下图 9 所示,MeshGPT 还可以基于给定的局部形状推断出多种可能的补全,生成多种形状假设。

Transformer变革3D建模,MeshGPT生成效果惊动专业建模师,网友:革命性idea


微信 WeLM
微信 WeLM

WeLM不是一个直接的对话机器人,而是一个补全用户输入信息的生成模型。

下载

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
登录token无效
登录token无效

登录token无效解决方法:1、检查token的有效期限,如果token已经过期,需要重新获取一个新的token;2、检查token的签名,如果签名不正确,需要重新获取一个新的token;3、检查密钥的正确性,如果密钥不正确,需要重新获取一个新的token;4、使用HTTPS协议传输token,建议使用HTTPS协议进行传输 ;5、使用双因素认证,双因素认证可以提高账户的安全性。

6136

2023.09.14

登录token无效怎么办
登录token无效怎么办

登录token无效的解决办法有检查Token是否过期、检查Token是否正确、检查Token是否被篡改、检查Token是否与用户匹配、清除缓存或Cookie、检查网络连接和服务器状态、重新登录或请求新的Token、联系技术支持或开发人员等。本专题为大家提供token相关的文章、下载、课程内容,供大家免费下载体验。

816

2023.09.14

token怎么获取
token怎么获取

获取token值的方法:1、小程序调用“wx.login()”获取 临时登录凭证code,并回传到开发者服务器;2、开发者服务器以code换取,用户唯一标识openid和会话密钥“session_key”。想了解更详细的内容,可以阅读本专题下面的文章。

1064

2023.12.21

token什么意思
token什么意思

token是一种用于表示用户权限、记录交易信息、支付虚拟货币的数字货币。可以用来在特定的网络上进行交易,用来购买或出售特定的虚拟货币,也可以用来支付特定的服务费用。想了解更多token什么意思的相关内容可以访问本专题下面的文章。

1312

2024.03.01

github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

599

2026.01.21

idea快捷键大全
idea快捷键大全

本专题为大家提供idea快捷键相关的文章,帮助大家解决问题。

166

2023.08.03

idea如何集成Tomcat
idea如何集成Tomcat

idea集成Tomcat的步骤:1、添加Tomcat服务器配置;2、配置项目部署;3、运行Tomcat服务器;4、访问项目;5、注意事项;6、关闭Tomcat服务器。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

169

2024.02.23

idea怎么配置maven
idea怎么配置maven

idea配置maven的步骤:1、打开intellij idea,并确保已安装maven integration插件,可以在"file"菜单中选择"settings",然后在"plugins"选项卡中搜索并安装maven integration插件等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

119

2024.02.23

拼多多赚钱的5种方法 拼多多赚钱的5种方法
拼多多赚钱的5种方法 拼多多赚钱的5种方法

在拼多多上赚钱主要可以通过无货源模式一件代发、精细化运营特色店铺、参与官方高流量活动、利用拼团机制社交裂变,以及成为多多进宝推广员这5种方法实现。核心策略在于通过低成本、高效率的供应链管理与营销,利用平台社交电商红利实现盈利。

31

2026.01.26

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Django 教程
Django 教程

共28课时 | 3.5万人学习

Go 教程
Go 教程

共32课时 | 4.2万人学习

TypeScript 教程
TypeScript 教程

共19课时 | 2.4万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号