0

0

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

看不見的法師

看不見的法師

发布时间:2025-09-28 12:01:29

|

438人浏览过

|

来源于php中文网

原创

9 月 26 日,腾讯宣布,混元3d生成模型家族又添新成员——混元3d-omni、混元3d-part发布并开源。这也是腾讯混元在可控3d生成上的新突破,让ai 3d建模更具实用性,加速3d生成模型在游戏、打印和 ar/vr 等实际生产流程中的落地应用。

作为业界首个统一支持多条件控制的3D生成框架,混元3D-Omni 突破传统图像输入的局限性,支持多种模态输入,实现对物体几何结构、拓扑和姿态的精细控制。混元3D-Part则实现了灵活可控的部件拆分和生成,让分解和生成3D模型像玩乐高一样简单。

混元3D-Omni、混元3D-Part将完整开放推理代码和权重,全面开源、免费使用,便于学术研究和工业部署,助力可控3D生成的社区探索。

混元3D-Omni:3D界的“ControlNet”,多条件控制一网打尽

近年来,基于原生3D表示(如点云和体素)的生成模型迅速兴起。然而,当前主流方法主要依赖图像输入,易受单视角遮挡、光照干扰,导致几何准确性不足;同时难以精细调控比例、姿态和细节,且无法适应多模态输入,限制了在复杂场景中的实用性。

混元3D-Omni 基于混元3D 2.1开源模型构建,就像 “3D界的ControlNet”,通过轻量化的统一控制编码器和渐进式难度感知训练策略,混元 3D-Omni能融合多达四类控制条件,显著提升生成的可控性和质量:

骨骼:在单图条件下加入骨骼数据,能精确调节生成人物资产的姿态,完美适用于动画制作或虚拟角色设计;

点云:注入完整物体点云或从深度图投影的部分点云,帮助消除单张图像的视觉歧义,提升几何细节,让3D模型更逼真可靠;

边界框:允许微调生成资产的长宽高比例,确保结果与预期对齐;

体素:针对物体结构进行精确调节,让生成的3D资产在几何细节上满足需求。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

骨骼控制人物姿态

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

点云控制补充三维信息

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

边界框控制不同比例

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

边界框控制解决单图生成“纸片”问题

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

体素控制物体结构

这些控制条件可灵活组合,支持深度相机、LiDAR或重建模型等输入来源。社区开发者还可基于开源模型轻松扩展更多创意条件,如额外的人物姿态控制。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

混元3D-Omni标志着3D生成从“图像主导”向“多模态可控”转型的关键一步。多模态融合的创新,不仅提升了生成的可控性和鲁棒性,还为下游应用铺平道路。想象一下,在虚拟现实项目中,你用骨骼信号控制角色动态姿势,再叠加点云细节让模型更逼真——这一切,都能在本地快速迭代,无需昂贵硬件。

混元3D-Part:组件式生成新范式,让3D模型像乐高一样“可拆卸“

与混元3D-Omni的精准生成相呼应,混元3D-Part则专注解决3D生成的“拆解难题”。

传统算法往往输出不可分割的“一体化”模型,但实际应用中,可拆解的模型则能适应更多场景的需求:比如游戏制作中,汽车模型拆分成车身和独立轮子,便于绑定滚动逻辑;3D打印时,像搭积木般逐个组件打印,能够避免大件变形风险。

混元最新推出的混元3D-Part技术,由业界首个原生3D分割模型P3-SAM 与工业级组件生成模型X-Part 组成,首次实现高精度、可控的组件式3D生成,支持50 +组件自动生成,生成的模型几何质量高、可编辑、结构合理,让模型更易编辑、生产和应用。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代P3-SAM 的组件分割结果

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

X-Part 的组件生成结果

AskAI
AskAI

无代码AI模型构建器,可以快速微调GPT-3模型,创建聊天机器人

下载

用户用混元3D 2.5或3.0模型生成整体Mesh后,即可通过P3-SAM获取语义特征和边界框,进行自动、精确的组件分割,X-Part接棒将整体Mesh分解为独立部件,输出高保真、结构一致的部件几何体,同时保持灵活可控性。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

Hunyuan3D-Part 组件拆分整体流程

在PartObj-Tiny、PartObj-Tiny-WT和PartNetE等基准测试中,Hunyuan3D-Part的分割和生成结果大幅超越现有工作,体现其在精度和质量上的领先优势。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

X-Part 组件生成结果和开源工作对比

目前该模型也已经上线混元3D Studio,通过腾讯混元3D创作引擎即可免费使用。

全面拥抱开源,加速各行业落地应用

过去一年,腾讯混元大模型加速迭代,发布超过30个新模型,并全面拥抱开源,混元语言、图像、视频、3D生成模型全模态、多尺寸开源,多次拿下HuggingFace模型热榜第一。混元3D系列模型是全球最受欢迎的3D开源模型,社区下载量超260万。

2025 腾讯全球数字生态大会上刚刚发布的混元3D 3.0生成模型,建模精度提升3倍,几何分辨率高达1536³,支持 36 亿体素超高清建模,攻克人脸雕刻难题,细节表现力显著增强。面向3D设计师、游戏开发者、建模师等群体,还推出专业级AI工作台——混元3D Studio,通过AI技术整合3D生产全流程,实现更加可控、更加高效的3D创作。

凭借超高清建模和高质量生成,腾讯混元正加速推动3D技术在各行业的落地应用。头部3D打印厂商拓竹科技、创想三维等均接入腾讯混元3D模型,大幅提升建模效率。全球首个设计Agent Lovart也在3D生成任务中首选腾讯混元3D,拓展了设计领域的创新应用。

混元3D-Omni:

代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Omni

权重:https://huggingface.co/tencent/Hunyuan3D-Omni

技术报告:https://arxiv.org/pdf/2509.21241245

混元3D-Part:

代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Part

权重: https://huggingface.co/tencent/Hunyuan3D-Part

技术报告(两篇):

P3-SAM:

论文[2509.06784] P3-SAM: Native 3D Part Segmentation

项目网址:P3-SAM: Native 3D Part Segmentation

X-Part:

论文:[2509.08643] X-Part: high fidelity and structure coherent shape decomposition

项目网址:X-Part: High Fidelity And Structure Coherent Shape Decomposition

体验入口:

(轻量版)Hugging Face demo:https://huggingface.co/spaces/tencent/Hunyuan3D-Par

(满血版)混元3D Studio:腾讯混元3D

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

3512

2026.01.21

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

486

2023.08.14

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2799

2024.08.16

PHP高性能API设计与Laravel服务架构实践
PHP高性能API设计与Laravel服务架构实践

本专题围绕 PHP 在现代 Web 后端开发中的高性能实践展开,重点讲解基于 Laravel 框架构建可扩展 API 服务的核心方法。内容涵盖路由与中间件机制、服务容器与依赖注入、接口版本管理、缓存策略设计以及队列异步处理方案。同时结合高并发场景,深入分析性能瓶颈定位与优化思路,帮助开发者构建稳定、高效、易维护的 PHP 后端服务体系。

5

2026.03.04

AI安装教程大全
AI安装教程大全

2026最全AI工具安装教程专题:包含各版本AI绘图、AI视频、智能办公软件的本地化部署手册。全篇零基础友好,附带最新模型下载地址、一键安装脚本及常见报错修复方案。每日更新,收藏这一篇就够了,让AI安装不再报错!

12

2026.03.04

Swift iOS架构设计与MVVM模式实战
Swift iOS架构设计与MVVM模式实战

本专题聚焦 Swift 在 iOS 应用架构设计中的实践,系统讲解 MVVM 模式的核心思想、数据绑定机制、模块拆分策略以及组件化开发方法。内容涵盖网络层封装、状态管理、依赖注入与性能优化技巧。通过完整项目案例,帮助开发者构建结构清晰、可维护性强的 iOS 应用架构体系。

33

2026.03.03

C++高性能网络编程与Reactor模型实践
C++高性能网络编程与Reactor模型实践

本专题围绕 C++ 在高性能网络服务开发中的应用展开,深入讲解 Socket 编程、多路复用机制、Reactor 模型设计原理以及线程池协作策略。内容涵盖 epoll 实现机制、内存管理优化、连接管理策略与高并发场景下的性能调优方法。通过构建高并发网络服务器实战案例,帮助开发者掌握 C++ 在底层系统与网络通信领域的核心技术。

25

2026.03.03

Golang 测试体系与代码质量保障:工程级可靠性建设
Golang 测试体系与代码质量保障:工程级可靠性建设

Go语言测试体系与代码质量保障聚焦于构建工程级可靠性系统。本专题深入解析Go的测试工具链(如go test)、单元测试、集成测试及端到端测试实践,结合代码覆盖率分析、静态代码扫描(如go vet)和动态分析工具,建立全链路质量监控机制。通过自动化测试框架、持续集成(CI)流水线配置及代码审查规范,实现测试用例管理、缺陷追踪与质量门禁控制,确保代码健壮性与可维护性,为高可靠性工程系统提供质量保障。

77

2026.02.28

Golang 工程化架构设计:可维护与可演进系统构建
Golang 工程化架构设计:可维护与可演进系统构建

Go语言工程化架构设计专注于构建高可维护性、可演进的企业级系统。本专题深入探讨Go项目的目录结构设计、模块划分、依赖管理等核心架构原则,涵盖微服务架构、领域驱动设计(DDD)在Go中的实践应用。通过实战案例解析接口抽象、错误处理、配置管理、日志监控等关键工程化技术,帮助开发者掌握构建稳定、可扩展Go应用的最佳实践方法。

60

2026.02.28

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Git 教程
Git 教程

共21课时 | 4万人学习

Git版本控制工具
Git版本控制工具

共8课时 | 1.6万人学习

Git中文开发手册
Git中文开发手册

共0课时 | 94人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号