发布时间:2025-09-28
点击次数: 9 月 26 日,腾讯宣布,混元3d生成模型家族又添新成员——混元3d-omni、混元3d-part发布并开源。这也是腾讯混元在可控3d生成上的新突破,让ai 3d建模更具实用性,加速3d生成模型在游戏、打印和 ar/vr 等实际生产流程中的落地应用。
作为业界首个统一支持多条件控制的3D生成框架,混元3D-Omni 突破传统图像输入的局限性,支持多种模态输入,实现对物体几何结构、拓扑和姿态的精细控制。混元3D-Part则实现了灵活可控的部件拆分和生成,让分解和生成3D模型像玩乐高一样简单。
混元3D-Omni、混元3D-Part将完整开放推理代码和权重,全面开源、免费使用,便于学术研究和工业部署,助力可控3D生成的社区探索。
近年来,基于原生3D表示(如点云和体素)的生成模型迅速兴起。然而,当前主流方法主要依赖图像输入,易受单视角遮挡、光照干扰,导致几何准确性不足;同时难以精细调控比例、姿态和细节,且无法适应多模态输入,限制了在复杂场景中的实用性。
混元3D-Omni 基于混元3D 2.1开源模型构建,就像 “3D界的ControlNet”,通过轻量化的统一控制编码器和渐进式难度感知训练策略,混元 3D-Omni能融合多达四类控制条件,显著提升生成的可控性和质量:
骨骼:在单图条件下加入骨骼数据,能精确调节生|成人|物资产的姿态,完美适用于动画制作或虚拟角色设计;
点云:注入完整物体点云或从深度图投影的部分点云,帮助消除单张图像的视觉歧义,提升几何细节,让3D模型更逼真可靠;
边界框:允许微调生成资产的长宽高比例,确保结果与预期对齐;
体素:针对物体结构进行精确调节,让生成的3D资产在几何细节上满足需求。

骨骼控制人物姿态

点云控制补充三维信息

边界框控制不同比例

边界框控制解决单图生成“纸片”问题

体素控制物体结构
这些控制条件可灵活组合,支持深度相机、LiDAR或重建模型等输入来源。社区开发者还可基于开源模型轻松扩展更多创意条件,如额外的人物姿态控制。

混元3D-Omni标志着3D生成从“图像主导”向“多模态可控”转型的关键一步。多模态融合的创新,不仅提升了生成的可控性和鲁棒性,还为下游应用铺平道路。想象一下,在虚拟现实项目中,你用骨骼信号控制角色动态姿势,再叠加点云细节让模型更逼真——这一切,都能在本地快速迭代,无需昂贵硬件。
与混元3D-Omni的精准生成相呼应,混元3D-Part则专注解决3D生成的“拆解难题”。
传统算法往往输出不可分割的“一体化”模型,但实际应用中,可拆解的模型则能适应更多场景的需求:比如游戏制作中,汽车模型拆分成车身和独立轮子,便于绑定滚动逻辑;3D打印时,像搭积木般逐个组件打印,能够避免大件变形风险。
混元最新推出的混元3D-Part技术,由业界首个原生3D分割模型P3-SAM 与工业级组件生成模型X-Part 组成,首次实现高精度、可控的组件式3D生成,支持50 +组件自动生成,生成的模型几何质量高、可编辑、结构合理,
让模型更易编辑、生产和应用。
P3-SAM 的组件分割结果

X-Part 的组件生成结果
用户用混元3D 2.5或3.0模型生成整体Mesh后,即可通过P3-SAM获取语义特征和边界框,进行自动、精确的组件分割,X-Part接棒将整体Mesh分解为独立部件,输出高保真、结构一致的部件几何体,同时保持灵活可控性。
美图云修
商业级AI影像处理工具
50
查看详情

Hunyuan3D-Part 组件拆分整体流程
在PartObj-Tiny、PartObj-Tiny-WT和PartNetE等基准测试中,Hunyuan3D-Part的分割和生成结果大幅超越现有工作,体现其在精度和质量上的领先优势。

X-Part 组件生成结果和开源工作对比
目前该模型也已经上线混元3D Studio,通过腾讯混元3D创作引擎即可免费使用。
过去一年,腾讯混元大模型加速迭代,发布超过30个新模型,并全面拥抱开源,混元语言、图像、视频、3D生成模型全模态、多尺寸开源,多次拿下HuggingFace模型热榜第一。混元3D系列模型是全球最受欢迎的3D开源模型,社区下载量超260万。
在 2025 腾讯全球数字生态大会上刚刚发布的混元3D 3.0生成模型,建模精度提升3倍,几何分辨率高达1536³,支持 36 亿体素超高清建模,攻克人脸雕刻难题,细节表现力显著增强。面向3D设计师、游戏开发者、建模师等群体,还推出专业级AI工作台——混元3D Studio,通过AI技术整合3D生产全流程,实现更加可控、更加高效的3D创作。
凭借超高清建模和高质量生成,腾讯混元正加速推动3D技术在各行业的落地应用。头部3D打印厂商拓竹科技、创想三维等均接入腾讯混元3D模型,大幅提升建模效率。全球首个设计Agent Lovart也在3D生成任务中首选腾讯混元3D,拓展了设计领域的创新应用。
混元3D-Omni:
代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Omni
权重:https://huggingface.co/tencent/Hunyuan3D-Omni
技术报告:https://arxiv.org/pdf/2509.21245
混元3D-Part:
代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Part
权重: https://huggingface.co/tencent/Hunyuan3D-Part
技术报告(两篇):
P3-SAM:
论文[2509.06784] P3-SAM: Native 3D Part Segmentation
项目网址:P3-SAM: Native 3D Part Segmentation
X-Part:
论文:[2509.08643] X-Part: high fidelity and structure coherent shape decomposition
项目网址:X-Part: High Fidelity And Structure Coherent Shape Decomposition
体验入口:
(轻量版)Hugging Face demo:https://huggingface.co/spaces/tencent/Hunyuan3D-Par
(满血版)混元3D Studio:腾讯混元3D
以上就是腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代的详细内容,更多请关注其它相关文章!
# 多模
# 营销网站建设公司名录
# 东港网站包年推广
# 乡镇集约网站平台建设
# 专业网站建设客服
# 品牌推广营销案例ppt
# 网站推广seo网站
# 同仁堂团购网站推广方案
# 网络营销推广引流平台
# 衢州整合营销推广系统
# 刷关键词排名软件有用吗
# 云和
# 多条
# 可拆卸
# git
# 首个
# 美图
# 两大
# 开源
# 2025
# 游戏开发
# 大模型
# 虚拟现实
# pdf
# ai
# 腾讯
# 编码
# github
相关栏目:
【
行业新闻62819 】
【
科技资讯67470 】
相关推荐:
羚客系统即将升级,推出全新的AI数字化工具
微软新出热乎论文:Transformer扩展到10亿token
爱设计PPT发布第二代AI一键生成PPT产品:智能、个性化、自动化
百度文心一言App上架苹果商店,人工智能创作引发热议
AMD在AI方面奋起直追,与英伟达的差距缩小了吗?
优地网络助力新媒体拥抱人工智能时代
美图设计室2.0使用教程
WHEE上线时间介绍
AI数字人业务频频获点赞,谦寻积极引领示范作用
“痴迷”元宇宙,魔珐科技想做什么?
当一切设备都受到人工智能的控制
人工智能如何与智能家居集成
AI和ML推动联网设备的增长
OpenAI首席执行官表态支持欧盟AI监管
人工智能的变革之路:通过OpenAI的GPT-4漫游
美妆行业在AI时代蓬勃发展
人工智能在商业中的风险和局限性
OpenAI高管:AI能创造新的就业机会 但也会淘汰一些
搭载星火认知大模型 讯飞听见智慧屏开启AI办公新体验
AYANEO AIR 1S 掌机发布:R7 7840U,预订价 4699 元起
AMD在ChinaJoy展示全新的锐龙AI笔记本,开创了人工智能领域的新时代!
自动驾驶汽车避障、路径规划和控制技术详解
“长沙造”无人机,领先的不止植保
中美陷入囚徒困境,人工智能变得不可控?可参考核不扩散条约规范
“可用”“有用”的讯飞星火认知大模型将亮相世界人工智能大会
人工智能改变网络安全和用户体验的三种方式
热点资讯:家乐福推出聊天机器人;米哈游2025年营收273.4亿元…
中国电信AI能力通过国家级金融领域权威认证并荣膺AI国际头部竞赛冠军
扎克·施奈德新片《月球叛军》曝剧照 机器人首度现身
时间、空间可控的视频生成走进现实,阿里大模型新作VideoComposer火了
两小时就能超过人类!DeepMind最新AI速通26款雅达利游戏
“五年内人类程序员将消失”预言引争议,AI真的那么强大了吗?
用AI升级会议体验!思必驰多款会议产品亮相全球智博会!
云南首例达芬奇机器人微创心脏手术成功开展
谷歌将使用公开信息训练 AI 模型,构建更强大的自家产品
警惕!AI或致虚假信息泛滥
「电子果蝇」惊动马斯克!背后是13万神经元全脑图谱,可在电脑上运行
抛媚眼给瞎子看?微软、谷歌的AI广告被广告主抵制
阿里达摩院发布免费开放100项AI专利许可的动机是什么?
苹果机器学习关键人物 Ali Farhadi 离职,回归 AI2 担任 CEO
首家承认ChatGPT影响其收入的公司Chegg选择拥抱AI ,裁减4%员工
马斯克“揭秘”人工智能真面目
AI连线 | 专访风平智能CEO林洪祥:让AI数字人拥有漂亮的外表和有趣的灵魂,安全问题是重要考量
微软最新推出的NaturalSpeech2语音合成模型:提供更准确的语音重构,避免棒读效果
OpenAI 引入个性化指令功能,消除对话中的重复偏好与信息
猿编程参加人工智能高峰论坛,推动人工智能教育解决方案在千所学校推行
AI时代,企业需要什么样的员工?
人手一部「*」!视频版Midjourney免费可用,一句话秒生酷炫大片惊呆网友
第四范式“式说”大模型入选《2025年通用人工智能创新应用案例集》
AI与5G的强强联合:唤醒数字时代的无尽潜能