400 128 6709

行业新闻

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

发布时间:2025-09-28点击次数:

9 月 26 日,腾讯宣布,混元3d生成模型家族又添新成员——混元3d-omni、混元3d-part发布并开源。这也是腾讯混元在可控3d生成上的新突破,让ai 3d建模更具实用性,加速3d生成模型在游戏、打印和 ar/vr 等实际生产流程中的落地应用。

作为业界首个统一支持多条件控制的3D生成框架,混元3D-Omni 突破传统图像输入的局限性,支持多种模态输入,实现对物体几何结构、拓扑和姿态的精细控制。混元3D-Part则实现了灵活可控的部件拆分和生成,让分解和生成3D模型像玩乐高一样简单。

混元3D-Omni、混元3D-Part将完整开放推理代码和权重,全面开源、免费使用,便于学术研究和工业部署,助力可控3D生成的社区探索。

混元3D-Omni:3D界的“ControlNet”,多条件控制一网打尽

近年来,基于原生3D表示(如点云和体素)的生成模型迅速兴起。然而,当前主流方法主要依赖图像输入,易受单视角遮挡、光照干扰,导致几何准确性不足;同时难以精细调控比例、姿态和细节,且无法适应多模态输入,限制了在复杂场景中的实用性。

混元3D-Omni 基于混元3D 2.1开源模型构建,就像 “3D界的ControlNet”,通过轻量化的统一控制编码器和渐进式难度感知训练策略,混元 3D-Omni能融合多达四类控制条件,显著提升生成的可控性和质量:

骨骼:在单图条件下加入骨骼数据,能精确调节生|成人|物资产的姿态,完美适用于动画制作或虚拟角色设计;

点云:注入完整物体点云或从深度图投影的部分点云,帮助消除单张图像的视觉歧义,提升几何细节,让3D模型更逼真可靠;

边界框:允许微调生成资产的长宽高比例,确保结果与预期对齐;

体素:针对物体结构进行精确调节,让生成的3D资产在几何细节上满足需求。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

骨骼控制人物姿态

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

点云控制补充三维信息

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

边界框控制不同比例

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

边界框控制解决单图生成“纸片”问题

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

体素控制物体结构

这些控制条件可灵活组合,支持深度相机、LiDAR或重建模型等输入来源。社区开发者还可基于开源模型轻松扩展更多创意条件,如额外的人物姿态控制。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

混元3D-Omni标志着3D生成从“图像主导”向“多模态可控”转型的关键一步。多模态融合的创新,不仅提升了生成的可控性和鲁棒性,还为下游应用铺平道路。想象一下,在虚拟现实项目中,你用骨骼信号控制角色动态姿势,再叠加点云细节让模型更逼真——这一切,都能在本地快速迭代,无需昂贵硬件。

混元3D-Part:组件式生成新范式,让3D模型像乐高一样“可拆卸“

与混元3D-Omni的精准生成相呼应,混元3D-Part则专注解决3D生成的“拆解难题”。

传统算法往往输出不可分割的“一体化”模型,但实际应用中,可拆解的模型则能适应更多场景的需求:比如游戏制作中,汽车模型拆分成车身和独立轮子,便于绑定滚动逻辑;3D打印时,像搭积木般逐个组件打印,能够避免大件变形风险。

混元最新推出的混元3D-Part技术,由业界首个原生3D分割模型P3-SAM 与工业级组件生成模型X-Part 组成,首次实现高精度、可控的组件式3D生成,支持50 +组件自动生成,生成的模型几何质量高、可编辑、结构合理,让模型更易编辑、生产和应用。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代P3-SAM 的组件分割结果

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

X-Part 的组件生成结果

用户用混元3D 2.5或3.0模型生成整体Mesh后,即可通过P3-SAM获取语义特征和边界框,进行自动、精确的组件分割,X-Part接棒将整体Mesh分解为独立部件,输出高保真、结构一致的部件几何体,同时保持灵活可控性。

美图云修 美图云修

商业级AI影像处理工具

美图云修 50 查看详情 美图云修

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

Hunyuan3D-Part 组件拆分整体流程

在PartObj-Tiny、PartObj-Tiny-WT和PartNetE等基准测试中,Hunyuan3D-Part的分割和生成结果大幅超越现有工作,体现其在精度和质量上的领先优势。

腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代

X-Part 组件生成结果和开源工作对比

目前该模型也已经上线混元3D Studio,通过腾讯混元3D创作引擎即可免费使用。

全面拥抱开源,加速各行业落地应用

过去一年,腾讯混元大模型加速迭代,发布超过30个新模型,并全面拥抱开源,混元语言、图像、视频、3D生成模型全模态、多尺寸开源,多次拿下HuggingFace模型热榜第一。混元3D系列模型是全球最受欢迎的3D开源模型,社区下载量超260万。

在 2025 腾讯全球数字生态大会上刚刚发布的混元3D 3.0生成模型,建模精度提升3倍,几何分辨率高达1536³,支持 36 亿体素超高清建模,攻克人脸雕刻难题,细节表现力显著增强。面向3D设计师、游戏开发者、建模师等群体,还推出专业级AI工作台——混元3D Studio,通过AI技术整合3D生产全流程,实现更加可控、更加高效的3D创作。

凭借超高清建模和高质量生成,腾讯混元正加速推动3D技术在各行业的落地应用。头部3D打印厂商拓竹科技、创想三维等均接入腾讯混元3D模型,大幅提升建模效率。全球首个设计Agent Lovart也在3D生成任务中首选腾讯混元3D,拓展了设计领域的创新应用。

混元3D-Omni:

代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Omni

权重:https://huggingface.co/tencent/Hunyuan3D-Omni

技术报告:https://arxiv.org/pdf/2509.21245

混元3D-Part:

代码:https://github.com/Tencent-Hunyuan/Hunyuan3D-Part

权重: https://huggingface.co/tencent/Hunyuan3D-Part

技术报告(两篇):

P3-SAM:

论文[2509.06784] P3-SAM: Native 3D Part Segmentation

项目网址:P3-SAM: Native 3D Part Segmentation

X-Part:

论文:[2509.08643] X-Part: high fidelity and structure coherent shape decomposition

项目网址:X-Part: High Fidelity And Structure Coherent Shape Decomposition

体验入口:

(轻量版)Hugging Face demo:https://huggingface.co/spaces/tencent/Hunyuan3D-Par

(满血版)混元3D Studio:腾讯混元3D

以上就是腾讯混元3D两大应用模型开源:3D生成迈入精准可控时代的详细内容,更多请关注其它相关文章!


# 多模  # 营销网站建设公司名录  # 东港网站包年推广  # 乡镇集约网站平台建设  # 专业网站建设客服  # 品牌推广营销案例ppt  # 网站推广seo网站  # 同仁堂团购网站推广方案  # 网络营销推广引流平台  # 衢州整合营销推广系统  # 刷关键词排名软件有用吗  # 云和  # 多条  # 可拆卸  # git  # 首个  # 美图  # 两大  # 开源  # 2025  # 游戏开发  # 大模型  # 虚拟现实  # pdf  # ai  # 腾讯  # 编码  # github 


相关栏目: 【 行业新闻62819 】 【 科技资讯67470


相关推荐: 羚客系统即将升级,推出全新的AI数字化工具  微软新出热乎论文:Transformer扩展到10亿token  爱设计PPT发布第二代AI一键生成PPT产品:智能、个性化、自动化  百度文心一言App上架苹果商店,人工智能创作引发热议  AMD在AI方面奋起直追,与英伟达的差距缩小了吗?  优地网络助力新媒体拥抱人工智能时代  美图设计室2.0使用教程  WHEE上线时间介绍  AI数字人业务频频获点赞,谦寻积极引领示范作用  “痴迷”元宇宙,魔珐科技想做什么?  当一切设备都受到人工智能的控制  人工智能如何与智能家居集成  AI和ML推动联网设备的增长  OpenAI首席执行官表态支持欧盟AI监管  人工智能的变革之路:通过OpenAI的GPT-4漫游  美妆行业在AI时代蓬勃发展  人工智能在商业中的风险和局限性  OpenAI高管:AI能创造新的就业机会 但也会淘汰一些  搭载星火认知大模型 讯飞听见智慧屏开启AI办公新体验  AYANEO AIR 1S 掌机发布:R7 7840U,预订价 4699 元起  AMD在ChinaJoy展示全新的锐龙AI笔记本,开创了人工智能领域的新时代!  自动驾驶汽车避障、路径规划和控制技术详解  “长沙造”无人机,领先的不止植保  中美陷入囚徒困境,人工智能变得不可控?可参考核不扩散条约规范  “可用”“有用”的讯飞星火认知大模型将亮相世界人工智能大会  人工智能改变网络安全和用户体验的三种方式  热点资讯:家乐福推出聊天机器人;米哈游2025年营收273.4亿元…  中国电信AI能力通过国家级金融领域权威认证并荣膺AI国际头部竞赛冠军  扎克·施奈德新片《月球叛军》曝剧照 机器人首度现身  时间、空间可控的视频生成走进现实,阿里大模型新作VideoComposer火了  两小时就能超过人类!DeepMind最新AI速通26款雅达利游戏  “五年内人类程序员将消失”预言引争议,AI真的那么强大了吗?  用AI升级会议体验!思必驰多款会议产品亮相全球智博会!  云南首例达芬奇机器人微创心脏手术成功开展  谷歌将使用公开信息训练 AI 模型,构建更强大的自家产品  警惕!AI或致虚假信息泛滥  「电子果蝇」惊动马斯克!背后是13万神经元全脑图谱,可在电脑上运行  抛媚眼给瞎子看?微软、谷歌的AI广告被广告主抵制  阿里达摩院发布免费开放100项AI专利许可的动机是什么?  苹果机器学习关键人物 Ali Farhadi 离职,回归 AI2 担任 CEO  首家承认ChatGPT影响其收入的公司Chegg选择拥抱AI ,裁减4%员工  马斯克“揭秘”人工智能真面目  AI连线 | 专访风平智能CEO林洪祥:让AI数字人拥有漂亮的外表和有趣的灵魂,安全问题是重要考量  微软最新推出的NaturalSpeech2语音合成模型:提供更准确的语音重构,避免棒读效果  OpenAI 引入个性化指令功能,消除对话中的重复偏好与信息  猿编程参加人工智能高峰论坛,推动人工智能教育解决方案在千所学校推行  AI时代,企业需要什么样的员工?  人手一部「*」!视频版Midjourney免费可用,一句话秒生酷炫大片惊呆网友  第四范式“式说”大模型入选《2025年通用人工智能创新应用案例集》  AI与5G的强强联合:唤醒数字时代的无尽潜能 

400 128 6709
E-mail

contact@tlftec.cn

扫一扫,添加微信

©  云南淘乐房科技有限公司 版权所有  滇ICP备2025071560号  

云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司