7月27日,上海 —— 在今日举办的2025世界人工智能大会(WAIC)腾讯论坛上,腾讯正式发布并开源混元3D世界模型1.0,成为全球首个支持沉浸式漫游、交互与仿真的开源3D场景生成模型。该技术的推出,将大幅降低3D内容创作门槛,为游戏、虚拟现实(VR)、影视制作及数字孪生等领域带来革新性工具。
混元3D世界模型1.0基于腾讯自研的“语意层次化3D场景表征及生成算法”,能够通过文本或图片输入,快速生成高精度、可交互的3D场景。相较于传统建模方式需专业团队耗时数周完成的工作,该模型可在几分钟内生成完整场景,并支持Mesh文件导出,兼容Unity、Unreal Engine、Blender等主流开发工具。
该模型的核心优势包括:
高质量生成:在权威评测中,其场景保真度(PSNR 32.5dB)、几何精度(Chamfer Distance降低23%)等指标超越现有开源方案。
可编辑性强:支持前景物体独立调整、天空背景更换,满足个性化创作需求。
端到端优化:从生成到渲染全流程优化,1080P场景生成时间控制在3分钟以内(RTX 4090)。
对于游戏行业,该模型可快速生成包含建筑、地形、植被等元素的完整3D场景,大幅缩短关卡设计周期。同时,普通用户也可通过该技术轻松创建360°沉浸式空间,并直接导入Vision Pro等VR设备,实现低门槛的虚拟体验制作。
腾讯此次不仅开源了混元3D世界模型1.0,还同步发布了0.5B、1.8B、4B、7B等不同规模的轻量化版本,适配不同算力需求。此外,配套的Blender/Unreal插件、WebGL轻量化部署方案及百万级标注数据集也已开放,助力开发者快速集成。
目前,混元3D系列模型的社区下载量已突破230万次,成为全球最受欢迎的3D开源模型之一。腾讯还预告,混元3D 2.5版本将于年内发布,重点优化物理仿真与动态场景生成能力,进一步拓展工业仿真、元宇宙构建等场景的应用潜力。

除3D生成外,腾讯混元此次还披露了多项AI技术进展:
混元TurboS:保持月更节奏,在代码生成、复杂推理等任务中表现领先。
混元T1:基于TurboS优化,推理能力进一步提升。
混元Voice/Vision:端到端语音及多模态理解模型,在多模态评测中表现优异。
腾讯表示,未来将持续推进AIGC技术的开源与落地,推动游戏、影视、工业设计等行业的智能化升级。
腾讯混元 3D 世界模型 1.0
项目主页:
https://3d-models.hunyuan.tencent.com/world/
体验地址:
https://3d.hunyuan.tencent.com/sceneTo3D
Hugging Face 模型地址:
https://huggingface.co/tencent/HunyuanWorld-1
Github 项目地址:
https://github.com/Tencent-Hunyuan/HunyuanWorld-1.0