Hunyuan3D

Hunyuan3D是由騰訊開發的3D生成大模型,於2024年11月5日首次發布開源版本Hunyuan3D-1.0。該模型採用兩階段生成架構,支持文本生成3D(Text-to-3D)和圖像生成3D(Image-to-3D)雙模態輸入,通過多視角擴散模型和前饋重建模型實現高效建模。輕量版模型在NVIDIA A100 GPU上僅需10秒即可生成高質量3D格線,標準版生成時間為25秒,支持建築、工具、花草等不同尺度物體的3D重建。

截至2025年3月,模型已疊代至Hunyuan3D-2 Turbo版本,通過自研FlashVDM架構實現秒級生成速度,較前代提速30倍。開源生態覆蓋Hugging Face、GitHub等技術社區,提供代碼、模型權重及ComfyUI/TensorRT適配版本。

基本介紹

  • 中文名:混元3D
  • 外文名:Hunyuan3D
  • 發布時間:2024年11月5日
  • 開發者:騰訊公司 
  • 開源時間:2024年11月5日
  • 支持模態:文本/圖像輸入 
  • 生成速度:輕量版10秒 
  • 套用場景:遊戲/導航/UGC
技術架構,功能特性,技術參數,套用場景,開源生態,技術限制,所獲榮譽,

技術架構

採用兩階段生成框架:第一階段通過多視角擴散模型在4秒內生成多視角RGB圖像,第二階段利用前饋重建模型在7秒內完成3D資產重建。2025年升級的Hunyuan3D-2版本引入幾何生成大模型(3D-DiT)與紋理生成大模型(3D-Paint)解耦架構,支持1分鐘級快速處理。
2025年發布的Turbo加速版採用自研FlashVDM架構,通過漸進式流蒸餾技術將推理步驟壓縮至5步,結合層次化體素解碼技術,顯存占用降至5GB以內,支持多型號顯示卡及CPU運行。

功能特性

  • 雙模態支持:兼容文本描述與圖像輸入條件,支持混合輸入及自適應分類器引導技術
  • 高效生成能力:輕量版生成耗時10秒,Turbo版本實現秒級生成,計算量減少超95%
  • 材質渲染最佳化:升級PBR(基於物理的渲染)材質系統,增強表面反射與漫反射效果
  • 格式兼容性:輸出格式包括OBJ/GLB/GIF/STL/USDZ等主流3D格式,支持Blender外掛程式集成

技術參數

  • 模型規模:標準版參數量為輕量版3倍,Hunyuan3D-1.0版本達到3B規模
  • 硬體需求:標準版要求40GB顯存,Turbo版本支持RTX 3090等消費級顯示卡
  • 訓練數據:基於GSO與OmniObject3D數據集最佳化,幾何細節指標優於主流開源方案

套用場景

在騰訊地圖業務中實現3D導航車標生成效率提升91%,元寶APP集成個性化3D角色生成功能。騰訊雲HAI平台提供可視化部署界面,支持一鍵部署Hunyuan3D-1.0模型。2025年新增3D列印套用支持,可直接生成符合工業標準的STL檔案。

開源生態

開源內容包括模型權重、推理代碼、訓練工具及WebUI界面。開發者可通過Hugging Face獲取輕量版/標準版/稀疏視角重建模型。2025年新增ComfyUI適配版本,支持節點式參數配置。

技術限制

現有版本存在複雜場景細節缺失、泛化能力不足及高算力需求等瓶頸。在生成超過200萬面的高精度模型時,標準版需搭配專業級GPU集群。

所獲榮譽

2025年7月,混元3D獲評2025全球百大AI套用(AI內容創作與生成)。

相關詞條

熱門詞條

聯絡我們