Hunyuan3D-2 完整部署指南:从文字和图片生成高分辨率3D模型
2026/9/12 4:06:00 网站建设 项目流程

Hunyuan3D-2 完整部署指南:从文字和图片生成高分辨率3D模型

【免费下载链接】Hunyuan3D-2High-Resolution 3D Assets Generation with Large Scale Hunyuan3D Diffusion Models.项目地址: https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2

Hunyuan3D-2 是一个在你本地跑起来的 3D 生成工具:输入一句文字描述,或一张物体照片,它就产出一个可直接进游戏引擎、上架电商、再丢回 Blender 继续编辑的高分辨率 3D 模型。适合游戏开发者、电商设计师和 3D 创作爱好者。跑通之后,你手里拿到的是一个带纹理的 .glb 文件,浏览器里直接旋转查看。

一、环境自检

先把机器要求对一遍,缺了哪项就先补哪项。

项目要求
操作系统Windows 10/11 64 位
Python3.10.x(推荐 3.10.9)
显卡NVIDIA(RTX 3060 及以上)
内存16 GB
磁盘20 GB 可用空间

运行python --version确认是 3.10;再执行nvidia-smi,能正常显示显卡和驱动版本就说明 CUDA 侧就绪。

二、三步装好

第一步,下载代码。

git clone https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2 cd Hunyuan3D-2

第二步,安装依赖。

pip install -r requirements.txt

依赖起冲突时,先建一个干净环境再装:

python -m venv venv venv\Scripts\activate

第三步,编译原生模块。纹理生成依赖两个 C++ 扩展,必须各自编译一次:

cd hy3dgen/texgen/custom_rasterizer && python setup.py install && cd ../../..
cd hy3dgen/texgen/differentiable_renderer && python setup.py install && cd ../../..

🔧 报cl.exe not found或找不到头文件,多半是编译器环境没进对:确认 Visual Studio 2022 装了「C++ 桌面开发」组件(含 MSVC 与 Windows SDK),然后以管理员身份打开 “x64 Native Tools Command Prompt for VS 2022”,在那个窗口里重新跑上面的编译命令。

三、跑通第一个模型

最简单的入口是 Gradio 网页界面。

python gradio_app.py --enable_tex

启动后浏览器会自动打开。上传 assets/example_images/ 里任意一张图,或直接输入一句描述,点「生成」。按硬件不同大约等 2–8 分钟,页面会出现一个可拖拽旋转的 3D 模型,点导出即可存成 .glb。

拿雕塑图 075.png 走一遍就是「图生 3D」:把一张 2D 照片变成带立体结构的模型,适合文物数字化这类场景。

预期结果:模型轮廓跟原图一致,表面贴上纹理,能直接进 Blender 或游戏引擎继续处理。

四、使用入口

三种方式按需选,互不冲突。

🖥️Gradio 界面(可视化)。命令就是上面那条。界面支持三种模式:文字生成(输描述即可)、图片转 3D(传单张图)、多视角合成(上传前/后/左/右几张图,assets/example_mv_images/ 下有现成套图,融合后结构更准)。

Blender 插件(专业工作流)。打开 Blender 3.0+,进「编辑 → 偏好设置 → 插件」,点「安装」选项目里的blender_addon.py,启用后在 3D 视图侧边栏找到「Hunyuan3D-2 3D Generator」面板。生成结果自动进当前场景,方便接着建模。

API 服务(开发集成)。

python api_server.py --host 0.0.0.0 --port 8080 --enable_tex

把图片转成 base64 后放进 JSON({"image":"<base64>","texture":true}),POST 到http://localhost:8080/generate,响应直接是 .glb 文件。一行请求即可:

curl -X POST "http://localhost:8080/generate" -H "Content-Type: application/json" -d '{"image":"<base64>","texture":true}' -o output.glb

文本模式生成一个卡通角色,比如输入「穿着龙年服饰的卡通企鹅」,得到的模型见下图。

五、调优指南

原理上它分两步走:先由 Hunyuan3D-DIT 从文字或图像里「捏」出形状毛坯,再由 Hunyuan3D-Paint 给毛坯贴上纹理。打个比方,前者像捏泥塑定型,后者像给雕塑上色。

按硬件选参数组合:

硬件配置参数组合生成时间模型质量
RTX 4070 以上--fp16 --flashvdm --resolution 3843–5 分钟
RTX 3060--steps 30 --resolution 2565–8 分钟
GTX 1660--model_path tencent/Hunyuan3D-2mini --resolution 1282–4 分钟基础

三个关键参数:

  • --octree_resolution:它控制模型细节精度(默认 256),调高细节更丰富但显存占用更大,调低则更省显存但边缘变粗。
  • --guidance_scale:它控制结果与输入的贴合程度(建议 5.0–10.0),调高更贴描述但多样性下降,调低更发散但可能跑偏。
  • --texture_guidance_scale:它控制纹理细节强度,调高纹理更锐利,纹理发虚时可以试 7.5。

六、排错

显存不足(CUDA out of memory):降分辨率到--resolution 128,或换 mini 模型--model_path tencent/Hunyuan3D-2mini,也可去掉--enable_tex先只出形状。

编译报cl.exe not found或头文件缺失:装全 VS2022 的 C++ 桌面开发组件,并改用 x64 Native Tools Command Prompt 重新编译。

模型纹理模糊:把推理步数加到--steps 50,或提高--resolution 384,再配合--texture_guidance_scale 7.5增强细节。

pip 依赖起冲突:建虚拟环境(见第二节)后再装,避免和系统里的包互相打架。

七、资源与后续

把想法从一张图或一句话变成可编辑的 3D 资产,这条链路到这里就通了。

  • 官方文档:docs/
  • 示例代码:examples/
  • 模型权重:启动时自动下载,首次运行需联网

【免费下载链接】Hunyuan3D-2High-Resolution 3D Assets Generation with Large Scale Hunyuan3D Diffusion Models.项目地址: https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询