ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Hunyuan3D-2实操教程:从单张图片到带纹理3D模型,4步产出第一个模型

Hunyuan3D-2实操教程:从单张图片到带纹理3D模型,4步产出第一个模型 Hunyuan3D-2实操教程从单张图片到带纹理3D模型4步产出第一个模型【免费下载链接】Hunyuan3D-2High-Resolution 3D Assets Generation with Large Scale Hunyuan3D Diffusion Models.项目地址: https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2建模组需要把一张产品渲染图变成能导入Blender调整纹理的3D模型。本文在CUDA显卡上跑通Hunyuan3D-2图像生成3D全流程装好环境、编译渲染模块、跑通首个.glb文件完成即算达标。先跑起来下面是最短的3步安装路径跑通后直接执行示例脚本、拿到demo.glb即算通过。第1步拉取代码。git clone https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2 cd Hunyuan3D-2第2步安装依赖。先按官方指引安装CUDA版PyTorch再装其余依赖pip install -r requirements.txt pip install -e .第3步编译两个渲染模块。仅纹理流水线需要只做几何生成可跳过cd hy3dgen/texgen/custom_rasterizer python3 setup.py install cd ../../.. cd hy3dgen/texgen/differentiable_renderer python3 setup.py install cd ../../..首次运行会自动下载模型权重第一次启动耗时较长属正常现象。它是怎么工作的Hunyuan3D-2是一个两阶段的图像生成3D系统先产出无纹理的几何网格再给这个网格贴出高分辨率贴图。网格mesh就是用三角形拼出的物体表面是Blender等3D软件的通用表示两阶段各自的输出都能单独拿去用。第一阶段Hunyuan3D-DiT1.1B参数基于流匹配扩散模型从一张或多张图片推断物体的三维形状默认推理50步第二阶段Hunyuan3D-Paint1.3B参数把参考图上的颜色和材质投影到网格上它不依赖生成几何直接给手工建模的模型上色也行。官方基准里CMMD几何细节指标3.193、纹理FID 282.429均优于对比的开源与闭源模型数值见README.md的Performance小节。这种主体清晰、背景干净的单图是最标准的输入。显存方面几何阶段约6GB两阶段全跑共16GB。核心用法这一节按三个典型场景给出最小可运行示例单图片、多视角图片、文字提示与低显存界面。用单张图片生成带纹理的3D模型两阶段管线用几行代码串起来输出是trimesh对象调用export即可存成glb/obj等格式。输入图建议用透明背景的RGBA格式RGB图先抠背景写法见examples/shape_gen.py。几何与纹理各用一个Pipeline类从同一个模型库加载。num_inference_steps50、octree_resolution380控制速度与精度参数组合参考examples/shape_gen.py。from PIL import Image from hy3dgen.shapegen import Hunyuan3DDiTFlowMatchingPipeline from hy3dgen.texgen import Hunyuan3DPaintPipeline image Image.open(assets/demo.png).convert(RGBA) mesh Hunyuan3DDiTFlowMatchingPipeline.from_pretrained(tencent/Hunyuan3D-2)(imageimage)[0] mesh Hunyuan3DPaintPipeline.from_pretrained(tencent/Hunyuan3D-2)(mesh, imageimage) mesh.export(output.glb)用多视角图片生成几何更稳的模型给到front/left/back三个视角几何与纹理对输入的还原都更严格适合手里已有多角度渲染图的场景。示例图在assets/example_mv_images/每个文件夹含front/left/back三张。多视角几何用1.1B的Hunyuan3D-2mv系列纹理可换turbo版参考examples/fast_texture_gen_multiview.py。image参数传三张图组成的列表顺序front、left、back。from PIL import Image import trimesh from hy3dgen.texgen import Hunyuan3DPaintPipeline pipeline Hunyuan3DPaintPipeline.from_pretrained( tencent/Hunyuan3D-2, subfolderhunyuan3d-paint-v2-0-turbo) mesh trimesh.load(assets/1.glb) images [Image.open(p) for p in [ assets/example_mv_images/1/front.png, assets/example_mv_images/1/left.png, assets/example_mv_images/1/back.png]] mesh pipeline(mesh, imageimages) mesh.export(demo_textured.glb)用文字提示或低显存模式启动本地界面没有现成图片、只有一句描述时可以带文字生3D开关启动Gradio界面显存小或想跑通流程再调参就用mini模型加低显存模式。启动命令加--enable_t23d才出现文本输入框内部先把文字转成图片再进3D管线。显存低于16GB就加--low_vram_mode0.6B的2mini系列内存占用更低。想快速预览可换Turbo子文件夹并加--enable_flashvdm推理从50步降到5步命令对照见docs/source/started/gradio.md。python3 gradio_app.py \ --model_path tencent/Hunyuan3D-2mini \ --subfolder hunyuan3d-dit-v2-mini \ --texgen_model_path tencent/Hunyuan3D-2 \ --enable_t23d --low_vram_mode启动后浏览器访问http://localhost:8080。要发HTTP请求生成则改用python api_server.py --host 0.0.0.0 --port 8080请求示例见docs/source/started/api.md。容易踩的坑以下几条是前几次运行的高频错误每条一行现象直接给修复动作。⚠️ 纹理阶段显存溢出几何约占6GB纹理再叠加合计16GB起步 → 加--low_vram_mode或换0.6B的Hunyuan3D-2mini。setup.py install提示找不到nvcc未装CUDA工具包或不在PATH → 安装CUDA 11.x工具包把其bin目录加入PATH后重新编译。模型下载长时间卡住默认走HuggingFace源网络慢 → 运行前执行export HF_ENDPOINThttps://hf-mirror.com。界面里看不到文本输入框启动时漏了--enable_t23d→ 给gradio_app.py命令补上该参数并重启。生成形状残留背景色或缺角输入图不是透明底 → 用hy3dgen/rembg.py里的BackgroundRemover先抠背景再喂入。接下来可以做什么跑通第一个模型后沿这三个方向深入路径均在仓库内接入Blender先启动API服务再安装blender_addon.py插件生成的模型直接落进Blender场景步骤见docs/source/started/blender.md。加速推理读examples/fast_shape_gen_with_flashvdm.pyTurbo模型加FlashVDM可把几何推理降到5步。理解模型细节各模型参数量与日期查docs/source/modelzoo.md技术报告在assets/report/Tencent_Hunyuan3D_2_0.pdf。【免费下载链接】Hunyuan3D-2High-Resolution 3D Assets Generation with Large Scale Hunyuan3D Diffusion Models.项目地址: https://gitcode.com/GitHub_Trending/hu/Hunyuan3D-2创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表