Skip to content

Repository files navigation

Modly-Turnaround

English | 简体中文

面向 Windows + AMD Radeon RX 5000/6000/7000 系列的 DirectML Image-to-3D 工作流。

Modly-Turnaround 要填补的明确缺口,是主流 Image-to-3D 工具没有完整覆盖的 Windows + AMD GPU 本地生产路径。它把横向排列的 正面 / 左侧 / 背面 图交给本机 Modly API 和 Hunyuan3D 多视图节点生成白模,再以确定性纹理投影完成 UV、颜色图集、PBR GLB 与离线验收预览。

本项目是 Modly 的配套工具,不是 Modly,也不随包分发 Modly、模型权重或完整 Python 运行环境。运行完整流水线前,必须单独安装兼容版本的 Modly,并启动其本地 API。

公开发行边界: 发布脚本会无条件排除整个 third_party/hunyuan3d/。公开 ZIP 不包含 Hunyuan 源码、源码归档、模型权重或上游许可副本;使用者必须自行提供其有权使用的完整 DirectML 兼容 source_root

为什么是 Windows + AMD DirectML

现有主流 Image-to-3D 工具对 Windows + AMD 用户存在明确缺口:

  • Modly 0.4.1 与当前 main:扩展安装器的 GPU 探测路径运行 nvidia-smi;Windows AMD 环境无法通过该探测,安装参数会回退到 CPU。
  • Linux ROCm 提案PR #235):目前仍处于未合并状态,而且 ROCm 检测显式限定为 Linux,不提供 Windows AMD 加速路径。
  • ZLUDA:在本项目的 RX 6750 GRE 测试机上可以枚举显卡,但最小 PyTorch 张量加法等待 124 秒仍未完成,未通过扩散模型生产推理门槛。该结果是本机实测,不泛化为所有硬件上的 fp16 缺陷结论。
  • DirectML:通过 Windows 的 DirectX 12 图形适配器运行。本项目的兼容修改已经在 RX 6750 GRE 上完成模型加载、去噪、几何解码、GLB 导出和完整三视图任务。

因此,DirectML 是本项目目前在 Windows AMD 环境中唯一完成端到端生产验证的 GPU 路径。项目以 RX 5000/6000/7000 系列为兼容性目标;当前生产级实测仍仅覆盖 RX 6750 GRE 10 GB。其他型号、驱动和显存组合必须先运行真实 DirectML 验收,不能仅凭“可枚举 GPU”视为已经兼容。

能做什么

  • 校验三视图尺寸、顺序、可见主体和本机资源。
  • 通过 hunyuan3d-mini/turnaround 顺序生成 GLB 白模。
  • 为批任务保存原子 JSON 清单,支持中断恢复、输出哈希校验和有限重试。
  • 清理退化面、修正反向封闭组件,并通过 xatlas 生成 UV。
  • 将正面、左侧和背面颜色投影到网格,输出内嵌纹理的 PBR GLB。
  • 使用本机 Edge 或 Chrome 渲染固定视角预览并生成验收报告。
  • 为已验证的 Windows AMD DirectML 运行栈提供安装、诊断和资产恢复工具。

已验证范围

当前生产验证范围是:

  • Windows x64
  • AMD Radeon RX 6750 GRE 10 GB
  • AMD 驱动 32.0.21030.2001
  • Python 3.11.15 模型运行环境
  • PyTorch 2.4.1、torchvision 0.19.1、torch-directml 0.2.5.dev240914
  • Modly 0.4.1 的本地 API 与 hunyuan3d-mini 扩展

其他 AMD 显卡、驱动、Modly 版本和操作系统尚未经过同等级端到端验证。ZLUDA 与 Windows ROCm 在上述机器上的首个真实张量探测失败,因此不属于生产路径。

快速开始

在 PowerShell 中进入项目根目录:

powershell -ExecutionPolicy Bypass -File .\scripts\setup.ps1
.\scripts\doctor.ps1

模型资产准备完成后,再使用 -RequireModly -RequireAssets 执行完整诊断;缺失资产的可恢复安装见快速开始验收

启动外部 Modly API。路径必须指向你已经安装好的 Modly 和准备好的运行根目录:

.\scripts\start_modly_api.ps1 `
  -ApiDir "C:\path\to\Modly\resources\api" `
  -Python "C:\path\to\api-venv\Scripts\python.exe" `
  -RuntimeRoot ".\runtime" `
  -ModelRoot ".\runtime\models\hunyuan3d-mini\turnaround" `
  -SourceRoot ".\runtime\models\hunyuan3d-mini\generate\_hy3dgen" `
  -Offline

API 就绪后运行完整流水线:

& .\.venv\Scripts\python.exe .\src\pipeline.py ".\inputs" `
  --output-dir ".\outputs" `
  --preset production `
  --seed 12345

默认生产参数为 30 步、380 网格分辨率、引导强度 5.0、自动解码器、2048 像素纹理图集、1024 像素投影视图和 1024 像素验收预览。首次使用前请完整阅读快速开始输入规范

重要限制

  • 输入只有左侧图,没有真实右侧图;右向纹理来自左侧镜像。
  • 头顶、脚底和完全遮挡区域使用邻近可见颜色补全,不能恢复不存在的信息。
  • 上色是正交视图投影,不是生成式纹理,也不是相机标定或特征重建。
  • Hunyuan Paint 依赖 CUDA 原生光栅化扩展,当前 DirectML 路径不支持。
  • 投影上色不会增加面部几何。白模脸形错误时,纹理只能贴到错误的曲面上。
  • 上色阶段把输入作为静态三角网格处理,不承诺保留骨骼、动画、Morph、相机、灯光、原材质或场景层级。

完整边界见限制与适用范围

文档

文档 内容
快速开始 从安装、诊断到生成、上色和导入 Modly
架构 组件、数据流、进程边界和产物
输入规范 三视图顺序、尺寸、构图和批量目录
配置 配置文件、CLI 和环境变量优先级
AMD DirectML 已验证运行栈、显存策略和后端边界
Modly 接入 外部安装、API、模型节点和模型导入
批处理与续跑 预设、清单、重试、取消和恢复
纹理投影 UV、可见性、视图混合和 PBR 输出
验收 预检、哈希、预览、报告和发布门禁
故障排查 常见错误、诊断顺序和恢复办法
限制 技术、质量、兼容性和数据边界
发布 测试、打包、校验和发布清单
许可 项目、Modly、Hunyuan 与第三方许可边界

完整英文文档见 English documentation

开发与测试

.\scripts\test.ps1 -SkipDirectML

测试覆盖批任务状态机、输入校验、GLB 验证、本地 API 启动契约和 PBR 预览。真实 AMD 验收还需单独的 torch-directml 环境,并通过 -DirectMLPython 传入其解释器;完整命令见 AMD DirectML。真实模型生成耗时很长,不属于默认单元测试。

任何人都可以提交 Issue、改进建议和 Pull Request,无需签署 CLA。贡献前请阅读 CONTRIBUTING.md。安全问题请按 SECURITY.md 私下报告。

许可提示

本项目贡献者有权许可的原创工具代码与文档采用宽松的 MIT License。用户自行提供的 Hunyuan 材料、外部 Modly 和其他第三方依赖不是同一个许可主体,也不因本项目采用 MIT 而被重新许可。尤其是 Tencent Hunyuan 3D 2.0 Community License 存在地域、分发、用途和大规模商业使用限制。本项目不提供法律意见;获取或使用外部 Hunyuan 材料前,请阅读许可说明第三方声明以及该材料合法来源提供的完整许可文本。

About

DirectML Image-to-3D workflow for Windows AMD GPUs, targeting Radeon RX 5000/6000/7000. End-to-end validated on RX 6750 GRE.

Topics

Resources

Contributing

Security policy

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages