生图3D类

ComfyUI v0.37.0 更新:MoGe 3 进核心,一张图就能估出带细节的 3D 几何

2026年9月22日1 次阅读
ComfyUI v0.37.0 更新:MoGe 3 进核心,一张图就能估出带细节的 3D 几何

一句话先说结论

ComfyUI 在 9 月 21 日发布的 v0.37.0 正式版中,把微软的 MoGe 3 单图几何估计模型纳入了核心支持:上传一张普通图片,就能估出保留细小结构的深度/点图几何,并且可以在节点里调节 0 到 8 档精化强度。对于想把照片变成 3D 素材的创作者,这是一个不需要离开 ComfyUI 就能完成的新能力。

*本文基于官方 changelog 与多家媒体转述整理。*

这是什么

MoGe 3 是微软 MoGe 系列的单图几何估计模型,任务是从一张普通照片推算出整个场景的 3D 几何(深度和 3D 点图)。这次的 v3 版本相比老版本的架构升级在于:它不再直接在图像空间里解码深度,而是先用一个粗略的点图搭起"稀疏体素外壳",再在上面做迭代精化。

这样做最直接的好处是:头发丝、细栏杆、椅子腿这类纤细结构,在旧式图像空间解码器里经常被"糊"成一团,而稀疏体素方案能把这些细节保下来。官方实现暴露了 0-8 档 refinement steps,你可以用时间换精度——要快速预览就调低,要精细结果就拉满。

目前提供 ViT-L 和 ViT-g 两个尺寸的权重,后者更大更准,但对显存的要求也更高。

为什么重要

对普通用户来说,"图生 3D"这个需求一直卡在一个尴尬的位置:纯生成式方案(text-to-3D、image-to-3D 生成完整模型)出来的网格好看但几何不一定可靠;而传统摄影测量又需要围着物体拍一圈。MoGe 这类单图几何估计走的是中间路线——不帮你"脑补"完整模型,但能从一张图快速估出可靠的几何底子,拿来做人像立体卡片、场景深度重构、给后续重打光和补帧当几何参考都很实用。

这次更新还有两个背景值得知道:

  1. 模型本身不是今天发布的。 MoGe 3 的权重早在 8 月中下旬就已在 Hugging Face 上线(Ruicheng/moge-3-vitg 等),这次是 ComfyUI 把它接进了工作流,让不会写代码的用户也能图形化地用起来。
  2. 同批更新里有不少 3D 相关内容。 v0.37.0 还加了 Meshy 7.1 节点支持、Tripo P2 节点对空 GLB/FBX 输出的校验拒绝,图像侧则加入了 Qwen-Image-2.1 原生支持。整个版本对做 3D 内容管线的人来说是一次集体升级。

对谁有用

  • ComfyUI 玩家:直接更新到 v0.37.0,在节点管理器里下载 MoGe 模型即可使用,不用再折腾第三方自定义节点。
  • 做照片转 3D 素材的创作者:单图就能出几何,配合后续的重打光或生成流程,比以前"先拍一圈再重建"轻量得多。
  • 做场景重建/虚拟摄影的研究者:v3 的稀疏体素精化思路值得参考,特别是细结构保留这一点。

怎么用(简要)

  1. 更新 ComfyUI 到 v0.37.0 或以上。
  2. 下载 MoGe 3 的 ViT-L(轻量)或 ViT-g(高质量)权重。
  3. 在工作流里加载图片,接上 MoGe 节点,按需调整 refinement steps(0-8)。
  4. 输出的是深度/点图类几何结果,可导入后续节点做点云、法线或渲染参考。

注意事项

  • 这不是"一张图变完整 3D 模型":MoGe 3 估计的是可见表面的几何,被遮挡的部分它不会凭空补全,别拿它替代完整的 image-to-3D 生成。
  • ViT-g 权重对显存要求不低,显卡吃紧的话先用 ViT-L 试。
  • refinement steps 调太高会增加耗时,建议先从默认值开始试。

参考来源

  • https://docs.comfy.org/changelog
  • https://github.com/Comfy-Org/ComfyUI/pull/16381
  • https://comfyui-wiki.com/en/news/2026-09-20-comfyui-v0-37-0

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...