微软开源的TRELLIS图片转3D模型,文本图像都能生成辐射场、3D高斯和网格
微软开源的 TRELLIS,输入一张图片或一段文字就能生成 3D 模型,输出可选辐射场、3D 高斯或网格。基于 50 万物体数据集预训练,最大 20 亿参数,支持对生成资产做局部编辑或生成变体,登录后能看到 GitHub 仓库、Hugging Face 演示和官网
TRELLIS 是微软开源的一个 3D 资产生成模型,输入一张图片或一段文字,就能生成带形状和纹理细节的 3D 资产。它支持多种输出格式,辐射场、3D 高斯和网格都可以,生成之后还能直接编辑
TRELLIS 是什么
TRELLIS 是一个大型 3D 资产生成模型,接收文本或图像提示,生成不同格式的高质量 3D 资产
它的基础是一套统一的结构化潜在表示(SLAT),同一份结果可以解码成不同格式;主干网络采用针对 SLAT 设计的 Rectified Flow Transformers
预训练用的是一个包含 50 万个不同对象的大型 3D 资产数据集,模型参数量最大到 20 亿。按官方说法,它的效果明显超过现有方法,包括近期同类规模的做法
主要功能
- 高品质:能生成形状复杂、纹理细节丰富的 3D 资产
- 多功能性:接受文本或图像提示,输出辐射场、3D 高斯和网格等多种 3D 表示,满足不同的下游要求
- 灵活编辑:可以对生成的 3D 资产做编辑,比如生成同一对象的不同变体,或者只改其中一个局部

三种输出格式
辐射场、3D 高斯和网格对应不同的使用场景。网格是比较通用的 3D 文件形式,导进 Blender、Unity 这类软件里继续编辑比较方便;辐射场和 3D 高斯更适合做渲染和展示,画面细节留得住
选哪种格式看后面要拿它做什么,模型本身允许在生成时切换

怎么用上
代码在 GitHub 上开源,Hugging Face 上还有官方搭好的在线演示。不想折腾环境的话,直接在演示页面上传一张图片试效果最省事
想在本地跑,代码仓库里有安装和推理的说明。模型参数量不小,跑起来对显卡有一定要求
项目主页、代码仓库和在线演示入口都整理在本页,登录后可以查看
本文隐藏内容
已解锁- 本文标题
- 微软开源的TRELLIS图片转3D模型,文本图像都能生成辐射场、3D高斯和网格
- 本文作者
- AFeng
- 来源平台
- 资速达 (zisuda.com)
- 本文链接
- https://www.zisuda.com/microsoft-trellis-open-source-image-to-3d-model-generator
版权声明:本站所有资源均来自互联网公开分享或原创整理,仅供个人学习、技术交流与研究测试使用,版权归原作者所有
免责条款:任何个人或组织不得将本站资源用于商业用途。如无意中侵犯了您的知识产权或合法权益,请通过邮件(hello@zisuda.com)联系我们,我们将在收到通知并核实后第一时间进行删除下架处理







