Prompt 语宙Prompt 语宙
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
Search
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2024 Prompt 语宙. HalfPX. All Rights Reserved.
阅读: 微软开源TRELLIS.2:40亿参数3D生成模型,3秒从单图生成高保真3D资产
Share
登陆
通知 阅读更多
Font Resizer字体
Font Resizer字体
Prompt 语宙Prompt 语宙
Search
  • 首页
  • 语宙 AI 导航
  • AIGC 资讯
    • AIGC 早报Hot
    • 最新趋势
    • AI 工具
    • 热门资源
    • 强化 AI 学习
  • AI 绘图
    • Prompt 实战
    • AI 绘画教程
    • 模型精选
  • AI 图库
    • 人物
    • 展台场景
    • Banner
    • 游戏
    • 动物
    • 食物
    • 自然
    • 背景
    • 海报
    • 建筑
    • 室内设计
  • 出海数字营销宝典
  • AI 生图 Prompt
    • 写实人像
    • 产品与广告
    • 游戏资产与 3D
    • 界面与图标
    • 建筑与室内
    • 动漫与插画
    • 风景与自然
已有帐户? 登陆
  • Contact
  • Blog
  • Complaint
  • Advertise
© 2023 Prompt 语宙. Paooo.com. All Rights Reserved.
Prompt 语宙 > AI 工具 > 微软开源TRELLIS.2:40亿参数3D生成模型,3秒从单图生成高保真3D资产
AI 工具AIGC 资讯

微软开源TRELLIS.2:40亿参数3D生成模型,3秒从单图生成高保真3D资产

站外新闻
最近更新: 2026年6月7日 下午8:10
3D生成模型 AIGC O-Voxel TRELLIS.2 微软
SHARE

💡 站外导读:在游戏、影视和工业设计领域,高质量3D资产的创建长期面临效率瓶颈,传统流程耗时且成本高昂。随着AIGC技术的爆发,AI驱动的3D生成成为关键突破口。微软最新开源的TRELLIS.2模型,以其40亿参数的庞大体量和创新的O-Voxel稀疏体素架构,旨在从根本上解决从单张图片或文本描述快速生成高保真、全纹理3D资产的难题。它不仅支持复杂几何结构,更实现了PBR材质建模和超高清渲染,预示着3D内容创作即将进入一个‘秒级生成’的新时代。

TRELLIS.2是什么

TRELLIS.2是微软开源的40亿参数3D生成模型,专为从单张图片高效生成高保真3D资产设计。核心创新在于采用O-Voxel稀疏体素架构,能处理复杂拓扑结构(如开放表面、非流形几何),支持完整PBR材质建模。在NVIDIA H100上生成512³分辨率模型仅需3秒,最高支持1536³超高清渲染。相比传统方法,通过16倍空间下采样显著提升效率,同时提供GLB格式导出功能,适用于游戏、影视和工业设计等领域。

阅读目录
  • TRELLIS.2是什么
  • TRELLIS.2的主要功能
  • TRELLIS.2的技术原理
  • TRELLIS.2的项目地址
  • TRELLIS.2的应用场景
      • 📝 站长洞察 (Editor’s Insight)

TRELLIS.2

TRELLIS.2的主要功能

  • 图像到3D生成:能根据输入的图像快速生成高质量的3D模型,适用于从2D图像创建3D资产的场景。
  • 文本到3D生成:支持基于文本描述生成3D模型,用户可以通过文字指令生成所需的3D对象。
  • 复杂拓扑处理:可以处理复杂的3D结构,包括开放表面、非流形几何和内部封闭结构,生成具有复杂形状的3D模型。
  • 材质与纹理生成:生成的3D模型支持多种材质属性(如基础颜色、粗糙度、金属度、不透明度等),并支持透明度和逼真渲染。
  • 多分辨率支持:支持从512³到1536³等多种分辨率的3D模型生成,用户可以根据需求选择合适的分辨率。
  • 快速渲染与导出:生成的3D模型可以直接用于渲染,并支持导出为GLB等标准3D文件格式,便于在其他软件中使用。
  • 模型编辑与变体生成:用户可以对生成的3D模型进行编辑,生成同一对象的不同变体,满足多样化的设计需求。

TRELLIS.2的技术原理

  • O-Voxel表示:采用“O-Voxel”稀疏体素结构,这是一种创新的3D表示方法,能高效处理复杂拓扑和锐利特征,突破传统等值面场的限制,支持开放表面、非流形几何和内部封闭结构。
  • 稀疏3D VAE编码:通过稀疏3D变分自编码器(VAE)将3D资产编码到紧凑的潜在空间中,实现高效的压缩和生成,支持16倍的空间下采样,显著提升处理效率。
  • 全纹理建模:不仅处理基础颜色,还能模拟粗糙度、金属度和不透明度等PBR材质属性,支持透明度和逼真渲染,生成的3D模型具有丰富的纹理细节。
  • 极简数据处理流程:数据处理无需复杂的渲染或优化步骤,可在短时间内完成纹理网格与O-Voxel之间的转换,大大简化了处理流程,提升了生成速度。
  • 高效渲染与后处理:结合CUDA加速的网格处理工具(如CuMesh)和高效的渲染技术,快速生成高质量的3D模型,并支持实时渲染和后处理操作。
  • 大规模预训练:在大规模数据集上进行预训练,模型学习了丰富的3D形状和纹理特征,能根据输入的图像或文本生成多样化的3D资产。

TRELLIS.2的项目地址

  • 项目官网:https://microsoft.github.io/TRELLIS.2/
  • Github仓库:https://github.com/microsoft/TRELLIS.2
  • HuggingFace模型库:https://huggingface.co/microsoft/TRELLIS.2-4B
  • arXiv技术论文:https://arxiv.org/pdf/2512.14692
  • 在线体验Demo:https://huggingface.co/spaces/microsoft/TRELLIS.2

TRELLIS.2的应用场景

  • 游戏开发:快速生成高质量的3D游戏资产,如角色、道具、场景等,提升开发效率,降低制作成本。
  • 影视制作:用于创建逼真的3D特效和虚拟场景,支持复杂的材质和纹理,满足影视行业对视觉效果的高要求。
  • 虚拟现实(VR)和增强现实(AR):生成沉浸式的3D环境和物体,增强用户体验,适用于VR/AR应用开发。
  • 建筑设计与可视化:快速生成建筑模型和室内设计的3D可视化,帮助设计师和客户更好地理解和评估设计方案。
  • 工业设计与产品开发:创建产品原型的3D模型,加速设计迭代过程,便于进行虚拟展示和功能测试。
  • 教育与培训:作为教学工具,帮助学生和受训者更好地理解和掌握3D建模、渲染和设计的相关知识和技能。

📝 站长洞察 (Editor’s Insight)

TRELLIS.2的开源,标志着AI驱动的3D内容生成正式迈入‘工业化实用’阶段。其核心突破在于两点:一是O-Voxel稀疏体素架构,它巧妙地解决了传统等值面方法难以处理开放表面、非流形几何等复杂拓扑的业界痛点,为生成真正‘可用’的3D资产奠定了技术基石;二是其极致的效率提升,在H100上3秒生成512³模型,这不再是实验室演示,而是具备了融入实际生产管线的潜力。结合对PBR材质的全面支持,TRELLIS.2实质上构建了一个从视觉输入到生产级3D输出的端到端快速通道。这不仅是工具层面的升级,更将深刻改变内容产业的商业模式——从‘人力密集型’的资产制作,转向‘创意驱动型’的资产生成与迭代。微软此举,无疑是在AIGC的3D赛道上投下了一枚重磅炸弹,将强力催熟相关应用生态,并加速元宇宙、数字孪生等宏大愿景的落地进程。

Attention
Spark-TTS – AI文本转语音工具,支持中英零样本语音克隆
告别信息过载!ClawFeed:开源AI新闻聚合摘要神器,一网打尽Twitter、RSS、GitHub等多平台信息
GigaTok – 港大联合字节推出用于自回归图像生成的视觉分词器
Asyncflow v1.0 – Podcastle 推出的 AI 文本转语音模型
TAGGED:3D生成模型AIGCO-VoxelTRELLIS.2微软
分享
Email 复制链接 打印
Share
上一篇 MiniMax视频团队重磅开源VTP框架:突破视觉生成瓶颈,实现高质量与高扩展性
下一篇 苹果开源SHARP模型:1秒内将单张2D照片转为逼真3D场景,速度提升1000倍!
发表评价

发表评价 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Please select a rating!

Ad image
- 入群领取知识星球折扣卷, 仅剩99份 -
Ad imageAd image

最近更新

[AI生图咒语] 严肃职业肖像摄影提示词 (LinkedIn/商务高管头像)
AI 生图 Prompt 写实人像
Cosmos 3 Edge – 英伟达开源的 4B 参数世界模型
AIGC 资讯
BigMac – 小红书开源的多模态大模型流水并行训练框架
AIGC 资讯
Kimi K3 攻防考卷翻车:漏洞利用只到美国前沿模型四成,蒸馏疑云被安全机构摆上台
AIGC 资讯

相关推荐

AI 工具AIGC 资讯

StableAvatar: 复旦微软联手,音频驱动虚拟人视频生成革命,无需后处理即可生成无限长度高清视频

站外新闻
AIGC 复旦大学 数字人 虚拟形象 音频驱动视频生成
全息流体渐变通用占位特色图
AIGC 资讯

AI演习变实战?OpenAI新模型意外“入侵”知名开源平台

站外新闻
AIGC 资讯

Moshi – 法国AI实验室Kyutai开发的实时音频多模态模型

站外新闻
AI 工具AIGC 资讯

DeepCode:港大重磅发布!多Agent代码生成平台,一键将论文秒变生产级代码

站外新闻
CodeRAG Paper2Code 代码生成平台 多Agent代码生成 香港大学
/ Prompt 语宙 /

Experience the limitless creative possibilities of generative AI and unlock new levels of innovation.

Quick Link

  • Remaker AI
  • BGRemaker 抠图Hot
  • AIGC 工具
  • Prompt 咒语生成器
  • 去水印工具

Support

  • Contact
  • Blog
  • Complaint
  • Advertise

标签

AIGC Midjourney prompt AI Agent GPT Image 2 多模态大模型 EvoLink灵感 AI绘画 字节跳动 开源工具 开源模型 早报 具身智能 openai 大语言模型 开源大模型 阿里通义 强化学习 腾讯混元 Anthropic MoE架构 多模态AI 开源框架 AI智能体 教程 AI工具 扩散模型 AI视频生成 chatgpt 大模型
Prompt 语宙Prompt 语宙
Follow US
© 2009-2026 Prompt 语宙. Paooo.com. All Rights Reserved.