分类:科技 标签:人工智能、大模型、开源项目、计算机图形学
微软亚洲研究院前全球研究合伙人、计算机图形学泰斗童欣正式加入 AI 3D 独角兽企业 Meshy 担任首席科学家。十年前曾在行业狂热中冷思考「3D 为什么还没飞起来」的学术大牛,如今正与胡渊鸣带领的 Meshy 团队一起,将生成式 AI 与 3D 资产生产、实时互动世界的构建紧密结合,共同推开三维数字世界的大门。
从「每个人」与「到处都是」的行业痛点谈起
回顾 2016 年,VR 产业迎来首轮爆发,资本、硬件和开发者三方共振,高盛更是将其誉为下一代计算平台。然而,时任微软亚研院首席研究员的童欣却在一次内部研讨会上泼了冷水。
他指出,互联网加文字诞生了微博与维基百科,互联网加图片催生了 Instagram,互联网加视频造就了 YouTube。然而,发展多年的计算机图形学(Graphics)却迟迟没有迎来属于自己的互联网爆发。究其根本,行业被两个核心难题卡住:
- Everyone(人人创作):专业建模门槛高,普通人无法轻松参与三维内容生产。
- Everywhere(随处消费):三维内容受限於复杂的工作流与笨重的设备,无法在各种场景中自由传播。
在微软度过的 25 年间,童欣发表了 190 多篇顶级论文,从早期的游戏数据压缩、Kinect 深度相机应用,到后来的 O-CNN 与生成式扩散模型,他的研究一直在尝试卸下专业门槛。但直到生成式 AI 时代全面爆发,这些理想才真正具备了落地的土壤。
创作入口与下游生态的双重蝶变
进入 AI 时代后,3D 领域的底层逻辑发生了颠覆性变化:
- 创作入口极简化:用户不再需要学习复杂的 Maya 或 Blender,通过一句话、一张图片甚至一张草图,就能在几秒内生成 3D 模型。
- 打通下游工作流:以 Meshy 为代表的平台,将 Text-to-3D 的生成时间压缩到 60 秒以内,并原生支持 GLB、FBX、USDZ 等行业标准格式,无缝接入 Blender、Unity 和 Unreal Engine。
目前,Meshy 的注册用户已突破 1200 万,累计生成超过 1 亿个 3D 模型。从游戏开发商到 3D 打印爱好者,AI 正在从单纯的“加速渲染”演变为“重塑生产力”。在真实的游戏生产管线中,Meshy 已经能够将部分复杂的高模雕刻与资产制作效率提升 30% 到 40% 甚至更多。
从 AI for 3D 迈向 AI for Fun
在解决了基础的生成与管线问题后,Meshy 的野心正进一步向互动娱乐延伸。在 GDC 2026 上推出的 Meshy Labs 以及多模态开放世界实时架构 Mora,标志着行业正在从 AI for 3D 走向 AI for Fun。
Mora 架构并没有将所有任务盲目压给单一的视频模型,而是通过代码智能体(Coding Agent)生成世界的规则与骨架,交由 Meshy 的 3D 生成能力转化为稳定的三维资产,最终由实时视频模型渲染呈现。这种「代码 + 3D + 实时渲染」的组合拳,成功实现了空间解谜、物理互动及多风格 200ms 以内实时切换,让 AI 真正深入到游戏机制与世界交互中。
随着近 4 亿美元 B 轮融资的完成以及估值的飙升,Meshy 已经成长为 AI 3D 赛道的中坚力量。对于深耕图形学 25 年的童欣而言,加入 Meshy 不仅是学术研究的自然延伸,更是一个将毕生所学转化为千万级用户产品的绝佳契机。
正如文章所言,当技术、数据与真实场景形成正向飞轮,被阻隔多年的 3D 视觉,终于迎来了属于它自己的「互联网时刻」。