分类:AI动态 标签:人工智能、大模型、开源项目、3D生成
回顾2016年,被无数次宣布为「元年」的VR产业迎来了首轮爆发。当时,硬件、资本与开发者迅速形成共识,唯独中国计算机图形学界的知名学者、时任微软亚研院首席研究员的童欣提出了一个与行业情绪格格不入的问题。
在一次研讨会上,他指出:“互联网加文字有了微博,加图片有了Instagram,加视频有了YouTube,几乎每一种内容都在互联网里爆炸过一次。但为什么图形学(Graphics)却好像什么都没发生?”
他将原因归结为两个词:Everyone(每个人都能创造内容)与Everywhere(跨越设备和场景传播消费)。在当时,专业建模工具门槛极高,昂贵的动捕与扫描设备让3D技术始终无法真正走进普通人的世界。
然而十年后的今天,这个行业在生成式AI的浪潮下听到了回响。2026年9月,童欣正式加入由胡渊鸣创办的AI 3D创新企业 Meshy 担任首席科学家。一位深耕图形学二十五年的学者,终于走到了自己十年前那个问题的下一页。
一、 提问者的二十五年追寻
1999年,童欣从清华大学博士毕业,加入了成立不久的微软亚洲研究院。从早期的游戏资源按需下载、HDR纹理压缩,到后来的Kinect深度摄像头应用、O-CNN八叉树三维卷积,童欣团队的研究重心始终围绕着如何降低3D生产门槛、减少专业劳动展开。
大模型技术成熟后,他的研究从重构(Reconstruct)走向生成(Generate)。GRAM和LAS-Diffusion等前沿研究,开始尝试让普通用户通过简单的二维草图去控制扩散模型生成三维形状。
在微软亚研院的25年间,童欣发表了190多篇论文,引用量超过2.1万次,从研究员一路成长为微软全球研究合伙人。随着Everyone和Everywhere的痛点逐步被技术消解,时代的齿轮终于转到了正确的位置。
二、 条件变了:当创作与工作流全面打通
在童欣看来,如今的3D图形学之所以能够迎来爆发,核心在于几个维度的深刻巨变:
- 创作入口彻底平权:生成式AI时代,输入的门槛从复杂的专业建模软件缩减为一张图片、一段草图甚至是一句话。
- 下游专业Pipeline的结合:过去的AI模型虽然能生成漂亮的3D模型,但内部拓扑结构混乱,无法投入实际生产。而以Meshy为代表的现代工具,能够直接生成符合GLB、FBX、USDZ等工业标准的资产,并无缝接入Blender、Unity与Unreal Engine。
- 真实场景的大规模应用:从三七互娱等游戏厂商的落地实践,到如今平台积累的超过1200万注册用户与1亿个累计生成模型,AI生成3D已经真正进入了游戏开发、3D打印与工业设计的主流生产线。
通过推出 Meshy Labs、3D Agent 以及 Smart Topology 等功能,Meshy 正在将繁琐的底层技术封装在系统内部,让用户只需专注于创意本身。
三、 从 AI for 3D 到 AI for Fun 的未来
当前,Meshy 的野心早已不仅限于“生成一个3D模型”,而是向构建一个可持续运行、可交互的虚拟世界迈进。
在最新的技术探索中,Meshy 推出了名为 Mora(多模态开放世界实时架构)的新架构。它通过 Coding Agent 生成世界规则与代码,结合 3D 生成模型输出稳定的三维场景,再由实时视频模型转化为高质量的交互画面。这种分层架构成功避开了纯视频模型在物理碰撞和空间逻辑上的缺陷,实现了在 200ms 以内实时切换空间解谜、建造种植等复杂交互体验。
正如资本市场在2026年7月给予 Meshy 近4亿美元B轮融资、估值达15亿美元所证明的那样,AI 3D 赛道已经迎来了商业化与技术创新的双重爆发。
对于童欣而言,选择加入 Meshy 意味着拥抱一个最好的时代。在数据与反馈构成的新智能循环中,被两大痛点横亘多年的 3D 视觉,终于迎来了属于自己的互联网时刻 -> 感知、生成 -> 互动、重塑产业未来。