2026/9/7 18:50:45

图形学宗师童欣加入AI 3D明星公司Meshy,共探想象具象化之路!

图形学宗师童欣加入AI 3D明星公司Meshy,共探想象具象化之路! AI 3D下一代AI核心引擎AI创新的下一块高地正朝着3D生成聚集。从多模态生成、世界模型到空间智能、具身智能机器人3D正成为下一代AI的核心引擎。宗师与明星公司联手如今图形学领域的宗师级人物与AI 3D赛道最炙手可热的明星公司联手了。最新消息显示童欣正式加入胡渊鸣创办的Meshy。童欣将出任AI 3D公司Meshy的首席科学家负责制定Meshy的长期科研战略。这或许意味着华人图形学界最具代表性的两代研究者——Meshy创始人胡渊鸣与童欣将共同推进多模态世界模型与实时交互系统的突破。童欣图形学界的传奇人物童欣此前在微软亚洲研究院工作25年期间领导网络图形组并担任全球研究合伙人。其研究方向涵盖计算机图形学与三维计算机视觉包括材质捕捉与建模、纹理合成等。计算机图形学关注的是 “如何在计算机中创建、操控和呈现三维世界” 在游戏、影视等领域具有基础性地位也是AI感知与表达的基础设施。童欣是在这个方向上扎根最久、积淀最深的学者之一。1999年童欣从清华博士毕业后进入微软中国研究院也就是后来的微软亚洲研究院。他在这里一待就是25年从研究员做到全球研究合伙人、网络图形组负责人几乎见证了中国计算机图形学的所有重要时刻。这期间他在顶刊顶会上发表大量论文Google Scholar引用已超过21000次。他的技术研究给微软留下诸多成果如Xbox游戏开发API等。此外他还为亚研院网络图形组培养了一批中坚力量像浙大周昆、清华徐昆、北大王鹏帅等。和他共事过的人对他评价一致平易近人始终扑在一线能严谨讨论技术问题也能用大白话讲明白。童欣认为计算机图形学是应用学科研究问题源于实际需要和新设备、新数据。他还很幽默风趣曾形容自己的研究。他就是图形学圈里无人不知的 “童姥” 学术功力深厚又带着孩童般的亲切和好奇。MeshyAI 3D明星独角兽Meshy是胡渊鸣从MIT博士毕业后创办的第一家公司其定位是把文字和图片变成3D模型。目前Meshy聚集了1200万名用户客户覆盖全球市值与估值前十企业中的半数。今年7月Meshy完成近4亿美元的B轮融资投后估值超100亿元人民币创下全球AI 3D领域单轮融资规模与估值两项纪录成为该领域估值最高的公司。胡渊鸣提出 “AI for Fun” 的目标。他认为未来AGI解决大量生产力问题后人类核心问题是 “如何创造、表达、连接如何获得意义” 。在自由时间丰饶的时代人们会追求更新颖、更有效的快乐和意义感生成方式而这将由AI驱动。所以 “用AI给人类带来快乐和意义感将是未来五年最重要的问题之一” 。Meshy想成为这个图景里关键的拼图要 “基于生成式AI重塑图形学找到将想象具象化的全局最优解” 。Meshy的技术研究与突破为实现愿景Meshy当下在三个层面做基础性技术研究工作。首先是重新发明图形学要走出过去网络图形学里图形渲染管线的局部最优解用AI重新打造一套不依赖 “三角形” 的全局最优解。其次是搭建导演系统若新图形学像剧组就需配套导演系统实现AI for Fun该系统负责制定世界运行机制和3D骨架实现剧本实时编写。最后是基础设施低延迟、高画质、低成本的三维生成与渲染基础架构很必要需重新设计一套高性能的infra这与胡渊鸣的博士论文、Meshy创业之初做的Taichi编程语言基础一脉相承。在基础研究之外Meshy的新模型也在攻克AI 3D领域的具体卡点如 “可控性” 问题。今年8月10日Meshy发布了Meshy - 7在几何对齐方向迈了一大步在有机角色、硬表面与机械零件、文字与纹样等方面都有出色表现。Meshy的探索与童欣的关注点耦合他近年研究处于3D与视频生成的交叉地带曾提出 “三维是否只是视频生成的特例” 这一问题。Mora超越世界模型恰逢本文成稿时胡渊鸣在公众号发布了Meshy团队的新工作Mora即 “Multimodal Open - world Real - time Architecture” 意为 “多模态开放世界实时架构” 。它由Coding agent、3D生成、视频模型三块拼图组成。胡渊鸣称这是一项 “超越世界模型” 的技术。今年1月Google Genie 3上线可玩demo宣称能让用户用文字生成可探索的真实环境引发市场震动。然而大半年过去胡渊鸣玩遍市面上所有世界模型demo后指出当下互动视频模型存在一致性弱、互动简单等八大弊端认为现有视频模型难玩且可能不是靠优化就能解决的问题本质上只是渲染器沿此路发展只能做 “散步模拟器” 。Mora反其道而行让Coding agent搭骨架Meshy生成3D视频模型出画面使空间稳定、精致又能玩。不过Mora 1还处于早期阶段只是用于验证框架通过scaling逼近目标。Mora对童欣的问题给出初步回答至少在当下三维与视频生成不必是替代关系可以在Coding agent的串联下各司其职。但这个答案还不确切问题也变得模糊了。童欣二三十年间亲历了多轮技术冲击新技术一次次叩问传统图形学的边界图形学该以怎样的形态继续存在面对这一迫切问题童欣再次出发要和年轻人们一起创造新的图形学。未来究竟如何让我们拭目以待