童欣出任Meshy首席科学家,将负责长期科研战略
童欣在微软亚洲研究院工作 25 年后加入胡渊鸣创办的AI 3D公司Meshy,出任首席科学家,负责制定长期科研战略;Meshy目前有 1200 万用户,今年 7 月完成近 4 亿美元B轮融资。
AI解读:童欣从微软亚洲研究院转到Meshy,最直接的变化是Meshy多了一个能决定长期研究方向的人。他此前在亚研院做了 25 年图形学,负责过网络图形组,研究方向从材质捕捉、纹理合成到真实感绘制和三维人脸动画,这些恰好是 3D生成模型在“像不像、能不能用”上最卡的部分。
Meshy今年 8 月发布的Meshy-7主攻几何对齐,官方描述是在有机角色的面部表情和解剖结构、硬表面零件的部件位置、阴刻文字和浮雕图案上都有提升,童欣的工程积累对应的就是这类问题。
Meshy的规模让这次人事变动不只是一条学术圈新闻。据量子位报道,Meshy目前有 1200 万名用户,客户覆盖全球市值与估值前十企业中的半数;今年 7 月完成近 4 亿美元B轮融资,投后估值超 100 亿元人民币。这个体量意味着公司需要的不只是产品迭代,而是对“3D生成接下来往哪走”下注,首席科学家要处理的就是这种长周期判断。
胡渊鸣给Meshy定的目标是“AI for Fun”,逻辑是AGI解决生产力问题后,人类核心问题变成如何创造、表达、连接和获得意义感。具体到技术路线,Meshy称正在三个层面做基础研究:重新发明不依赖三角形的图形学、搭建负责世界运行机制和 3D骨架的导演系统、以及低延迟高画质低成本的三维生成与渲染基础设施。这三件事都不像短期能验证,所以童欣的加入更像为长期路线找一位有资历的负责人。
一个值得留意的限制是,这些方向目前大多处于早期。胡渊鸣同期发布的Mora被描述为“多模态开放世界实时架构”,由Coding agent生成游戏世界骨架和代码、3D生成丰富骨架并输出控制信号、视频模型输出画面与音效,但他也明确说Mora 1还处于很早期阶段,只是用来验证框架。
童欣 2024 年提出的“三维是否只是视频生成的特例”也还没有确定答案,Mora给出的初步回答是两者当下不必互相替代。对关注AI 3D的人来说,这次人事变动说明Meshy打算在基础研究上继续加码,但路线本身仍待验证。
据量子位 2026 年 9 月 17 日报道,图形学学者童欣正式加入胡渊鸣创办的AI 3D公司Meshy,出任首席科学家,负责制定Meshy的长期科研战略。
报道称,童欣此前在微软亚洲研究院工作 25 年,曾领导网络图形组,并担任全球研究合伙人。他的研究方向涵盖计算机图形学与三维计算机视觉,包括材质捕捉与建模、纹理合成、三维几何处理与建模、光传输分析与模拟、真实感绘制、三维人脸动画等。其Google Scholar引用已超过 21000 次。
Meshy由胡渊鸣创办,定位是把文字和图片变成 3D模型。报道称其目前聚集了 1200 万名用户,客户覆盖全球市值与估值前十企业中的半数。
Meshy今年 7 月完成近 4 亿美元B轮融资,投后估值超 100 亿元
报道称,Meshy今年 7 月完成了近 4 亿美元的B轮融资,投后估值超 100 亿元人民币,创下全球AI 3D领域单轮融资规模与估值两项纪录。
胡渊鸣是Meshy.ai创始人,MIT计算机图形学博士,曾获SIGGRAPH最佳博士论文提名,也是Taichi编程语言和编译器的作者。
胡渊鸣提出“AI for Fun”,Meshy称在三个层面做基础研究
报道提到,胡渊鸣提出的目标是“AI for Fun”。他的逻辑是,未来AGI解决大量生产力问题之后,人类将只剩下一个核心问题:如何创造、表达、连接,以及如何获得意义。他认为用AI给人类带来快乐和意义感,将是未来五年最重要的问题之一。
据胡渊鸣的说法,Meshy要做的是“基于生成式AI重塑图形学,找到将想象具象化的全局最优解”。报道称,Meshy当下在三个层面做基础性技术研究:重新发明图形学,走出过去网络图形学里图形渲染管线的局部最优解,用AI打造一套不依赖“三角形”的全局最优解;搭建导演系统,负责制定世界的运行机制和 3D骨架,实现剧本的实时编写;建设基础设施,即低延迟、高画质、低成本的三维生成与渲染基础架构。
Meshy-7在几何对齐方向取得进展
报道称,Meshy的新模型在攻克AI 3D领域的“可控性”问题,即生成结果是否忠实于输入图像,表现为整体比例的准确性、空间分布的合理性以及表面细节的还原度。
今年 8 月 10 日,Meshy发布了Meshy-7。报道称其在几何对齐方向迈了一大步:在有机角色方面,模型能够还原面部表情、解剖结构与皮肤褶皱等细节;在硬表面与机械零件方面,各部件能够准确落在图像给定的位置,相邻部件互不粘连;在文字与纹样方面,阴刻文字与浮雕图案清晰干净,可直接用于激光雕刻等工业场景。
胡渊鸣发布Mora,称其为“超越世界模型”的技术
报道称,恰逢本文成稿时,胡渊鸣在自己的公众号上发布了Meshy团队的新工作Mora。Mora是“Multimodal Open-world Real-time Architecture”(多模态开放世界实时架构)的缩写。
据介绍,Mora由三块拼图组成:Coding agent,用来生成游戏世界骨架和运行代码;3D生成,即Meshy这块拼图,用来丰富骨架,输出给视频模型的控制信号;视频模型,接收 3D场景信号,输出最终画面与音效。
胡渊鸣称这是一项“超越世界模型”的技术。报道提到,今年 1 月Google Genie 3上线可玩demo,宣称是通用世界模型,能让用户使用文字生成可探索的真实环境,消息出来后Unity一天跌了 24%,Roblox跌了 27%。但报道称,胡渊鸣玩遍市面上所有世界模型demo后,认为当下几乎所有互动视频模型存在八大弊端:一致性弱、互动简单、物理解算能力弱、体验时间短、无法支持剧情和复杂逻辑、以单人游玩为主、无法利用Coding的机制生成能力、延迟较高。
Mora的路线是让Coding agent搭骨架,让Meshy生成 3D,再让视频模型出画面。报道称,Mora 1现在还处于很早期的阶段,只是用来验证一个框架,然后在这个框架下通过scaling一步步逼近目标。
童欣提出的“三维是否只是视频生成的特例”尚无确定答案
报道称,童欣近年的研究方向处于 3D与视频生成的交叉地带。他在 2024 年提出过一个经典问题:“三维是否只是视频生成的特例?”即如果一段视频已经能从任意角度“看到”一个物体,我们还有必要显式地去构建它的三维模型吗?报道称答案尚未明了。
报道提到,2016 年童欣就提出要解决图形内容生产的everyone和everywhere问题,让任何人anywhere都能创造可视媒体内容。报道将这一理念与Meshy现在所说的“让任何人只用一句话就能把想象变成一个可进入体验、互动的世界”联系起来。
报道称,Meshy创始人胡渊鸣与童欣被描述为华人图形学界最具代表性的两代研究者,两人的合作可能推进多模态世界模型与实时交互系统的突破。