图形学宗师童欣加入AI 3D明星公司Meshy,共探想象具象化之路!
2026/9/7 18:50:39 网站建设 项目流程

AI 3D:下一代AI核心引擎

AI创新的下一块高地,正朝着3D生成聚集。从多模态生成、世界模型,到空间智能、具身智能机器人,3D正成为下一代AI的核心引擎。

宗师与明星公司联手

如今,图形学领域的宗师级人物与AI 3D赛道最炙手可热的明星公司联手了。最新消息显示,童欣正式加入胡渊鸣创办的Meshy。童欣将出任AI 3D公司Meshy的首席科学家,负责制定Meshy的长期科研战略。这或许意味着,华人图形学界最具代表性的两代研究者——Meshy创始人胡渊鸣与童欣,将共同推进多模态世界模型与实时交互系统的突破。

童欣:图形学界的传奇人物

童欣此前在微软亚洲研究院工作25年,期间领导网络图形组,并担任全球研究合伙人。其研究方向涵盖计算机图形学与三维计算机视觉,包括材质捕捉与建模、纹理合成等。计算机图形学关注的是 “如何在计算机中创建、操控和呈现三维世界” ,在游戏、影视等领域具有基础性地位,也是AI感知与表达的基础设施。童欣是在这个方向上扎根最久、积淀最深的学者之一。

1999年,童欣从清华博士毕业后,进入微软中国研究院,也就是后来的微软亚洲研究院。他在这里一待就是25年,从研究员做到全球研究合伙人、网络图形组负责人,几乎见证了中国计算机图形学的所有重要时刻。这期间他在顶刊顶会上发表大量论文,Google Scholar引用已超过21000次。

他的技术研究给微软留下诸多成果,如Xbox游戏开发API等。此外,他还为亚研院网络图形组培养了一批中坚力量,像浙大周昆、清华徐昆、北大王鹏帅等。和他共事过的人对他评价一致:平易近人,始终扑在一线,能严谨讨论技术问题,也能用大白话讲明白。童欣认为计算机图形学是应用学科,研究问题源于实际需要和新设备、新数据。他还很幽默风趣,曾形容自己的研究。他就是图形学圈里无人不知的 “童姥” ,学术功力深厚,又带着孩童般的亲切和好奇。

Meshy:AI 3D明星独角兽

Meshy是胡渊鸣从MIT博士毕业后创办的第一家公司,其定位是把文字和图片变成3D模型。目前,Meshy聚集了1200万名用户,客户覆盖全球市值与估值前十企业中的半数。今年7月,Meshy完成近4亿美元的B轮融资,投后估值超100亿元人民币,创下全球AI 3D领域单轮融资规模与估值两项纪录,成为该领域估值最高的公司。

胡渊鸣提出 “AI for Fun” 的目标。他认为未来AGI解决大量生产力问题后,人类核心问题是 “如何创造、表达、连接,如何获得意义” 。在自由时间丰饶的时代,人们会追求更新颖、更有效的快乐和意义感生成方式,而这将由AI驱动。所以, “用AI给人类带来快乐和意义感,将是未来五年最重要的问题之一” 。Meshy想成为这个图景里关键的拼图,要 “基于生成式AI重塑图形学,找到将想象具象化的全局最优解” 。

Meshy的技术研究与突破

为实现愿景,Meshy当下在三个层面做基础性技术研究工作。首先是重新发明图形学,要走出过去网络图形学里图形渲染管线的局部最优解,用AI重新打造一套不依赖 “三角形” 的全局最优解。其次是搭建导演系统,若新图形学像剧组,就需配套导演系统实现AI for Fun,该系统负责制定世界运行机制和3D骨架,实现剧本实时编写。最后是基础设施,低延迟、高画质、低成本的三维生成与渲染基础架构很必要,需重新设计一套高性能的infra,这与胡渊鸣的博士论文、Meshy创业之初做的Taichi编程语言基础一脉相承。

在基础研究之外,Meshy的新模型也在攻克AI 3D领域的具体卡点,如 “可控性” 问题。今年8月10日,Meshy发布了Meshy - 7,在几何对齐方向迈了一大步,在有机角色、硬表面与机械零件、文字与纹样等方面都有出色表现。Meshy的探索与童欣的关注点耦合,他近年研究处于3D与视频生成的交叉地带,曾提出 “三维是否只是视频生成的特例?” 这一问题。

Mora:超越世界模型

恰逢本文成稿时,胡渊鸣在公众号发布了Meshy团队的新工作Mora,即 “Multimodal Open - world Real - time Architecture” ,意为 “多模态开放世界实时架构” 。它由Coding agent、3D生成、视频模型三块拼图组成。胡渊鸣称这是一项 “超越世界模型” 的技术。

今年1月,Google Genie 3上线可玩demo,宣称能让用户用文字生成可探索的真实环境,引发市场震动。然而大半年过去,胡渊鸣玩遍市面上所有世界模型demo后,指出当下互动视频模型存在一致性弱、互动简单等八大弊端,认为现有视频模型难玩,且可能不是靠优化就能解决的问题,本质上只是渲染器,沿此路发展只能做 “散步模拟器” 。Mora反其道而行,让Coding agent搭骨架,Meshy生成3D,视频模型出画面,使空间稳定、精致又能玩。不过Mora 1还处于早期阶段,只是用于验证框架,通过scaling逼近目标。

Mora对童欣的问题给出初步回答:至少在当下,三维与视频生成不必是替代关系,可以在Coding agent的串联下各司其职。但这个答案还不确切,问题也变得模糊了。童欣二三十年间亲历了多轮技术冲击,新技术一次次叩问传统图形学的边界:图形学该以怎样的形态继续存在?面对这一迫切问题,童欣再次出发,要和年轻人们一起创造新的图形学。未来究竟如何,让我们拭目以待?

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询