图形学宗师童欣加盟Meshy,要做“AI for Fun”的头号玩家
AI创新的下一块高地正在向3D生成领域聚集,从多模态生成、世界模型到空间智能、具身智能机器人,3D已成为下一代AI的核心引擎。如今,图形学领域的宗师级人物与AI 3D赛道最受关注的明星公司正式联手。
童欣官宣出任Meshy首席科学家
据最新消息,童欣将正式担任AI 3D公司Meshy首席科学家,全面负责公司长期科研战略的制定。童欣在计算机图形学与三维计算机视觉领域有超过25年的深耕经验,此前在微软亚洲研究院工作25年,历任网络图形组负责人、全球研究合伙人,研究方向覆盖材质捕捉与建模、纹理合成、三维几何处理与建模、光传输分析与模拟、真实感绘制、三维人脸动画等细分方向,在顶刊顶会发表大量论文,Google Scholar引用量已超过21000次。
1999年,童欣刚从清华大学博士毕业便加入成立不足一年的微软中国研究院,作为研究院第一批研究员,他几乎见证了中国计算机图形学的所有重要发展节点,是领域内公认的宗师级人物,业内也常以“童姥”称呼他,他本人也曾幽默自述“拥有极深厚的学术功力,却带着孩童般的亲切和好奇”。童欣在AI多模态训练领域也有前沿研究和工程积累,他的加入将把Meshy的技术探索带向更远的边界。
Meshy发布Mora架构剑指“超越世界模型”
就在童欣加盟消息官宣的同时,Meshy创始人胡渊鸣也在个人公众号发布了团队最新研究成果Mora。Mora是“Multimodal Open-world Realtime Architecture”的缩写,即多模态开放世界实时架构,该架构由三大核心模块组成:
- Coding agent:负责生成游戏世界的骨架与运行代码,搭建基础场景框架
- 3D生成模块:作为Meshy的核心技术能力,负责丰富场景骨架,输出给视频模型的控制信号
- 视频模型:接收3D场景信号,最终输出可交互的画面与音效
胡渊鸣将Mora称为“超越世界模型”的技术,今年1月Google曾上线通用世界模型Genie 3的demo,宣称可以用文字生成可探索的真实环境,Mora的推出被视为对该方向的技术迭代。胡渊鸣本人是MIT计算机图形学博士、SIGGRAPH最佳博士论文提名者,更是Taichi编程语言与编译器的作者,他提出“AI for Fun”的核心理念:当AGI解决大量生产力问题后,人类的核心需求将转向创造、表达、连接,获得快乐与意义感,用AI为人类带来快乐和意义感将是未来五年最重要的问题之一,Meshy的目标是基于生成式AI重塑图形学,找到将想象具象化的全局最优解。
童欣十年内容生产愿景与Meshy技术路线深度同频
早在2016年,童欣就提出要解决图形内容生产的“everyone和everywhere”问题,让任何人anywhere都能创造可视媒体内容。十年后的今天,这一愿景已演变为“让任何人只用一句话就能把想象变成一个可进入体验、互动的世界”,与Meshy的技术方向高度契合。
为了实现这一目标,Meshy当前正在三个层面开展基础性技术研究:
- 重新发明图形学:跳出传统网络图形学渲染管线的局部最优解,用AI重新打造一套不依赖“三角形”(GPU渲染三维物体的最小单位)的全局最优解,传统3D渲染的基础单位“三角形”是图形学渲染管线的核心基础,哪怕是经典的斯坦福兔子模型也包含69451个三角形数据,新架构将彻底跳出这一传统框架的束缚
- 搭建导演系统:作为新图形学的配套支撑,负责制定世界的运行机制和3D骨架,实现剧本的实时编写
- 布局基础设施:打造低延迟、高画质、低成本的三维生成与渲染基础架构,避免体验中的卡顿等问题被数百倍放大
华人图形学两代领军者联手拓展AI 3D边界
业内也将童欣与胡渊鸣的联手称为“胡渊鸣童姥大会师”,这被视为华人图形学最具代表性的两代研究者的合流,双方将共同推进多模态世界模型与实时交互系统的技术突破。
当前Meshy已聚集1200万名全球用户,客户覆盖全球市值与估值前十企业中的半数,今年7月Meshy完成了近4亿美元的B轮融资,投后估值超100亿元人民币,创下全球AI 3D领域单轮融资