2秒生成专业3D模型!VAST宋亚宸:我们要搭一套「可交互世界」的底座
导语:VAST创始人宋亚宸接受专访,揭秘如何用AI大模型将3D内容生产从数天压缩到2秒,并直言要做“可交互世界”底座。
“2023年初,我们就已经明确要做可交互的3D内容。”VAST创始人宋亚宸这样回忆创业的原点。在他的判断里,3D生成迟迟没有普及,不是因为技术路线不清晰,而是因为“到现在为止,其实都没有真正意义上的3D UGC平台”。正是这种判断,促使VAST选择从工具和模型切入,而不是等待平台成熟后再进场。
在最近的一次交流中,宋亚宸一边快速解决着午饭,一边向我们演示了Tripo Studio的最新能力。月底,他即将飞往美国参加GDC大会,这家成立于2023年的人工智能公司,正试图用大模型重塑3D内容的生产方式。
“低模”也能高还原:一次对3D资产可用性的重新定义
VAST的Tripo系列刚刚同步更新了两个核心模型:H3.1和P1.0。它们分别对应着3D生成的两个关键方向——高保真与高可用。
H3.1强调还原度,能在数秒内输出结构完整、贴图清晰的3D效果图;P1.0则更激进,将专业建模师级别的3D模型生成时间压缩到2秒,且生成的模型拓扑干净、布线稳定,可以直接进入Unity、Unreal等引擎管线继续编辑与部署。
对于游戏、XR和UGC场景而言,真正决定资产能否被直接使用的,并不只是面数高低。宋亚宸打了个比方:可以把3D模型理解成一件由许多小三角形拼成的“外壳”。三角形越多,细节越丰富,但也越“费劲”。像5000面左右的低模,就如同分辨率不高但足够清晰的图片,肉眼看来已经能呈现栩栩如生的细节,轮廓和结构完整度足够,却不会给设备带来算力负担。正因如此,这类模型才能被广泛应用于实时交互和规模化场景中。
从“用毛笔写微博”到全链路AI工作流
宋亚宸把传统3D生产的痛点形容为“用毛笔写微博”——门槛极高。过去,建模需要依赖十几种不同的引擎和建模软件,搭配数百种中间件和数千种插件,完全依靠手工搭建工作流。一个普通用户想打印一个手机壳,都得去学习Blender、3DMAX或Maya,这对大众来说根本不可能。
VAST在2025年推出的Tripo Studio,正是一套全链路AI工作流。它将几何、贴图、材质、绑定等环节用一系列自研算法整合起来,用户可以在一个平台上完成从几何处理到PBR渲染,再到拆分、编组、笔刷风格化等复杂操作。宋亚宸说:“核心还是生产效率和门槛。现在社会上几乎所有工业品本质上都来自3D模型,但建模的成本、周期和专业门槛都非常高。Tripo Studio的目标,就是让专业用户把原本几个月甚至一年的流程压缩到几周甚至更短。”
目前,这套产品线分为两条:面向PGC用户的Studio工具平台,以及面向企业客户的API服务。截至采访,API已累计服务超过9万家客户,工具平台聚集了超过650万专业开发者,累计生成近1亿个3D模型。
从工业设计到3D打印:技术落地的四个象限
这些3D生成技术正在多个行业产生实际价值。宋亚宸归纳了四类落地场景:
重工业:例如帮助车企快速生成海量3D车型,替代传统周期长、成本高的油泥模型评审。传统车型开发动辄一年,借助AI可压缩至数月,线下评审、层层审批的冗长流程被线上协作替代,设计方案的可选空间也更大。
轻工业与UGC制造:涵盖首饰、玩具、鞋服包包的工业设计,以及彻底打通3D打印社区的建模门槛。宋亚宸观察到,3D打印在硬件上没有本质突破,但出货量却暴涨,原因就在于用户群从千万级扩展到十亿级。而3D打印普及的真正难点,并不是机器操作复杂,而是普通用户不会建模,如今3D生成恰好解决了这个“不知道能打什么”的问题。
虚拟内容:包括游戏(网易等大厂及UGC游戏)、XR元宇宙、动画和影视制作等。VAST与腾讯、字节等头部企业都有合作。
交互展示展陈:如电商商品三维展示、文博、教育课件等,正在为线上体验注入空间感。
阿里百度同框下注,世界模型共识初显
就在今日,VAST宣布完成5000万美元A轮融资,由阿里、恒旭资本(上汽旗下)联合领投,元禾璞华、百度风投、东方嘉富等跟投,老股东春华创投、北京市人工智能产业基金超额加注。这是阿里与百度首次在AI 3D赛道同框下注,侧面反映出头部互联网与产业资本对3D生成赛道的共识正在形成。
宋亚宸认为,融资本身不代表事情绝对正确,但代表市场形成了一定的阶段性共识。投资人选择此时下注,主要有三方面原因:VAST在世界模型等前沿方向上布局较早且走在前面;AI 3D大模型技术已带来不错的商业化收入;市场对于可交互的UGC内容平台产生了新的认知与共识。
值得注意的是,VAST还是李飞飞World Labs的BP里唯一提到的中国公司。李飞飞曾定义世界模型由三大场景构成:3D生成、XR空间智能、机器人——前两者才是重点。而VAST从成立之初就押注3D,宋亚宸说:“世界模型是通用模型的终极形态,必须建立在对三维空间的原生理解之上。世界模型的底座就是基于AI 3D大模型的算法建立的,可以理解为AI加上图形学。如果说原来的3D大模型是80%的图形学加20%的AI,那么世界模型可能就是AI和图形学各占一半。”
这种判断也体现在VAST的商业化策略上。目前海外用户占比约85%,因为实际数据显示欧美市场的付费率、忠诚度和LTV都更高。“起初我们对全球市场一视同仁,但数据反馈决定了我们以海外为主。”宋亚宸说。
“断层式领先”的底气与务实的管理哲学
在演示现场,宋亚宸的自信毫不掩饰:“这两个技术一出,市面上基本没有什么对手。”他认为VAST在跑的技术路线已经是“断崖式、断层式的领先”。这种自信并非凭空而来,而是来自长期的技术验证。
团队的跨界背景也常被提及。1997年出生的宋亚宸并非技术出身,而是文科背景,拥有约翰霍普金斯大学国际关系学和经济学双学位。在创办VAST之前,他曾任职商汤科技,负责多个AI项目的商业化落地,并联合创立MiniMax。对于非科班的疑问,他回应:“创业的核心在于你想做成一件什么样的事,把终局描述清楚最重要,技术只是达到终局的路径。”
在管理上,VAST同样保持务实风格。团队目前100多人,绝大部分是研发人员。他们没有强制打卡、复杂职级,甚至前三年都没有设置OKR。宋亚宸把市面上的管理机制比作“工具箱”,只有当公司发展到特定阶段、遇到真实问题时才拿出相应的工具来解决问题,而不是盲目照搬大厂机制。
随着Tripo H3.1和P1.0的发布,以及新一轮融资的注入,VAST正在更明确地朝着“可交互世界”底座的目标迈进。从数秒生成高还原度资产,到2秒输出引擎可用模型,3D内容的生产门槛被前所未有地拉低。当被问及最终愿景时,宋亚宸的回答很直接:“创造一个世界需要两个能力:造万物和定规则。我们选择从造万物开始,让每个人都能零门槛、零成本地实时创作。”在这场通往世界模型的竞赛中,VAST已经跑在了前面。