The information:中国 AI 的新淘金热:世界模型
一年前,当陆弘远完成他在人工智能与工程领域的博士学位时,他曾与一些投资者接洽,希望筹集资金建立一家致力于开发“世界模型”的初创公司。世界模型是一种能够理解并模拟物理世界的 AI 系统。但当时正专注于 AI Agent(智能体)应用领域的投资者们对此并不感兴趣。
他说,到了今年,整个环境已经完全不同了。“世界模型”已成为中国初创领域的新流行词。曾联合撰写学术论文探索如何让 AI 理解虚拟空间环境的陆弘远,开始在微信上收到来自风险投资人的好友申请。他的初创公司——总部位于上海和香港的 FaceMind——今年已从包括中国网络安全公司奇虎 360 旗下风投基金在内的投资者手中筹集了 2,000 万美元的种子轮资金。
“如果我为大公司工作,我可能没有自由去探索世界模型,因为那些公司有自己的战略和许多其他优先事项,”拒绝了字节跳动的工作邀约转而投身 FaceMind 的陆弘远说道。
陆弘远只是中国大量涌现的创业者之一,其中包括许多大学教授或博士生,他们正蜂拥成立自己的 AI 实验室。虽然这种趋势在某种程度上也在美国上演,但美国的“新实验室(neolabs)”倾向于专注于多元化的研究实验室,且多由曾在知名企业任职甚至担任过高管的研究人员掌舵。
这一新世代中国 AI 实验室的不同之处在于,他们绝大多数都专注于世界模型。这种模型能够模拟现实世界环境,旨在近似拟合物体如何运动以及如何与周围环境互动的物理规律。
这是因为世界模型被视为开启人形机器人和自动驾驶领域突破的关键所在,而这两个领域恰恰拥有中国在全球最广泛、最深厚产业链的支撑。这些中国新实验室认为自己有机会,因为与大语言模型这条已经被众人踩平的道路相比,构建世界模型的竞赛仍处于早期阶段,目前尚未出现领跑者。
当地风险投资人表示,这引发了一场对世界模型的狂热追捧,让人联想起 2023 年的大语言模型热潮——当时无数中国新初创公司竞相开发大语言模型,被当地媒体形容为“百模大战”。
“现在围绕世界模型的炒作是前所未有的。科技巨头、初创公司和风投机构都在蜂拥而入,”清华大学 AI 与机器人专业研二学生张健科表示。两个月前,他与同学共同创立了世界模型初创公司 LatentVerse。“现在有太多的博士生在成立自己的初创公司,”张健科说。
LatentVerse 在 6 月从高瓴资本(Hillhouse)等蓝筹投资者手中筹集了数千万美元,目前正在寻求新一轮融资。
这场淘金热是如此剧烈,以至于各类初创公司都开始根据自己对该概念的理解,套上“世界模型”的标签。例如,今年 1 月成立的中国初创公司 PettiChat(该公司开发针对宠物的穿戴式 AI 设备)在 4 月表示,它正在构建据称是首个“动物行为世界模型”,这是一种旨在模拟和预测宠物行为的 AI 系统。
今年成立世界模型初创公司的研究人员有了一套全新的融资公式,他们称之为“1-3-5-7”。这意味着他们希望在第一轮融资中估值达到 1 亿美元,第二轮达到 3 亿美元,以此类推。有些人甚至在同一次洽谈中就提出前三轮融资的需求,要求投资者对这三轮融资同时做出出资承诺。
一些风险投资人警告称,投资那些缺乏在知名实验室或科技公司构建前沿模型履历的研究人员可能是一场高风险的赌博。相比之下,许多美国新实验室的创始人都是曾在 Open AI 和 xAI 等知名企业工作过甚至担任过高管的研究人员。
中国新实验室面临的挑战还不止于此。他们都面临着一个先天缺陷:受限于美国的出口限制,先进芯片出现短缺。怀疑论者表示,一旦炒作退去,中国的这些新实验室将难以获得足够的芯片和人才。
尽管新成立的世界模型初创公司正在快速融资,但它们必须与财力雄厚的科技巨头以及根基深厚的 AI 独角兽竞争有限的芯片供应。据《The Information》报道,中国主要的 AI 企业月之暗面(Moonshot AI)和深度求索(DeepSeek)都在其最新的大语言模型训练中使用了英伟达先进的 Blackwell 芯片,这两家公司都已从投资者那里筹集了数十亿美元。
研发世界模型的中国新初创公司的研究人员表示,他们正从提供云服务的科技巨头(如阿里巴巴和百度)租用芯片来训练模型。但他们同时也承认,大多数中国新实验室尚未找到解决算力问题的长期方案。
“百个世界模型大战”
在美国,由知名 AI 先驱创立的少数几家新世界模型初创公司已筹集了数十亿美元。由空间智能研究先驱、斯坦福大学教授飞飞(Fei-Fei Li)领衔的旧金山初创公司 World Labs,在 2 月以 50 亿美元的估值筹集了 10 亿美元。3 月,前 Meta Platforms 首席 AI 科学家杨立昆(Yann LeCun)为其新初创公司 Advanced Machine Intelligence Labs 在种子轮融资中筹集了超过 10 亿美元。
美国正在发生的事情在中国科技界和投资界引发了强烈讨论,大家纷纷探讨世界模型作为实现人形机器人和其他自动化技术大规模商业化关键步骤的重要性。世界模型的概念在中国引起了特别强烈的共鸣,因为中国拥有庞大的制造业和物流业,能够提供来自工厂和仓库的真实世界数据,同时政府也对机器人产业给予了大力支持。
近几个月来吸引了大量投资者关注的世界模型初创公司之一是“自然意志”(英文为 Ziran Yizhi)。其创始人丁宁是清华大学的助理教授,他是一篇发表于 2023 年、极具影响力的学术论文的主要作者,该论文探讨了一项通过更新极小一部分参数来微调海量 AI 模型的技术。据知情人士透露,这家总部位于北京的初创公司成立于今年早些时候,估值约 5.7 亿美元,其支持者包括红杉中国(HongShan)、蚂蚁集团和电池巨头宁德时代(CATL)。
越来越多来自传统行业的成熟企业也在背书世界模型初创公司。上周,在香港上市的医疗器械公司深圳康多机器人(Shenzhen Edge Medical)宣布,已投资由清华大学另一位助理教授于 1 月创立的北京世界模型初创公司 PrimalVerse。深圳康多机器人在一份监管文件中表示,它将与该初创公司合作开发 AI 驱动的手术机器人。
一些开发视频生成模型的中国 AI 独角兽也已将其重心转向世界模型。总部位于北京的生数科技(ShengShu Technology)过去最出名的是其 AI 视频业务“Vidu”,该业务与字节跳动的 Seedance 视频模型展开竞争。4 月,生数科技发布了 Motubrain,这是一款旨在作为机器人导航物理环境的“大脑”的世界模型。生数科技现在将自己定义为一家“通用世界模型公司”。
今年 1 月,另一家与生数科技竞争的 AI 视频生成初创公司 PixVerse 推出了一款“实时世界模型”R1,该模型允许用户创建一个逼真的虚拟世界,并通过文本或图像提示词实时对其进行持续修改。本月早些时候,PixVerse 宣布推出 PixVerse Game Engine,这是一款由 R1 模型驱动、用于构建互动电子游戏的新软件框架。
尽管一些投资者开始将世界模型热潮描述为泡沫,但创始人表示,资金和资源的快速集中可能会带来真正的突破。
“如果没有这个泡沫,突破可能就不可能发生,”张健科说。