©潮涌AI编辑部
2024年秋天,一个叫王启斌的人在上海市注册了一家机器人公司。
此前,他在黑莓手机待过,在京东管过机器人业务,在Sonos做过智能音箱。
跟他一起干的还有三个人:北大人工智能研究院助理教授杨耀东、阿里和腾讯出身的机器人专家柴晓杰,以及一个刚从斯坦福回来的广东00后——陈源培。
陈源培在斯坦福的导师是李飞飞和Karen Liu。
在多数同龄人还在读研究生的年纪,他已经完成了全球首次在真实世界中用强化学习同时控制机器人双臂、双手完成多技能操作。
这家叫灵初智能的公司,做的是具身智能赛道最重也最慢的方向——世界模型。
不是做一个好看的机器人本体,而是让机器人真正理解物理世界:抓起一个杯子之前,先能“想象”杯子可能会滑、会碎、会被捏变形。
灵初智能新一代具身模型7月23日,彭博社报道,灵初智能接近完成约1亿美元融资,估值14.8亿美元(106.56亿人民币),奇瑞汽车领投,苹果和特斯拉的传感器供应商蓝思科技参投。
自2024年成立以来,公司累计融资约3亿美元,不到两年跻身独角兽。今年3月,灵初刚完成20亿元人民币的天使轮和Pre-A轮融资,投资方包括国开金融、国中资本、央视融媒体产业投资基金等“国家队”资本,以及徐汇资本等上海地方国资。灵初智能的核心路径有别于多数具身智能公司。
它不直接造整机卖整机,而是铺了两条并行的轨道:一端是自研的外骨骼触觉手套和数采系统(Psi-SynEngine),用来大规模采集人类手部操作数据;另一端是端到端VLA模型,用世界模型(Psi-W0)做数据迁移,把人类动作转化为机器人可执行的动作策略(Psi-R2)。
这套架构的逻辑是:从人类手上采集数据的综合成本,可以压到真机遥操作方案的十分之一。CEO王启斌在WAIC上透露,公司的目标是今年完成百万小时量级的数据积累。
灵初智能CEO王启斌
截至今年5月,10万小时量级的内部验证已经完成——在这个体量上,人类数据可以大幅替代真机采集数据。
今年5月,摩根士丹利发布人形机器人研报,将灵初智能列入“中国-人形机器人价值链”大脑板块,与百度、地平线、华为并列。同月,灵初在HuggingFace上开源了1000小时手部操作全模态数据集SynData。
王启斌对这条路线的时间表有明确预判:“具身智能的GPT-2时刻将在两年内到来。”他的参照系是2019年——当时OpenAI的GPT-2用纯互联网文本训练出了一个能像人类一样写作的模型,尽管粗糙,但它证明了“规模+数据+架构”这条公式在语言领域是成立的。王启斌相信同样的逻辑将在物理世界复现。风险同样肉眼可见。
王启斌自己也承认,当前收入大头来自硬件——数据手套和采集系统,数据收入要到明年之后。这意味着在真正的“模型即服务”商业模式跑通之前,公司仍处在以硬件养软件的过渡阶段。
王启斌在WAIC上的一句话,大概最能概括这笔融资的底层押注逻辑:“当前资本市场投资人结构正在变化,产业资本正在入场。投资人现在关注的不是demo展示,而是模型与数据能力上是否具有持续价值。”
从奇瑞到蓝思科技——这笔钱的背后,是汽车和供应链巨头开始把具身智能的“大脑”视为自己未来产线的核心部件。