独家 | 清华 AIR 首届博士李健雄创立本溯智能:五源资本领投,押注动作原生具身模型
常春藤、线性、华山资本跟投,AIR副教授詹仙园任首席科学家。 作者丨 邓哲敏 编辑丨 齐铖湧 雷峰网·鲸犀独家获悉,清华大学智能产业研究院(AIR)首届博士生李健雄已毕业,并创立具身智能公司 本溯智能 (BASAL Intelligence,简称 BASAL)。目前,本溯智能已获得五源资本领投,常春藤资本、线性资本、华山资本 WestSummit Capital 参与投资。 团队核心成员包括首席科学家、清华 AIR 副教授詹仙园,以及 7 名长期合作的年轻研究者。据本溯智能称,创始团队组建前,核心成员分别拿到字节跳动 Top Seed、英伟达、小米等企业的高薪 offer 和海外高校博士录取机会,合计放弃的年薪总包接近 4000 万元,其中李健雄个人放弃的最高年薪总包接近千万元。 本溯智能官方资料显示,公司不会追随市面上已成主流的“预训练基模+后训练部署”范式,而是选择押注动作原生的 In-Context 具身基础模型,试图让机器人在更换场景后无需重新训练,在现场完成学习与适应。 01 环境一变,一切推倒重来 当前具身智能的主流路线,是先预训练一个基础模型,再针对每个任务做后训练部署交付。 这套范式在工厂标准化场景下已经跑通,但一旦环境、物体或作业流程发生变化,机器人往往需要重新采集数据、重新训练。面对现实世界中无穷无尽的长尾场景和长尾任务,这条路的规模化天花板显而易见。 本溯智能对此有一个直接的判断:这 本质上还是工业自动化的延伸,并不是真正意义上的具身智能 。 在团队看来,真实世界中与物理环境交互的动作信息,很难通过语言被完整、准确地描述;现有以语言为中心的 VLA 路线,也因此在精细操作和跨场景泛化上存在先天局限。 本溯智能的目标,是让机器人具备现场学习的能力:当面对训练阶段从未见过的新场景、新任务或新本体时,无需重新训练模型,只需通过少量人类示范和自主尝试,在几分钟内完成快速学习与适应。 02 弃语言、押动作,一条非主流的具身路线 本溯智能将其方法论归结为智能决策的第一性原理,提出“动作原生的 In-Context 具身基础模型”技术路线。 区别于现有方案以语言为中心,本溯智能将动作作为模型的核心表达方式,让模型直接学习与世界交互的动作、任务反馈、失败纠正以及人类示范之间的关系。模型的大部分容量用于动作生成,并通过长上下文组织机器人的连续物理交互,使机器人能够根据此前的动作、结果、失败和反馈,持续调整后续决策。 本溯智能认为, 动作比语言更接近机器人与物理世界交互的本质 ,而 In-Context Learning 则让模型具备在部署后持续学习的能力。 据雷峰网·鲸犀观察,走一条人迹罕至的小路,意味着必须和行业主流叙事正面交锋。以多模态大模型、自然语言指令为中心的 VLA 路线,仍是资本与产业界最熟悉的语境,客户也更习惯让机器人听懂人话的产品叙事。弃
说明:本站展示中文整理摘要,便于快速阅读;完整内容和版权归原站所有。