← 返回资讯热点
AI热点雷峰网发布时间:2026-10-10 05:30热度 148.0000

JEPA、空间智能路线正面交锋:WorldArena 2.0 挑战赛开考「能不能被机器人真正用起来」| IROS 2026

JEPA 路线先下一城:视启未来 Track 1 第一,晨昏线 Track 2 第二。 作者丨 张岂萍 幸丽娟 编辑丨 幸丽娟 世界模型的竞争,正在从“生成未来”,走向“能不能被机器人真正用起来”。 视频可以生成得越来越逼真,但进入机器人系统后,世界模型还要回答更具体的问题:它能否预测动作执行后的状态变化,能否支持策略训练,最终能否在真实机器人上完成任务。 WorldArena 把世界模型拉进了同一个“考场”。这套评测体系由清华大学团队联合多所海内外高校推出,是世界模型领域最权威的评测榜单之一。 WorldArena 1.0 已经将世界模型评测从单纯的视频生成,初步延伸到数据生成、策略评估和动作规划等具身任务。但整体仍主要集中在视觉输入、离线任务和仿真环境。 真实机器人执行、在线强化学习闭环、视触觉多模态感知,以及真实部署中的噪声、延迟和误差累积,还缺少系统性的评测。 针对这些缺口,WorldArena 2.0 进一步升级了评测体系。 模态从纯视觉扩展到视触觉,功能从离线任务扩展到在线强化学习,平台从仿真环境延伸到真实机器人。 IROS 作为机器人领域最具影响力的国际顶级会议之一,WorldArena 2.0 Challenge 在这场盛会上搭起了真机闭环的竞技场,三条赛道分别指向视频质量、在线强化学习环境和真实机器人操作。 几大世界模型流派争鸣这么久,不同技术路线下的模型,也终于在这个竞技场上真刀真枪地一较高下。 明确走 JEPA 路线的视启未来 拿下 Track 1 冠军, 空间智能路线 的同济大学 BWM-Turbo 模型则以 0.84 分之差位列第二;另有同属 JEPA 路线的晨昏线科技 ,在 Track 2 总分第二。 此外,一个值得注意的细节是:三条赛道的前两名,学院派与产业派都各占一席。世界模型赛道的竞争,已经迎来学术与工程能力的正面对撞。 围绕赛事定位、多机构协作、赛道设置与榜单结果,AI 科技评论还采访到了 WorldArena 2.0 Challenge 主办方清华团队。他们的回答,也进一步说明了这套评测在走向在线交互和真机执行时,如何设计、如何协作,又有哪些边界。 01 WorldArena 2.0, 新一轮“大考”难在哪 WorldArena 2.0 把世界模型评测进一步推进到了在线交互和真实机器人。 WorldArena 1.0 主要检查两类能力:一类是世界模型生成的未来视频质量,15 项指标覆盖视觉质量(Visual Quality)、运动质量(Motion Quality)、内容一致性(Content Consistency)、物理遵循性(Physics Adherence)、3D 准确性(3D Accuracy)和可控性(Controllability);另一类看这些预测对机器人有没有实际用处,包括数据生成、策略评估和动作规划

来源:雷峰网
说明:本站展示中文整理摘要,便于快速阅读;完整内容和版权归原站所有。