开源量子位·原文 2026年9月4日本站收录 2026年9月5日

李飞飞World Labs刚发布Atlas,国内影溯称类似世界模型已开源半年,并登顶WorldArena 2.0

9月2日李飞飞旗下World Labs发布多模态世界模型Atlas;国内空间智能团队影溯称其3月已开源具备类似能力的InSpatio-World,升级版即将发布,且其另一模型InSpatio-Curious在WorldArena 2.0榜单登顶。

AI解读:这条新闻的实质是:世界模型赛道出现两条技术路线,而中国团队在开源和评测上已经占了一个身位。影溯的做法是,输入一段普通视频,模型会构建一个可继续探索的动态4D场景,用户能改变观察时刻和视角;这和李飞飞团队Atlas从单张图片出发重建3D场景、移动相机视角的路线不同,但都指向同一个目标——让模型不只是生成好看的视频,而是能理解并维持三维空间的连续性。对做具身智能或机器人训练的人来说,这意味着多了一个可用的开源选项,而且影溯的InSpatio-Curious在WorldArena 2.0上拿到的第一,靠的是轨迹准确率64.89分、深度准确率99.29分这类底层指标,不是画面清晰度——它的图像质量只有60.64分,比第二名低近9分。换句话说,这个模型更擅长“空间关系对不对”,而不是“画面好不好看”,这恰好是机器人训练更看重的。不过要提醒的是,WorldArena 2.0的评测仍以标准化仿真环境为主,覆盖不了真实世界的长尾情况,而且InSpatio-Curious所在赛道总分主要来自15项生成与视觉代理指标,它判断的是碰撞在视觉上是否合理,并不能测量真实的力、摩擦或质量。所以榜单第一说明它在特定任务分布下表现好,但还不能等同于通用空间智能。对普通读者来说,这件事暂时不需要你采取什么行动,它更多是给做机器人、自动驾驶或3D生成的技术团队提供了一个值得测试的开源模型,以及一个需要留意的评测边界。

9月2日,由李飞飞创办的World Labs发布其称为全球首个多模态世界模型(omni world model)的Atlas。据量子位报道,Atlas的核心能力是把文字、图像、视频和3D信息放进统一的空间上下文,使模型能在三维空间中理解并维持场景结构;用户只需一张或几张图片,就能重建三维场景、生成新视角,并让相机沿指定轨迹移动,同时保持空间结构一致。

国内空间智能团队影溯称,早在今年3月,其开源的InSpatio-World就具备类似能力,并透露升级版本即将发布,将继续开源。影溯表示,输入一段普通视频后,InSpatio-World会尝试从有限时空观测中构建一个可继续探索的动态4D场景,允许用户改变原始相机轨迹、绕到未拍摄过的位置观察,并能改变观察时刻、从新视角重新观察同一动态过程。

影溯模型登顶WorldArena 2.0,但强项不在画质

影溯近期最受关注的事件是其世界模型InSpatio-Curious登顶世界模型榜单WorldArena 2.0。截至8月27日的首版阶段性公开榜单中,InSpatio-Curious以66.11分位列77个参评模型第一。

据量子位报道,除了Track 1总分第一,InSpatio-Curious还在Physics Adherence、Trajectory Accuracy、JEPA Similarity和Depth Accuracy四项指标上排名第一:Trajectory Accuracy得分64.89分,领先第二名3.02分;Depth Accuracy达99.29分;JEPA Similarity得分98.36分;Physics Adherence指标以73.24分位居榜首。

值得注意的是,InSpatio-Curious的Image Quality仅为60.64分,比综合排名第二的模型低了近9分,但依然拿下总分第一。量子位指出,这意味着该模型的优势主要来自轨迹、深度、时空表征和交互一致性等底层能力,而非画面美观度。

WorldArena 2.0评测局限:仿真环境为主,不测真实物理量

WorldArena由清华、上交、港大等高校联合发起,是衡量具身世界模型真实可用性的评测之一,目前已迭代至2.0版本。量子位报道称,WorldArena 2.0不只检查画面清晰度,还会检查机械臂运动轨迹是否准确、场景深度与空间关系是否稳定,以及物体受作用后是否按合理物理逻辑运动。

但量子位也指出,WorldArena 2.0仍主要围绕标准化仿真环境和机器人操作任务展开,对真实世界的场景、物体、动态过程和交互方式覆盖有限;InSpatio-Curious所在的Track 1,总分主要来自15项生成与视觉代理指标,可判断碰撞在视觉和运动上“看起来是否合理”,但不会直接测量真实世界中的力、摩擦、质量和惯性。模型在固定题库中得高分,不代表换场景或机器人后仍能稳定表现。

影溯联合启动大规模空间智能3D数据开放计划SIDO

8月29日,在武汉举行的第二届中国空间智能大会上,影溯联合20余家高校团队和行业机构,启动大规模空间智能3D数据开放计划SIDO。据量子位报道,SIDO参与方涵盖高校、激光雷达、机器人、3D生成、数字空间及产业应用等环节,目标是打通从数据生产、模型训练到应用反馈的链路。

量子位称,SIDO未来两年计划逐步建设百万级3D/4D场景数据底座,并同步推进评测基准建设,围绕3D重建与生成、场景理解、空间推理、动态预测和具身规划等任务建立更统一的任务定义与评价标准。

信息来源

量子位原始来源