Daily Tech Briefing
AI 科技速览

每天 5 分钟内学习 AI。获取最新的人工智能新闻,理解其重要性,并学习如何将其应用于您的工作。

AI 快讯
量子位 · 2026/8/1 04:53:33
李飞飞World Labs收购SceniX,物理AI训练正从“采数据”走向“造世界”

李飞飞World Labs收购SceniX,物理AI训练正从“采数据”走向“造世界”

AI 中文解读
李飞飞创办的World Labs收购了机器人仿真公司SceniX,这标志着AI训练方式正从“到处采集真实数据”转向“在虚拟世界里造场景练机器人”。通俗点说,过去训练机器人就像拍电影,需要搭实景、反复试错;现在则像做动画,先在电脑里搭建一个高度逼真的虚拟训练场,让机器人在里面反复练习,练熟了再回到现实中干活。这套“真实—虚拟—真实”的闭环,能大幅降低机器人训练的成本和风险。对于普通人来说,最直接的影响是:以后家里的扫地机器人、仓储物流机器人甚至养老陪护机器人,能更快学会新技能,更聪明地应对复杂环境,而不需要开发者把每个动作都在现实中演示上万遍。这等于给物理世界的AI装上了一台“时光机”,让机器人在虚拟世界里提前经历各种情况,等它们走到我们身边时,已经是个“老手”了。
首页 资讯 智能车 智库 活动 MEET大会 AIGC 扫码关注量子位 // $('.biaojiwei').click(function(){ $('.biaojiwei').click(function(event){ event.stopPropagation(); $('#pophead').show(); }) $('.weixin_pop').click(function(){ $('.weixin_pop').hide(); }) // }) < img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 李飞飞World Labs收购SceniX,物理AI训练正从“采数据”走向“造世界” 一水 2026-08-01 12:53:33 来源:量子位 下一场竞争,是谁能造出更多“有用的世界” 允中 发自 凹非寺量子位 | 公众号 QbitAI 一笔收购,揭示了世界模型开始从“生成空间”走向“模拟行动后果”。 李飞飞把世界模型的下一站,押在了机器人身上。 7月21日,World Labs宣布收购机器人仿真公司SceniX。 仅一周后,双方便公布了Real-to-Sim-to-Real,也就是R2S2R的最新成果。 这套系统做的事情,听起来并不复杂:把一个真实机器人任务搬进仿真,在仿真放大的任务场景中训练和评测策略,再把策略部署回真实机器人。 但World Labs想证明的不只是“仿真里能跑”。 更关键的是,策略在仿真中的相对表现,能否预测它回到真机后的表现;仿真中发现的失败区域,能否提前暴露真实部署可能遇到的问题。 World Labs将其定义为一个可以反复运行的机器人训练与评测引擎:一个真实任务进入系统后,可以被扩展成大量可控制、可复用的训练世界。 这件事真正值得关注的地方,也不只是李飞飞开始进入机器人行业了。 企业可以用采访和发布会表达愿景,但收购意味着资本、人才和组织资源的真实配置。 World Labs真金白银买下SceniX,背后代表的是一个更明确的判断: 世界模型的下一站,不只是生成一个看起来逼真的世界,而是要让机器人能够在虚拟世界中行动、试错和学习。 当世界模型进入机器人领域,核心问题变了 过去两年,世界模型最直观的进展,是生成越来越完整、逼真和空间一致的三维环境。 输入文字、图片或视频,模型可以创造一个能够自由浏览、继续编辑的空间。 房间从不同角度看过去,结构不会突然变化;用户向前走几步,桌椅也不会凭空消失。 但机器人面对的是另一道题。 一个纸箱即使在画面中足够逼真,如果箱盖不会弯曲,就无法用于训练装箱。 一根线缆即使拥有准确的纹理和阴影,如果它不会随着受力滑动、弯折和缠绕,机器人在仿真中学会的动作,也很难回到现实。 所以,当世界模型进入机器人领域,核心问题就从: 世界看起来是什么样? 变成了: 机器人采取一个动作后,世界会发生什么? 这也是SceniX之于World Labs的意义。 SceniX补上的是真实任务重建、物理属性恢复、复杂交互模拟,以及机器人策略训练和评测能力。 世界模型因此开始从生成观察的Renderer,走向预测状态变化的Simulator。 World Labs也把模拟器视为连接世界生成与智能行动的关键中间层。 顺着这次收购继续往下看,会发现R2S2R很难由一个世界模型、一套物理引擎或者一个仿真平台独立完成。 它要求真实数据、世界重建、生成扩展、物理模拟、模型训练、能力评测和真机反馈被放进同一个闭环。 而这套由真实世界进入虚拟世界、再回到真实世界的技术路径,恰好与无问智科以“世界模型X数据工厂X世界模拟器”三位一体架构实现“采集世界—生成世界—模拟世界”路径完整打通Real2Sim2Real的技术布局不谋而合。 无问智科要用世界模型,构建物理AI时代的数据基础设施 过去很长一段时间,机器人行业谈数据,首先想到的是“缺多少”。 训练场、真机遥操、第一人称采集和仿真合成等不同路线,解决的都是数据从哪里来的问题。 但无问智科看到的另一个问题是:即使采到了更多数据,模型也未必稳定变强。 同样规模的数据,因为输入模态、任务动作、场景覆盖、交互质量和失败样本不同,对模型的价值可能完全不同。 因此,真正困难的不是生产一批数据,而是持续回答三个问题: 模型究竟缺什么数据? 如何给整个行业规模化生产这些数据? 如何让这些数据真正改善模型能力? 在无问智科的定义里,物理AI数据基础设施并不是一座更大的数据仓库。 它是一个把数据、场景、工具和测评结合在一起的、持续运转的循环系统: 模型在训练、测评和真机运行中暴露问题;系统根据这些问题重新定义数据需求;再通过真实采集、世界生成和仿真补充数据,进入下一轮训练与验证。 在定义了什么是物理AI的数据基础设施之后,无问智科构建了“采集—生成—模拟”的独特世界模型技术路线: 从真实世界获得物理先验知识,在生成世界中放大数据分布,再在模拟世界中完成训练、评测和反馈。 三个世界,一个闭环,藏着机器人进化的钥匙 如果说World Labs收购SceniX,让R2S2R从一条技术路线走到了产业聚光灯下,那么无问智科此前提出的“采集世界—生成世界—模拟世界”,则是试图把这条路线进一步落实为一套完整闭环的数据基础设施。 三个“世界”,是一套形成完整闭环的世界模型技术路线。 真实世界为虚拟世界提供真实锚点,生成式模型将有限数据扩展成更大的分布,物理规律模拟再让虚拟世界“动起来”。 数据由此不再是一次性交付的产品,而成为模型持续迭代的起点。 采集世界:让真实世界成为可被理解和计算的资产 R2S2R的起点,依然是真实世界。 但无问智科所理解的“采集世界”,不是把机器人集中到训练场里,反复执行一批预先设计好的动作,而是通过大规模无感野采,让采集设备进入工厂、商业空间、家庭等真实环境,记录自然作业过程中真实发生的物理交互。 这种方式保留下来的,不只是一条标准化动作轨迹。 真实环境中的物体差异、空间变化、操作习惯、任务中断、异常状态和失败过程,也会一并进入数据系统。 对于机器人而言,这些不够整齐、甚至略显“杂乱”的真实交互,恰恰构成了现实世界的复杂度。 但新的问题也随之出现。 真实场景中持续回传的海量数据,不会天然变成可以训练模型的高质量数据集。 从Raw Data到Model-Ready Data,还隔着一长串的数据处理管线。 在大量长时序记录中,可能混杂着无效动作、重复片段、遮挡、传感器误差和信息缺失。 如果依赖人工处理,采集规模越大,后端处理成本也会越高。 因此,无问智科将世界理解模型引入数据生产链路,对回传数据进行自动化清洗、筛选、时空对齐、标注、数据集构建和跨格式、跨本体转换。 系统需要理解物理交互中发生了什么、任务处于哪个阶段、人与什么物体发生了交互、人与物体如何运动,以及最终为什么成功或失败,再将连续的真实作业数据转换成可以用于训练、重建和评测的结构化资产。 在这套体系里,采集硬件也不再是一款孤立的设备。 无问智科以算法模型反向定义了Capture系列硬件: 不同任务需要采集哪些模态、达到怎样的时空精度、如何完成多传感器同步,以及数据怎样进入后端处理链路,共同决定设备的传感器组合与产品形态。 由此形成覆盖不同采集范式、不同数据模态和不同真实场景的Capture产品体系。 无问智科要解决的,不只是“怎样采到更多数据”,而是如何让真实物理交互能够以更自然的方式发生,再以更自动化的方式转化为模型可用的数据。 这些来自真实世界的交互数据,一方面经过治理,成为了可用于训练机器人大脑的数据资产,另一方面也会进入无问智科的世界模型训练体系,成为后续世界重建、生成扩展和虚实校准的现实锚点,通过源源不断真实世界的交互数据,构成了无问智科世界模型持续迭代的数据飞轮。 生成世界:把有限的真实数据扩展成无限泛化的世界 仅仅将真实世界采集下来,还不足以支撑通用机器人的训练。 现实世界里的物体、布局、材质和任务组合近乎无
分享
阅读原文