7月17日,2026世界人工智能大会在上海开幕。开幕当天,地瓜机器人(D-Robotics)联合北京谋先飞技术有限公司(Motphys)、影眸科技(Hyper3D)三方联合发布"具身智能可训练仿真闭环联合解决方案",用真实世界的影像直接生成可训练的虚拟场景,降低机器人数据采集与训练的成本。
具身智能的训练高度依赖真实场景数据,但真实数据采集面临场地、设备、人员等多重成本约束,复杂布局、特殊物体状态等长尾场景在真实环境中难以复现。此外传统仿真建模依赖人工搭建,周期长且与真实世界存在明显偏差,数据、仿真与训练三个环节长期未能有效衔接。
在这套方案中,影眸科技 Hyper3D WorldGen 基于自研的原生 3D 大模型 Rodin与 CAST 框架(SIGGRAPH2025 最佳论文),从单张照片还原出可交互三维场景,场景内的 3D 物品均为原生 SimReady 资产,具备物理属性,可直接用于仿真训练,实现从真实影像到可训练场景的端到端转化。

谋先飞基于自研物理引擎 MotrixSim,将这些资产接入仿真环境,使机器人在其中运动、抓取和交互,获得稳定的物理与传感器反馈。同一场景可复制多份并行运行,支撑大规模训练。

地瓜机器人提供算力底座与开发工具链,将场景生成、仿真运行、数据采集和模型训练整合到同一平台。

该方案已形成从场景重建、仿真运行、数据采集、模型训练到策略验证的完整流程。光照、布局、障碍物及物体状态等参数均可快速调整,训练所得策略可直接迁移至实体机器人。
目前,三方将持续完善该方案,并推进在具身智能训练场景中的落地应用。



沪公网安备31010702008139