论文提出 LingBot-VLA 2.0,针对 VLA 从实验室走向真实机器人应用的差距,重构数据处理流程并使用约 60,000 小时预训练数据,覆盖 20 种机器人配置与 10,000 小时人类第一视角视频;同时扩展头部、腰部、移动底盘和灵巧手动作空间,并引入结合视频语义先验与深度几何线索的预测动力学建模,在 GM-100 及跨平台长时程移动操作中进行验证。
最近 24 小时暂无可用热度快照。