论文提出N_0-VTLA视觉-触觉-语言-动作基础模型,通过大规模视触觉预训练、分阶段触觉通路集成和ALTER离线强化学习,提升接触丰富操作能力。模型在9项真实机器人任务中全部胜出,20项仿真任务平均成功率为63.8%,高于最强基线的44.0%;结合ALTER后,3项长时程真实任务达到75%至95%。
最近 24 小时暂无可用热度快照。