NVIDIA 研究团队提出 RoboTTT,将测试时训练引入视觉-语言-动作机器人策略,通过在训练和推理期间更新的快速权重压缩历史信息,使上下文扩展至 8K 个时间步且不增加推理延迟。在真实机器人任务中,相比单步上下文基线总体性能提升 87%;8K 预训练上下文较 1K 提升 62%,并完成基线未完成的五分钟十阶段装配任务。
最近 24 小时暂无可用热度快照。