TurboVLA 将传统 V→L→A 路径改为直接的 V+L→A 映射,独立编码视觉与语言后通过轻量双向交互预测连续动作块。论文报告其仅 0.2B 参数,在 RTX 4090 上达到 31.2 ms 延迟、0.9 GB 推理显存,并在 LIBERO 获得 97.7% 平均成功率。
最近 24 小时暂无可用热度快照。