论文提出一种随机多重打靶轨迹优化方法:将长控制序列拆成短段,并以局部反馈策略连接,以提升终端集合约束下的采样效率与收敛性。方法还能仅凭轨迹采样近似系统雅可比,面向黑盒动力学及基于模型的强化学习;摘要报告了两类倒立摆和VTOL四旋翼复合翼精准失速后着陆实验。
最近 24 小时暂无可用热度快照。