论文提出面向无人机导航的安全约束感知—控制一体化框架:以非对称卷积和深度可分离卷积编码稀疏观测,结合约束马尔可夫决策过程、拉格朗日安全PPO、分层控制与课程学习。在不同障碍密度和飞行速度下,作者报告其相较强化学习基线具有更高成功率、更强安全性和更高效率,但摘要未给出具体数值。
最近 24 小时暂无可用热度快照。