论文提出带随机需求与外包选项的车辆路径问题(VRP-SDO)方法:用迭代局部搜索划分自有车辆与外包客户,再以图注意力网络和深度Q网络离线学习动态配送策略。实验称其路由成本较先进方法降低19.6%,较经典启发式至少降低29.6%,整体决策在数分钟内完成。
最近 24 小时暂无可用热度快照。