驾驶、打包、飞行:带无人机的旅行小偷问题 (TTP-D)
摘要
本文介绍了带无人机的旅行小偷问题 (TTP-D),该问题使用混合整数规划、元启发式算法和基于注意力的深度强化学习联合优化地面路径规划、无人机同步和物品选择。
查看缓存全文
缓存时间: 2026/08/18 07:52
论文页面 - 驱动、装载、飞行:带无人机的旅行窃贼问题
来源:https://huggingface.co/papers/2608.16435 发布于 8月17日
·
由 https://huggingface.co/Murjani 提交 Kabir (https://huggingface.co/Murjani) 于8月18日
摘要
带无人机的旅行窃贼问题(Travelling Thief Problem with Drone)通过混合整数规划、元启发式算法以及基于注意力的深度强化学习与混合优化方法,联合优化地面路径规划、无人机协同和物品选择,以实现利润最大化。
在收集作业中,逐渐累积的载荷会减慢车辆速度,对路径效率造成累积惩罚。机载无人机可以通过回收偏远物品来抵消这种惩罚,从而缩短任务完成时间并提高运营利润。然而,行驶时间仍然取决于载荷,地面车辆收集的每件物品都会影响无人机的起飞与会合时间。本文引入了带无人机的旅行窃贼问题(TTP-D),通过联合优化物品选择、车辆路径规划和飞行协同,在扣除基于时间的租赁成本后,最大化收集利润。我们构建了混合整数线性规划模型,可求解小规模实例至最优解,并针对大规模实例开发了元启发式算法和基于注意力的深度强化学习策略。我们进一步提出了一种学习器初始化的混合求解器,其中DRL策略构建初始解,随后通过简短的模拟退火运行进行优化。在两个基准测试集上,该混合方法以远低于基线的计算成本,恢复了大部分元启发式基线的质量,但最大规模实例仍需完整的基线计算预算。最后,敏感性分析揭示租赁比例是影响盈利能力的主要因素,而车队参数仅产生边际影响。
查看 arXiv 页面 (https://arxiv.org/abs/2608.16435) | 查看 PDF (https://arxiv.org/pdf/2608.16435) | 项目页面 (https://abhaysobhanan.github.io/team/) | GitHub3 (https://github.com/corbit-lab/ttpd) | 添加到收藏夹 (https://huggingface.co/login?next=%2Fpapers%2F2608.16435)
在您的智能助手中获取本文:
hf papers read 2608.16435
还没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用本文的模型 1
Murjani/ttpd-weights 强化学习 • 约3小时前更新 • 1 (https://huggingface.co/Murjani/ttpd-weights)
引用本文的数据集 0
暂无关联此论文的数据集。
在数据集的 README.md 中引用 arxiv.org/abs/2608.16435 即可从本页面链接。
引用本文的 Space 0
暂无关联此论文的 Space。
在 Space 的 README.md 中引用 arxiv.org/abs/2608.16435 即可从本页面链接。
包含本文的收藏夹 0
暂无包含此论文的收藏夹。
将此论文添加到收藏夹 (https://huggingface.co/new-collection) 以从本页面链接。
相似文章
DRIFT: 解耦轨迹展开与重要性加权微调以实现高效多轮优化
本文提出DRIFT框架,该框架结合离线轨迹与重要性加权监督微调,高效实现与强化学习相当的多轮交互学习性能。
带时间窗与容量约束的取货配送路径问题深度强化学习解决方案
本文提出了一种改进的JAMPR深度强化学习模型,用于求解带容量与时间窗约束的取货配送问题(CPDPTW)。该模型可为中小规模实例提供快速最优解,并为大规模实例提供次优解。
在线请求的动态多车场车辆路径问题:事件驱动的Transformer-深度强化学习与滚动 horizon 基准测试
本文提出一种基于Transformer和深度强化学习的事件驱动框架,用于动态多车场车辆路径问题,并与启发式和优化方法进行比较。
动态多车辆路径规划中的奖励密度启发式算法:性能与计算效率
本文提出一种针对动态多车辆路径规划问题的奖励密度启发式算法,在无人机任务分配和城市出租车调度场景中,其解质量与ALNS、GA、SA等元启发式算法相当,而规划时间减少两到三个数量级。
基于深度强化学习的车辆路径问题:工业卡车规划案例研究
本文提出了一种基于深度强化学习的车辆路径问题求解方法,并通过三个工业卡车规划案例进行了演示。与基线结果相比,该方法实现了超过10%的成本降低,并讨论了对更多VRP变体的泛化。