Self-Generating Reward Network for AUV Path Planning With Hybrid Global-Local Optimization
{{output}}
Existing deep reinforcement learning (DRL) methods for autonomous underwater vehicle (AUV) path planning face two practical challenges: 1) dependency on manual reward engineering and 2) hyperparameter sensitivity in dynamic marine environments. This article pr... ...