TY - RPRT TI - Multi-AUV Ad-hoc network-based Target Tracking: A Value Gradient Guidance Multi-Agent Diffusion Reinforcement Learning Approach AU - Jiaao Ma AU - Chuan Lin AU - Guangjie Han AU - Shengchao Zhu AU - Qian Zhu AU - Ying Liu AU - Zhenyu Wang PY - 2026 UR - https://arxiv.org/abs/2608.12436 ID - 2608.12436 ER -