@misc{indiciaec600eca5a86d, title = {Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization}, author = {Simon Sinong Zhan and Qingyuan Wu and Philip Wang and Frank Yang and Xiangyu Shi and Chao Huang and Qi Zhu}, year = {2025}, url = {https://arxiv.org/abs/2506.00131}, note = {Source identifier: 2506.00131} }