@misc{indiciae2da902bfc440, title = {Same Reward, Different Skills: When Multimodal RL Learns to Look}, author = {Haocun Ye and Xinlong Jiang and Qile Chen and Bingyu Wang and Teng Zhang and Shubai Chen and Tingyu Wu and Zhenkun Zheng and Yiqiang Chen}, year = {2026}, url = {https://arxiv.org/abs/2610.01908}, note = {Source identifier: 2610.01908} }