@misc{indiciae69780918bef1, title = {RLHND: Video Foundation Models as Physically Grounded Hand Trackers for Robot Learning}, author = {Seungjun Moon and Subin Jeon and Sangwoo Kim and Hanbyul Joo and Jinwoo Shin}, year = {2026}, url = {https://arxiv.org/abs/2610.09455}, note = {Source identifier: 2610.09455} }