@misc{indiciae30848deb7153, title = {Visual Token Coding for Video Multimodal Large Language Models}, author = {Chenxin Fang and Tao Chen and JunChao You and Jun Peng and Yiyi Zhou and Rongrong Ji}, year = {2026}, url = {https://arxiv.org/abs/2608.28008}, note = {Source identifier: 2608.28008} }