@misc{indiciae6d7216ba33b9, title = {WOVEN: Weaving Visual World Modeling into Multimodal LLMs}, author = {Zheyu Fan and Yue Zhang and Mingkai Deng and Kangrui Wang and Qineng Wang and Canyu Chen and Jie Hao and Xing Fan and Chenlei Guo and Eric P. Xing and Mohit Bansal and Manling Li}, year = {2026}, url = {https://arxiv.org/abs/2610.12417}, note = {Source identifier: 2610.12417} }