@misc{indiciae079af3299295, title = {Prism: Dynamic Sparse Attention for Native 2K Joint Video-Audio Generation Model Training}, author = {Shuyuan Tu and Qi Tian and Yinming Huang and Yue Wu and Xintong Han and Kaihang Pan and Weijie Kong and Jiangfeng Xiong and Jian-Wei Zhang and Zuxuan Wu and Yu-Gang Jiang}, year = {2026}, url = {https://arxiv.org/abs/2610.05416}, note = {Source identifier: 2610.05416} }