@misc{indiciae5fe6417146ab, title = {Evidence-Grounded Trustworthy Multimodal Reasoning and Evaluation Benchmark in Complex Urban Scenes}, author = {Zhaoyang Wei and Bowen Jiang and Xumeng Han and Jiashu Li and Xuehui Yu and Yuling Liu and Guorong Li and Zhenjun Han and Jianbin Jiao}, year = {2026}, doi = {10.1007/s11263-026-02980-3}, url = {https://arxiv.org/abs/2506.09557}, note = {Source identifier: 2506.09557} }