@misc{indiciae916941ff37dd, title = {Aphanta: Diagnosing Task-Aligned Image-Edited Intermediates for Multimodal Reasoning}, author = {Hengyuan Xu and Wei Cheng and Yumeng Ji and Xuanyang Zhang and Xianfang Zeng and Gang Yu and Xingjun Ma}, year = {2026}, url = {https://arxiv.org/abs/2608.26993}, note = {Source identifier: 2608.26993} }