TY - RPRT TI - Long-MDR: Long-Context Reinforcement Learning for Multimodal Deep-Research Agents AU - On Tai Tang PY - 2026 UR - https://arxiv.org/abs/2610.05195 ID - 2610.05195 ER -