TY - RPRT TI - AgenticRag-R1: Agentic Reinforcement Learning with Stack Memory for Multi-Step Reasoning, Retrieval and Memorizing AU - Xinke Jiang AU - Yue Fang AU - Zhibang Yang AU - Jiaran Gao AU - Zhixin Zhang AU - Tao Feng AU - Rihong Qiu AU - Wentao Zhang AU - Hongxin Ding AU - Ruizhe Zhang AU - Yongxin Xu AU - Yuheng Huang AU - Xu Chu AU - Junfeng Zhao AU - Yasha Wang PY - 2026 UR - https://arxiv.org/abs/2608.29622 ID - 2608.29622 ER -