TY - RPRT TI - One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning AU - Armin Dariani AU - Sifan Wu AU - Bang Liu AU - Entao Yang PY - 2026 UR - https://arxiv.org/abs/2608.30952 ID - 2608.30952 ER -