TY - RPRT TI - When Do Larger Batches Help Scale LLM Reinforcement Learning? AU - Ziniu Li AU - Jinbo Wang AU - Guanhua Huang AU - Feiyuan Zhang AU - Pengbo Li AU - Alex Chen PY - 2026 UR - https://arxiv.org/abs/2608.29296 ID - 2608.29296 ER -