TY - RPRT TI - Reinforcement Learning with Segment Reward Feedback under Linear Function Approximation AU - Fengxu Liu AU - Siwei Wang AU - Gal Dalal AU - Shie Mannor AU - Yihan Du PY - 2026 UR - https://arxiv.org/abs/2610.08271 ID - 2610.08271 ER -