TY - RPRT TI - Bellman-Centric Learning: Near-Optimal Regret for Linear Bandits with Memory AU - Jingyuan Liu AU - Huiwen Jia PY - 2026 UR - https://arxiv.org/abs/2610.05659 ID - 2610.05659 ER -