TY - RPRT TI - Accelerating Reinforcement Learning via MPC Solver-Gradient Guidance for Weights-varying MPC AU - Baha Zarrouki AU - Arslan Thobani AU - Jasper Hoffmann AU - Mattia Piccinini AU - Rudolf Reiter AU - Felix Jahncke AU - Sébastien Gros AU - Davide Scaramuzza AU - Johannes Betz PY - 2026 UR - https://arxiv.org/abs/2609.01061 ID - 2609.01061 ER -