TY - RPRT TI - Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Teachers AU - Giovanni Bonetta AU - Matteo Merler AU - Davide Zago AU - Rossella Cancelliere AU - Bernardo Magnini PY - 2026 UR - https://arxiv.org/abs/2609.01567 ID - 2609.01567 ER -