TY - RPRT TI - Sharpen Before You Adapt: Data-Free Entry-State Sharpening for Test-Time Reinforcement Learning AU - Zhanming Zhang AU - Vinoth Selvendran PY - 2026 UR - https://arxiv.org/abs/2610.00903 ID - 2610.00903 ER -