TY - RPRT TI - Tail-Aware Information-Theoretic Bounds for LLM Alignment under Heavy-Tailed Rewards AU - Huiming Zhang AU - Binghan Li AU - Wan Tian AU - Qiang Sun PY - 2026 UR - https://arxiv.org/abs/2604.10727 ID - 2604.10727 ER -