TY - RPRT TI - ToSCA: Leveraging Hierarchical Reinforcement Learning on Temporal and Strategic Abstractions of Conversational Agents AU - Xiaoyu Wang AU - Qingqing Gu AU - Yue Zhao AU - Teng Chen AU - Yuqi Cao AU - Xiaokai Chen AU - Hongyan Li AU - Luo Ji PY - 2026 UR - https://arxiv.org/abs/2608.21969 ID - 2608.21969 ER -