TY - RPRT TI - Hierarchical Reinforcement Learning with Stable Temporal Abstraction for Language Model Agents AU - Shayan Mohajer Hamidi AU - Yize Cheng AU - Yuanda Xu AU - Zhengze Zhou AU - Alborz Geramifard PY - 2026 UR - https://arxiv.org/abs/2610.05473 ID - 2610.05473 ER -