TY - RPRT TI - BCPPO: Bachelier-Inspired Constrained Proximal Policy Optimization for Tail-Risk-Aware Safe Reinforcement Learning AU - Dongsheng Hou AU - Yanqiao Chen AU - Yuhan Rui PY - 2026 UR - https://arxiv.org/abs/2608.30283 ID - 2608.30283 ER -