@misc{indiciaeaa7703728d02, title = {Bait-and-Recover: Poisoning Internal Refusal Signals to Defend LLMs against White-Box Editing Jailbreaks}, author = {Tian Gao and Zhipeng Xie and Yuhao Wu and Junhua Liu and Xin Fang}, year = {2026}, url = {https://arxiv.org/abs/2609.05794}, note = {Source identifier: 2609.05794} }