@misc{indiciae73954fb43daa, title = {Why Are LLM Backdoor Defenses Fragmented? A Feature-Level Explanation with Sparse Autoencoders}, author = {Yizhe Zeng and Chenxu Niu and Wei Zhang and Hao Huang and Yunpeng Li and Dongxu Han and Dan Du and Cheng Hong and Hequn Xian and Yuling Liu}, year = {2026}, url = {https://arxiv.org/abs/2608.30403}, note = {Source identifier: 2608.30403} }