TY - RPRT TI - Why Are LLM Backdoor Defenses Fragmented? A Feature-Level Explanation with Sparse Autoencoders AU - Yizhe Zeng AU - Chenxu Niu AU - Wei Zhang AU - Hao Huang AU - Yunpeng Li AU - Dongxu Han AU - Dan Du AU - Cheng Hong AU - Hequn Xian AU - Yuling Liu PY - 2026 UR - https://arxiv.org/abs/2608.30403 ID - 2608.30403 ER -