TY - RPRT TI - Representational alignment yields generalizable safety in language models AU - Lingyu Li AU - Yan Teng AU - Yingchun Wang AU - Xia Hu PY - 2026 UR - https://arxiv.org/abs/2609.04022 ID - 2609.04022 ER -