TY - RPRT TI - Adaptive Mutual Distillation for Balanced Multi-Task Post-Training of Large Language Models AU - Baohang Li AU - Xiaocheng Feng AU - Yichong Huang AU - Chengpeng Fu AU - Wenshuai Huo AU - Zekun Zhou AU - Zekun Yuan AU - Tingjia Zhang AU - Bing Qin PY - 2026 UR - https://arxiv.org/abs/2610.02856 ID - 2610.02856 ER -