TY - RPRT TI - Adaptive Expert Guidance for Efficient On-Policy Reinforcement Learning AU - Daniele Affinita AU - Ming Xu AU - Rudolf Reiter AU - Davide Scaramuzza AU - Pascal Fua PY - 2026 UR - https://arxiv.org/abs/2610.06019 ID - 2610.06019 ER -