TY - RPRT TI - Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes AU - Kevin Vora AU - Yu Zhang PY - 2025 UR - https://arxiv.org/abs/2503.13414 ID - 2503.13414 ER -