@misc{indiciaea8bdb235ae48, title = {Multi-step Proximal Policy Improvement in Offline Reinforcement Learning}, author = {Soohyun Choi and Seonvin Cho and Songnam Hong}, year = {2026}, url = {https://arxiv.org/abs/2609.03842}, note = {Source identifier: 2609.03842} }