TY - RPRT TI - Prospective Hindsight: Self-Calibrating Reinforcement Learning via Prediction-Reality Gaps AU - Jiaxin Zhang AU - Xiangyu Peng AU - Qinglin Chen AU - Yu Li AU - Hiroaki Hayashi AU - Chien-Sheng Wu PY - 2026 UR - https://arxiv.org/abs/2610.02740 ID - 2610.02740 ER -