TY - RPRT TI - Reinforcement learning to choose optimizers AU - Martin van der Schelling AU - Deepesh Toshniwal AU - Miguel A. Bessa PY - 2026 UR - https://arxiv.org/abs/2609.01811 ID - 2609.01811 ER -