@misc{indiciae8d882518bb2f, title = {One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning}, author = {Armin Dariani and Sifan Wu and Bang Liu and Entao Yang}, year = {2026}, url = {https://arxiv.org/abs/2608.30952}, note = {Source identifier: 2608.30952} }