TY - RPRT TI - GPAgentBench-2K: Benchmarking Large Language Model Agents in Complex Clinical Action Space AU - Boqi Chen AU - Xudong Liu AU - Yunke Ao AU - Heejin Do AU - Jianing Qiu PY - 2026 UR - https://arxiv.org/abs/2608.30188 ID - 2608.30188 ER -