TY - RPRT TI - Boosting LLM Reasoning via Human-Inspired Reward Shaping AU - Wenze Lin AU - Zhen Yang AU - Xitai Jiang AU - Xiaoteng Ma AU - Gao Huang PY - 2026 UR - https://arxiv.org/abs/2602.04265 ID - 2602.04265 ER -