TY - RPRT TI - Application-Driven Pedagogical Knowledge Optimization of Open-Source LLMs via Reinforcement Learning and Supervised Fine-Tuning AU - Navan Preet Singh AU - Xiaokun Wang AU - Anurag Garikipati AU - Madalina Ciobanu AU - Qingqing Mao AU - Ritankar Das PY - 2026 DO - 10.3389/frai.2026.1851993 UR - https://arxiv.org/abs/2604.06385 ID - 2604.06385 ER -