@misc{indiciaebaa5aa9b98e5, title = {A Strong Baseline for Evaluating Vision Encoders in Multimodal Large Language Models}, author = {Yilin Yang and Jun-Tao Tang and Kengyi Wang and Siyuan Su and Gaoyong Luo and Mingda Chen}, year = {2026}, url = {https://arxiv.org/abs/2610.05413}, note = {Source identifier: 2610.05413} }