#computer vision
May 2026
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
A controlled diagnostic framework with two synthetic tasks that disentangle perception from reasoning reveals a consistent perception-reasoning asymmetry: post-training improves reasoning more substantially than perception, though the underlying mechanism differs across training paradigms.
Xueqing Wu, Yu-Chieh Lin, Kai-Wei Chang et al.
· arXiv.org · 0 citations