Preprint
Jul 2026
The Illusion of Robustness: Aggregate Accuracy Hides Prediction Flips under Task-Irrelevant Context
Context-induced tail risks concealed by aggregate accuracy are revealed, motivating per-example reliability evaluation of language models.
Yanzhe Zhang, Sanmi Koyejo, Diyi Yang
· 2 citations