Skip to content

AutoJudger : An Adaptive Evaluation Framework for Efficient Benchmarking of MLLMs

Xuanwen Ding Chengjun Pan Zejun Li Jiwen Zhang Siyuan Wang Zhongyu Wei Emanuele Tschannen Thomas Bugliarello Unterthiner Daniel Skanda Keysers Fangyu Koppula Adam Liu Alexey Grycner N. Gritsenko Manoj Houlsby Kumar Eli Bingham John Chen M. Jankowiak F. Obermeyer Neeraj Pradhan Theofanis Karaletsos R. Singh Paul A. Szerlip Paul Horsfall Li Cai Kilchan Choi Mark Hansen Lauren Harrell Zhe Chen Weiyun Wang Hao Tian Shenglong Ye Zhangwei Gao Erfei Cui Wenwen Tong Kongzhi Hu Jiapeng Luo Zheng Ma Jiannan Wu Wenhai Wang Weijie J. Su Guo Chen Sen Xing Muyan Zhong Qinglong Zhang Matt Deitke Christopher H. Clark Sangho Lee Rohun Tripathi Yue Yang Jae Sung Park Mohammadreza Salehi Niklas Muennighoff Kyle Lo Luca Soldaini Jiasen Lu Taira Anderson Erin Bransom Kiana Ehsani Huong Ngo YenSung Chen Ajay Patel Mark Yatskar Mucong Ding Chenghao Deng Jocelyn Choo Zichu Wu Aakriti Agrawal Avi Schwarzschild Tianyi Zhou Tom Goldstein John Langford Anima Anandkumar Khang T. Doan Bao G. Huynh D. T. Hoang T.-H. Pham Quan Nhat H. Pham T. M. Nguyen Bang Vo Suong N. Hoang Chaoyou Fu Peixian Chen Yunhang Shen Yulei Qin Mengdan Zhang Xueyi Lin Jinrui Yang Xiawu Zheng S. Galib Shanshan Wang Guan Xu Pascal Pfeiffer Ryan Chesler Mark Landry Sri Satish Wentao Ge Shunian Chen Hardy Chen Nuotian Chen Junying Chen Zhihong Chen Wenya Xie Shuo Yan Shuhao Gu Jialing Zhang Siyuan Zhou Kevin Yu Zhaohu Xing Liangdong Wang Zhou Cao Jintao Jia Zhuoyi Zhang Yixuan Wang Zhe Hu Bo-wen Zhang Jijie Li Dong Liang Yingli Zhao Yulong Ao
· 0 citations · 29 references
View source