Open access
Aug 2026
Quality of Large Language Model-Generated MCQs Across Three Medical Disciplines: An Expert Rater-Based Comparison of Gemini, GPT-4 and Perplexity Pro
Assessing LLM-generated assessment items provides valuable insight into the quality of LLM-supported MCQ questions, and there is no significant difference in mean scores and ranks among the three LLMs across different quality criteria.
N. K. Mitra, Thirupathirao Vishnumukkala, Thin Thin Win et al.
· Advances in Medical Educatio... · 0 citations