Open access
Aug 2026
Large Language Models as Examinees and Graders in Simulated General Surgery Oral Board-Style Cases: A Psychometric Pilot Study
LLMs demonstrate passing-level oral board performance and more consistent grading than human surgeons in this simulation context, suggesting potential value for further investigation of LLM integration into surgical training and assessment frameworks, pending replication in larger samples.
Kian A. Huang, Haris K. Choudhary, A-Lan Xu et al.
· Cureus · 0 citations