Review
Open access
Aug 2026
Recent Advances and Open Challenges in Mitigating Inference-Time Attacks on Large Language Models
A defense taxonomy spanning three axes, namely prompt-level, inference-time, and training-time interventions, is proposed, within which 30 mitigation mechanisms published from 2024 onwards are systematically analyzed, demonstrating that no single defense mechanism provides comprehensive protection, and that robust deployment mandates layered, complementary strategies.
Berkay Özçam, Mustafa Kara, Muhammet Ali Aydin et al.
· Electronics · 0 citations