Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability
This work introduces Pluralis v0.1, a novel multimodal, multi-regional, and multilingual dataset built from a culture-first perspective and calls upon the research community to utilize this foundation to advance the science of multilingual, multicultural evaluation to better support AI cultural alignment globally.