Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages
Camellia is introduced, a benchmark for evaluating entity-centric cultural biases in nine Asian languages, spanning six Asian cultures, and it is found that LLMs can struggle with context understanding in some Asian languages, creating performance gaps between cultures in entity extraction.