Preprint
Jul 2026
MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese
MTEB-BR is introduced, a benchmark of 22 native Brazilian-Portuguese tasks across seven categories (classification, multilabel classification, pair classification, semantic textual similarity, clustering, retrieval, and reranking), admitting only data created or found in Portuguese and excluding translations by construction.
Tardelli Ronan Coelho Stekel
· 1 citation