← Back to the wire

QIMMA قِمّة ⛰: A Quality-First Arabic LLM Leaderboard

AnnouncementBenchmarkApr 21, 2026

Hugging Face published QIMMA, an Arabic LLM leaderboard that validates benchmark quality before evaluating models. Developed by Leen AlQadi, Ahmed Alzubaidi, Mohammed Alyafeai, Maitha Alhammadi, Shaikha Alsuwaidi, Omar saif alkaabi, Basma Boussaha, and Hakim Hacid, the platform consolidates 109 subsets from 14 source benchmarks into over 52,000 samples across seven domains. A multi-stage validation pipeline combining automated assessment and human annotation found systematic quality issues, including incorrect answers and cultural bias, across widely used Arabic benchmarks.

Receipt № 5081 source · awaiting confirmation ◐

Evidence

1source· awaiting independent confirmation

No score is assigned. Sources and their independence are shown in the citation chain below.

Citation chain · 1 source

Omar saif alkaabiPersonHakim HacidPersonLeen AlQadiPersonShaikha AlsuwaidiPersonAhmed AlzubaidiPersonMohammed AlyafeaiPersonBasma BoussahaPersonMaitha AlhammadiPersonHugging FaceCompany
Canonical: https://huggingface.co/blog/tiiuae/qimma-arabic-leaderboard