Falcon-Emirati-7B shows dialect fidelity needs curated data, not just scale

lmoroney · x · 2026-10-07

Laurence Moroney analyzes TII's Falcon-Emirati-7B, built on Falcon-H1-Arabic (parallel Mamba SSM + attention layers) and further trained on crawled Emirati dialect text, MSA writing about Emirati culture, and glossary-constrained synthetic data. It scores 84.83% on the 1,173-question Alyah benchmark and hits 0.52 dialect fidelity in LLM-judged open-ended answers, versus ≤0.05 for four compared models that answered correctly but in Modern Standard Arabic. Evaluations are TII's own; a useful data point for adapting models to dialects or niches.

Original post →

More from Models

Models channel →