TIIのUAE方言LLM、Alyahで首位

性能と評価

Alyah正答率84.83%
方言忠実度0.52
文化理解85.57%

開発の要点

7B規模の実用性
実データと合成データ
母語話者による評価
詳細を読む

Technology Innovation Institute(TII)は2026年10月6日、アラブ首長国連邦で使われるエミラーティー方言に特化した70億パラメータのFalcon-Emirati-7Bを公表しました。標準アラビア語では捉えにくい日常表現や詩、ことわざの文化的な意味を理解・生成するため、既存のFalcon-H1-Arabicを方言データで追加学習したモデルです。

基盤にはMambaとTransformerの注意機構を並列に動かすFalcon-H1-Arabicの7B版を採用しました。学習にはエミラーティー方言のウェブ文章、文化や歴史を扱う標準アラビア語資料、語彙集と文法規則で制約した合成データを組み合わせています。

TIIの評価では、母語話者が作成した1,173問のAlyahで84.83%を記録し、比較対象のアラビア語・多言語モデルを上回りました。同じ設問への自由回答をGemini 3.7 Flashで判定した方言忠実度は0.52で、他の4モデルの0.05以下を大きく上回っています。

文化理解を測るArabCulture-DialogueのUAE向け283場面でも、正答率は85.57%と比較した4モデル中で最高でした。モデルの規模だけでなく、地域固有のデータと評価を組み合わせることが方言対応に重要だと、今回の結果は示しています。

一方、学習データ由来の偏りや誤答は残り、珍しい表現や地域性の強い話題では精度が落ちる可能性があります。方言や文化のニュアンスには母語話者間でも解釈差があるため、公式・機微・高リスク用途では個別検証が必要です。