نماذج مختبرة من المجتمع

نماذج الذكاء الاصطناعي مختبرة للعربية

هل يعمل فعلاً مع اللهجة السعودية أو النجدية أو الحجازية أو الخليجية؟ نادرًا ما تجيب المعايير القياسية. المجتمع يختبر هذه النماذج على كلام ونصوص حقيقية — ويشارك النتائج.

دعم العربية:الكلكاملجزئيبدون

Lahjawi

Misraj AI

الترجمة
لا توجد تقييمات بعد
🇸🇦 مطوَّر في السعوديةالعربية: دعم كاملالفصحىخليجيمصريشاميar

نظام للترجمة بين اللهجات العربية من شركة Misraj في الخبر، مُحسَّن انطلاقاً من Kuwain-1.5B في نسختين: Lahjawi-D2D للترجمة بين 15 لهجة عربية، وLahjawi-D2MSA لتحويل أي لهجة إلى الفصحى الحديثة. وتذكر الورقة البحثية اللهجات المصرية والإماراتية والأردنية والفلسطينية والشامية والمغاربية ضمن ما قُيِّم عليه، دون تعداد اللهجات الخمس عشرة كاملة. ولم تُنشر الأوزان.

Audar ASR V1 Turbo

Audar AI Labs

التعرف على الكلام
لا توجد تقييمات بعد
العربية: دعم كاملالفصحىخليجيمصريشاميarenmulti

نموذج تعرّف على الكلام يضع العربية أولاً بحجم 2.35 مليار معامل، دُرِّب على أكثر من 300 ألف ساعة، ويذكر تغطيته للهجات الخليجية والمصرية والشامية والمغاربية إضافة إلى التناوب اللغوي مع الإنجليزية. وتدّعي بطاقته صدارة لوحة Open Universal Arabic ASR التي تديرها شركة علم السعودية. برخصة AudarAI المجتمعية الخاصة، وليست مفتوحة المصدر.

Munsit

CNTXT AI

التعرف على الكلام
لا توجد تقييمات بعد
العربية: دعم كاملالفصحىخليجيمصريشاميar

نموذج للتعرف على الكلام العربي دُرِّب بإشراف ضعيف على أكثر من 30 ألف ساعة، وتزعم الورقة البحثية أنه الأدق في فئته عبر 18 لهجة. ولم تُنشر أي أوزان، إذ لا وجود لحساب CNTXT ولا لمستودع Munsit على Hugging Face، والنموذج متاح تجارياً عبر واجهة برمجية فقط، ولذلك يتعذر التحقق المستقل من ادعاءات اللهجات.

CAMeLBERT

CAMeL Lab, NYU Abu Dhabi

أخرى
لا توجد تقييمات بعد
العربية: دعم كاملالفصحىخليجيمصريشاميar

نماذج BERT مُدرَّبة مسبقاً لكل نوع من أنواع العربية (الفصحى الحديثة والعامية والتراثية) لاستخراج الكيانات وتصنيف أقسام الكلام وتحليل المشاعر وتمييز اللهجات. وتبقى نسخة mix المدخل الأكثر استخداماً رغم أنها تعود إلى عام 2021.

Fanar-2-27B

QCRI / HBKU

نموذج لغوي
لا توجد تقييمات بعد
العربية: دعم كاملالفصحىخليجيشاميمصريaren

النموذج الرائد عربي المحور في إصدار Fanar 2.0 (مارس 2026)، واصل التدريب المسبق انطلاقاً من google/gemma-3-27b-pt على نحو 166 مليار رمز عربي وإنجليزي وبرمجي، بنافذة سياق 32 ألف رمز. ويضيف مسارات استدلال عربية أصيلة، ووضع تفكير انتقائي، واستدعاء الأدوات. وهذا المستودع نصي المدخلات والمخرجات، أما توليد الصور وفهمها ونظم الشعر فلها نماذج Fanar-2 منفصلة.

Fanar-1-9B

QCRI / HBKU

نموذج لغوي
لا توجد تقييمات بعد
العربية: دعم كاملالفصحىخليجيشاميمصريaren

النموذج اللغوي العربي السيادي لقطر. هذا النموذج التعليماتي بحجم 8.7 مليار معامل، وهو فرع Prime، يواصل التدريب المسبق لنموذج google/gemma-2-9b على تريليون رمز عربي وإنجليزي، في حين دُرِّب نموذج Star المنفصل بحجم 7 مليارات معامل من الصفر. وتذكر البطاقة دعم الفصحى الحديثة إضافة إلى اللهجات الخليجية والشامية والمصرية، ومواءمة النموذج مع القيم الإسلامية والثقافة العربية.