نماذج الذكاء الاصطناعي مختبرة للعربية
هل يعمل فعلاً مع اللهجة السعودية أو النجدية أو الحجازية أو الخليجية؟ نادرًا ما تجيب المعايير القياسية. المجتمع يختبر هذه النماذج على كلام ونصوص حقيقية — ويشارك النتائج.
AIN
MBZUAI
نموذج متعدد الوسائط ثنائي اللغة بالعربية والإنجليزية مبني على Qwen2-VL ومدرَّب على 3.6 مليون عينة متعددة الوسائط، نحو ثلثها عربي أصيل. يتميز في التعرف الضوئي على الحروف العربية وفهم المستندات، وخضع لتقييم بشري في 17 دولة عربية. برخصة MIT.
NAMAA Saudi TTS
NAMAA Community
نموذج تحويل النص إلى كلام باللهجة السعودية مع توجيه صوتي مرجعي، موجَّه للكلام اليومي العفوي لا للفصحى. ويتميز بكونه النموذج المفتوح الأوزان الوحيد في هذا الدليل الذي تنص بطاقته صراحةً على اللهجة السعودية — ولم يُعثر على أي نموذج يذكر النجدية أو الحجازية تحديداً. برخصة MIT.
DeepSeek-R1
DeepSeek
نموذج استدلال مفتوح برخصة MIT الصريحة، يسمح بالاستخدام التجاري وبالاشتقاق منه بما في ذلك التقطير. والعربية ليست لغة مستهدفة معلنة، إذ لا تدرج البطاقة أي لغات، ومن ثم يظل الأداء بالعربية عرضياً. وقد تجاوزه ضمن سلسلة DeepSeek تحديث R1-0528 ثم إصدارات V3.x اللاحقة.