نماذج الذكاء الاصطناعي مختبرة للعربية
هل يعمل فعلاً مع اللهجة السعودية أو النجدية أو الحجازية أو الخليجية؟ نادرًا ما تجيب المعايير القياسية. المجتمع يختبر هذه النماذج على كلام ونصوص حقيقية — ويشارك النتائج.
Audar ASR V1 Turbo
Audar AI Labs
نموذج تعرّف على الكلام يضع العربية أولاً بحجم 2.35 مليار معامل، دُرِّب على أكثر من 300 ألف ساعة، ويذكر تغطيته للهجات الخليجية والمصرية والشامية والمغاربية إضافة إلى التناوب اللغوي مع الإنجليزية. وتدّعي بطاقته صدارة لوحة Open Universal Arabic ASR التي تديرها شركة علم السعودية. برخصة AudarAI المجتمعية الخاصة، وليست مفتوحة المصدر.
Whisper large-v3
OpenAI
نموذج مفتوح رائد للتعرف على الكلام يغطي أكثر من 99 لغة، وهو الخيار المفتوح الافتراضي للتعرف على الكلام العربي في المنتجات، غير أن العربية فيه لغة من بين لغات كثيرة لا محوراً للتدريب، وتبقى العامية نقطة ضعفه. ويُلاحظ تضارب في الرخصة: فبطاقة هذا النموذج تذكر Apache 2.0، بينما يذكر مستودع openai/whisper على GitHub وبطاقة large-v3-turbo رخصة MIT.