لم تعد لهجاتنا المحلية مجرد حديث مجالس، بل أصبحت اليوم مادة علمية تطور بها كبرى شركات العالم ذكاءها الاصطناعي.

في سابقة تقنية، أعلنت عملاق الحوسبة الأمريكي NVIDIA أنها استعانت ببيانات سعودية خالصة لترويض نموذجها الأقوى للتعرف على الكلام Nemotron 3.5 ASR.

القصة بالأرقام:
من 55% خطأ إلى 30% فقط.. بـ 133 ساعة صوتية نجدي وحجازي من أصل 667 ساعة سعودية.

كان النموذج قبل التجربة يفشل في فهم لهجتنا، يخطئ في 55 كلمة من كل 100 كلمة يسمعها بالنجدية والحجازية.

بعد أن أطعمته سدايا 133.7 ساعة صوتية منتقاة من اللهجتين، انهار معدل الخطأ إلى 29.9% فقط، بتحسن نسبته 45.6% في أقل من 4 ساعات ونصف تدريب.

ولم يتوقف التحسن هنا:
  • 58.8% إلى 35.6%: انخفاض الخطأ على كامل البيانات السعودية بكل لهجاتها
  • 31.6% إلى 12.1%: تراجع أخطاء الحروف
  • 80 ملي ثانية: سرعة استجابة النموذج الجديد.. يفهمك لحظياً
  • 40 لغة: يدعمها النموذج، لكنه لم يفهم النجدي إلا ببياناتنا
من أين جاءت البيانات؟
من كنز وطني اسمه «صدى».. أطلقته سدايا بالتعاون مع هيئة الإذاعة والتلفزيون وأتاحته للعالم عبر منصة Kaggle، ويضم:
  • 667 ساعة تسجيلات موثقة
  • 57 برنامجاً ومسلسلاً سعودياً
  • 125 ألف مقطع صوتي مصنف حسب اللهجة
  • أكثر من 10 لهجات سعودية
  • 20 ساعة مخصصة للاختبار والتحقق
الرسالة التي تقولها NVIDIA للعالم اليوم واضحة: الذكاء الاصطناعي لا يتعلم من الخوارزميات فقط، بل يتعلم من لهجتنا وثقافتنا السعودية وبياناتنا.

وكلما كانت بياناتنا المحلية أكثر جودة وتنوعاً، أصبحت الآلة العالمية أكثر قدرة على فهمنا.