الذكاء الاصطناعي يهمل اللغات الأفريقية، والباحثون يطلقون مبادرة بيانات لسد الفجوة
مع إهمال نماذج الذكاء الاصطناعي لأكثر من 2000 لغة أفريقية بسبب نقص البيانات التدريبية، أطلق الباحثون مشروعًا لجمع 9000 ساعة من التسجيلات الصوتية وتحويلها إلى مجموعات بيانات رقمية لسد هذه الفجوة.
آخر تحديث
يتم إهمال أكثر من 2000 لغة منطوقة في إفريقيا في عصر الذكاء الاصطناعي (AI). على سبيل المثال، يتعرف ChatGPT على 10-20% فقط من الجمل المكتوبة بلغة الهوسا، وهي لغة يتحدث بها 94 مليون شخص في نيجيريا. هذه اللغات ممثلة تمثيلاً ناقصًا في النماذج اللغوية الكبيرة (LLMs) بسبب نقص بيانات التدريب. لكن الباحثين في جميع أنحاء إفريقيا يغيرون ذلك.
سجل أخصائيو اللغة 9000 ساعة من المتحدثين بلغات أفريقية مختلفة وحولوا التسجيلات إلى مجموعات بيانات لغوية رقمية. أطلق الباحثون، الذين هم جزء من مشروع بحثي يسمى أصوات أفريقية جديدة (African Next Voices)، الدفعة الأولى من البيانات هذا الشهر من أكبر مبادرة لإنشاء بيانات لغوية جاهزة للذكاء الاصطناعي للعديد من اللغات الأفريقية.
قد يعجبك
- خطط ترامب للذكاء الاصطناعي تفضل الوقود الأحفوري وتثير انتقادات
- دمج PayPal في Wix Payments لتجارة إلكترونية مبسطة
- يوتيوب ميوزيك يحتفل بذكراه العاشرة مع قوائم تشغيل "مباراة الذوق" وميزات جديدة
- تأجيل محتمل لجهاز أبل القابل للطي الأكبر حجمًا إلى ما بعد عام 2026
- تقارير: آبل تُخطط لإدخال الإعلانات في تطبيق الخرائط العام المقبل
- الروبوتات المغناطيسية الدقيقة تظهر إمكانات في توصيل الأدوية المستهدف
- دروبوكس توقف خدمة مدير كلمات المرور بحلول أكتوبر
- دول الاتحاد الأوروبي ترجئ التصويت على هدف مناخي طموح لعام 2040 وسط خلافات