الرئيسية :نافذتك إلى مستقبل التكنولوجيا

الذكاء الاصطناعي يهمل اللغات الأفريقية، والباحثون يطلقون مبادرة بيانات لسد الفجوة

مع إهمال نماذج الذكاء الاصطناعي لأكثر من 2000 لغة أفريقية بسبب نقص البيانات التدريبية، أطلق الباحثون مشروعًا لجمع 9000 ساعة من التسجيلات الصوتية وتحويلها إلى مجموعات بيانات رقمية لسد هذه الفجوة.

آخر تحديث

يتم إهمال أكثر من 2000 لغة منطوقة في إفريقيا في عصر الذكاء الاصطناعي (AI). على سبيل المثال، يتعرف ChatGPT على 10-20% فقط من الجمل المكتوبة بلغة الهوسا، وهي لغة يتحدث بها 94 مليون شخص في نيجيريا. هذه اللغات ممثلة تمثيلاً ناقصًا في النماذج اللغوية الكبيرة (LLMs) بسبب نقص بيانات التدريب. لكن الباحثين في جميع أنحاء إفريقيا يغيرون ذلك.

سجل أخصائيو اللغة 9000 ساعة من المتحدثين بلغات أفريقية مختلفة وحولوا التسجيلات إلى مجموعات بيانات لغوية رقمية. أطلق الباحثون، الذين هم جزء من مشروع بحثي يسمى أصوات أفريقية جديدة (African Next Voices)، الدفعة الأولى من البيانات هذا الشهر من أكبر مبادرة لإنشاء بيانات لغوية جاهزة للذكاء الاصطناعي للعديد من اللغات الأفريقية.

يقوم اللاعبون الغاضبون بحملة منظمة ضد فيزا وماستركارد، يتهمونهم بالتسبب في تشديد الرقابة على بيع ألعاب البالغين في المتاجر الرقمية.