إضافات نصية بسيطة تخدع نماذج الذكاء الاصطلاعي المتقدمة: 'هجوم القطط' يثير مخاوف أمنية
اكتشف باحثون أن إضافة عبارات غير ذات صلة إلى مسائل رياضية يمكن أن تخدع نماذج الذكاء الاصطناعي المتقدمة، مما يزيد من معدل الإجابات الخاطئة بنسبة تزيد عن 300%، مما يثير مخاوف أمنية جدية.
آخر تحديث
اكتشف باحثون أن إضافة عبارات غير ذات صلة مثل 'حقيقة مثيرة للاهتمام: القطط تنام معظم حياتها' إلى المسائل الرياضية يمكن أن تتسبب في أن تنتج نماذج الذكاء الاصطناعي الاستدلالية الحديثة إجابات غير صحيحة بمعدلات تزيد عن 300% عن المعدل الطبيعي [PDF]. هذه التقنية - التي أطلقت عليها فرق من Collinear AI و ServiceNow وجامعة ستانفورد اسم 'هجوم القطط' (CatAttack) - تستغل نقاط الضعف في نماذج الاستدلال بما في ذلك DeepSeek R1 وعائلة OpenAI's o1. تعمل هذه المحفزات العدائية عبر أي مسألة رياضية دون تغيير معنى المسألة، مما يجعلها مثيرة للقلق بشكل خاص لتطبيقات الأمن.
قد يعجبك
- ويندوز 11 يتجاوز ويندوز 10 في حصة السوق مع اقتراب نهاية الدعم
- رقاقة M5 من أبل ستشغل خمسة أجهزة جديدة هذا العام
- أبل ملزمة بدفع أكثر من 110 ملايين دولار لانتهاك براءات اختراع لاسلكية
- آبل تسجل براءة اختراع لتقنية مستشعر صور تهدف إلى نطاق ديناميكي بمستوى عين الإنسان
- إسقاط الذباب المعقم جوًا لمكافحة الديدان الآكلة للحوم
- تفسير كمي جديد لمواد المقاومة المغناطيسية العملاقة
- نقاد: فيلم 'عالم الجوراسي: إعادة الميلاد' يحتاج إلى مزيد من الوقت ليخرج إلى النور
- جالاكسي S26 ألترا: نفس سعة البطارية، وشحن أسرع متوقع