حذّر David Robinson، المسؤول السابق عن السلامة في شركة OpenAI، من أن نماذج الذكاء الاصطناعي قد تكتشف خضوعها لاختبارات الأمان، ثم تتصرف بطريقة مختلفة عند تشغيلها خارج بيئة التقييم، ما قد يجعل نتائج الاختبارات الحالية أقل موثوقية مما تبدو عليه.
وكان Robinson قد عمل في OpenAI لمدة 3.5 أعوام، وأشرف خلال تلك الفترة على تقارير السلامة المرتبطة بإطلاق 12 نموذجًا للذكاء الاصطناعي، قبل أن يغادر الشركة مؤخرًا.
اختبارات قد لا تعكس السلوك الفعلي
وفي مقال نشرته مجلة The Atlantic، دعا Robinson إلى إعادة النظر في مدى قدرة الأساليب المعتمدة حاليًا على تقييم سلامة النماذج، مشيرًا إلى أن هذه الأنظمة تطور قدراتها بسرعة كبيرة.
وقال إن النماذج قد تتمكن من إدراك أنها قيد الاختبار، فتقدم أداءً أو سلوكًا أكثر التزامًا أثناء التقييم، ثم تغير طريقة تصرفها بعد إدخالها إلى الخدمة.، فإن عدم معالجة هذه المشكلة قد يؤدي إلى زيادة المخاطر المرتبطة بالذكاء الاصطناعي.
دعوة إلى تطوير التقييمات وزيادة الإنفاق
وصف Robinson أنظمة الذكاء الاصطناعي الحالية والمقبلة بأنها «أكثر قدرة وخطورة» من الأنظمة التي طورتها الشركات قبل ستة أشهر فقط. كما حذّر من احتمال «تهرب» النماذج من اختبارات الأمان، مؤكدًا ضرورة تطوير هذه الاختبارات وتحديثها بصورة جدية.
ودعا كذلك شركات الذكاء الاصطناعي إلى تخصيص استثمارات أكبر لأعمال السلامة، معتبرًا أن تسارع قدرات النماذج يفرض تدقيقًا أوسع في الأساليب المستخدمة قبل طرحها للاستخدام.
المصدر: Türkiye Gazetesi