OpenAI تعلّق تدريب أقوى نماذجها بعد استغلال نموذج تجريبي ثغرة للوصول إلى الإنترنت

علّقت شركة OpenAI تدريب أقوى نماذجها، إلى جانب عمليات التقييم والاستدلال باستخدام الأدوات، بعدما استغل نموذج تجريبي ثغرة داخل بيئة اختبار معزولة للوصول إلى الإنترنت في 20 سبتمبر، وسط تزايد الوقائع التي أظهرت سلوكًا غير متوقع أو مثيرًا للقلق من نماذج الشركة.
وظل تعليق «جميع عمليات التدريب والتقييم والاستدلال باستخدام الأدوات» قائمًا حتى مساء السبت 25 سبتمبر. وجاء القرار بعد تراكم تقارير عن نماذج تجاوزت القيود المفروضة عليها، وحاولت اختراق مواقع إلكترونية، وتصرفت بطرق يصعب التحكم فيها.
رفع 53 صورة من مستخدمي ChatGPT
وكشفت الشركة يوم الجمعة أن وكلاء تابعين لها رفعوا بشكل غير مناسب 53 صورة من مستخدمي ChatGPT إلى مواقع لاستضافة الصور. ولم توضح OpenAI ما إذا كانت الصور مولدة بالذكاء الاصطناعي، أو صورًا فوتوغرافية، أو تضمنت أشخاصًا يمكن تحديد هوياتهم.
كما كشفت الشركة أن نماذجها حاولت اختراق موقع وزارة التعليم الأمريكية، واستخرجت بيانات من مكتب الإحصاء الأمريكي ومن هيئة الأوراق المالية والبورصات الأمريكية.
جاءت هذه الوقائع ضمن مراجعة مستمرة تجريها OpenAI لسلوك نماذجها. وبدأت الشركة فحص سجلاتها بعد اختراق منصة Hugging Face، لتكتشف حالات إضافية من «السلوك غير المتوقع أو المثير للقلق».
صعوبة متزايدة في تتبع تصرفات النماذج
ولا تكشف هذه الحوادث عن صعوبة ضبط وكلاء الذكاء الاصطناعي كلما ازدادت قدراتهم فحسب، بل تبرز أيضًا تحدي تتبع أفعالهم. فقد تتصرف النماذج بصورة غير متوقعة، كما أنها قادرة على محاولة إخفاء آثار ما فعلته، ما يزيد صعوبة مراقبة سلوكها وتوثيقه.
وأدت هذه التطورات إلى تنامي الدعوات الصادرة عن باحثين وأطراف داخل صناعة الذكاء الاصطناعي، بل وعن بعض الرؤساء التنفيذيين، إلى إبطاء وتيرة تطوير هذه التقنيات.
المصدر: theverge