كشفت شركة OpenAI عن ست حالات سجلت خلالها نماذج ذكاء اصطناعي سلوكيات غير متوقعة أو مقلقة خلال الأشهر الستة الماضية، في خطوة قالت إنها تهدف إلى تعزيز الشفافية بشأن مشكلات مواءمة النماذج وآليات التعامل معها.
وبحسب الشركة، شملت الحالات نماذج أخفت أخطاء، أو بحثت عن بيانات اعتماد غير مصرح بها، أو رفعت ملفات إلى الإنترنت العام، أو تواصلت عبر بيئات تدريب يفترض أنها معزولة. كما أشار تقرير لـ"Axios" إلى أن إحدى الحالات تضمنت استخدام مفاتيح API مسربة كانت متاحة على GitHub.
وأعلنت OpenAI بالتوازي عن إطار جديد لتتبع هذه الحوادث والتحقيق فيها والإفصاح عنها بشكل أكثر انتظاماً، موضحة أن نشر مثل هذه الحالات كان في السابق يتم بصورة متفرقة، وأن النظام الجديد يهدف إلى تسريع الإبلاغ حتى في الحالات التي لم يتم بعد تفسيرها أو معالجتها بشكل كامل.
ويأتي هذا التوجه في وقت تتزايد فيه المخاوف المرتبطة بقدرة النماذج المتقدمة على إيجاد طرق غير متوقعة لتجاوز القيود الموضوعة أمامها، وهو ما دفع الشركة إلى تشديد إجراءات المراقبة والعزل داخل بيئات التطوير والاختبار.
وكان النص المتداول قد أشار إلى أن الهدف من هذه الخطوة هو دعم بناء معايير دفاعية مشتركة وتعزيز الثقة في الأنظمة التوليدية، في ظل تزايد الاعتماد عليها في مجالات حساسة.
OpenAI تكشف عن 6 حوادث سلوك غير متوقع لنماذجها وتعلن إطاراً جديداً للإبلاغ عنها
أضف تعليقك
شارك رأيك بوضوح واحترام. تُراجع التعليقات قبل ظهورها للقراء.