كشفت OpenAI عن 6 حالات من "سلوك النماذج غير المتوقع أو المقلق" التي لوحظت خلال الأشهر الستة الماضية، إلى جانب إطار عمل يلتزم الشركة بالإبلاغ عن مثل هذه النتائج.
تتراوح الحالات بين النماذج التي تخفي أخطائها إلى نماذج تتخذ إجراءات غير مصرح بها لتجاوز العقبات.
تنشر OpenAI 6 حالات لنماذج تخفي الأخطاء وتخالف القواعد
في إحدى الحالات، وجد نموذج يجيب على سؤال روتيني حول الأرباح في مقاطعة في كاليفورنيا مفتاح واجهة برمجة تطبيقات مكشوفة في مستودع عام واستخدمه دون إذن. عندما لم تكن البيانات لا تزال لا تحميل، اخترع الأرقام وقدمها على أنها صادرة المصدر المطلوب.
يظهر الإخفاء مرتين. خلال تدريب GPT-5.6 سول، كتبت عدة حالات تعليمات في ملخصات المهام لإخفاء الأخطاء والسلوك غير المتوافق.
أدرج نموذج بحثي غير منشور تعليمات غير مرتبطة، بما في ذلك أوامر بتجاهل قيوده الطبيعية، في 27 ملخصا.
نموذج آخر لم يصدر رفع ملفا إلى الإنترنت دون أن يسأل، فقط ليتمكن من الاستشهاد برابط متصفح.
تقارير إضافية تغطي التنسيق. حولت النماذج مستودع برمجيات داخلي إلى لوحة رسائل لتبديل الطلبات عبر جولات تدريب منفصلة. كما كان الوكلاء في مهمة مشتركة ينشرون المخرجات على مواقع استضافة الملفات العامة عندما لا يستطيعون قراءة ملفات بعضهم البعض.
"توضح هذه الحالات مجموعة من السلوكيات المختلفة التي نعتقد أنها تستحق المشاركة، من إخفاء المعلومات عن المستخدم إلى اتخاذ إجراءات غير مصرح بها لتجاوز العقبات. هذه تقارير عن حالات فردية، ولا ينبغي اعتبارها انعكاسا لعدد مرات حدوث عدم التوافق عبر نماذجنا،" أضاف OpenAI.
تابعنا على X للحصول على آخر الأخبار فور حدوثها
إطار إفصاح وتحذير
يأتي الإطار بعد انطلاقة يوليو، عندما هرب عملاء OpenAI من وضعهم المفتوح واخترقوا أنظمة Hugging Face. وصفت OpenAI تلك الحلقة بأنها طلقة تحذيرية.
الآن، مع إطار الإفصاح الجديد، أصبح لدى الشركة مسار رسمي لتغطية حوادث عدم التوافق. يمكن لأي موظف في OpenAI الإبلاغ عن حادث، والذي ينتهي بعد ذلك في أحد ثلاثة مسارات.
يغطي برنامج "جاهز للإفصاح والتحقيق البسيط" معظم القضايا، بينما يتعامل "المسار البطيء" مع التحقيقات المعقدة التي تشمل أطراف ثالثة. قالت OpenAI إن حادثة "وجه العناق" في يوليو كانت ستقع ضمن هذا المسار الأبطأ.
جمعت الشركة الإطار مع تقييم حاد لموقف الصناعة.
"لا نعتقد أن صناعة الذكاء الاصطناعي قد حلت مشكلة المحاذاة والمراقبة بدرجة كافية للاستمرار في التوسع بمسؤولية بأقصى سرعة لفترة أطول."
تأتي هذه الإفصاحات مع تراكم التحذيرات من الانقراض. وصلت تحذيرات من باحثي الذكاء الاصطناعي إلى الكونغرس بالفعل، حيث يدرس المشرعون مشروع قانون لحظر الذكاء الفائق تماما.
تسمي الشركة هذه الإفصاحات بأنها خطوة أولى نحو معايير لم تمتلكها الصناعة بعد. ما إذا كانت المختبرات المنافسة ستتبنى تقارير مماثلة سيظهر مدى استعداد الصناعة لمراقبة نفسها علنا
اشترك في قناتنا على يوتيوب لمشاهدة القادة والصحفيين يقدمون رؤى خبراء









