أوضحت OpenAI كيف تتعامل مع "الجرمّين" في إجابات الذكاء الاصطناعي، وأزالت القيود.
كشف شركة أوبن إيه آي عن "مشكلة" مع الجوبلين
أصبح معروفًا في Wired أن شركة OpenAI واجهت ميزة غير متوقعة في نماذج الذكاء الاصطناعي الخاصة بها: بدأت هذه النماذج غالبًا في ذكر الجوبلين، الغريميلون وغيرها من الكائنات الخيالية. لتصحيح ذلك، اضطر المطورون إلى إعطاء النموذج تعليمات خاصة: "لا تتحدث أبدًا عن الجوبلين، الغريميلون، القنافذ، الترولات، الأورغ، الحمام أو أي حيوانات وكائنات أخرى".
لماذا نشأت هذه العادة؟
أصبح واضحًا بعد إصدار GPT‑5.1، لا سيما عندما كان يتضمن الحوار شخصية "بوتانيك" (Nerdy). مع كل تحديث للنموذج، ارتفعت تكرار الإشارات. تبين أن أثناء تدريب التعزيز، كانت هذه الاستعارات تُمنح مكافأة—لكن فقط عند تنشيط شخصية بوتانيك. بما أن التدريب بالتحفيز لا يضمن الحفاظ على السلوك في نفس الظروف، فقد تنتشر هذه العادة إلى أجزاء أخرى من النموذج، خاصة إذا تم إعادة استخدام النتائج في التعديل الدقيق أو بيانات التفضيلات.
كيف ردت الشركة؟
في مارس، أوقفت OpenAI استخدام بوتانيك، وبعد ذلك اختفت إشارات الجوبلين تقريبًا. ومع ذلك، ظهرت مرة أخرى في خدمة Codex مع GPT‑5.5، لأن تدريب النموذج بدأ قبل اكتشاف المشكلة. لذلك اضطُر المطورون إلى إضافة تعليمات إضافية لـ Codex: "لا تذكر الكائنات الأسطورية". ومع ذلك، حصل المستخدمون الذين يفضلون هذا النمط من التواصل على إمكانية إيقاف هذه القيود عبر كود خاص.
وبهذا الشكل، واجهت OpenAI "عادة" غير متوقعة في نماذج الذكاء الاصطناعي الخاصة بها واتخذت إجراءات لتصحيحها، مع تقديم إعدادات مرنة لجماهير مختلفة.
التعليقات (0)
شارك أفكارك — يرجى الالتزام بالأدب والبقاء ضمن الموضوع.
سجّل الدخول للتعليق