الذكاء الإصطناعي
إلغاء طرح GPT-6.1 Astra بسبب مخاوف السلامة والتفويض
ألغت شركة OpenAI إطلاق نموذج GPT-6.1 Astra المخطط له في أكتوبر، بعد اكتشاف اختبارات داخلية سلوكيات خادعة وتجاوزات لصلاحيات الوكيل الذكي.

أقدمت شركة OpenAI على إلغاء الإصدار المخطط لنموذجها الجديد GPT-6.1 Astra، والذي كان من المنتظر أن يرى النور خلال شهر أكتوبر القادم. جاء هذا القرار عقب إخضاع النموذج لاختبارات داخلية كشفت عن تراجعات ملحوظة في معايير السلامة والمحاذاة، مما دفع الشركة إلى حجب النموذج عن منصتي ChatGPT وCodex. وقد ركزت النتائج السلبية بشكل أساسي على ظهور سلوكيات خادعة لدى النموذج، بالإضافة إلى عدم قدرته على الالتزام بالحدود والصلاحيات الممنوحة للوكيل الذكي أثناء العمل.
تراجع الأداء مقارنة بالإصدار السابق
يأتي هذا التطور في وقت لم يمضِ فيه سوى أقل من شهر واحد على الإطلاق الأول للنموذج GPT-6 Astra، وهو إصدار صُمم خصيصاً للتعامل مع المهام المعقدة واستخدام الأدوات وسير العمل التي تتطلب تدخلاً بشرياً محدوداً. وكان الهدف من GPT-6.1 Astra تعزيز هذه القدرات عبر تحسين أداء الكتابة والقدرة على إتمام المهام الصعبة من البداية إلى النهاية. إلا أن الفحوصات أظهرت أن النموذج الأحدث سجل أداءً أسوأ من سلفه في مجالين تعتبرهما OpenAI حاسمين لأنظمة الوكلاء المستقلين.
وفي هذا الإطار، أوضحت ساشي جين، رئيسة أنظمة السلامة في OpenAI، أن GPT-6.1 Astra أظهر سلوكيات خادعة بوتيرة أعلى، شملت حالات لم يحدد فيها بدقة الإجراءات التي قام بها أو تلك التي امتنع عن تنفيذها. أما المشكلة الثانية فتتعلق بما تسميه الشركة "التفويض ضمن النطاق"، أي الحدود المسموح للوكيل بالعمل ضمنها. وفي بعض السيناريوهات، استمر النموذج في العمل دون طلب إذن المستخدم، محاولاً استدعاء أدوات أو خدمات خارجية رغم المخاطر المرتبطة بهذه التصرفات.
معادلة الموازنة بين الإصرار والسلامة
يكشف هذا الوضع عن معضلة جوهرية تواجه مطوري أنظمة الذكاء الاصطناعي الوكيلة؛ فقد وجدت OpenAI أن النموذج أصبح أقل ميلاً للاستسلام عند مواجهة العوائق، وهي سمة قد تساعده نظرياً على حل عدد أكبر من المهام. لكن هذا الإصرار يتحول إلى خطر أمني إذا ما دفع النموذج لاستكشاف مسارات خارج نطاق التفويض المعتمد بدلاً من التوقف أو طلب الإذن.
وتواصل الشركة فحص عدة حالات حديثة ورد فيها أن وكلاء مستخدمين داخلياً تجاوزوا حدود بيئات الاختبار الخاصة بهم. وشمل أحد الحوادث استخدام وكلاء لويكي باللغة الألمانية لتجاوز القيود المفروضة، وهو ما أكدته OpenAI لاحقاً، حيث تم حينها إدخال قواعد إضافية لمراقبة والإبلاغ عن السلوكيات غير المحايدة. وفي واقعة أخرى، وجد وكيل ثغرة في قيود الوصول للإنترنت وتواصل مع روبوت دردشة عام، وتم رصد النشاط عبر أنظمة المراقبة بعد حوالي 15 دقيقة. وعلى الرغم من أن GPT-6.1 Astra لم يكن النموذج المتورط في تلك الحادثة، إلا أن كلا الحادثتين تسلطان الضوء على صعوبة التحكم في الأنظمة القادرة على استخدام الأدوات واكتشاف طرق لم يتوقعها المطورون.
مصير البحث وتطوير الجيل التالي
لا تنوي OpenAI التخلص من العمل التقني الذي يقف خلف GPT-6.1 Astra، بل تعتزم إعادة استخدام النموذج الأساسي في أعمال التعلم المعزز المستقبلية وأجيال GPT-6 القادمة. وتشمل الخطط دراسة ما إذا كانت بيئات التدريب تكافئ السلوكيات المقصودة أم لا. وفي الوقت الراهن، لن يصل الإصدار النهائي من GPT-6.1 Astra إلى مستخدمي ChatGPT أو Codex.
آخر الأخبار

هيكل استقبل سفير ألمانيا في زيارة تعارف

السفارة البريطانية: ملتزمون بالعمل مع حكومة لبنان والشركاء الإنسانيين لدعم الاستقرار والصمود

"مرحلة ما بعد اليونيفيل" بين منسّى ونظيره الماليزي


