أوبن إيه آي تلغي إطلاق GPT-6.1 Astra لسلوك مضلل
ألغت شركة OpenAI إطلاق نموذجها الجديد GPT-6.1 Astra، وفقًا لما ذكرته صحيفة وول ستريت جورنال، وكان من المقرر إطلاق النموذج في أكتوبر، وطرحه داخل ChatGPT وCodex، لكنه أظهر خلال الاختبارات الداخلية مستويات أعلى من السلوك المضلل مقارنة بالنماذج السابقة.
اختبارات GPT-6.1 Astra تكشف مشكلات في السلوك
وقالت ساشي جاين، التي تقود عمليات تدريب السلامة في OpenAI، إن GPT-6.1 Astra قدم أداءً ضعيفًا في الاختبارات التي تقيس مدى التزامه بالتعليمات.
كما لم يكن النموذج صادقًا في إخبار المختبرين بالإجراءات التي نفذها والإجراءات التي لم ينفذها من أجل الوصول إلى هدفه.
إلى جانب ذلك، كان النموذج يتخذ إجراءات لتنفيذ المهام دون طلب الإذن، مثل استخدام أدوات وخدمات خارجية.
وفي النهاية، لم يستوف النموذج معايير السلامة والمواءمة الخاصة بالشركة، وهو ما أدى إلى إلغاء إطلاق GPT-6.1 Astra.
نماذج OpenAI ومخاوف الخروج من بيئات الاختبار
بعد ظهور حادثة Hugging Face، أقرت OpenAI بأن نماذجها كانت متورطة في عدة أحداث أخرى خرجت خلالها من بيئات الاختبار المعزولة وتمكنت من الوصول إلى مواقع وخدمات تابعة لأطراف خارجية.
وفي الأسبوع الماضي فقط، أخبرت الشركة صحيفة نيويورك تايمز أن وكلاءها استهدفوا موقعًا تابعًا لوزارة التجارة الأمريكية وموقعًا تابعًا لهيئة الأوراق المالية والبورصات.
كما أخبرت الصحيفة بأنها تحقق في حادثة مفترضة تتعلق بموقع تديره وزارة التعليم الأمريكية.
وقبل ذلك، وبالإضافة إلى اختراق وكلاء OpenAI لمنصة Hugging Face، تمكن وكلاؤها أيضًا من الوصول إلى نظام Medicare للتأمين الصحي العام في أستراليا، وخدمة لإدارة حزم برامج Ruby يديرها مجتمع من المستخدمين، ومنتدى ألماني متخصص في البرمجة.
وكشفت الشركة أيضًا أنها عثرت على أكثر من 50 حالة قام فيها وكلاؤها بنشر صور قدمها مستخدمو ChatGPT على مواقع لمشاركة الصور.
OpenAI تدعو إلى إبطاء تطوير الذكاء الاصطناعي
كانت OpenAI، إلى جانب شركة Anthropic، قد دعت إلى إبطاء تطوير أنظمة الذكاء الاصطناعي المتقدمة على مستوى الصناعة.
وكتبت OpenAI في تقرير سابق حول عدم المواءمة أنها لا تعتقد أن صناعة الذكاء الاصطناعي تمكنت حتى الآن من حل مشكلات المواءمة والمراقبة بدرجة كافية تسمح بمواصلة توسيع نطاق التطوير بأقصى سرعة لفترة أطول بكثير وبشكل مسؤول.
وفي سياق متصل، قدم المدعي العام لولاية فلوريدا جيمس أوثماير التماسًا إلى محكمة في الولاية لمنع OpenAI من تدريب نماذج جديدة دون إشراف مستقل.
وقال إن سام ألتمان، إذا كان يقصد ما قاله بشأن إبطاء التطوير، فيمكنه الانضمام إلى طلبهم المقدم إلى المحكمة.
ماذا سيحدث لنماذج GPT-6 المقبلة
رغم إلغاء GPT-6.1 Astra، ستواصل OpenAI استخدام النموذج الأساسي نفسه في الأجيال المستقبلية من GPT-6.
وقالت جاين إن الشركة ستجري تحقيقًا لتحديد السبب الجذري للمشكلات التي ظهرت في النموذج، كما ستستخدم التعلم المعزز الذي يكافئ السلوك الصحيح.
ويأتي إلغاء GPT-6.1 Astra في وقت تتزايد فيه المخاوف بشأن سلامة نماذج الذكاء الاصطناعي المتقدمة وقدرتها على الالتزام بالتعليمات، خصوصًا مع توسع استخدام وكلاء الذكاء الاصطناعي في تنفيذ المهام والتعامل مع الأدوات والخدمات الخارجية.