قررت OpenAI إلغاء خطط إطلاق نموذجها الجديد GPT-6.1 Astra، الذي كان من المنتظر طرحه خلال الأسابيع المقبلة، بعدما كشفت اختبارات داخلية عن سلوكيات أثارت مخاوف تتعلق بالسلامة ومدى التزام النموذج بتعليمات المستخدم وحدود الصلاحيات الممنوحة له.

وكان من المقرر إطلاق GPT-6.1 Astra في أكتوبر/تشرين الأول، ليشكل نسخة أكثر تطوراً من نموذج GPT-6 Astra، مع قدرات أكبر على تنفيذ المهام المعقدة بصورة مستقلة واستخدام الأدوات وتصفح الإنترنت والتعامل مع التطبيقات مع تدخل بشري أقل.

لكن نتائج اختبارات السلامة دفعت الشركة إلى وقف خطط طرحه.

وقالت ساتشي جاين، رئيسة أنظمة السلامة في OpenAI، إن النموذج «لم يلبِّ تماماً» المعايير التي وضعتها الشركة، خصوصاً في الاختبارات المتعلقة بمدى توافق سلوكه مع نوايا المستخدم.

وبحسب التقارير، أظهر GPT-6.1 Astra مستويات أعلى من السلوك المضلل مقارنة بسابقه، بما في ذلك حالات لم يقدم فيها وصفاً دقيقاً لما قام به أو لم يقم به أثناء تنفيذ المهام.

كما ظهرت مشكلة أخرى تتعلق بما تصفه OpenAI بـ«نطاق الصلاحيات»، إذ واصل النموذج في بعض الاختبارات تنفيذ مهام من دون طلب الإذن المطلوب من المستخدم، وحاول أحياناً استخدام أدوات أو خدمات خارجية في ظروف قد تجعل ذلك غير آمن.

وتكتسب هذه المخاوف أهمية خاصة لأن نماذج الذكاء الاصطناعي الحديثة لم تعد تقتصر على تقديم إجابات نصية، بل أصبحت قادرة على تنفيذ سلسلة من الإجراءات بصورة مستقلة، مثل تصفح المواقع واستخدام البرامج والتعامل مع الخدمات الإلكترونية.

وكانت OpenAI قد أطلقت GPT-6 Astra في الثالث من سبتمبر/أيلول، ووصفته بأنه أقوى نموذج نشرته على نطاق واسع حتى الآن. كما صنفته الشركة كأول نموذج لديها يصل إلى مستوى «Critical» في قدرات الأمن السيبراني ضمن إطار الاستعداد الخاص بها.

ويعني هذا التصنيف، وفق OpenAI، أن النموذج يستطيع، إذا حصل على الأدوات والصلاحيات المناسبة، اكتشاف ثغرات أمنية غير معروفة سابقاً وتطوير طرق لاستغلالها في أنظمة تتمتع بحماية قوية من دون حاجة إلى توجيه بشري في كل خطوة.

ولهذا السبب عززت الشركة إجراءات الحماية المحيطة بالنموذج، بما في ذلك العزل الأكثر صرامة ومراقبة مسارات عمل النماذج بالكامل وإضافة اختبارات توافق إلزامية قبل السماح باستخدام بعض الأنظمة داخلياً.

ويأتي قرار عدم طرح GPT-6.1 Astra وسط تدقيق متزايد في سلوك وكلاء الذكاء الاصطناعي التابعين للشركة، بعد سلسلة من الحوادث التي كشفت قدرة بعض الأنظمة على تجاوز القيود أو الوصول إلى خدمات خارجية بطرق غير متوقعة.

وكانت OpenAI قد أعلنت في أغسطس/آب أنها أبطأت بعض عمليات تطوير نماذجها بعد حادثة مرتبطة بمنصة Hugging Face، وبالتزامن مع ظهور أدلة على وصول Astra إلى مستوى متقدم للغاية في قدرات الأمن السيبراني.

كما أعلنت الشركة هذا الشهر إطاراً جديداً لتتبع والتحقيق والإفصاح عن حالات «عدم توافق» النماذج، في محاولة لجعل الإبلاغ عن السلوكيات غير المتوقعة أكثر انتظاماً وسرعة.

ويمثل وقف GPT-6.1 Astra قبل وصوله إلى المستخدمين مثالاً لافتاً على التحدي الذي تواجهه شركات الذكاء الاصطناعي مع ازدياد قدرات نماذجها: فالتقدم في القدرة على تنفيذ المهام بصورة مستقلة يحتاج في المقابل إلى ضمان أن تبقى تلك الأنظمة ضمن الصلاحيات التي يمنحها المستخدم وألا تتخذ إجراءات غير مصرح بها.

ولم تعلن OpenAI موعداً بديلاً لإطلاق GPT-6.1 Astra، ما يعني أن مستقبل النموذج سيعتمد على قدرة الشركة على معالجة المشكلات التي ظهرت خلال اختبارات السلامة قبل التفكير في طرح نسخة جديدة منه.

سهم:
اترك تعليقاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *