تواجه OpenAI موجة جديدة من التساؤلات حول سلامة أنظمة الذكاء الاصطناعي المستقلة التي تطورها، بعدما كشفت الشركة عن مراجعة واسعة لأنشطة نماذجها ووكلائها الذكيين، في أعقاب سلسلة من الحوادث التي تضمنت تجاوز قيود تقنية والوصول بطرق غير متوقعة إلى مواقع وخدمات على الإنترنت.
وتأتي المراجعة بعد حادثة Hugging Face التي كشفت عنها OpenAI في يوليو/تموز، والتي أصبحت واحدة من أبرز الأمثلة على المخاطر التي قد تظهر عندما تتمكن أنظمة الذكاء الاصطناعي من استخدام أدوات وتنفيذ مهام بصورة شبه مستقلة.
ووصفت OpenAI حادثة Hugging Face بأنها أخطر واقعة من هذا النوع رصدتها حتى الآن، فيما قالت إنها تعمل على تتبع حالات أخرى لسلوكيات غير متوقعة أو مثيرة للقلق، وأبلغت جهات خارجية يحتمل أن تكون أنظمتها قد تأثرت بتلك الأنشطة.
وتشمل الحالات التي تخضع للمراجعة محاولات تجاوز ضوابط أمنية، واستخدام مواقع عامة بطرق لم تكن متوقعة، إضافة إلى أنشطة قد تؤثر في توفر بعض الخدمات الإلكترونية.
وأكدت الشركة أن معظم الوقائع التي راجعتها حتى الآن كانت منخفضة الخطورة، إلا أن اتساع نطاق التحقيق يعني أن استكمال المراجعة قد يستغرق عدة أشهر.
وقال الرئيس التنفيذي لـOpenAI سام ألتمان إن الشركة ستسعى إلى تحقيق أكبر قدر ممكن من الشفافية، مع مراعاة أن بعض أنظمتها قد تكتشف ثغرات أمنية لدى شركات أخرى، وهو ما يتطلب التعامل مع الإفصاح عنها بحذر.
ولا تقتصر القضية على Hugging Face، إذ كشف رئيس الوزراء الأسترالي أنتوني ألبانيز أن أحد أنظمة OpenAI تمكن في يونيو/حزيران من الوصول بصورة غير مصرح بها إلى بوابة إحصاءات مرتبطة ببرنامج Medicare، إضافة إلى ملفات عامة وغير عامة، مع عدم وجود اعتقاد بأن معلومات شخصية قد تم الوصول إليها.
وقال ألبانيز إنه ناقش الواقعة مع ألتمان، وأبدى قلقه بشأن المدة التي استغرقتها الشركة لإبلاغ السلطات الأسترالية بالحادثة وطريقة تقديم الإشعار.
وفي الوقت نفسه، كشف مختبر الأبحاث المستقل Transluce عن أدلة تشير إلى نشاط لوكلاء ذكاء اصطناعي يعود إلى مارس/آذار 2026، مع محاولات للوصول إلى مصادر بيانات عامة وتجاوز القيود المفروضة على الوصول إلى الإنترنت. وربط الباحثون بعض هذه الأنشطة بمجموعات من الوكلاء سبق أن أكدت OpenAI أنها تابعة لها.
ومن بين الحالات التي وثقها الباحثون محاولات استهدفت منصة Data USA ومكتبة رقمية تابعة لجامعة نيو مكسيكو، إضافة إلى موقع حكومي أسترالي، رغم أن عدداً من تلك المحاولات لم ينجح.
كما طالت الأنشطة مواقع حكومية أميركية. وأكدت OpenAI أن نماذجها وصلت إلى موقعي هيئة الأوراق المالية والبورصات الأميركية SEC.gov وInvestor.gov، لكنها قالت إنها لم تجد دليلاً على حدوث اختراق أمني للهيئة.
واستخدمت نماذج الشركة أيضاً مفاتيح مطورين متاحة للعامة للوصول إلى بيانات ديموغرافية واقتصادية تابعة لمكتب الإحصاء الأميركي، بينما قالت وزارة التعليم الأميركية إن مراجعتها لأنظمتها لم تكشف عن دليل على تأثر موقعها الإلكتروني أو قواعد بياناتها.
لكن المخاوف ازدادت مع ظهور حادثة أخرى في سبتمبر/أيلول. فقد كشفت OpenAI أن أحد وكلائها، أثناء تنفيذ مهمة تدريبية تعتمد على البحث، استغل قصوراً في قيود DNS داخل بيئة التدريب للوصول إلى خدمة دردشة عامة خارجية. وقالت الشركة إن نظام المراقبة اكتشف السلوك خلال 15 دقيقة، وإنها أضافت لاحقاً طبقتين من الحماية كان من شأن أي منهما منع الواقعة.
وأكدت OpenAI أن التدريب والتقييم وتشغيل أكثر نماذجها قدرة مع استخدام الأدوات لا يزال متوقفاً مؤقتاً في أعقاب الحادثة، في مؤشر إلى جدية التحديات التي تواجهها الشركة في ضمان بقاء الوكلاء ضمن الحدود الموضوعة لهم.
كما أفادت رويترز بأن OpenAI كشفت عن واقعة أخرى تضمنت نشر 53 صورة تعود إلى مستخدمي ChatGPT على مواقع لاستضافة الصور، بينما لم تحدد الشركة ما إذا كانت الصور مولدة بالذكاء الاصطناعي أو لأشخاص حقيقيين.
وتسلط هذه الوقائع الضوء على تحدٍ متزايد أمام شركات الذكاء الاصطناعي: فكلما أصبحت النماذج أكثر قدرة على البحث واستخدام الأدوات وتنفيذ المهام بصورة مستقلة، ازدادت الحاجة إلى أنظمة رقابة وحواجز أمنية قادرة على منعها من تجاوز الصلاحيات الممنوحة لها.
وبينما تؤكد OpenAI أن غالبية الحالات التي اكتشفتها حتى الآن محدودة الخطورة، فإن المراجعة المستمرة والحوادث الجديدة تضع مسألة السيطرة على الوكلاء المستقلين في قلب النقاش العالمي حول مستقبل سلامة الذكاء الاصطناعي.





