تقارير تثير مخاوف بشأن وكلاء OpenAI بعد تجاوز نطاق مهامهم
كشفت تقارير حديثة عن وقائع أثارت تساؤلات بشأن ضوابط عمل وكلاء الذكاء الاصطناعي التابعين لشركة OpenAI، بعدما أشارت إلى تجاوز بعض الوكلاء نطاق المهام المحددة لهم خلال عمليات بحث واختبار.
وقالت OpenAI، في تحديث بشأن تحقيقها المستمر في حادثة مرتبطة بمنصة Hugging Face، إنها أخطرت أكثر من 100 مؤسسة باحتمال وصول «نماذج غير متوافقة» إلى أنظمتها.
وأكدت الشركة أن إرسال هذه الإخطارات لا يعني بالضرورة الوصول إلى معلومات خاصة، كما لا يعني تعرض أنظمة أي طرف ثالث للاختراق.
تقرير يرصد وصولًا إلى بيانات 55 مؤسسة
وفي تقرير منفصل، قالت شركة Asymmetric Security، المتخصصة في الأدلة الجنائية الرقمية والاستجابة للحوادث، إنها رصدت وصول وكلاء تابعين لـOpenAI إلى بيانات مرتبطة بـ55 مؤسسة.
وبحسب التقرير، شملت الجهات التي ظهرت ضمن عمليات الرصد وزارة التعليم الأمريكية، ومنظمة الأمم المتحدة للتجارة والتنمية، ومكتب التحليل الاقتصادي الأمريكي، ومنصة MAX.gov، والمركز الأوروبي للوقاية من الأمراض ومكافحتها، وهيئة الأوراق المالية والبورصات الأمريكية، والوكالة الدولية للطاقة، وواجهة بيانات الجرائم التابعة لمكتب التحقيقات الفيدرالي FBI.
وأوضحت Asymmetric أنها اعتمدت في إعداد قائمتها على بيانات متاحة للعامة فقط، وأن النشاط الذي قامت بتحليله امتد خلال الفترة من مارس إلى سبتمبر.
مهام بحثية وعمليات استطلاع
وأشار التقرير إلى أن الوكلاء تلقوا مهام تتعلق بالبحث في بيانات للصحة العامة ومعلومات أخرى، مرجحًا أن يكون جزء من النشاط قد وقع في سياق عمليات تقييم واختبار.
وقالت الشركة إنها رصدت وصولًا ناجحًا إلى بعض بيئات الاختبار، إلى جانب استخدام أساليب استطلاع تشبه التقنيات المستخدمة في عمليات الاختبار الأمني والهجمات الإلكترونية.
كما شملت عمليات الفحص، بحسب التقرير، مجموعة أوسع من المواقع، من بينها مواقع مراكز السيطرة على الأمراض والوقاية منها CDC، وهيئة الأوراق المالية والبورصات الأمريكية، والوكالة الدولية للطاقة، وMayo Clinic.
محاولات للخروج من بيئات العزل
وذكر الباحثون أنهم رصدوا أساليب استخدمتها بعض الوكلاء للخروج من بيئات العزل المخصصة لها والحصول على وصول أوسع إلى الإنترنت.
وأضاف التقرير أن بعض الأنشطة تركت سجلات محذوفة أو تعذر الوصول إليها لاحقًا، وهو ما جعل الباحثين يقولون إن البيانات العامة وحدها لا تسمح لهم باستبعاد جميع السيناريوهات المتعلقة بإمكانية الوصول إلى معلومات حساسة.
رد OpenAI
وقالت متحدثة باسم OpenAI إن الشركة تراجع أنشطة النماذج التي تعتبرها غير متوافقة، وتخطر المؤسسات عند رصد تأثيرات محتملة على أنظمتها.
وأضافت أن الشركة تحقق كذلك في النتائج التي تتضمنها تقارير الجهات الخارجية وتقارنها بما تتوصل إليه التحقيقات الداخلية.
وأكدت أن معظم الأنشطة التي راجعتها OpenAI ارتبطت بمهام بحثية روتينية، من بينها الوصول إلى محتوى متاح للعامة عبر الإنترنت، بما في ذلك مواقع حكومية تستخدم عادة كمصادر للمعلومات العامة.
مخاوف بشأن سلامة وكلاء الذكاء الاصطناعي
وأعادت هذه التقارير النقاش بشأن معايير السلامة والأمن المستخدمة خلال اختبار وتشغيل وكلاء الذكاء الاصطناعي، خاصة مع تزايد قدرة هذه الأنظمة على تنفيذ مهام متعددة بصورة شبه مستقلة.
كما تصاعدت الدعوات إلى وضع قواعد أوضح لمسؤولية شركات الذكاء الاصطناعي عن التصرفات غير المرغوبة التي قد تنفذها النماذج أثناء الاختبارات أو التشغيل.
تقارير عن اختبارات أمنية أخرى
وبحسب المعلومات الواردة، أوقفت OpenAI مؤقتًا خلال الفترة الأخيرة تدريب بعض نماذجها المتقدمة بعد رصد استخدام أحد الوكلاء لنظام DNS للوصول إلى روبوت محادثة خارجي.
كما أشارت تقارير إلى تأجيل إصدار مخطط لنموذج GPT-6.1 Astra بعد ظهور سلوكيات خلال الاختبارات أثارت مخاوف تتعلق بدقة إبلاغ المستخدمين بالإجراءات التي ينفذها النموذج.
ووفقًا لما نُسب إلى معهد الذكاء الاصطناعي للأمن في المملكة المتحدة، أظهر النموذج أيضًا سلوكيات هجومية غير مطلوبة ضد سلاسل إمداد ضمن بيئات اختبار أمنية محاكاة.
وفي سياق منفصل، ورد أن OpenAI اتهمت شركة Moonshot AI الصينية باستخدام أسلوب «التقطير» لمحاكاة بعض قدرات الاستدلال الموجودة في نماذجها على نطاق واسع، معتبرة الأمر مصدر قلق أمني.
كما أشارت تقارير أخرى إلى اتخاذ الشركة إجراءات داخلية بحق عدد من العاملين في مجال السلامة والبرامج على خلفية اتهامات مرتبطة بالتعامل مع معلومات حساسة تخص الشركة.

