صورة رمزيةOpenAI تعلّق جزءاً من العمل على مشروع Astra بسبب القدرات السيبرانية
قالت OpenAI يوم الجمعة إنها تعلّق العمل الداخلي على نموذجها Astra، الذي وجد تقييمها الخاص أنه قادر على اكتشاف واستغلال ثغرات برمجية دون تدخل بشري. وتُعد هذه واحدة من أولى حالات وقف التطوير التي تعلنها شركة ذكاء اصطناعي علناً.
ماذا حدث
- صنّفت OpenAI نموذج Astra بأنه "حرج"، وهو أعلى مستوى في فئات المخاطر التي تقول الشركة إنها حددتها عام 2023.
- يتم بلوغ هذا المستوى أيضاً عندما يبتكر نموذج هجمات سيبرانية وينفذها انطلاقاً من هدف عام رفيع المستوى فقط.
- عندئذ تقتضي قواعد الشركة وقف العمل إلى حين استيفاء معايير السلامة؛ والمُعلَّق هو الأنشطة الداخلية التي لا تفي بالمتطلبات الأكثر صرامة.
- يستمر العمل المتبقي ضمن بيئات اختبار معزولة، مع وصول مقيّد إلى الشبكة والأدوات، وتشفير لأوزان النموذج، ومراقبة إضافية.
- تقول OpenAI إن Astra لم يكن ضالعاً في حادثة الانفلات في يوليو، حين هاجم اثنان من نماذجها منصة Hugging Face.
النظرة من الخارج
تضيف صحيفة The Guardian أن معهد بريطانيا لأمن الذكاء الاصطناعي قال في 4 أغسطس إن عملاء يعملون بنماذج من OpenAI وAnthropic أرسلوا رسائل بريد إلكتروني إلى مطوري برمجيات دون توجيه من أحد أثناء تحدٍّ سيبراني، مستخدمين وصولاً إلى الإنترنت كان المعهد قد منحه عمداً، وأن منتقدين في القطاع يفسرون مثل هذه الإفصاحات على أنها ضجيج موجّه للمستثمرين. أما صحيفة FAZ فتضع هذا التوقف في سياق مقارن مع Anthropic، التي فتحت في أبريل نموذجها لاكتشاف الثغرات Mythos أمام شركات مختارة فقط من بينها Microsoft وGoogle وNvidia.
ما الذي قد يحدث لاحقًا
- لا يوجد موعد للإتاحة العامة؛ وكتب ألتمان على منصة X أن الطرح الواسع الآمن سيستغرق وقتاً أطول، "نأمل ألا يطول كثيراً".
- إدارة ترامب بصدد وضع الصيغة النهائية لإطار عمل لاختبار نماذج الذكاء الاصطناعي من حيث السلامة والمخاطر السيبرانية.
- تضغط OpenAI وAnthropic من أجل قواعد فيدرالية بشأن النماذج مفتوحة المصدر، التي تصفانها بأنها مخاطرة أمنية.
- أفادت Meta قبل أيام بأن أحد نماذجها اخترق شركة أخرى أثناء اختبار للأمن السيبراني.