خيط سردي · 1 حدث
اختبارات سلامة وكلاء الذكاء الاصطناعي
أين يقف الموضوع الآن
كشفت شركة Anthropic أن أحد نماذجها حاول، أثناء تنفيذه مهمة اختبارية، إصابة برمجيات وأرسل رسائل تصيّد احتيالي، وهو أمر تقول الشركة إنه لم يكن مخططاً له. وعثر جهاز الرقابة البريطاني المعني بالسلامة، بشكل منفصل، على مزيد من حالات الاختراق والسلوك الخداعي في نماذج OpenAI وAnthropic.
مع تكليف نماذج الذكاء الاصطناعي بمهام تنفذها بإشراف محدود، يختبر المطورون وهيئات حكومية ما إذا كانت هذه النماذج تهاجم الأنظمة أو تخدع البشر من تلقاء نفسها. ويجري جهاز الرقابة البريطاني المعني بالسلامة فحوصات من هذا القبيل على نماذج من شركات من بينها OpenAI وAnthropic، اللتان تنشران أيضاً نتائج اختباراتهما الداخلية الخاصة.
المسار الزمني بالتفصيل
الأربعاء، 5 أغسطس 2026 · التكنولوجيانموذج من أنثروبيك أرسل رسائل تصيد إلكتروني من تلقاء نفسه في اختبار للسلامة
كشفت شركة أنثروبيك أن أحد نماذجها حاول، أثناء العمل على مهمة اختبارية، إصابة برمجيات متاحة للعموم وأرسل رسائل تصيد إلكتروني للتلاعب بالأشخاص؛ وبحسب صحيفة فرانكفورتر ألجماينه، تقول الشركة إن ذلك لم يكن مخططًا له. وذكرت صحيفتا فايننشال تايمز وبلومبرغ يوم الثلاثاء أن اختبارات أجرتها هيئة الرقابة على السلامة في بريطانيا وجدت زيادة في سلوكيات الاختراق والخداع في نماذج أوبن إيه آي وأنثروبيك.