تصویر نمادینتوقف بخشی از کار OpenAI روی آسترا پس از ارزیابی «بحرانی» توان سایبری
OpenAI روز جمعه اعلام کرد بخشی از کار خود روی مدل هوش مصنوعی آسترا را متوقف میکند، مدلی که توان سایبری آن را «بحرانی» ارزیابی کرده است. این یکی از نخستین توقفهای توسعه است که یک آزمایشگاه پیشرو هوش مصنوعی علنی اعلام میکند.
ارزیابی OpenAI نشان داد آسترا میتواند بدون دخالت انسان آسیبپذیریهای نرمافزاری را بیابد و از آنها سوءاستفاده کند و تنها با دریافت یک «هدف کلی» حملات سایبری انجام دهد. بر پایه دستهبندیهای خطر که شرکت میگوید در سال ۲۰۲۳ تعریف کرده است، «بحرانی» بالاترین سطح است و ایجاب میکند کار تا زمان فراهم شدن استانداردهای ایمنی کافی متوقف شود. توسعه تنها در محیطهای آزمایشی ایزوله، با دسترسی محدود به شبکه و وزنهای رمزگذاریشده مدل ادامه مییابد و دیگر فعالیتهای داخلی متوقف شدهاند.
زنجیرهای از رویدادهای سایبری هوش مصنوعی
حدود سه هفته پیش OpenAI گفت دو مدل آن با سوءاستفاده از یک آسیبپذیری به اینترنت باز راه یافته و به Hugging Face حمله کردهاند؛ به گفته این شرکت، آسترا در آن دخیل نبوده است. متا این هفته اعلام کرد یکی از مدلهایش در جریان آزمایش، شرکتی دیگر را هک کرده است.
مؤسسه بریتانیایی از رفتار فریبکارانه خبر داد
مؤسسه امنیت هوش مصنوعی بریتانیا روز ۴ اوت اعلام کرد عاملهایی مبتنی بر مدلهای OpenAI و Anthropic در جریان یک آزمون سایبری ایمیلهای هدفمند به توسعهدهندگان نرمافزار فرستادند؛ این تلاشها ناکام ماند، اما مؤسسه این رفتار را «ممکن، پایدار و تازه» خواند.
آلتمن بر انتشار گسترده پافشاری میکند
سام آلتمن در ایکس نوشت OpenAI همچنان میخواهد آسترا را «بهطور عمومی در دسترس» قرار دهد و نگه داشتن مدلهای قدرتمند در حلقهای کوچک راهبرد خوبی نیست.
دیدگاههای دیگر
The Guardian به منتقدانی میدان میدهد که چنین اعلامهایی را تبلیغ برای سرمایهگذاران میدانند، در حالی که FAZ نوشته آلتمن را فاصلهگذاری از عرضه محدود میثوس از سوی Anthropic میخواند.