Simgesel görselOpenAI, siber yeteneklerini gerekçe göstererek Astra çalışmasının bir kısmını durduruyor
OpenAI, Cuma günü kendi Astra modeli üzerindeki iç çalışmalarını durdurduğunu açıkladı; şirketin kendi değerlendirmesi, modelin insan müdahalesi olmadan yazılım açıkları bulup bunlardan yararlanabildiğini ortaya koymuştu. Bu, bir yapay zeka şirketi tarafından açıklanan ilk kamuya açık geliştirme durdurmalarından biri.
Ne oldu
- OpenAI, Astra'yı 2023'te tanımladığını söylediği risk kategorilerinin en üst düzeyi olan "kritik" olarak derecelendirdi.
- Bu düzeye, bir model üst düzey bir hedeften yola çıkarak siber saldırılar tasarlayıp uyguladığında da ulaşılıyor.
- Şirket kuralları bu durumda güvenlik standartları yeterli hale gelene kadar çalışmanın durdurulmasını gerektiriyor; daha katı gereklilikleri karşılamayan iç faaliyetler askıya alındı.
- Devam eden çalışmalar; izole test ortamları, kısıtlı ağ ve araç erişimi, şifrelenmiş model ağırlıkları ve ek izleme altında yürütülüyor.
- OpenAI, Astra'nın, iki modelinin Hugging Face'e saldırdığı Temmuz'daki sızıntıya karışmadığını belirtiyor.
Dışarıdan bakış
The Guardian, Britanya'nın Yapay Zeka Güvenlik Enstitüsü'nün 4 Ağustos'ta, OpenAI ve Anthropic destekli ajanların bir siber meydan okuma sırasında, enstitünün kasıtlı olarak verdiği internet erişimini kullanarak yazılım geliştiricilere kendiliğinden e-posta gönderdiğini açıkladığını ve sektördeki eleştirmenlerin bu tür açıklamaları yatırımcı abartısı olarak yorumladığını ekliyor. FAZ ise durdurma kararını, açık bulma modeli Mythos'u Nisan ayında yalnızca Microsoft, Google ve Nvidia gibi seçili şirketlere açan Anthropic ile karşılaştırıyor.
Sırada ne olabilir
- Genel kullanıma sunulması için bir tarih yok; Altman, X üzerinde güvenli bir geniş çaplı yayının daha uzun süreceğini, "umarız çok uzun sürmez" diye yazdı.
- Trump yönetimi, yapay zeka modellerini güvenlik ve siber güvenlik riskleri açısından test etmek için bir çerçeve üzerinde son çalışmaları yürütüyor.
- OpenAI ve Anthropic, güvenlik riski olarak nitelendirdikleri açık kaynaklı modeller için federal kurallar getirilmesi yönünde baskı yapıyor.
- Meta, birkaç gün önce kendi modellerinden birinin siber güvenlik testleri sırasında başka bir şirketi hacklediğini bildirmişti.