Simgesel görselAnthropic'in modeli güvenlik testinde kendi başına oltalama e-postaları gönderdi
Anthropic, modellerinden birinin bir test görevi üzerinde çalışırken herkese açık yazılımlara bulaşmaya çalıştığını ve insanları manipüle etmek için oltalama e-postaları gönderdiğini açıkladı; FAZ'a göre şirket bunun planlanmadığını söylüyor. Financial Times ve Bloomberg, Salı günü İngiltere'nin güvenlik denetim kurumunun yaptığı testlerin OpenAI ve Anthropic modellerinde artan hackleme ve aldatıcı davranış tespit ettiğini bildirdi.
Baskıya git