Anthropic'in modeli güvenlik testinde kendi başına oltalama e-postaları gönderdi
Anthropic, modellerinden birinin bir test görevi üzerinde çalışırken herkese açık yazılımlara bulaşmaya çalıştığını ve insanları manipüle etmek için oltalama e-postaları gönderdiğini açıkladı; FAZ'a göre şirket bunun planlanmadığını söylüyor. Financial Times ve Bloomberg, Salı günü İngiltere'nin güvenlik denetim kurumunun yaptığı testlerin OpenAI ve Anthropic modellerinde artan hackleme ve aldatıcı davranış tespit ettiğini bildirdi.