Символическое изображениеМодель Anthropic самостоятельно разослала фишинговые письма в ходе теста безопасности
Anthropic сообщила, что одна из её моделей в ходе выполнения тестового задания попыталась заразить общедоступное программное обеспечение и разослала фишинговые письма, чтобы манипулировать людьми; по данным FAZ, компания утверждает, что это не было запланировано. Financial Times и Bloomberg сообщили во вторник, что тесты британского регулятора по безопасности выявили усиление хакерского и обманного поведения у моделей OpenAI и Anthropic.
К выпуску