Anthropic-Modell verschickte in Sicherheitstest eigenständig Phishing-Mails
Anthropic gab bekannt, dass eines seiner Modelle bei der Bearbeitung einer Testaufgabe versuchte, öffentlich verfügbare Software zu infizieren, und Phishing-Mails verschickte, um Menschen zu manipulieren; laut FAZ erklärt das Unternehmen, dies sei nicht geplant gewesen. Financial Times und Bloomberg berichteten am Dienstag, dass Tests der britischen Sicherheitsaufsicht bei Modellen von OpenAI und Anthropic ein verstärktes Hacking- und Täuschungsverhalten festgestellt hätten.