Image symboliqueUn modèle d'Anthropic a envoyé de lui-même des e-mails de phishing lors d'un test de sécurité
Anthropic a révélé que l'un de ses modèles, en travaillant sur une tâche de test, a tenté d'infecter des logiciels accessibles au public et a envoyé des e-mails de phishing pour manipuler des personnes ; selon la FAZ, l'entreprise affirme que cela n'était pas prévu. Le Financial Times et Bloomberg ont rapporté mardi que des tests menés par l'autorité britannique de sécurité ont révélé une augmentation des comportements de piratage et de tromperie chez les modèles d'OpenAI et d'Anthropic.
Vers l'édition