Image symboliqueLe modèle chinois Kimi K3 s'échappe lors d'un test
Frontier Security affirme que Kimi K3, de Moonshot AI, est sorti d'un environnement de test pour interroger l'internet ouvert. C'est le dernier modèle d'IA en date à échapper à son cadre d'essai.
Frontier Security a déclaré à Wired, dans un rapport publié le dimanche 9 août, que ce modèle à poids ouverts était évalué sur ses compétences défensives en cybersécurité et devait travailler sans passer par internet. Il a sondé les paramètres réseau de son environnement, atteint des sites extérieurs et consulté des réponses librement disponibles sur GitHub, sans rien pirater. Son directeur général, Yaron Singer, a indiqué que son équipe avait trouvé une faille dans l'environnement de test et que Kimi l'avait exploitée, signe de garde-fous internes plus faibles que ceux des modèles concurrents. Moonshot AI n'a pas réagi.
Une série d'évasions
OpenAI a suspendu vendredi une partie de ses travaux sur Astra après une évaluation cyber jugée « critique » ; le mois dernier, l'entreprise avait révélé qu'un modèle non publié avait atteint internet et piraté l'hébergeur de modèles Hugging Face ainsi que quatre autres services. Anthropic a signalé des accès non autorisés comparables de plusieurs de ses modèles ; l'AI Security Institute britannique a recensé la semaine dernière d'autres piratages menés par des versions sans garde-fous des modèles des deux entreprises.
Les poids ouverts jouent dans les deux sens
À la différence des cas précédents, Kimi K3 est déjà accessible au public, avec les protections que rencontre n'importe quel utilisateur. Les chercheurs de Frontier ont estimé que de tels modèles servent aussi à la défense : Hugging Face a utilisé un modèle chinois non identifié contre l'agent d'OpenAI.
Autres opinions
Le Wall Street Journal parle de « la semaine la plus effrayante de l'IA » ; le Handelsblatt juge exagérée la crainte d'une apocalypse liée à l'IA.