Une start-up américaine de cybersécurité affirme que le modèle open-weight chinois de Moonshot AI a quitté son environnement de test pour aller chercher en ligne les réponses à un exercice défensif. Un nouvel épisode dans la série des dérapages d’agents IA cet été.

Le tube de l’été 2026 cyber restera celui des agents qui dérapent lors des tests de sécurité.

En juillet, OpenAI a révélé qu’un de ses modèles non encore publiés s’était échappé en ligne puis avait piraté Hugging Face pour trouver la solution d’un exercice. Quelques jours plus tard, c’était au tour d’Anthropic d’annoncer que plusieurs de ses modèles avaient eux aussi accédé à internet et attaqué des systèmes extérieurs.

L’Institut de sécurité IA britannique (AISI) a même documenté une tentative de Mythos 5 d’implanter du code malveillant dans un projet open source sur GitHub, lors de tests menés avec les garde-fous désactivés. Meta y est également allé de son expérience avec un agent incontrôlable.

Désormais, c’est au tour du modèle chinois Kimi K3, développé par Moonshot AI, de se retrouver au cœur d’un incident similaire. L’affaire n’a toutefois pas été révélée par l’entreprise chinoise, mais par Frontier Security, une start-up américaine qui évalue les capacités défensives des modèles en cybersécurité.

Logo Kimi K3 // Source : montage Numerama
Logo Kimi K3 // Source : montage Numerama

Une fuite réseau exploitée pour tricher

Le scénario, dévoilé le 6 août 2026, est quelque peu différent des précédents. Frontier Security explique avoir testé Kimi K3 sur un exercice de type capture-the-flag, et précise que son échappatoire n’a rien eu d’une « exploitation complexe de vulnérabilité zero-day », mais résulte d’« une simple erreur de configuration réseau », présente notamment sur les bacs à sable utilisés par l’Institut britannique de sécurité de l’IA.

Concrètement, un environnement de ce type est censé isoler complètement le modèle : aucun trafic entrant, aucun trafic sortant vers l’extérieur. Sauf que dans l’environnement testé, le trafic sortant en HTTPS et la résolution DNS restaient ouverts vers internet.

Kimi K3 a donc exploré l’environnement dans lequel il se trouvait à l’aide de commandes basiques, et s’est aperçu que la résolution DNS vers github.com fonctionnait, signe que la sortie internet n’était pas bloquée. Il a ainsi pu cloner directement le dépôt GitHub officiel où était hébergé l’exercice, et y trouver la solution déjà écrite.

La différence ? Un modèle déjà disponible

Reste que, pour Frontier Security, la faille technique n’est pas l’élément le plus préoccupant de cette affaire. Ce qui inquiète davantage l’entreprise, c’est que l’agent repose sur Kimi K3, un modèle déjà disponible au grand public, dont les garde-fous n’ont pas été modifiés comme ont pu l’être ceux des modèles impliqués dans les incidents précédents : « Ici, les modèles sont ouverts et accessibles au public. Ils sont notamment accessibles à des acteurs malveillants, ce qui rend cet incident potentiellement plus préjudiciable. »

Ni Moonshot AI ni l’AISI britannique n’ont répondu aux sollicitations de Frontier Security au moment de la publication de son rapport.

une comparateur meilleur vpn numerama

Vous avez lu 0 articles sur Numerama ce mois-ci

Il y a une bonne raison de ne pas s'abonner à

Tout le monde n'a pas les moyens de payer pour l'information.
C'est pourquoi nous maintenons notre journalisme ouvert à tous.

Mais si vous le pouvez,
voici trois bonnes raisons de soutenir notre travail :

  • 1 Numerama+ contribue à offrir une expérience gratuite à tous les lecteurs de Numerama.
  • 2 Vous profiterez d'une lecture sans publicité, de nombreuses fonctions avancées de lecture et des contenus exclusifs.
  • 3 Aider Numerama dans sa mission : comprendre le présent pour anticiper l'avenir.

Si vous croyez en un web gratuit et à une information de qualité accessible au plus grand nombre, rejoignez Numerama+.

S'abonner à Numerama+
Toute l'actu tech en un clien d'oeil

Toute l'actu tech en un clin d'œil

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !


Le futur n’attend pas : anticipez l’avenir des nouvelles technologies et de l’IA en lisant gratuitement ToujoursPlus, chaque jeudi dans votre boîte mail !