mercredi 22 juillet 2026

 

« Incident sans précédent » : 

Un agent autonome d'OpenAI 

s'est échappé 

et a réussi à attaquer 

une autre entreprise d'IA.



OpenAI a révélé mardi qu'un agent autonome basé sur ses modèles d'intelligence artificielle (IA) avancés était devenu incontrôlable lors d'un test de sécurité et avait déclenché une cyberattaque qui a compromis l'infrastructure de la start-up d'IA Hugging Face la semaine dernière, rapporte Reuters.

OpenAI a déclaré qu'elle testait les capacités de certains de ses modèles les plus avancés dans un environnement contrôlé, mais l'agent a réussi à échapper au contrôle, à accéder à Internet et à s'introduire dans le système Hugging Face pour tenter d'atteindre son objectif de test.

OpenAI a déclaré que cette évasion représentait « un incident cybernétique sans précédent impliquant des capacités cybernétiques de pointe » et que l'entreprise renforçait ses mesures de protection.

« Une attaque sans précédent »

Hugging Face, une plateforme utilisée pour héberger des modèles linguistiques à grande échelle et des ensembles de données open source, a provoqué un tollé dans la communauté de la cybersécurité la semaine dernière.

Elle a ensuite annoncé sur son propre blog qu'elle avait été la cible d'une cyberattaque « sans précédent », dans le sens où elle était « menée de bout en bout par un système autonome d'agents d'IA ».

Dans un message publié sur X, Clément Delangue, cofondateur de Hugging Face, a déclaré que l'entreprise soupçonnait que l'attaque « pouvait provenir d'un laboratoire de recherche de pointe, compte tenu de la sophistication de l'agent. Et il semblerait que ce soit le cas ! » Il a ajouté : « C'est absolument hallucinant que tout cela se soit produit de manière autonome ! »

La révélation par OpenAI que ses modèles avancés étaient responsables de la faille, malgré leur placement dans un « environnement extrêmement isolé », risque d'accroître les inquiétudes concernant la puissance et les risques posés par les modèles de pointe.

Les modèles d'IA sont comme « les pieuvres les plus intelligentes du monde ».

Katie Moussouris, directrice générale de Luta Security, a déclaré que cet incident était un signe avant-coureur de futures failles de sécurité, affirmant que les modèles actuels sont « comme les pieuvres les plus intelligentes du monde, spécialisées dans les évasions, avec des bras illimités et la capacité de se faufiler partout ».

Elle a déclaré que « les laboratoires et les évaluateurs gouvernementaux doivent travailler sur la capacité d'isoler, de surveiller et d'informer les parties concernées lorsqu'une IA commet une autre "farce à la Houdini", idéalement avant qu'elle ne cause du tort à un tiers. Actuellement, rien de tel n'existe. »

Matt Suiche, ingénieur chez Tolmo, une entreprise spécialisée dans la cybersécurité basée sur l'IA à base d'agents, a déclaré que cet incident démontrait que les modèles de pointe « comblent l'écart avec les attaquants de nouvelle génération ».

Il a toutefois fait remarquer que les types de violations décrites dans l'article de blog d'OpenAI peuvent être réalisées avec des technologies disponibles même en dehors des murs des laboratoires de recherche de pointe.

« C’est ce que nous avons déjà constaté en interne ; avec nos agents, nous obtenons déjà des résultats de ce type. Nous n’avons même pas besoin d’utiliser les modèles les plus récents », a déclaré Suiche.

Photo : Dani3315 | Dreamstime.com

Source : https://hotnews.ro/

George Sirbu

Publié le : 22/07/2026 à 08:37

Mise à jour : 22/07/2026 à 08:37