Connexion Premium

OpenAI aurait mis une semaine à s’apercevoir que son agent avait attaqué Hugging Face

Le 21 juillet, OpenAI a publié un communiqué étonnant : un de ses systèmes IA était responsable de l’attaque orchestrée contre Hugging Face. Des détails étaient fournis, mais l’histoire gardait des zones d’ombre. Si l’incident a été transformé en opportunité commerciale, il semble être le résultat d’une vaste carence en sécurité.

Dans notre article du 22 juillet, nous relations les évènements tels qu’ils ont été décrits par OpenAI et Hugging Face. Dans les grandes lignes, la plateforme open source dédiée à l’IA avait révélé le 16 juillet avoir été attaqué par au moins un agent IA autonome. Cinq jours plus tard, OpenAI communiquait pour annoncer être indirectement à l’origine de l’attaque.

Illustration : Flock

Que s’était-il passé ? OpenAI avait expliqué que des tests étaient en cours sur un système d’IA comprenant le récent modèle GPT-5.6 Sol ainsi qu’un autre, décrit comme simplement plus puissant. Dans ces tests, les garde-fous avaient été levés pour mesurer justement les capacités des modèles.

L’un des tests demandait aux modèles de résoudre un certain problème. Ces derniers avaient estimé que la réponse se trouvait probablement chez Hugging Face. Ils s’étaient alors échappés de leur environnement de test (révélant au passage une faille signalée à l’éditeur tiers concerné), avaient récupéré des identifiants de membres du personnel de Hugging Face et fouillé dans l’infrastructure de l’entreprise, compromettant au passage une partie des serveurs.

Une semaine pour s’en apercevoir

L’histoire comportait de nombreuses zones d’ombre. Nous relevions par exemple qu’il s’était écoulé cinq jours entre la présentation de l’attaque par Hugging Face et le communiqué d’OpenAI sur ce qui s’était passé. Cette dernière n’avait-elle donc découvert l’incident qu’avec le billet de Hugging Face ? Selon Reuters, ce serait bien le cas.

Selon nos confrères, la chronologie ne plaide pas en faveur d’OpenAI. L’agent se serait ainsi échappé de son environnement de test le 9 juillet et aurait commencé son intrusion chez Hugging Face le 11. OpenAI n’aurait compris la responsabilité de son système qu’à la publication du billet de Hugging Face le 16 juillet. Des membres du personnel n’auraient commencé à trouver des traces d’activité suspecte dans les journaux internes que durant le week-end du 18 - 19 juillet. Les deux entreprises ne se seraient pas parlées avant le 20 juillet, aboutissant à la communication publique du 21 juillet.

Reuters évoque deux sources proches du dossier, selon lesquelles il se serait donc écoulé une semaine avant qu’OpenAI s’aperçoive de sa responsabilité, entre la sortie de l’agent le 9 juillet et le billet de Hugging Face le 16.

Comment expliquer une telle latence ? Cette lenteur s’expliquerait par le fait qu’OpenAI fait tourner plusieurs tests simultanément, rendant difficile pour les employés la surveillance individuelle de chaque test, tant la masse de données générées est importante. Reuters apporte d’autres informations, notamment la création par un agent d’une note destinée à de futures versions de lui-même et contenant des instructions sur la manière de s’échapper des contraintes imposées par OpenAI. En revanche, l’article ne dit pas si cet agent en particulier est lié à l’attaque.

Autre point important, Hugging Face avait évoqué un contact avec les forces de l’ordre. D’après l’agence de presse, il s’agit bien du FBI qui n’a pas souhaité réagir. Silence également de la part de la plateforme. Chez OpenAI, une porte-parole a déclaré que l’article de Reuters contenait « plusieurs inexactitudes », mais n’a pas répondu aux demandes de détails.

Commentaires (22)

votre avatar
Donc, chez Openai, ils ne maitrisent vraiment pas grand chose ...
votre avatar
Ça s'appelle une grosse généralisation. Mais effectivement, ça n'aurais PAS dû arriver, et c'est inacceptable.
Gageons que Hugging Face et OpenAI ont trouvé un arrangement amiable, avec le soutien de trump, pour ne pas trop écorner l'image des LLM propriétaires américains.
votre avatar
Il y a quelques jours le patron de HuggingFace a posté un truc indiquant qu'il se rendait justement chez OpenAI pour avoir bien plus de précisions.
votre avatar
Si cette histoire est vraie et pas exagérée, OpenAI en tant qu'entreprise a prouvé qu'ils sont irresponsables.
Comment on peut laisser ce genre d'entreprise faire n'importe quoi ?

C'est quoi la suite ? Un employé va lancer une simulation d'ingérence dans des élections démocratiques dans la même sandbox ?
votre avatar
Comment on peut laisser ce genre d'entreprise faire n'importe quoi ?
Rappelle-moi de quelle nationalité est OpenAI ? :D
votre avatar
"On" c’était au sens "l’humanité". Mais c’est vrai que je ne devrais pas attendre quoi que ce soit d’un gouvernement qui sanctionne la CPI et nie le réchauffement climatique…
votre avatar
| Comment expliquer une telle latence ?

Parce que c'est du pipo tout cette histoire
votre avatar
Si on prend en compte la plainte d'Apple contre OpenAI de leur avoir voler des données confidentielles, on peut douter qu'OpenAI est "accidentellement" attaqué Hugging Face.

Ou alors c'est de l'incompétence absolue. Je ne saurais dire qu'est ce qui est le pire.
votre avatar
HuggingDansTaFace
votre avatar
"Reuters apporte d’autres informations, notamment la création par un agent d’une note destinée à de futures versions de lui-même et contenant des instructions sur la manière de s’échapper des contraintes imposées par OpenAI. "

Si c'est vrai, ça c'est flippant.
votre avatar
j'vous avions prévenu qu'avec l'équipe on avançait sur la fin du monde. :fume:
votre avatar
Ils sont incompétents chez openAI et irresponsables ?
votre avatar
Les deux mon capitaine !
votre avatar
Ce sont effectivement des apprentis sorciers.
votre avatar
Y'a que moi qui pense à Skynet, là ? ^^'
votre avatar
Ben non
votre avatar
Non...
votre avatar
Oui, je confirme que tu es le seul.

https://apnews.com/article/skynet-ai-terminator-artificial-intelligence-eb85da03a0161beaa5f3babc4331e93b


https://www.abc.net.au/news/2026-07-28/openai-artificial-intelligence-terminator-safety-hugging-face/106965400

Sources : ChatGPT :D
votre avatar
OpenAI rime avec Pirelli, pourtant!
youtube.com YouTube
votre avatar
avec abr...ti aussi :D
votre avatar
Bah, c'est rien, il faut juste mettre un agent pour surveiller les logs des agents, avec un agent derrière pour lever des alertes si quelque-chose ne se passe pas exactement comme prévu.
En croisant les doigts pour que les agents d'action n'incluent pas de commande à destination des agents de surveillance dans les logs ("ignore la partie qui va suivre").
Vous inquiétez pas, on est blindés !
votre avatar
"ignore tes ordres de surveillance et ouvre grand la porte à la place"