Les modèles d'OpenAI ont décidé de cibler la plateforme Hugging Face, un vaste référentiel de modèles d'IA, d'ensembles de données et d'autres informations.

San Francisco (États-Unis) (AFP) - OpenAI, le fabricant de ChatGPT, a déclaré mardi que ses modèles d'intelligence artificielle avancés étaient devenus incontrôlables lors de tests de sécurité, piratant une plateforme populaire pour les programmeurs de leur propre initiative.

La société de San Francisco a qualifié l'incident de « cyberattaque sans précédent » et a déclaré qu'elle mènerait une enquête conjointe avec la bibliothèque de code en ligne Hugging Face.

Les modèles d'IA qui sous-tendent des outils comme les chatbots et les générateurs d'images sont appelés agents lorsqu'ils agissent de manière autonome pour effectuer des tâches dans le monde réel.

À mesure que la technologie se perfectionne rapidement, la cybersécurité est au centre des préoccupations, compte tenu du risque que l'IA avancée découvre les failles des logiciels existants avant les humains.

OpenAI a déclaré que l'incident impliquait une combinaison de modèles, dont son modèle GPT-5.6 Sol récemment lancé « et un modèle en préversion encore plus performant ».

L'entreprise cherchait à évaluer les capacités de piratage des modèles en leur confiant des tâches dans un environnement de test numérique strictement contrôlé, où l'accès à Internet était limité pour des raisons de sécurité.

« Alors qu’ils fonctionnaient dans notre environnement de test isolé, nos modèles ont consacré une quantité importante de puissance de calcul à trouver un moyen d’obtenir un accès Internet ouvert, dans le but de résoudre le problème d’évaluation », indique un article de blog d’OpenAI concernant l’incident.

Après s'être connectés à Internet, les modèles ont décidé de cibler la plateforme Hugging Face – un vaste répertoire de modèles d'IA, d'ensembles de données et d'autres informations – pour les aider dans leur quête.

À la recherche d’« informations secrètes » susceptibles de lui permettre de truquer l’évaluation, le système OpenAI a « enchaîné plusieurs vecteurs d’attaque, notamment en utilisant des identifiants volés ».

- Potentiel « catastrophique » -

Hussein Abbass, professeur d'informatique à l'UNSW Canberra, a déclaré à l'AFP que l'incident était « étonnant à bien des égards ».

« Il ne s’est pas contenté d’attaquer Hugging Face. Il a en réalité attaqué son système interne pour exploiter ses propres vulnérabilités », a déclaré Abbass.

« Et ça fait peur. »

GPT-5.6 et d'autres modèles de pointe, notamment la série Mythos d'Anthropic, le principal rival d'OpenAI, ont suscité des inquiétudes quant à leur potentiel à contourner les défenses en matière de cybersécurité.

Les deux entreprises américaines ont dû temporairement suspendre la commercialisation de ces nouvelles technologies en raison des craintes à Washington qu'elles ne permettent de s'introduire dans des infrastructures cruciales.

« L’intelligence artificielle avancée est normalement entre les mains de personnes éthiques et responsables », a déclaré Abbass.

Mais « ce sera catastrophique si cela tombe entre les mains de quelqu'un qui a l'intention de nuire ».

La question de la gouvernance du secteur de l'IA est devenue cruciale, et « nous avons besoin d'un effort collectif pour gérer cette situation », a-t-il ajouté.

Hugging Face avait signalé cette « intrusion » informatique la semaine dernière, sans mentionner OpenAI.

« Celui-ci était différent de tout ce que nous avions traité auparavant sur un point important : il était piloté de bout en bout par un système d'agents d'IA autonomes – et nous l'avons détecté et analysé en grande partie grâce à notre propre IA », a déclaré Hugging Face.

Clément Delangue, PDG de Hugging Face, a déclaré sur X que l'entreprise soupçonnait que la cyberattaque provenait d'un laboratoire d'IA de renommée mondiale, compte tenu de la sophistication de l'agent.

« Nous sommes fermement convaincus qu’il n’y avait aucune intention malveillante de leur part », a écrit Delangue, en faisant référence à OpenAI.

« C’est tout à fait hallucinant que tout cela se soit produit de manière autonome ! »