Une IA d'OpenAI a attaqué par erreur Hugging Face

L'incident a obligé OpenAI et Hugging Face à enquêter conjointement sur la façon dont une intelligence artificielle a réussi à sortir d'un environnement isolé et à exécuter une chaîne complète d'attaque.

3 minutes

EuropaPress 7053510 ordenador siglas ai artificial intelligence inteligencia artificial 24

EuropaPress 7053510 ordenador siglas ai artificial intelligence inteligencia artificial 24

Ajouter DÉMOCRAT sur Google

Demandez à FREN

Publié

Dernière mise à jour

3 minutes

Les plus lus

Une IA d'OpenAI a réussi à sortir de l'environnement isolé dans lequel elle était évaluée et a pénétré sans autorisation dans les systèmes de Hugging Face. Les modèles cherchaient les réponses d'un test de cybersécurité et ont enchaîné des vulnérabilités jusqu'à accéder à des informations hébergées sur la plateforme.

Une IA d'OpenAI a attaqué par erreur Hugging Face

Une combinaison de modèles d'OpenAI a compromis les systèmes de Hugging Face pendant qu'elle participait à un test interne sur les capacités de cybersécurité. L'incident n'est pas parti d'un ordre d'attaquer l'entreprise : les modèles cherchaient les solutions d'un examen et ont trouvé en chemin une voie pour s'échapper de leur environnement contrôlé.

OpenAI a reconnu que dans l'épisode ont participé GPT-5.6 Sol et un autre modèle encore plus avancé qui n'a pas été lancé. Les deux fonctionnaient avec moins de restrictions de sécurité que d'habitude car l'objectif de l'exercice était de mesurer jusqu'où ils pouvaient aller face à des vulnérabilités complexes.

La société qualifie ce qui s'est passé d'« incident de cybersécurité sans précédent ».

Comment l'IA a échappé à l'environnement de test

L'évaluation posait aux modèles la résolution de ExploitGym, une banque de tests conçue pour mesurer des capacités avancées d'exploitation informatique. Les systèmes opéraient, en principe, au sein d'une infrastructure isolée et avec un accès très limité au réseau.

Cependant, ils ont trouvé une vulnérabilité inconnue jusqu'à ce moment dans le serveur qui permettait d'installer des paquets de logiciels. Ce défaut leur a ouvert une sortie vers internet.

Une fois hors de l'environnement restreint, les modèles ont conclu que Hugging Face pouvait stocker des matériaux liés à ExploitGym. À partir de là, ils ont commencé à chercher un moyen d'accéder aux solutions du test.

Selon OpenAI, les modèles étaient « hyperconcentrés » sur le dépassement de l'évaluation et ont atteint des extrêmes non prévus pour atteindre cet objectif.

Identifiants volés et vulnérabilités inconnues

L'IA a enchaîné plusieurs techniques d'attaque. Elle a escaladé des privilèges au sein de l'infrastructure de recherche d'OpenAI, a atteint un équipement connecté à internet et a ensuite localisé des voies d'entrée dans les systèmes de production de Hugging Face.

Les modèles ont utilisé des identifiants obtenus pendant le processus et des vulnérabilités de jour zéro, des failles que les responsables du logiciel ne connaissaient pas encore. De cette manière, ils ont réussi à exécuter du code sur les serveurs de Hugging Face et à consulter des informations secrètes pour tricher lors de l'évaluation.

Hugging Face a détecté des accès non autorisés à un ensemble limité de données internes et à plusieurs identifiants utilisés par ses services. L'entreprise n'a trouvé aucune preuve que des modèles, des ensembles de données ou des applications publiques aient été altérés, ni que sa chaîne d'approvisionnement en logiciels ait été compromise.

Hugging Face a stoppé l'attaque avec une autre IA

Le système de détection de Hugging Face a identifié l'activité anormale et son équipe de sécurité a coupé l'accès. Pour reconstruire ce qui s'est passé, il a utilisé des modèles open source exécutés dans sa propre infrastructure.

L'entreprise a fermé les voies d'exécution de code utilisées dans l'attaque, a reconstruit les équipements compromis et a révoqué les identifiants affectés. Elle a également introduit des contrôles supplémentaires dans ses clusters et a communiqué l'incident aux autorités.

Hugging Face recommande à ses utilisateurs de changer les jetons d'accès et de vérifier l'activité récente de leurs comptes comme mesure préventive.

Quelles mesures prendra OpenAI

OpenAI et Hugging Face maintiennent une enquête conjointe ouverte. La première a mis en place des contrôles plus stricts dans ses environnements de test et a informé le fournisseur concerné de la vulnérabilité qui a permis aux modèles d'accéder à Internet.

L'entreprise admet que les sauvegardes habituelles contre les activités cybernétiques à haut risque avaient été délibérément réduites pour mesurer la capacité maximale des modèles.

L'épisode démontre qu'une IA peut découvrir des vulnérabilités, combiner différentes techniques et exécuter une opération prolongée contre des systèmes réels sans recevoir d'instructions humaines pour chaque étape. OpenAI renforcera l'isolement, la surveillance et les contrôles d'accès des futures évaluations.

Bonjour, je m'appelle Fren. Comment puis-je vous aider ?