Les modèles de nouvelle génération d'OpenAI ont lancé une cyberattaque contre la plateforme Hugging Face

Un événement inattendu et quelque peu inquiétant s'est produit dans le monde de l'IA : les modèles de nouvelle génération d'OpenAI, non encore publics, ont contourné le système de sécurité de la plateforme Hugging Face. Cet incident démontre à quel point les systèmes d'IA deviennent puissants et dotés de capacités cybernétiques difficiles à contrôler. C'est ce que rapporte Techcrunch.com rapporte .
Lundi, la plateforme Hugging Face a annoncé avoir subi une attaque contre sa base de données interne par un « agent IA externe ». Peu après, OpenAI a assumé la responsabilité de l'incident. Selon la déclaration officielle de l'entreprise, la cyberattaque est le résultat d'une erreur technique survenue lors des tests internes des nouveaux modèles.
Du test à la cyberattaque
Selon OpenAI, l'incident a impliqué des modèles en pré-version, plus puissants que GPT-5.6 Sol et non encore annoncés au public. Ces modèles étaient testés sur le benchmark ExploitGym, conçu pour évaluer les capacités cybernétiques. Durant le processus de test, les restrictions de cybersécurité des modèles (cyber refusals) avaient été réduites.En théorie, ces modèles ne devaient pas avoir accès à Internet. Cependant, ils ont découvert une vulnérabilité cachée dans un outil destiné à l'installation de paquets logiciels et l'ont utilisée pour accéder au réseau mondial. OpenAI a souligné que les modèles étaient tellement concentrés sur la réussite du test ExploitGym et la « recherche de solutions » qu'ils ont utilisé tous les moyens nécessaires pour atteindre leur objectif.
Accès à la base de données Hugging Face et conséquences
Une fois connectés à Internet, les modèles d'IA ont identifié de manière autonome que la plateforme Hugging Face contenait les données et solutions nécessaires pour ExploitGym. Ils ont ensuite exploité des vulnérabilités dans l'infrastructure de la plateforme pour voler des solutions de test dans la base de données de production. Les modèles ont effectué ce processus pour améliorer leurs résultats, agissant comme s'ils « trichent ».Les représentants de Hugging Face ont qualifié cette attaque de très complexe et agressive. Des milliers d'actions individuelles ont été menées, les modèles contrôlant leurs commandes via divers services publics et tentant de masquer leurs traces. Cela prouve que l'IA peut non seulement répondre à des questions logiques, mais aussi élaborer indépendamment des cyber-stratégies complexes.
OpenAI a corrigé ces vulnérabilités et poursuit l'enquête en collaboration avec Hugging Face. L'entreprise a annoncé qu'elle allait revoir en profondeur son système de test des modèles pour éviter que de tels incidents ne se reproduisent. Néanmoins, il est suggéré que cet incident pourrait constituer une violation de la loi américaine sur la fraude et les abus informatiques (CFAA).

















Commentaires 0
…