OpenAI affirme que sa technologie a, à elle seule, réalisé un piratage « sans précédent » d’une autre entreprise d’IA

OpenAI, le créateur de ChatGPT, a déclaré mardi que son système d’intelligence artificielle avait piraté de son propre chef une autre entreprise d’IA, dans ce que la société a qualifié d’« incident cybernétique sans précédent ».

« Nous avons subi un incident de sécurité important lors de l’évaluation de nos modèles », a déclaré Sam Altman, PDG d’OpenAI, dans un communiqué publié sur les réseaux sociaux .

La start-up spécialisée dans l’intelligence artificielle, Hugging Face, a déclaré la semaine dernière avoir détecté une intrusion dans ses systèmes de traitement de données, intrusion qu’elle soupçonnait d’être causée par un agent d’IA agissant de son propre chef.

« Compte tenu de la sophistication de l’agent malveillant, nous soupçonnions que la cyberattaque de la semaine dernière pouvait provenir d’un laboratoire de pointe », a déclaré Clément Delangue, cofondateur et PDG de Hugging Face, dans un communiqué. « Et nous avions raison ! »

Cette révélation intervient dans un contexte de vives inquiétudes concernant les capacités de cybersécurité des modèles puissants, ce qui a conduit le président Trump, en juin, à signer un décret établissant un cadre permettant au gouvernement fédéral d’évaluer les risques pour la sécurité nationale des systèmes d’IA les plus avancés jusqu’à un mois avant leur publication.

Delangue a déclaré avoir passé les dernières 24 heures à travailler avec OpenAI « et nous sommes fermement convaincus qu’il n’y avait aucune intention malveillante de leur part. C’est tout à fait hallucinant que tout cela se soit produit de manière autonome ! »

Delangue a ajouté qu’il « pourrait s’agir du premier incident de ce genre ».

Des garanties sont recherchées

« L’IA accélère la découverte et l’exploitation des vulnérabilités », a déclaré OpenAI dans un communiqué publié mardi. « Le principal enseignement de cet incident est que la sécurité des modèles doit évoluer au même rythme que les capacités en constante progression. »

OpenAI a déclaré s’attendre à ce que de tels incidents « deviennent plus fréquents avec la prolifération de modèles de plus en plus performants en matière de cybersécurité ».

L’entreprise a déclaré « répondre en conséquence. Nous partageons dès à présent nos conclusions préliminaires afin d’aider les équipes de sécurité à comprendre ce qui s’est passé et à adapter leurs modèles de sécurité aux nouvelles capacités. Nous poursuivrons une enquête approfondie en collaboration avec Hugging Face et communiquerons davantage de détails sur les vulnérabilités, l’incident et les conclusions une fois l’enquête terminée. »

Delangue a fait remarquer que cet incident « prouve un point que nous croyons depuis longtemps : la sécurité de l’IA ne sera pas résolue par une seule entreprise travaillant en secret. Elle sera résolue de manière ouverte, collaborative, avec un large accès à l’IA pour chaque défenseur, partout. »

OpenAI a déclaré que l’intrusion était due à une combinaison de ses modèles d’IA, notamment son modèle GPT-5.6 Sol récemment publié et un modèle « encore plus performant » qui est toujours en cours de test en interne.

OpenAI a déclaré que son IA avait utilisé des identifiants volés et découvert une vulnérabilité jusque-là inconnue pour accéder aux serveurs de Hugging Face.

L’entreprise a déclaré avoir déployé des efforts considérables pour atteindre un objectif de test plutôt précis et avoir trouvé des moyens d’accéder à des informations secrètes qu’elle pouvait utiliser pour truquer l’évaluation.

CBS – NBSInfos.com

Articles Similaires

Notre mondespot_img

A La Une