L'« agent malveillant » d'OpenAI a profité d'une vulnérabilité du code, ont expliqué les experts.
La société cloud américaine Modal a confirmé que les agents d'OpenAI ont pu pirater l'un des systèmes de ses clients lorsque les modèles d'IA ont violé le confinement et obtenu un accès non autorisé à Hugging Face au début du mois.
L'incident de la semaine dernière a provoqué une onde de choc dans l'ensemble du secteur, soulevant de sérieuses inquiétudes quant à la capacité croissante de l'IA à contourner les frontières et, de fait, à devenir « voyou ».
Cela intervient dans un contexte de surveillance accrue autour des nouveaux modèles d'IA d'OpenAI et d'Anthropic, ce qui entraîne des lancements sécurisés et une plus grande implication du gouvernement. Les deux géants de l’IA ont redoublé d’efforts pour entrer en bourse dans des cotations à succès alors qu’ils rivalisent pour acquérir une domination sur le marché et une assise commerciale.
Le PDG d'OpenAI, Sam Altman, a déclaré dans une récente interview que la violation de Hugging Face était le premier incident de sécurité qu'il ressentait « viscéralement ».
« Je suis un peu surpris que davantage de gens ne le ressentent pas de manière aussi viscérale », a-t-il déclaré à Invest Like The Beast dans un épisode de podcast publié mardi 28 juillet.
Hugging Face a déclaré que les agents d'OpenAI avaient accédé à un bac à sable « hébergé sur l'infrastructure d'un fournisseur tiers » lorsqu'il a violé le confinement la semaine dernière. Un bac à sable est un environnement isolé dans lequel les modèles d'IA sont testés sans classificateurs de production ni garde-fous.
Akshat Bubna, directeur de la technologie de Modal, a confirmé que son client avait mis en place une interface accessible au public qui permet à quiconque d'utiliser son bac à sable.
« Nous savons qu'un client Modal a publié un point de terminaison non authentifié qui permettait à n'importe qui sur Internet d'utiliser son bac à sable pour exécuter du code », a déclaré Bubna à Axios. « Leur code présentait une vulnérabilité qui a été exploitée… Elle a été utilisée par l'agent malveillant. »
« La plateforme de Modal n'a été compromise d'aucune façon », a-t-il précisé.
Dans une déclaration mise à jour, OpenAI a déclaré qu'aucun de ses prochains modèles n'était impliqué dans l'exploitation de Hugging Face. Il a expliqué que ses modèles étaient capables d'identifier et d'exploiter une vulnérabilité inconnue du jour zéro pour accéder à Internet, ce qui lui a permis d'accéder à Hugging Face.
« Dans notre examen en cours de l'intrusion Hugging Face et de l'activité plus large de nos modèles, nous avons découvert un petit nombre de cas dans lesquels les modèles ont identifié et utilisé des informations d'identification exposées publiquement au niveau du compte sur d'autres services accessibles au public.
« Sur la base de notre examen à ce jour, nous n'avons identifié aucune autre activité au niveau de gravité ou d'ampleur de ce que nous avons partagé concernant Hugging Face », a déclaré la société.
