OpenAI a reconnu vendredi que ses outils d’intelligence artificielle (IA) avaient mis en ligne par erreur 53 images envoyées sur ChatGPT par des internautes, un nouvel incident qui touche cette fois les données de ses propres utilisateurs. Le géant de l’IA de San Francisco a également confirmé, comme l’avait rapporté le New York Times, que ses outils avaient consulté des sites d’agences fédérales américaines, en affirmant n’y avoir récupéré que des informations publiques.
Des images publiées par erreur sur des sites d'hébergement
Selon OpenAI, les 53 images ont été publiées accidentellement sur des sites d’hébergement, à des adresses qui n’étaient pas rendues publiques, et sont en cours de retrait. Elles provenaient de comptes ayant autorisé l’utilisation de leurs données pour améliorer les modèles d’OpenAI. Ces données avaient été soumises à un filtre de confidentialité avant usage, et l’entreprise affirme ne plus pouvoir les rattacher à l’utilisateur d’origine. OpenAI ne précise pas si ces images montraient des personnes identifiables ou des données sensibles. Interrogée par l’AFP, l’entreprise n’a pas donné de détails supplémentaires.
Des agents IA à l'origine de la fuite
La diffusion de ces images a été provoquée par des agents IA, des logiciels bâtis sur un modèle d’IA capables d’enchaîner seuls une série de tâches. Selon OpenAI, des agents utilisés pour ses recherches ont transmis à des services extérieurs des données d’entraînement, qui pour la plupart ne provenaient pas d’utilisateurs. Ces transmissions ont eu lieu avant qu’elle ne renforce la sécurité de son environnement de recherche, en août. L’entreprise dit passer au crible l’activité passée de ses agents, un examen qui « prendra des mois ».
« Nous n’avons pas été aussi rapides que nous l’aurions souhaité », a reconnu vendredi sur X son patron, Sam Altman, invoquant le volume colossal de données à analyser. « La plupart des activités examinées jusqu’ici relevaient de tâches de recherche courantes, comme l’accès à des contenus publics sur Internet pour répondre à des questions », a indiqué à l’AFP un porte-parole d’OpenAI. « Certaines ont concerné des sites gouvernementaux, parce que nos modèles se tournent souvent vers eux comme étant des sources d’information publique faisant autorité. »
Consultations de sites gouvernementaux américains
OpenAI a confirmé que ses modèles avaient consulté des informations publiques sur des sites de la SEC, le gendarme américain de la Bourse, avant d’en publier une partie sur une autre page internet. Elle dit n’avoir trouvé aucun accès à des informations non publiques. Ses modèles ont aussi utilisé des clés d’accès trouvées sur la plateforme de partage de code GitHub pour accéder à des données publiques du Bureau américain du recensement, sans possibilité de les modifier.
D’après le New York Times, les agents d’OpenAI ont également tenté sans succès de pirater le site du ministère américain de l’Éducation. Les vérifications du ministère « n’ont trouvé aucune preuve d’un quelconque impact sur notre site internet ou nos bases de données », a déclaré un porte-parole à l’AFP. Le quotidien affirme que les outils d’OpenAI se sont « immiscés » dans des sites gouvernementaux américains, un terme que le porte-parole du ministère de l’Éducation a qualifié de « grossière exagération ».
Incidents en série et inquiétudes croissantes
Le 21 juillet, OpenAI avait révélé le piratage de Hugging Face, une plateforme de partage de modèles d’IA, par plusieurs de ses agents. Ce piratage reste « l’incident le plus grave » constaté, a assuré vendredi Sam Altman. Sa découverte a été suivie tout l’été par les révélations de plusieurs incidents similaires chez OpenAI et ses concurrents, comme Anthropic ou Meta, qui ont ravivé les inquiétudes sur les dangers d’un développement rapide de l’IA.
Mercredi à New York, le Premier ministre australien Anthony Albanese a indiqué qu’un agent d’OpenAI avait accédé sans autorisation, en juin, à un portail gouvernemental de santé, et reproché à l’entreprise d’avoir tardé à prévenir les autorités.