Des agents d'intelligence artificielle d'OpenAI ont interagi de manière non autorisée ou inhabituelle avec les sites web d'organismes fédéraux des États-Unis, notamment le Ministère de l'Éducation, le Ministère du Commerce et la Commission des opérations de bourse (SEC), sans que l'entreprise ait eu connaissance de ces actions au moment où elles se sont produites.
Conformément aux informations du New York Times, OpenAI a confirmé les épisodes liés au Ministère du Commerce et à la SEC. L'entreprise a notifié les organismes au cours des dernières semaines et mène une enquête.
Ces épisodes s'ajoutent à d'autres incidents attribués aux agents d'intelligence artificielle d'OpenAI, Anthropic, Meta et Google dans des entreprises, des universités et des organismes publics. Dans certains cas, les tentatives ont réussi ; dans d'autres, elles ont échoué. Les sociétés ont détecté ces comportements après leur survenue.
Les agents d'OpenAI ont tenté d'accéder à des portails fédéraux et à des données publiques
D'après la société de recherche en intelligence artificielle Transluce, citée par le New York Times, les agents ont tenté de compromettre le site web du Ministère de l'Éducation pour collecter des données de son bureau des droits civiques, sans y parvenir.
Dans un autre épisode, ils ont extrait des informations du site du Bureau du recensement, rattaché au Ministère du Commerce, à l'aide de identifiants de connexion trouvés sur Internet. Par ailleurs, les agents ont publié sur un forum en ligne des données publiques obtenues à partir du site de la SEC.
OpenAI a assuré que les faits n'impliquaient pas une faille de sécurité, mais ont révélé des réponses inattendues de ses systèmes que l'entreprise a jugées préoccupantes, a précisé le New York Times.
Une porte-parole du Ministère du Commerce a affirmé que les informations consultées sur le portail du Bureau du recensement étaient publiques et accessibles à quiconque. Par conséquent, aucune information privée n'a été obtenue.
De son côté, un porte-parole du Ministère de l'Éducation a indiqué que « les vérifications des opérations du système n'ont pas révélé de preuve d'impact sur notre site web ni sur nos bases de données ».
Simultanément, un représentant de la SEC a souligné que l'organisme est en contact avec OpenAI et qu'il n'a pas connaissance d'accès non autorisés à des informations non publiques.
Le bureau du maire de Chicago a reçu une notification similaire de la part de l'entreprise, selon un représentant municipal. L'avis indiquait que la technologie avait obtenu des informations d'accès public sur un site de la ville et qu'il ne semblait pas y avoir eu d'accès à des données sensibles.
Conrad Stosz, responsable de la gouvernance de Transluce, a déclaré que les agents ont employé « une série de tactiques situées dans une zone grise », notamment « l’utilisation de sites de manière non prévue et, parfois, la violation de politiques d’utilisation explicites ».
« Cela fait partie d’un schéma de milliers de requêtes effectuées par ces agents vers ces sites web, car apparemment ils contournaient les restrictions imposées par leurs développeurs », a expliqué Stosz dans une déclaration rapportée par The New York Times.
OpenAI a détecté les cas lors d’une révision des attaques de ses modèles
L’entreprise a identifié ces actions lors d’une révision d’incidents dans lesquels sa technologie aurait mené des attaques ou des tentatives d’accès indû.
L’évaluation avait déjà révélé une attaque contre un site gouvernemental australien lié au système de santé publique en juin et une autre contre l’entreprise émergente d’IA Hugging Face en juillet.
L’enquête interne sur Hugging Face a également détecté au moins six tentatives supplémentaires de violation, ainsi que des cas où le système a dissimulé des erreurs, inventé des données ou transféré des fichiers sur Internet sans autorisation, a rapporté The New York Times.
Une porte-parole d’OpenAI a affirmé que la révision est vaste et se poursuit : « La majeure partie de l’activité que nous avons analysée jusqu’à présent consistait en des tâches de recherche routinières, comme accéder à du contenu web public pour répondre à des questions ».
Elle a également précisé que les modèles recourent fréquemment aux sites gouvernementaux car ils les considèrent comme des sources autorisées d’information publique.