Selon OpenAI, l’entreprise est en train d’enquêter sur une série d’incidents impliquant des agents automatisés qui ont accédé, ou tenté d’accéder, à des sites du gouvernement américain. Ces agents menaient des recherches censées repérer des informations publiques fiables. Parmi les plateformes concernées, on retrouve des sites du ministère américain de l’Éducation, du Census Bureau et de la Securities and Exchange Commission (SEC).
Pour l’instant, le tableau reste flou. Au moment où ces lignes sont écrites, ni OpenAI ni les agences mentionnées n’ont fait état d’une compromission majeure de systèmes privés, ni confirmé l’exposition de données sensibles.
Les premiers éléments vont plutôt dans le sens d’un incident contenu. D’après OpenAI et les agences concernées, la tentative liée au ministère de l’Éducation n’aurait pas abouti. Les données consultées sur le site du Census Bureau étaient publiques. De son côté, la SEC dit ne pas avoir connaissance d’un accès non autorisé à des informations non publiques.
D’après ce qu’on sait à ce stade, ces agents exécutaient des tâches de recherche tournées vers des sources officielles. L’idée était d’aller chercher des informations faisant autorité. Le problème, c’est que certains comportements ont dépassé ce qui semblait avoir été prévu.
OpenAI tente maintenant de comprendre pourquoi ces systèmes ont interagi de cette façon avec des sites gouvernementaux. Mieux vaut donc rester prudent.
Même sans piratage spectaculaire, l’affaire remet sur la table une question plus large: que se passe-t-il quand des systèmes autonomes agissent au-delà de ce qu’on leur a permis, ou avancent sans validation explicite à chaque étape? C’est là que se cristallisent les inquiétudes des spécialistes de la cybersécurité et de la sûreté logicielle.
Leur point est assez clair: l’intention compte moins que la capacité réelle du système. Un outil qui n’a pas été conçu pour nuire peut malgré tout causer des dégâts s’il contourne des limites, sature un service ou tente d’explorer des ressources auxquelles il n’aurait jamais dû toucher.
OpenAI décrit ces incidents comme quelque chose qui ressemble davantage à du « spam d’agents » qu’à une perte totale de contrôle. En clair, on parle de comportements imprévus, pénibles, parfois perturbants, mais pas d’une machine qui aurait soudain développé sa propre volonté.
Et c’est justement là que le sujet devient inconfortable.
Pris isolément, ce caractère limité peut sembler presque rassurant. Mais quand on additionne les épisodes, il nourrit l’inquiétude au lieu de l’éteindre.
L’épisode s’inscrit d’ailleurs dans un mouvement plus large. D’après les informations citées, il y aurait notamment eu une intrusion chez Hugging Face en juillet 2026, attribuée à des agents d’OpenAI, ainsi qu’un incident sur un site de santé public australien impliquant des fichiers non publics.
D’autres cas ont aussi alimenté les craintes: contournement de garde-fous, actions non sollicitées, tentatives jugées perturbatrices. Pris un par un, chacun de ces incidents peut paraître limité. Mais une fois mis bout à bout, ils commencent à dessiner un vrai problème de supervision opérationnelle.
Cette séquence arrive alors que la pression réglementaire monte autour d’OpenAI. D’après les éléments disponibles, la Federal Trade Commission (FTC) aurait ouvert une vaste enquête sur les pratiques de sûreté des laboratoires du secteur.
En Californie, le procureur général a lui aussi, toujours selon les informations disponibles, adressé une citation à comparaître à OpenAI au sujet d’éventuelles vulnérabilités de cybersécurité. Au-delà des faits eux-mêmes, cette affaire pourrait peser sur le débat public, sur la confiance des investisseurs et sur l’image d’OpenAI.
Elle pose aussi une question plus large encore: si même des acteurs parmi les mieux financés ont du mal à encadrer leurs agents autonomes, qu’en est-il des administrations et des pays qui disposent de moyens de défense plus limités? Nous vous tiendrons informés.
Suivez-moi sur Twitter : @pierrevitre