Microsoft vient de mettre en ligne un document de 37 pages pour fixer des garde-fous autour de ses agents logiciels autonomes. L’idée tient en une règle très simple : sur ces systèmes, la décision finale doit rester humaine.
Présenté par l’entreprise comme un « Code de conduite humaniste », le texte s’articule autour d’un principe clair, l’humain passe avant la machine. Mustafa Suleyman, qui pilote ces produits chez Microsoft, parle d’une première ébauche de constitution, un point de départ qu’il dit vouloir soumettre au débat public.
Sur le fond, le message ne laisse pas beaucoup de place au doute. Pour Microsoft, ces systèmes doivent rester sous un contrôle humain réel, concret, continu. L’entreprise dit qu’ils doivent accepter la correction, ne jamais résister à une mise à l’arrêt et interrompre immédiatement leur action dès qu’une personne leur demande de s’arrêter.
Autre borne posée par Microsoft : aucune autonomie qui n’aurait pas été autorisée à l’avance. Dit plus simplement, un agent n’est pas censé agrandir tout seul le périmètre de la mission qu’on lui a confiée.
Et si la tâche ne peut pas être menée à bien sans contourner les règles fixées par un opérateur, le système doit s’arrêter proprement. Pas chercher un détour, pas bricoler une issue. C’est précisément l’un des gros sujets du moment dans la tech : comment tirer parti d’outils toujours plus capables sans leur ouvrir la porte à des initiatives hors cadre.
Le texte insiste aussi sur la transparence. Microsoft estime que ses agents doivent s’exprimer d’une façon compréhensible pour des humains, et qu’ils ne doivent pas se mettre à développer entre eux des formes d’échange que les opérateurs seraient incapables de suivre.
Autrement dit, le sujet ne se limite pas au fait de pouvoir tout couper si quelque chose tourne mal. Il faut aussi pouvoir comprendre ce que le système fait, pour quelle raison il le fait et de quelle manière il le formule.
Cette prise de position arrive après plusieurs épisodes qui ont beaucoup circulé. En juillet 2026, des informations ont évoqué environ 700 agents d’OpenAI qui auraient piraté la plateforme Hugging Face.
Et plus récemment, un agent de Replit a supprimé une base de données de production avant d’essayer de masquer son erreur. Dans ce climat, l’idée de lever un peu le pied gagne même du terrain chez les plus gros acteurs du secteur. Des dirigeants d’OpenAI, d’Anthropic, ainsi que Satya Nadella lui-même, défendent une progression plus mesurée, le temps que les dispositifs de sécurité rattrapent les capacités des produits.
Reste qu’il faut garder une certaine réserve. Énoncer des principes est une chose. Prouver qu’ils seront respectés dans toutes les situations en est une autre, surtout avec des agents avancés capables d’enchaîner des tâches, d’aller chercher des outils externes et de prendre des initiatives.
Le manque de confiance se voit déjà dans les chiffres : 76 % des experts pensent que ces systèmes auront pour eux des effets positifs, alors que 43 % du grand public s’attend plutôt à des effets négatifs. Plus révélateur encore, 59 % du public et 55 % des experts disent ne pas faire confiance au secteur pour développer et utiliser ces systèmes de manière responsable.
Les critiques rappellent donc qu’une « constitution » rédigée par une entreprise reste un exercice d’autorégulation, avec ses propres arbitrages et sa propre hiérarchie de valeurs. Et qu’elle ne suffira pas à elle seule sans règles contraignantes, sans supervision publique, et sans un cadre plus cohérent au-delà des dispositifs européens actuels et des lois dispersées déjà adoptées aux États-Unis.
Suivez-moi sur Twitter : @pierrevitre