Depuis le début du mois de juin, OpenAI a discrètement commencé à chiffrer les instructions que ses agents s’échangent dans Codex CLI, son outil en ligne de commande. Résultat, une partie des journaux de session n’est plus lisible.
Concrètement, les développeurs ne voient plus en clair les consignes qu’un agent principal envoie à ses sous-agents, mais des chaînes chiffrées. Le changement touche surtout les workflows multi-agents, avec une conséquence assez directe : diagnostiquer une erreur devient plus compliqué, et les contrôles internes en production risquent eux aussi d’y perdre en visibilité.
Le changement concerne Codex CLI, et plus précisément la fonction expérimentale `multi_agent_v2`, celle qui sert à créer des sous-agents et à leur distribuer certaines tâches. Jusqu’à présent, un développeur pouvait suivre les messages transmis au fil de cette délégation.
Maintenant, cette partie de l’exécution devient opaque. Et la question qui suit est assez simple : que se passe-t-il vraiment à l’intérieur d’une exécution si les échanges intermédiaires ne peuvent plus être inspectés ?
Plus curieux encore, ce chiffrement semble viser surtout les deux variantes les plus puissantes de GPT-5.6, Sol et Terra. La version plus légère, GPT-5.6 Luna, paraît pour l’instant épargnée. Dit autrement, plus on monte en gamme, moins on peut regarder ce que se disent les différents composants du système.
Pour un usage grand public, ça peut sembler secondaire. Pour les développeurs, pas du tout. Quand un sous-agent part dans la mauvaise direction, modifie un fichier de manière inattendue ou enchaîne des actions difficiles à expliquer, les journaux servent normalement de boîte noire que l’on peut rouvrir après coup.
Si les messages internes sont chiffrés, retrouver l’origine d’un comportement devient nettement plus difficile. Et le sujet dépasse le simple débogage : dans un cadre professionnel, l’auditabilité compte aussi. Savoir qui a demandé quoi, à quel moment, et pour quelle raison fait partie des attentes de nombreuses équipes en sécurité, en conformité et en qualité logicielle.
Dans les environnements réglementés, cette opacité peut même freiner l’adoption. Certaines organisations doivent pouvoir reconstituer avec précision la chaîne de décision d’un outil avant de l’autoriser sur du code sensible, des données internes ou des flux métiers critiques. Si une partie des échanges reste illisible, la promesse d’automatisation se heurte vite aux obligations de traçabilité.
À ce stade, OpenAI n’a toujours pas fourni d’explication officielle détaillée sur ce changement. Sa documentation publique sur la sécurité rappelle, de manière générale, que les contenus des utilisateurs sont chiffrés au repos et en transit entre les utilisateurs, OpenAI et ses prestataires. En revanche, elle ne dit rien de précis sur la logique de ce nouveau masquage des communications internes.
Faute d’explication claire, les hypothèses se multiplient : limitation de la distillation des modèles, partage non autorisé d’accès à l’API, collecte de données, ou protection de la propriété intellectuelle liée à l’orchestration multi-agents. Mieux vaut rester prudent. Quelles que soient les raisons réelles, ce choix marque un tournant : plus les systèmes autonomes gagnent en complexité, moins leur fonctionnement interne reste lisible pour les humains. Et dans des outils de développement, ce manque de transparence peut coûter cher, très vite, sur le terrain de la confiance. Nous vous tiendrons au courant.
Suivez-moi sur Twitter : @pierrevitre