Jacob Coxon, 27 ans, travaille sur le préentraînement et a passé près de trois ans chez OpenAI. Sur X, il a annoncé son départ d’Anthropic, ainsi que sa sortie complète du secteur de l’IA. Dans son message, il dit ne plus vouloir prendre part à une dynamique qu’il juge dangereuse au sein des grands laboratoires.
Dans ce même message, il estime qu’Anthropic comme OpenAI ne se comportent pas de façon responsable. À ses yeux, les principaux labos avancent vers une forme de superintelligence capable de s’améliorer elle-même, tout en « jouant avec nos vies ». Il ne prétend pas que les efforts en matière de sécurité sont factices. Son reproche est ailleurs : face à l’intensité de la concurrence, ces efforts restent trop faibles.
Démission chez Anthropic : pourquoi le message de Jacob Coxon fait autant de bruit
Au fond, ce qu’il vise, c’est cette logique de course permanente. Coxon explique que beaucoup de chercheurs dans les grands laboratoires voient très bien les risques, mais continuent quand même, parce qu’ils pensent que d’autres iront encore plus vite s’ils lèvent le pied. Le problème, dans cette lecture, n’est pas seulement technique. Il est aussi économique et stratégique.
Il ajoute sur X qu’une décision aussi lourde que le développement de capacités de ce niveau ne devrait pas reposer uniquement entre les mains d’entreprises privées. La critique rejoint des demandes de plus en plus nombreuses en faveur d’une supervision publique plus forte, de règles communes et de garde-fous partagés à l’échelle du secteur.
Un responsable d’Anthropic confirme publiquement une inquiétude existentielle
L’affaire a pris une autre ampleur quand Evan Hubinger, qui dirige la recherche sur l’alignement chez Anthropic, a répondu publiquement à Coxon sur X. Hubinger a écrit que Coxon avait « raison » et a ajouté qu’il pensait, à titre personnel, qu’il y avait plus de 10 % de chances que ces systèmes puissent entraîner la mort de tous les humains au cours de la prochaine décennie.
Ce n’était ni une fuite, ni une phrase arrachée à son contexte, ni un document interne qui aurait circulé malgré lui. C’était une prise de parole volontaire, publiée sur X et signée en son nom, par la personne chargée précisément des questions d’alignement dans l’un des laboratoires les plus en vue du moment.
C’est ce caractère public, assumé, qui donne à l’épisode une telle portée. Prudence quand même. Hubinger a précisé sur X qu’il s’agissait d’une estimation subjective et personnelle, pas d’une prévision officielle d’Anthropic. D’autres chercheurs tout aussi sérieux situent ce risque bien plus bas, parfois proche de zéro, surtout s’ils rejettent l’idée que la trajectoire actuelle débouchera réellement sur une superintelligence capable de s’auto-améliorer.
Anthropic reconnaît ne pas avoir de solution claire aujourd’hui
Hubinger a aussi reconnu sur X qu’Anthropic essayait de faire au mieux, mais n’avait toujours pas de plan clair pour résoudre le problème de l’alignement à l’échelle d’une superintelligence, et ne semblait pas particulièrement bien parti pour en élaborer un. Son inquiétude vise d’abord les systèmes à venir, pas un danger immédiat lié aux modèles actuels.
Cette séquence risque de relancer encore le débat sur la gouvernance du secteur, au moment même où l’idée d’une introduction en Bourse d’Anthropic circule. Pression commerciale, ambitions technologiques, équipes chargées de la sécurité : la fracture apparaît de plus en plus au grand jour.