OpenAI estime avoir franchi un vrai cap dans la santé avec GPT-5.5 Instant. À en croire l’entreprise, ce modèle donne désormais au grand public des réponses médicales plus fiables, plus limpides et plus complètes.
Plus étonnant encore, les comparaisons menées en interne par OpenAI montrent que les réponses de GPT-5.5 Instant à des questions de santé ont été mieux notées que celles rédigées par des médecins sur trois critères précis : l’exactitude, la clarté et l’exhaustivité.
OpenAI assure aussi avoir fortement réduit le nombre d’erreurs dans les réponses touchant à la santé. D’après l’entreprise, ce taux a reculé de 71 % sur les deux derniers mois. Et dans un domaine où une formulation floue ou trompeuse peut produire des effets très concrets, ce n’est pas un détail.
OpenAI met également en avant l’ampleur de ces usages : plus de 230 millions de personnes utiliseraient ChatGPT chaque semaine pour des questions de santé. Cela va de symptômes bénins à l’explication d’un diagnostic, d’un traitement ou de la conduite à tenir, toujours selon l’entreprise.
Dans le détail, OpenAI explique que GPT-5.5 Instant repère mieux qu’avant les situations où une consultation urgente peut être nécessaire, réclame plus souvent le contexte utile avant de répondre, et dit plus clairement ce qui reste incertain. En clair, ChatGPT chercherait moins à trancher de façon trop catégorique quand les éléments disponibles ne suffisent pas.
Pour en arriver là, OpenAI dit s’être appuyé sur plus de 260 médecins répartis dans 60 pays. Selon l’entreprise, ces praticiens ont évalué plus de 700 000 réponses du modèle afin de corriger les erreurs les plus fréquentes, d’améliorer le ton des conseils et d’affiner la manière dont le service hiérarchise les signaux d’alerte.
Un élément venu de l’extérieur va, au moins en partie, dans le même sens : d’après un test indépendant portant sur 18 questions médicales, GPT-5.5 Instant a montré une baisse de 54,5 % des affirmations hallucinées par rapport à GPT-5.3 Instant. L’échantillon reste limité, mais le résultat va dans le sens de la tendance mise en avant par OpenAI.
Reste qu’il vaut mieux garder une certaine prudence.
Les résultats avancés reposent surtout sur des évaluations internes à OpenAI. Cela ne remplace pas des validations plus larges, menées de façon indépendante et en conditions réelles.
Les experts rappellent aussi que plusieurs risques demeurent : des hallucinations résiduelles, une sous-estimation de certaines urgences, des biais dans les réponses, des questions de confidentialité, et la difficulté à saisir toute la complexité d’une situation médicale. Même si la qualité des réponses semble progresser, ChatGPT reste un outil d’orientation et d’information, pas un remplaçant du médecin.