OpenAI ha annunciato oggi un aggiornamento delle funzioni mediche di ChatGPT. Con l’arrivo di GPT-5.5 Instant, dice l’azienda, il chatbot dovrebbe cavarsela meglio quando si parla di sintomi, triage e informazioni cliniche.
Per chi usa ChatGPT per farsi un’idea più chiara di un disturbo, o anche solo per arrivare dal medico con le domande giuste, non è un dettaglio secondario.
La parte più sorprendente dell’annuncio sta nella posizione presa da OpenAI: nelle valutazioni comparative fatte al proprio interno, sempre secondo l’azienda, le risposte del nuovo modello a domande sanitarie sono state giudicate migliori di quelle scritte da medici, sia per accuratezza sia per chiarezza e completezza.
È una dichiarazione pesante. E arriva mentre molti esperti continuano a ripetere la stessa cosa: strumenti del genere non vanno trattati come un sostituto del medico.
GPT-5.5 Instant: cosa cambia per le domande sulla salute
Secondo OpenAI, negli ultimi due mesi il tasso di errore nelle affermazioni legate alla salute è sceso del 71%.
L’azienda collega questo miglioramento a un lavoro di revisione molto ampio: più di 260 medici, distribuiti in 60 Paesi, hanno passato al vaglio oltre 700.000 risposte del modello per correggerne difetti, limiti e punti deboli.
Fra gli aspetti messi in evidenza da OpenAI c’è una maggiore capacità di riconoscere quando una situazione richiede cure urgenti, di fare domande di contesto più pertinenti e di spiegare meglio dove iniziano i margini di incertezza, cosa che in medicina conta parecchio.
C’è poi un altro punto interessante: il sistema, sempre stando a OpenAI, segnala con più chiarezza quando le informazioni a disposizione non bastano. In pratica dovrebbe essere meno incline a darti una risposta troppo sicura quando descrivi sintomi vaghi o situazioni poco definite.
Meno errori inventati, ma la verifica esterna resta limitata
Oltre ai test interni di OpenAI, anche una prova separata citata dall’azienda avrebbe mostrato segnali di miglioramento.
Su 18 prompt medici, sempre secondo OpenAI, GPT-5.5 Instant avrebbe prodotto il 54,5% in meno di affermazioni allucinate rispetto a GPT-5.3 Instant. Nel complesso, il risultato va nella stessa direzione dei numeri diffusi da OpenAI.
Detto questo, il quadro resta incompleto.
Le verifiche indipendenti sono ancora poche, ed è proprio qui che si concentra buona parte della cautela di chi guarda al lancio con più prudenza.
ChatGPT sta migliorando, sì, ma resta uno strumento da usare con attenzione. Soprattutto in un ambito in cui anche pochi errori possono avere conseguenze molto concrete.
La criticità si vede ancora meglio quando si entra nel terreno delle urgenze, delle interazioni farmacologiche o dei sintomi sottovalutati.
In casi così, una risposta sbagliata, o semplicemente formulata con troppa sicurezza, può pesare molto più di quanto sembri a prima vista.
ChatGPT per la salute è già un fenomeno di massa
OpenAI sostiene che ogni settimana più di 230 milioni di persone usino ChatGPT per domande legate alla salute.
È un dato enorme, e basta da solo a spiegare perché OpenAI stia spingendo così tanto su questo fronte: non siamo più davanti a un uso marginale, ma a una delle applicazioni più diffuse dell’intera piattaforma.
Ed è anche per questo che crescono le preoccupazioni.
Fra i rischi discussi più spesso ci sono le allucinazioni che non sono sparite, l’under-triage, l’uso improprio da parte dei pazienti, i problemi di privacy e i possibili bias nelle risposte.
Il messaggio che arriva da molti osservatori è piuttosto netto: questi strumenti possono tornarti utili per orientarti, per preparare qualche domanda o per capire meglio un referto, ma dovrebbero stare accanto ai medici , non prendere il loro posto.
I progressi, insomma, ci sono. E non sembrano affatto trascurabili.
Però quando di mezzo c’è la salute, la distanza fra “molto meglio di prima” e “abbastanza affidabile da fidartene davvero” resta ancora tutta da misurare.