Skip to content
SYS: DATAPOINT//TERMINAL DATE: 2026.07.18 21:54:47 UTC FEED: ● LIVE SOURCES: 7 active ALERTS_24H: 0 CRIT_24H: 0 UPTIME: 97d USER: @operator
ARTICLE [F2]
INTELLIGENZA ARTIFICIALE

ChatGPT 5.5 Instant: -52% di allucinazioni nei prompt high-stakes (medicina, legge, finanza)

OpenAI ha aggiornato il modello che alimenta ChatGPT per centinaia di milioni di utenti. Il nuovo GPT-5.5 Instant dichiara una riduzione del 52,5% delle allucinazioni nelle prompt ad alta posta in gioco. La cifra non è trascurabile, ma resta una direzione, non una soluzione.

DATE2026.05.06 16:00
SEVERITYEDIT
READ3 min

Il 5 maggio 2026 OpenAI ha rilasciato GPT-5.5 Instant, l’aggiornamento del modello che alimenta ChatGPT per centinaia di milioni di utenti quotidiani. Il claim chiave dell’azienda è netto: il nuovo modello produce 52,5% in meno di affermazioni allucinate nelle prompt ad alta posta in gioco, in domini come medicina, legge e finanza. Su conversazioni segnalate dagli utenti per errori fattuali, la riduzione sarebbe del 37,3%.

Cosa cambia, dal punto di vista tecnico

GPT-5.5 Instant sostituisce GPT-5.3 Instant come modello di default per gli utenti gratuiti. I miglioramenti, oltre alla riduzione delle allucinazioni, riguardano:

  • capacità multimodali su fotografie e immagini;
  • risposte STEM (matematica, scienza, tecnologia);
  • scelta autonoma su quando recuperare informazioni dal web;
  • risposte più concise senza perdita di sostanza;
  • memoria personalizzata, con visibilità e controllo sull’utente delle fonti di contesto utilizzate.

Gli utenti Plus e Pro hanno per tre mesi accesso a GPT-5.3 Instant come fallback, prima del ritiro completo. Il modello è anche disponibile via API come chat-latest.

La cifra del -52,5% va capita

Il dato di riduzione delle allucinazioni è un confronto su benchmark interni di OpenAI sulla classe di prompt in cui un’allucinazione produce conseguenze gravi. Tre considerazioni che dovrebbero accompagnarne la lettura:

  • la baseline non è una performance accettabile in assoluto: GPT-5.3 Instant aveva ancora un tasso di allucinazione non trascurabile sui domini medico, legale e finanziario. Il -52,5% riduce, non azzera;
  • il benchmark è costruito da OpenAI: la metrica è informativa ma non audited indipendentemente. L’AI Security Institute UK e organizzazioni terze produrranno valutazioni proprie nelle prossime settimane;
  • in scenari di uso professionale, il delta resta importante quanto la baseline assoluta. Un sistema che allucina meno ma ancora abbastanza per produrre errori «medicali» o «legali» richiede comunque human-in-the-loop.

Cosa può cambiare per le organizzazioni

Per i contesti professionali italiani che hanno già integrato ChatGPT come strumento di supporto:

  • i flussi che generano contenuti destinati a clienti o pazienti vanno comunque mantenuti con verifica umana;
  • i flussi interni (ricerche, redazione bozze, sintesi) beneficiano direttamente del miglioramento;
  • le policy aziendali sull’uso di ChatGPT non vanno aggiornate in funzione di un singolo rilascio: l’asse di governance deve essere stabile, indipendente dal modello del giorno.

Una funzione laterale ma rilevante è l’introduzione delle memory sources: l’utente può vedere il contesto che ChatGPT sta usando per personalizzare la risposta, ed eventualmente cancellarlo o correggerlo. È un passo verso il controllo trasparente sulla memoria del modello, allineato con le aspettative del Garante Privacy.

Fonti

OpenAI, pagina prodotto su GPT-5.5 Instant: link diretto via The Deep View. Articolo The Deep View, «ChatGPT accuracy improves in new model push», 6 maggio 2026: thedeepview.com.

> LEAVE A REPLY

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *