OpenAI ha rilasciato GPT-5.4 il 5 marzo 2026, distribuendolo simultaneamente su ChatGPT, l’API e Codex. Non è un aggiornamento di routine. È il primo modello mainline di OpenAI che incorpora le capacità di programmazione di punta di GPT-5.3-Codex — fino ad oggi disponibili solo nel ramo dedicato agli sviluppatori — e le combina con ragionamento avanzato, computer use nativo e un significativo salto nella precisione fattuale.
In ChatGPT il nuovo modello si chiama GPT-5.4 Thinking e sostituisce GPT-5.2 Thinking per gli abbonati Plus, Team e Pro. GPT-5.2 Thinking resterà disponibile per tre mesi nella sezione Legacy Models, con pensionamento fissato al 5 giugno 2026. Per chi richiede il massimo delle prestazioni su compiti complessi, è disponibile anche GPT-5.4 Pro, accessibile ai piani Pro ed Enterprise.
Cosa cambia rispetto a GPT-5.2
La discontinuità rispetto al predecessore si articola su più fronti.
Sul fronte della precisione, GPT-5.4 è il modello più accurato che OpenAI abbia mai rilasciato: le singole affermazioni false sono il 33% in meno rispetto a GPT-5.2, e le risposte contenenti almeno un errore calano del 18%. OpenAI ha misurato questi dati su un campione di prompt anonimizzati in cui gli utenti avevano segnalato inesattezze nelle risposte precedenti.
Sul fronte professionale, il benchmark GDPval — che valuta la capacità dei modelli di svolgere compiti lavorativi reali coperti da 44 professioni nelle nove industrie più rilevanti dell’economia statunitense — segna 83,0% per GPT-5.4 contro il 70,9% di GPT-5.2. Tradotto: il modello eguaglia o supera professionisti umani in oltre otto casi su dieci.
La novità più rilevante sul fronte agenti è però il computer use nativo. GPT-5.4 è il primo modello mainline di OpenAI in grado di controllare un computer — navigare interfacce grafiche, interagire con applicazioni, usare mouse e tastiera — all’interno di un ciclo autonomo di pianificazione, esecuzione, verifica e correzione. Sul benchmark OSWorld Verified, che misura la capacità di navigare ambienti desktop reali, GPT-5.4 raggiunge il 75,0% di successo: il gruppo di riferimento umano si ferma al 72,4%. È la prima volta che un modello OpenAI supera la soglia umana su questo test specifico.
Codex e lo /fast mode: velocità senza rinunciare alla qualità
Su Codex — la piattaforma di OpenAI dedicata agli sviluppatori e ai workflow di programmazione — GPT-5.4 porta due novità concrete.
La prima è la modalità /fast, che permette al modello di girare a 1,5 volte la velocità standard mantenendo invariate intelligenza e capacità di ragionamento. Per chi lavora in cicli iterativi di debug e revisione del codice, la differenza si sente.
La seconda è il supporto sperimentale a una finestra di contesto da un milione di token. OpenAI ha precisato che richieste oltre i 272.000 token standard vengono conteggiate a velocità doppia rispetto ai limiti d’uso ordinari — un dettaglio rilevante per chi gestisce codebase estese o documenti molto lunghi.
Sul benchmark SWE-Bench Pro, che misura la capacità di risolvere issue reali in repository software open source, GPT-5.4 segna 57,7% — leggermente sopra GPT-5.3-Codex (56,8%) e GPT-5.2 (55,6%), con latenza inferiore.
Tool Search: meno token, stessa precisione
Una delle innovazioni tecniche più interessanti di questo rilascio riguarda la gestione degli strumenti nell’API. Nei sistemi agentici complessi, includere le definizioni complete di tutti i tool disponibili nel prompt consuma migliaia di token aggiuntivi a ogni chiamata. GPT-5.4 introduce Tool Search: il modello riceve una lista compatta degli strumenti disponibili e carica le definizioni complete solo di quelli effettivamente necessari per il compito.
In un test condotto su 250 task del benchmark MCP Atlas con 250 strumenti disponibili, il consumo di token si è ridotto del 47% senza perdite di accuratezza. Per chi costruisce agenti con decine di integrazioni MCP attive, i risparmi economici possono essere sostanziali.
La visione migliorata: immagini a piena risoluzione
GPT-5.4 introduce anche una nuova modalità di elaborazione delle immagini denominata “original”, che processa le immagini a risoluzione piena fino a 10,24 megapixel — rispetto ai livelli compressi precedenti. Sul benchmark OmniDocBench per il parsing di documenti, il tasso medio di errore scende da 0,140 a 0,109. Utile in contesti come l’analisi di contratti scansionati, planimetrie tecniche o materiali con testo denso.
Chi può usarlo e cosa c’è di nuovo in ChatGPT
GPT-5.4 Thinking è disponibile da oggi per gli abbonati ChatGPT Plus, Team e Pro. GPT-5.4 Pro è riservato ai piani Pro ed Enterprise. Nell’API il modello è accessibile come gpt-5.4, mentre la variante Pro è disponibile come gpt-5.4-pro. Gli utenti Enterprise e Edu possono abilitare l’accesso anticipato tramite le impostazioni amministrative.
All’interno di ChatGPT, GPT-5.4 Thinking introduce una novità nell’interfaccia: il modello può ora esporre in anticipo il proprio piano di ragionamento prima di elaborare la risposta, permettendo all’utente di correggere la direzione a metà processo. Meno iterazioni a vuoto, output più aderente all’intenzione originale.
In parallelo al lancio del modello, OpenAI ha anche annunciato ChatGPT for Excel e Google Sheets in beta — un’integrazione diretta nei fogli di calcolo per costruire, analizzare e aggiornare modelli finanziari senza uscire dall’applicazione. Nuove integrazioni con FactSet, MSCI, Third Bridge e Moody’s completano il posizionamento esplicito verso il mercato enterprise.
Fonti:
The Decoder — OpenAI launches GPT-5.4 Thinking and Pro
Fortune — OpenAI launches GPT-5.4, its most powerful model for enterprise work