GPT-5.4 è qui: OpenAI unisce ragionamento, coding e controllo del computer in un solo modello

Condividi:
Facebook
X
Telegram
Threads
WhatsApp

OpenAI ha rilasciato GPT-5.4 il 5 marzo 2026, distribuendolo simultaneamente su ChatGPT, l’API e Codex. Non è un aggiornamento di routine. È il primo modello mainline di OpenAI che incorpora le capacità di programmazione di punta di GPT-5.3-Codex — fino ad oggi disponibili solo nel ramo dedicato agli sviluppatori — e le combina con ragionamento avanzato, computer use nativo e un significativo salto nella precisione fattuale.

In ChatGPT il nuovo modello si chiama GPT-5.4 Thinking e sostituisce GPT-5.2 Thinking per gli abbonati Plus, Team e Pro. GPT-5.2 Thinking resterà disponibile per tre mesi nella sezione Legacy Models, con pensionamento fissato al 5 giugno 2026. Per chi richiede il massimo delle prestazioni su compiti complessi, è disponibile anche GPT-5.4 Pro, accessibile ai piani Pro ed Enterprise.

Cosa cambia rispetto a GPT-5.2

La discontinuità rispetto al predecessore si articola su più fronti.

Sul fronte della precisione, GPT-5.4 è il modello più accurato che OpenAI abbia mai rilasciato: le singole affermazioni false sono il 33% in meno rispetto a GPT-5.2, e le risposte contenenti almeno un errore calano del 18%. OpenAI ha misurato questi dati su un campione di prompt anonimizzati in cui gli utenti avevano segnalato inesattezze nelle risposte precedenti.

Sul fronte professionale, il benchmark GDPval — che valuta la capacità dei modelli di svolgere compiti lavorativi reali coperti da 44 professioni nelle nove industrie più rilevanti dell’economia statunitense — segna 83,0% per GPT-5.4 contro il 70,9% di GPT-5.2. Tradotto: il modello eguaglia o supera professionisti umani in oltre otto casi su dieci.

La novità più rilevante sul fronte agenti è però il computer use nativo. GPT-5.4 è il primo modello mainline di OpenAI in grado di controllare un computer — navigare interfacce grafiche, interagire con applicazioni, usare mouse e tastiera — all’interno di un ciclo autonomo di pianificazione, esecuzione, verifica e correzione. Sul benchmark OSWorld Verified, che misura la capacità di navigare ambienti desktop reali, GPT-5.4 raggiunge il 75,0% di successo: il gruppo di riferimento umano si ferma al 72,4%. È la prima volta che un modello OpenAI supera la soglia umana su questo test specifico.

Codex e lo /fast mode: velocità senza rinunciare alla qualità

Su Codex — la piattaforma di OpenAI dedicata agli sviluppatori e ai workflow di programmazione — GPT-5.4 porta due novità concrete.

La prima è la modalità /fast, che permette al modello di girare a 1,5 volte la velocità standard mantenendo invariate intelligenza e capacità di ragionamento. Per chi lavora in cicli iterativi di debug e revisione del codice, la differenza si sente.

La seconda è il supporto sperimentale a una finestra di contesto da un milione di token. OpenAI ha precisato che richieste oltre i 272.000 token standard vengono conteggiate a velocità doppia rispetto ai limiti d’uso ordinari — un dettaglio rilevante per chi gestisce codebase estese o documenti molto lunghi.

Sul benchmark SWE-Bench Pro, che misura la capacità di risolvere issue reali in repository software open source, GPT-5.4 segna 57,7% — leggermente sopra GPT-5.3-Codex (56,8%) e GPT-5.2 (55,6%), con latenza inferiore.

Tool Search: meno token, stessa precisione

Una delle innovazioni tecniche più interessanti di questo rilascio riguarda la gestione degli strumenti nell’API. Nei sistemi agentici complessi, includere le definizioni complete di tutti i tool disponibili nel prompt consuma migliaia di token aggiuntivi a ogni chiamata. GPT-5.4 introduce Tool Search: il modello riceve una lista compatta degli strumenti disponibili e carica le definizioni complete solo di quelli effettivamente necessari per il compito.

In un test condotto su 250 task del benchmark MCP Atlas con 250 strumenti disponibili, il consumo di token si è ridotto del 47% senza perdite di accuratezza. Per chi costruisce agenti con decine di integrazioni MCP attive, i risparmi economici possono essere sostanziali.

La visione migliorata: immagini a piena risoluzione

GPT-5.4 introduce anche una nuova modalità di elaborazione delle immagini denominata “original”, che processa le immagini a risoluzione piena fino a 10,24 megapixel — rispetto ai livelli compressi precedenti. Sul benchmark OmniDocBench per il parsing di documenti, il tasso medio di errore scende da 0,140 a 0,109. Utile in contesti come l’analisi di contratti scansionati, planimetrie tecniche o materiali con testo denso.

Chi può usarlo e cosa c’è di nuovo in ChatGPT

GPT-5.4 Thinking è disponibile da oggi per gli abbonati ChatGPT Plus, Team e Pro. GPT-5.4 Pro è riservato ai piani Pro ed Enterprise. Nell’API il modello è accessibile come gpt-5.4, mentre la variante Pro è disponibile come gpt-5.4-pro. Gli utenti Enterprise e Edu possono abilitare l’accesso anticipato tramite le impostazioni amministrative.

All’interno di ChatGPT, GPT-5.4 Thinking introduce una novità nell’interfaccia: il modello può ora esporre in anticipo il proprio piano di ragionamento prima di elaborare la risposta, permettendo all’utente di correggere la direzione a metà processo. Meno iterazioni a vuoto, output più aderente all’intenzione originale.

In parallelo al lancio del modello, OpenAI ha anche annunciato ChatGPT for Excel e Google Sheets in beta — un’integrazione diretta nei fogli di calcolo per costruire, analizzare e aggiornare modelli finanziari senza uscire dall’applicazione. Nuove integrazioni con FactSet, MSCI, Third Bridge e Moody’s completano il posizionamento esplicito verso il mercato enterprise.


Fonti:

OpenAI — Introducing GPT-5.4

The Decoder — OpenAI launches GPT-5.4 Thinking and Pro

Fortune — OpenAI launches GPT-5.4, its most powerful model for enterprise work

Per rimanere aggiornato sulle novità e sulle offerte del mondo della tecnologia, seguici su Telegram e Whatsapp

Articoli correlati

Oggi, lunedì 14 settembre, Apple apre il rubinetto di iOS 27, iPadOS 27, watchOS 27, tvOS 27, visionOS 27 e...

WhatsApp sta allargando alle chiamate quello che ha già fatto con le chat da ospite: far entrare chi non ha...

Samsung Display sta per dare alla serie Galaxy S il primo cambio serio di materiale OLED in tre anni. Secondo...

Apple Reference Image, in italiano Immagine di riferimento, è la risposta di Cupertino a una domanda che i fotografi si...

Il giorno dopo il keynote, Apple non ha solo messo in vetrina iPhone 18 Pro e iPhone 18 Pro Max....

Apple ha presentato iPhone 18 Pro e iPhone 18 Pro Max il 9 settembre 2026, al keynote «Surprise and shine»...