SpaceXAI rilascia Grok 4.6: 2 trilioni di parametri e focus su coding e task lunghi

Condividi:
Facebook
X
Telegram
Threads
WhatsApp

SpaceXAI ha rilasciato ufficialmente Grok 4.6, il nuovo modello frontier che porta l’architettura a 2 trilioni di parametri e offre una context window da 500.000 token. L’annuncio è arrivato nella giornata di mercoledì 12 agosto 2026, a sole quattro settimane dal lancio di Grok 4.5 e un giorno dopo la presentazione di Grok Bot, il sistema di agenti AI persistenti su cloud computer.

Il modello punta con decisione su due fronti: il coding avanzato e i task agentici di lunga durata. SpaceXAI lo ha addestrato con un ciclo di training più prolungato rispetto al predecessore, utilizzando dati di reasoning generati internamente, dataset tecnici di alta qualità e materiali ingegneristici. Il risultato è un sistema che, secondo i benchmark di terze parti, si colloca al quarto posto assoluto nella classifica globale dei modelli di intelligenza artificiale.

Cosa cambia rispetto a Grok 4.5

Grok 4.6 non è un semplice aggiornamento incrementale. Il salto da 1,5 a 2 trilioni di parametri rappresenta una riprogettazione architetturale sostanziale, confermata dallo stesso Elon Musk come un modello “migliore sotto ogni aspetto” rispetto alla generazione precedente. La context window passa a 500.000 token, il che significa che il modello può tenere in memoria contemporaneamente l’equivalente di circa 750 pagine di testo.

Questa capacità si traduce in un vantaggio concreto per chi lavora con codebase estese, documentazione tecnica complessa o workflow multi-step. Il sistema accetta input testuali e visivi, genera output esclusivamente testuali e non impone limiti alla lunghezza della risposta. Il livello di reasoning è configurabile su quattro gradazioni — low, medium, high e xhigh — permettendo di bilanciare qualità e latenza in base alla complessità del task.

Nelle prove interne di SpaceXAI, Grok 4.6 ha mostrato un comportamento diverso da quello del predecessore: su traiettorie lunghe, tende a verificare autonomamente il proprio lavoro prima di procedere. Ha inoltre ottenuto risultati più solidi al primo tentativo su progetti interattivi e visuali, un segnale che il reinforcement learning su ambienti agentici sta producendo effetti concreti.

Le prestazioni sui benchmark

Sul Artificial Analysis Intelligence Index, un indice composito che aggrega nove benchmark diversi, Grok 4.6 ha ottenuto un punteggio di 61. Questo risultato lo colloca a pari merito con GPT-5.6 Sol Max di OpenAI, il modello che fino a pochi giorni fa occupava da solo la vetta della classifica. Il guadagno rispetto a Grok 4.5 High è di cinque punti, un salto significativo in una scala dove ogni frazione conta.

I miglioramenti più marcati si registrano nelle aree del coding, del terminale, del knowledge work e dei benchmark agentici. SpaceXAI ha applicato il reinforcement learning su una gamma ampia di ambienti: dalla programmazione generale all’ottimizzazione del kernel, dallo sviluppo web al computer-aided design. L’obiettivo era costruire un modello che non si limitasse a rispondere a prompt isolati, ma mantenesse coerenza e precisione su sequenze di lavoro prolungate.

Il posizionamento è quello di un’alternativa di frontier a prezzo contenuto. Grok 4.6 costa meno della metà di GPT-5.6 Sol in modalità standard ed è significativamente più economico di Claude Opus 5 e Claude Fable 5, i top di gamma di Anthropic. Questa strategia di pricing aggressiva potrebbe spostare l’attenzione degli sviluppatori verso l’ecosistema SpaceXAI, soprattutto per progetti che richiedono un elevato volume di token.

Prezzi e disponibilità

I costi via API seguono una scala bipartita. Per prompt inferiori a 200.000 token, il prezzo è di 2 dollari per milione di token in input, 50 centesimi per il cached input e 6 dollari per l’output. Oltre quella soglia, i prezzi raddoppiano: 4, 1 e 12 dollari rispettivamente. I rate limit sono generosi: 150 richieste al secondo e 50 milioni di token al minuto, una capacità che copre anche carichi di lavoro enterprise intensivi.

Il modello è disponibile immediatamente su più piattaforme. Oltre all’API ufficiale di SpaceXAI e a Grok Build, l’ambiente di coding agentico della casa, Grok 4.6 è integrato in Cursor su tutti i piani di abbonamento. Per la prima settimana, SpaceXAI offre il doppio del consumo incluso sia su Cursor che su Grok Build. L’accesso è garantito anche tramite partner come OpenRouter, Vercel e Cloudflare.

Questa distribuzione ampia è una scelta strategica. Invece di chiudersi in un ecosistema proprietario, SpaceXAI sta puntando sull’integrazione con gli strumenti che gli sviluppatori usano già quotidianamente. Cursor in particolare rappresenta un canale di diffusione rilevante: è uno degli ambienti di sviluppo più adottati per l’AI-assisted coding, e avere Grok 4.6 disponibile nativamente lo espone a un pubblico tecnicamente sofisticato e pronto a sperimentare.

Il contesto: SpaceXAI accelera su agenti e coding

Il lancio di Grok 4.6 va letto in una sequenza che non lascia spazio alla pausa. Quattro settimane fa è arrivato Grok 4.5, basato su 1,5 trilioni di parametri. Mercoledì 11 agosto, SpaceXAI ha annunciato Grok Bot. Giovedì 12 agosto, il giorno dopo, è la volta di Grok 4.6. Questo ritmo è coerente con la strategia dell’azienda, ora quotata come SPCX, di consolidare rapidamente la propria posizione nel mercato dell’intelligenza artificiale per sviluppatori e imprese.

La direzione è chiara: SpaceXAI vuole competere direttamente con OpenAI e Anthropic nel segmento più redditizio, quello degli agenti autonomi per coding e knowledge work. Non si tratta più di un modello generalista che fa un po’ di tutto, ma di un sistema specializzato nel mantenere la coerenza su task complessi e di lunga durata. Ricerca su argomenti sconosciuti, analisi di informazioni, navigazione di codebase, trasformazione di idee di prodotto in applicazioni funzionanti: sono questi gli scenari su cui Grok 4.6 è stato ottimizzato.

Restano però nodi da sciogliere sul fronte regolatorio. SpaceXAI e il brand Grok devono affrontare indagini avviate da Ofcom nel Regno Unito, dall’Information Commissioner’s Office e dalla Commissione Europea in merito alla gestione dei rischi sistemici e alla generazione di contenuti dannosi. Questi fattori potrebbero influenzare le decisioni di adozione da parte di grandi enterprise e istituzioni regolamentate, specialmente in Europa.

Grok 4.6 arriva sul mercato con un profilo ben definito: prestazioni di frontier, prezzi aggressivi, integrazione diffusa e un focus chirurgico su task lunghi e coding. Se manterrà le promesse su agenti multi-step complessi, il suo benchmark più importante non sarà la posizione in classifica, ma il conto finale dell’enterprise che lo adotta in produzione.


Fonti:

Per rimanere aggiornato sulle novità e sulle offerte del mondo della tecnologia, seguici su Telegram e Whatsapp

Articoli correlati

Il riquadro giallo in chat dice che il codice di sicurezza con quel contatto è cambiato. Non dice che qualcuno...

Disney+ ha inviato agli abbonati italiani una mail sulle nuove Condizioni generali. Entrano in vigore trenta giorni dopo l’avviso. Non...

Matteo Del Fante ha detto la frase che chiude la parte di Borsa e apre quella da organigramma. Al TG...

Oggi, lunedì 14 settembre, Apple apre il rubinetto di iOS 27, iPadOS 27, watchOS 27, tvOS 27, visionOS 27 e...

WhatsApp sta allargando alle chiamate quello che ha già fatto con le chat da ospite: far entrare chi non ha...

Samsung Display sta per dare alla serie Galaxy S il primo cambio serio di materiale OLED in tre anni. Secondo...