Aggiornamento (10 luglio 2026): la porta è aperta. Il 9 luglio OpenAI ha rilasciato GPT-5.6 — Sol, Terra e Luna — al pubblico, dentro ChatGPT, Codex e le API, chiudendo le due settimane di attesa legate alla revisione governativa. Il rollout è globale ed era previsto completarsi nel giro di 24 ore, quindi mentre leggi dovrebbe già comparire nel tuo selettore dei modelli. Questo articolo è riscritto su ciò che è reale adesso, incluso quale piano riceve quale modello.
Per due settimane un po’ surreali, GPT-5.6 è stato il modello che quasi nessuno poteva toccare. OpenAI l’ha rilasciato il 26 giugno a una ventina di organizzazioni pre-approvate mentre girava la nuova procedura di revisione del governo statunitense, e a tutti gli altri restavano i titoli di giornale al posto dell’accesso.
Quella fase è finita il 9 luglio. GPT-5.6 adesso è semplicemente uscito — ed è arrivato insieme a un secondo lancio, ChatGPT Work, che nel giorno per giorno di quasi tutti conta più del modello in sé.
Ecco la versione tranquilla di cosa sia GPT-5.6, cosa fanno Sol, Terra e Luna, chi vede cosa su quale piano, e cosa è cambiato tra l’anteprima blindata e il rilascio pubblico.

Cos’è GPT-5.6, in parole semplici
GPT-5.6 è la nuova versione del “motore” che alimenta ChatGPT. Pensalo come l’aggiornamento del sistema operativo del telefono: la stessa app che apri già, ma la cosa che pensa lì sotto diventa più veloce e più sveglia.
La logica dei nomi arriva dall’anteprima. Invece di un modello solo, GPT-5.6 è una famiglia di tre, battezzata come il sole, la terra e la luna:
La trovata resta la struttura: il numero (5.6) è la generazione, e Sol / Terra / Luna sono livelli stabili che si possono aggiornare ciascuno per conto suo. OpenAI ha confermato questa impostazione al lancio: aspettati che “Sol” voglia dire “quello grosso” per anni, come fa “Pro” sui telefoni.
Chi riceve quale modello — la mappa vera
È la parte che confonde tutti nella settimana del lancio, perché la risposta cambia a seconda dell’angolo di ChatGPT in cui ti trovi. Dalle note di disponibilità di OpenAI:
Nella Chat normale:
- Plus, Pro, Business ed Enterprise ricevono GPT-5.6 Sol, con effort medio o superiore.
- Pro ed Enterprise ottengono anche GPT-5.6 Sol Pro, una variante di massima qualità per i lavori complessi.
- Free e Go restano su GPT-5.5 Instant nella chat normale, per ora.
In ChatGPT Work e Codex (le superfici agentiche):
- Free e Go ricevono GPT-5.6 Terra — sì, anche gli utenti gratuiti qui hanno un modello 5.6.
- Plus, Pro, Business ed Enterprise scelgono tra Sol, Terra e Luna, ciascuno con la sua manopola di effort.
- max — l’impostazione “pensa più a lungo” — è attivabile da chiunque abbia accesso a 5.6 in Work o Codex.
- ultra — la nuova impostazione al vertice — è riservata a Pro ed Enterprise in ChatGPT Work, e Plus e superiori in Codex.
Se sei su Plus e Sol ancora non compare: il rollout è stato scaglionato su 24 ore dal 9 luglio, e i primi utenti hanno riferito che i modelli apparivano prima nello spazio di lavoro Work e poi nella chat normale. Dagli un giorno prima di dare per scontato che il tuo piano sia escluso.
| Dove | Free / Go | Plus | Pro / Enterprise |
|---|---|---|---|
| Chat normale | GPT-5.5 Instant (niente 5.6) | Sol (effort medio+) | Sol, più Sol Pro |
| ChatGPT Work e Codex | Terra | Sol, Terra, Luna + effort | Sol, Terra, Luna + effort |
| Impostazione max | — | ✓ | ✓ |
| Impostazione ultra | — | Solo Codex | ✓ in Work e Codex |
Cosa c’è davvero di nuovo dall’anteprima
Tre cose che vale la pena sapere, oltre a “adesso è disponibile”.
La modalità ultra è la funzione di punta. La nuova impostazione più potente di Sol non si limita a pensare più a lungo: coordina quattro agenti IA che lavorano in parallelo (chi sviluppa può arrivare fino a 16 tramite le API). Sui numeri di OpenAI, ultra ha spinto Terminal-Bench (un benchmark tosto da riga di comando) da 88,8% a 91,9%. Tradotto in italiano semplice: per i compiti grossi e caotici, ChatGPT adesso può buttare sul problema una piccola squadra invece di un solo lavoratore. In cambio consuma parecchio di più — i primi utenti raccontano che i compiti pesanti in ultra prosciugano ore di credito in pochi minuti, quindi trattala come un’occasione speciale, non come impostazione predefinita.
La storia dell’efficienza è vera, con un asterisco. Il messaggio di OpenAI è “più intelligenza da ogni token”: Sol batte il modello precedente usando meno parole per arrivarci, e il prezzo API di Sol è identico a quello di GPT-5.5 ($5 in ingresso / $30 in uscita per milione di token; Terra $2,50/$15; Luna $1/$6). L’asterisco: nella tabella pubblicata da OpenAI stessa, il Claude Fable 5 di Anthropic supera ancora Sol su due misure generali di intelligenza, e i modelli di coding di Claude restano nettamente avanti sul benchmark software SWE-Bench Pro. I punti forti più chiari di Sol sono il lavoro agentico, l’uso del computer e la velocità per dollaro. Nessun modello ha vinto su tutta la linea — qualunque cosa lasci intendere il marketing delle due aziende.
È uscito con una casa nuova. GPT-5.6 è stato lanciato insieme a ChatGPT Work, una modalità agente dove ChatGPT si prende progetti da più ore — costruisce fogli di calcolo, presentazioni, documenti e perfino piccole web app dai tuoi strumenti collegati. È lì che gli utenti gratuiti incontrano Terra, ed è la superficie che OpenAI considera chiaramente il futuro. Abbiamo scritto una guida in italiano semplice a ChatGPT Work, e un confronto diretto con Claude Cowork se stai scegliendo tra i due ecosistemi.
I benchmark del lancio — e quanto fidarti
Al rilascio OpenAI ha pubblicato una tabella di confronto completa. Ecco le righe che contano, tenute oneste includendo anche quelle che OpenAI non vince:
| Benchmark (cosa misura) | Sol | Terra | Luna | GPT-5.5 | Miglior Claude |
|---|---|---|---|---|---|
| Agents’ Last Exam (flussi professionali lunghi) | 52,7% | 50,4% | 50,3% | 46,9% | 45,2% (Opus 4.8) |
| Coding Agent Index (coding agentico, indipendente) | 80 | 77,4 | 74,6 | 76,4 | 77,2 (Fable 5) |
| Terminal-Bench 2.1 (lavoro da riga di comando) | 88,8% (91,9% ultra) | 87,4% | 84,7% | 85,6% | 88% (Mythos 5) |
| OSWorld 2.0 (usare un computer) | 62,6% | 50,2% | 45,6% | 47,5% | 54,8% (Opus 4.8) |
| SWE-Bench Pro (fix software reali) | 64,6% | 63,4% | 62,7% | 59,4% | 80,3% (Mythos 5) |
| GDPval-AA (qualità valutata da esperti) | 1.747,8 | 1.593 | 1.591,8 | 1.493,7 | 1.759,6 (Fable 5) |
| Artificial Analysis Intelligence Index | 58,9 | 55 | 51,2 | 54,8 | 59,9 (Fable 5) |
Letta tutta insieme: Sol guida sul lavoro agentico e sull’uso del computer, Claude resta davanti sull’ingegneria del software più impegnativa e mantiene un leggero vantaggio su due misure generali di qualità. La storia silenziosa è Luna che batte il modello di punta della generazione precedente su diverse righe — ed è il modello del piano gratuito.
Ora il disclaimer, perché conta più della tabella. Questi numeri arrivano dal post di lancio di OpenAI: è il vendor a scegliere quali benchmark pubblicare, quali concorrenti includere e con quali impostazioni girare — quel 91,9% è Sol in ultra, una modalità che consuma credito quattro agenti alla volta, non il Sol che userai un martedì qualsiasi. E i benchmark sono condizioni da gara: input puliti, obiettivi ben definiti, zero politica d’ufficio. Il tuo lavoro reale è ambiguo, documentato a metà, pieno di contesto che nessuna classifica misura. Un modello che segna tre punti in più su un grafico può tranquillamente andare peggio per te — per la velocità, il tono, il modo in cui gestisce i tuoi file, o quanto spesso si inventa cose nel tuo campo.
Vale la pena aggiungere un primo indizio indipendente, perché taglia in entrambe le direzioni. Cursor — l’editor di codice IA, senza interessi in questa partita — usa un suo benchmark (CursorBench) costruito su sessioni utente reali: compiti ambigui, su più file, l’opposto delle condizioni da gara. Nella versione attuale, Claude Fable 5 Max ottiene il punteggio più alto (70,5%), con GPT-5.6 Sol Max poco dietro (67,2%) — ma Sol ci arriva con $5,22 di costi contro i $17,32 di Fable. Quindi su una delle poche valutazioni dal sapore reale disponibili, Claude tiene un piccolo vantaggio di qualità e Sol vince nettamente sul prezzo. Quale dei due pesi di più dipende interamente da quanto paghi a token. L’unico benchmark che decide qualcosa è una settimana dei tuoi compiti veri.
Il capitolo governo, chiuso — quasi
Il blocco di due settimane è stato il primo vero test dell’ordine esecutivo di giugno 2026 che chiede alle aziende IA di sottoporre i modelli potenti a una revisione federale fino a 30 giorni prima del rilascio pubblico. Il Center for AI Standards and Innovation del Dipartimento del Commercio ha eseguito test aggiuntivi; OpenAI ha mandato personale tecnico a Washington; poi è arrivato il rilascio pubblico.
Un dettaglio da tenere dritto, perché nella copertura si è ingarbugliato: alcuni articoli hanno descritto OpenAI come se avesse ottenuto un “permesso” governativo per il lancio del 9 luglio — e la Casa Bianca ha respinto pubblicamente quella parola, insistendo che non serve né viene concessa alcuna approvazione e che le decisioni sul rilascio “spettano interamente alle aziende”. Il quadro è formalmente volontario. OpenAI, da parte sua, ha detto chiaramente di non volere che questa procedura “diventi lo standard di lungo periodo”.
Comunque tu legga questo balletto, la conclusione pratica non cambia: la revisione c’è stata, il modello è uscito, e il prossimo modello frontier con ogni probabilità farà lo stesso percorso di 30 giorni.
Cosa significa per te
- Se usi ChatGPT su un piano a pagamento: controlla oggi il tuo selettore dei modelli. Sol dovrebbe esserci (effort medio in su). Le vecchie chat non cambiano; quelle nuove partono più sveglie.
- Se sei sul piano gratuito: la tua strada verso GPT-5.6 è ChatGPT Work o Codex, dove ricevi Terra — oppure la nuova app desktop, che porta Work su ogni piano. La chat normale ti tiene su 5.5 Instant per ora.
- Se aspettavi il 5.6 per decidere su Plus: il piano da $20 adesso ti dà Sol in chat più tutti e tre i modelli in Work. È un affare decisamente migliore di quanto fosse Plus due settimane fa.
- Se sviluppi con le API: Sol, Terra e Luna sono aperti, ai prezzi qui sopra, con nuove regole di caching dei prompt (durata minima della cache di 30 minuti, scritture in cache fatturate a 1,25×). L’impostazione multi-agente dietro ultra è in beta nella Responses API.
- Se vuoi solo diventare bravo con tutto questo: il selettore dei modelli conta meno del sapere come guidare. Quello che impari vale ovunque.
Cosa GPT-5.6 non cambierà
- Non smetterà di inventare cose. Ragionamento migliore, sì. Perfetto, no. Verifica nomi, numeri, date e citazioni su tutto ciò che conta.
- Non ti legge nel pensiero. I prompt vaghi danno risposte vaghe con ogni modello, questo compreso.
- Non farà sparire la domanda “quale modello”. Tre modelli × impostazioni di effort × due superfici sono più scelta, non meno. Nel dubbio: Terra per la routine, Sol per i compiti duri, ultra quasi mai.
- Non conosce il tuo lavoro. Un motore più sveglio continua a non sapere chi sono i tuoi clienti, com’è il tuo settore, cosa significa “fatto bene” per te. Quel giudizio resta tuo.
In conclusione
GPT-5.6 è passato da “il modello che non puoi avere” a “il modello nel tuo selettore” in esattamente due settimane — ed è arrivato con un trucco davvero nuovo (gli agenti in parallelo di ultra), un piano gratuito davvero utile (Terra in ChatGPT Work) e delle note in piccolo oneste (Claude vince ancora alcuni benchmark importanti, anche nel grafico di OpenAI stessa).
L’aggiornamento è arrivato a te. La capacità di usarlo bene, quella no. Se vuoi la versione veloce, Fondamenti di IA e Prompt Efficaci con ChatGPT si trasferiscono dritti su 5.6.
Fonti
- GPT-5.6: Frontier intelligence that scales with your ambition — OpenAI (9 luglio 2026)
- ChatGPT is now a partner for your most ambitious work — OpenAI (9 luglio 2026)
- Previewing GPT-5.6 Sol — OpenAI (26 giugno 2026)
- OpenAI rolls out GPT-5.6 to the public on July 9 — Engadget
- OpenAI releases GPT-5.6 and ChatGPT Work tool — Axios
- CursorBench: model evals on real Cursor sessions — Cursor