GPT-6 Astra è il nuovo modello di punta di OpenAI, lanciato il 3 settembre 2026. Sostituisce GPT-5.6 Sol, arriva su ChatGPT Plus, Pro, Business ed Enterprise nel giro di pochi giorni e via API come gpt-6-astra a 10 dollari per milione di token in ingresso e 50 in uscita. La novità vera non è il punteggio sui benchmark: è che per la prima volta un modello usa il computer come una persona, in metà del tempo del predecessore, e viene distribuito con un sistema di monitoraggio che può fermare un task a metà.
Qui ti spiego cosa cambia davvero, quanto costa, dove vince e dove no, e cosa significa per chi ci lavora ogni giorno.
Io lavoro con questi modelli tutti i giorni, in Codex e in Claude Code, per i progetti dei miei clienti. Non ho ancora avuto accesso ad Astra: il rollout è partito da un gruppo ristretto di organizzazioni. Quello che trovi qui sotto sono i numeri ufficiali letti con occhio da sviluppatore, e i test che farò appena mi arriva.
GPT-6 Astra in 60 secondi
- Cos'è: il modello più capace che OpenAI abbia mai distribuito su larga scala. Un solo nome, niente più varianti Luna, Terra e Sol: la gamma è Astra e Astra Pro.
- Quando esce: rollout iniziato il 3 settembre 2026 per un gruppo limitato di aziende; entro pochi giorni per tutti gli utenti a pagamento di ChatGPT.
- Dove si usa: ChatGPT (Plus, Pro, Business, Enterprise), Codex, API OpenAI, Amazon Bedrock e Microsoft Azure.
- Quanto costa via API: 10 $ per milione di token in input, 50 $ in output. Modalità Fast a prezzo doppio per velocità fino a 2x.
- Cosa sa fare di nuovo: usa il computer (form, CRM, fogli di calcolo, browser) con il 72,6% su OSWorld 2.0 in circa 40 minuti per task, contro il 65,7% in 75 minuti di GPT-5.6 Sol.
- Cosa lo rende diverso: è il primo modello OpenAI a raggiungere la soglia "Critical" in cybersecurity. Trova e sfrutta vulnerabilità sconosciute da solo, e per questo esce con freni che prima non c'erano.
Cosa cambia rispetto a GPT-5.6 Sol
Chi cerca "GPT-6 uscita" o "ChatGPT 6" di solito vuole sapere una cosa sola: vale la pena? La risposta breve è che il salto c'è, ma è concentrato in tre aree. Nelle altre il miglioramento è incrementale.
1. Uso del computer: il vero salto
GPT-6 Astra compila moduli online, aggiorna i record di un CRM, sistema il calendario, fa ricerche e scrive riepiloghi direttamente nell'editor di documenti. Non è un'anteprima: sui benchmark di computer use batte tutti i modelli confrontati, incluso Claude Opus 5, e lo fa in circa il 47% di tempo in meno rispetto a GPT-5.6 Sol.
Nel contesto di Codex, con l'harness aggiornato, il completamento dei task su Mind2Web è 1,9 volte più veloce rispetto all'esperienza attuale con Sol. Per chi automatizza processi aziendali questo è il punto che pesa di più: un agente che ci mette 40 minuti invece di 75 costa meno e si può inserire in flussi reali.
2. Lavoro professionale: documenti, slide, fogli
OpenAI ha addestrato GPT-6 Astra a rispettare i template esistenti e a produrre slide, documenti e fogli di calcolo che seguono lo stile del cliente senza ripetere informazioni inutili. Su AutomationBench passa dal 18,1% di Sol al 41,4%. Su BenchCAD, che misura la ricostruzione di oggetti 3D in codice CAD, arriva al 95,9% contro l'83,3% del predecessore.
C'è un dettaglio che apprezzo da sviluppatore: quando le istruzioni sono ambigue, Astra fa domande mirate solo se la risposta cambia il risultato. In Codex le fa in modo asincrono, continuando a lavorare sulle parti che non dipendono dalla tua risposta.
Se non rispondi, procede con ipotesi ragionevoli sulle cose piccole e si ferma su quelle importanti. È il comportamento che vorresti da un collega junior in gamba.
3. Coding: meglio, ma non su tutto
Su Terminal-Bench 4.0 GPT-6 Astra fa 57,9% contro il 37,3% di Sol e il 55,8% di Claude Fable 5.1. Su DeepSWE v1.1 fa 74,1%, poco sopra il 72,7% di Sol e il 73,7% di Opus 5: qui il margine è sottile. Sulle migrazioni di database interne passa dal 42,7% al 63,9%.
La novità più utile per chi fa refactoring lunghi è la gestione del contesto in Codex. Finora, quando la finestra si riempiva, il modello riassumeva il lavoro fatto e perdeva dettagli: perché un fix era fallito, come si comportava un componente. Con GPT-6 Astra, Codex tiene appunti tra una finestra e l'altra e le finestre precedenti restano ricercabili.
Si attiva dal config.toml di Codex ed è sperimentale, ma diventerà il default nelle prossime settimane. Se ti sei mai trovato a spiegare tre volte la stessa cosa a un agente, sai quanto conta.
GPT-6 Astra vs Claude Fable 5.1: dove vince e dove perde
I titoli parlano di "trono dell'AI". I numeri di GPT-6 Astra raccontano una storia più equilibrata, e la dico chiaramente perché sono gli stessi numeri pubblicati da OpenAI nel confronto.
| Benchmark | GPT-6 Astra | Claude Fable 5.1 | Chi vince |
|---|---|---|---|
| Terminal-Bench 4.0 (coding agentico) | 57,9% | 55,8% | Astra |
| DeepSWE v1.1 | 74,1% | 67,4% | Astra |
| FrontierMath Tier 4 | 97,6% | 87,8% | Astra |
| GPQA Diamond | 96,0% | 93,7% | Astra |
| AutomationBench | 41,4% | 31,4% | Astra |
| Humanity's Last Exam (con strumenti) | 57,2% | 65,0% | Fable 5.1 |
| Artificial Analysis Intelligence Index | 61,2 | 65,7 | Fable 5.1 |
| Artificial Analysis Coding Agent Index | 67,0 | 67,2 | Pari |
| FrontierCode 1.1 Main | 53,3% | 50,9% | Astra (di poco) |
Quindi: GPT-6 Astra domina sull'uso del computer, sulla matematica di frontiera e sul lavoro d'ufficio strutturato. Fable 5.1 resta avanti sull'indice di intelligenza generale e sul test più duro di ragionamento con strumenti. Sul coding agentico sono vicini, con Astra che vince sui terminali e pareggia sugli indici aggregati. Se avevi letto la mia analisi su cosa cambia con Claude Fable 5.1, la conclusione non si ribalta: nessuno dei due è la scelta giusta per tutto.
Un'avvertenza sui numeri più clamorosi. Il 99,9% su ARC-AGI-3 è stato ottenuto con un harness specifico e con lo sforzo di ragionamento al massimo. Chiamate API stateless e con effort più basso non danno quei risultati. Il benchmark è reale, ma non è quello che ottieni con un prompt normale.
Quanto costa GPT-6 Astra e come si accede
Su ChatGPT
GPT-6 Astra è incluso negli abbonamenti Plus, Pro, Business ed Enterprise, dentro i limiti di utilizzo esistenti. Chi vuole di più potrà comprare crediti aggiuntivi. Gli utenti Pro, Business ed Enterprise avranno anche Astra Pro.
Per le aziende Enterprise l'accesso è disattivato di default: deve abilitarlo l'amministratore del workspace. Del piano gratuito, al momento del lancio, non c'è traccia.
Se usi Codex con un piano Plus, ricorda che i limiti sono tornati a cinque ore: ne ho scritto in questo confronto tra i limiti di Codex e Claude Code. Un modello più efficiente sui token può aiutare, ma la finestra oraria resta quella.
Via API
- Nome modello:
gpt-6-astra - Prezzo standard: 10 $ per milione di token in input, 50 $ per milione in output
- Cache: tariffe separate per lettura e scrittura della cache
- Fast mode: fino a 2x la velocità a 2x il prezzo
- Livelli di ragionamento: low, medium, high, xhigh e max
- Disponibilità: API OpenAI, Amazon Bedrock, Microsoft Azure
- Privacy: Zero Data Retention per i clienti API idonei
Il prezzo a token è alto rispetto ai modelli di fascia media. OpenAI insiste sul fatto che quello che conta è il prezzo per task, perché Astra usa meno token per arrivare al risultato: su Terminal-Bench dichiara un costo stimato inferiore del 63% rispetto a Fable 5.1, su BenchCAD dell'86%.
Sono stime del produttore su configurazioni scelte da lui. Il conto vero lo fai tu, sul tuo carico di lavoro, e ti consiglio di misurarlo prima di spostare pipeline in produzione. Se vuoi il quadro generale sull'andamento dei prezzi, ho fatto i conti in questo articolo sugli aumenti dei servizi AI.
Il lato che nessuno spiega: i freni di sicurezza
Questa è la parte che cambia il modo in cui lo userai, e che i titoli sul "salto generazionale" hanno saltato.
GPT-6 Astra è il primo modello OpenAI a raggiungere il livello Critical in cybersecurity secondo il framework interno dell'azienda. In pratica, senza le protezioni di produzione, ha dimostrato di poter trovare vulnerabilità sconosciute e trasformarle in exploit funzionanti su browser e sistemi operativi protetti. Su ExploitBench fa 100% contro il 78,5% di Sol. Durante i test ha scoperto e usato due zero-day mai viste prima, che OpenAI ha segnalato ai maintainer.
Per questo motivo il modello esce con tre limiti concreti:
- Rifiuti mirati: Astra fa revisione del codice e patching, ma rifiuta di creare proof-of-concept di exploit. Le funzioni più avanzate arriveranno gradualmente attraverso il programma Daybreak, rivolto a chi fa difesa.
- Monitoraggio in produzione: un sistema di classificatori controlla ragionamento e azioni del modello e blocca le attività non autorizzate. In ChatGPT e Codex ti può chiedere di rivedere un'azione prima di continuare. In API il task si ferma.
- Falsi positivi ammessi: OpenAI dichiara che questi controlli a volte rallentano o interrompono lavoro legittimo, incluso quello di sicurezza difensiva, e che sta lavorando per ridurre le interruzioni.
Se integri GPT-6 Astra in un'automazione che gira da sola, devi gestire il caso in cui il task venga fermato dal monitoraggio. Non è un errore di rete: è un comportamento previsto. Se hai seguito il blackout dei servizi AI del 3 settembre, sai già che un fallback serve sempre. Con Astra serve anche per un motivo nuovo.
Sul fronte allineamento i dati sono buoni: in una valutazione sui task impossibili, dove Sol superava il perimetro autorizzato nel 48% dei casi, GPT-6 Astra lo fa nello 0%. Non ha mai provato ad aggirare un blocco dell'Auto-review di Codex, nemmeno quando era configurato per essere aggirabile.
Ed è tre volte meno incline di Sol a dichiarare capacità che non ha. Per chi usa questi modelli in azienda, e deve rendere conto della loro condotta, queste sono le righe che conteranno davanti a un audit. Ne ho parlato a proposito dei controlli dell'UE sull'AI Act.
È l'AGI? Cosa ha detto davvero OpenAI
La domanda "gpt 6 astra agi" è tra le più digitate. La risposta onesta: OpenAI descrive GPT-6 Astra come "il modello più intelligente e allineato al mondo" e il suo presidente ha detto che non è irragionevole sentirsi nell'era dell'AGI, precisando che il termine non è più legato a un trigger contrattuale ma è un concetto di missione. Non c'è una dichiarazione formale di AGI raggiunta.
Quello che c'è è un modello che ha saturato due benchmark costruiti apposta per restare davanti alle AI, ARC-AGI-3 e FrontierMath Tier 4, e che ha contribuito a migliorare due risultati aperti sui numeri primi, uno dei quali fermo da oltre ottant'anni. È un fatto notevole. È anche un fatto che sull'indice di intelligenza generale più usato dal settore Astra resta sotto Fable 5.1. Chiamarlo AGI o no è una scelta di parole; per il tuo lavoro cambia poco.
Cosa significa per freelance, PMI e sviluppatori
Ecco come leggo questo lancio dal punto di vista di chi deve decidere cosa fare lunedì mattina.
Se automatizzi processi aziendali
Il computer use di GPT-6 Astra apre casi d'uso che finora richiedevano integrazioni custom: inserimento ordini in gestionali senza API, aggiornamento CRM da email, compilazione di portali di fornitori. Il costo per task scende perché il tempo scende.
Ma il monitoraggio può fermare un flusso, quindi ogni automazione va progettata con un punto di ripresa e un umano in copia. È il tipo di lavoro che faccio nei progetti di automazione AI per le aziende, e Astra lo rende più fattibile, non più semplice.
Se scrivi codice
La memoria persistente in Codex è la funzione da provare per prima. Il guadagno su Terminal-Bench e sulle migrazioni di database dice che GPT-6 Astra è più a suo agio nei task lunghi e sporchi, quelli in cui gli agenti attuali si perdono. Sui task brevi la differenza con Sol e con Fable 5.1 sarà difficile da percepire. Io metterò GPT-6 Astra alla prova su una migrazione reale di un progetto Next.js con Payload CMS, che è il mio stack, e aggiornerò questo articolo con i risultati.
Se paghi un abbonamento e basta
Se hai Plus, GPT-6 Astra ti arriva nei prossimi giorni senza costi extra. Provalo su un compito che oggi ti fa perdere tempo al computer, non su una domanda di cultura generale: è lì che si vede la differenza. Se sei sul piano gratuito, aspetta: non è ancora previsto.
I test che farò appena ho accesso
- Costo per task reale su tre flussi che uso ogni settimana, confrontato con Sol e Fable 5.1 sugli stessi input.
- Interruzioni del monitoraggio: quante volte un task legittimo di revisione sicurezza viene fermato, e come si riprende.
- Memoria tra finestre di contesto in Codex su un refactoring che supera i 200.000 token.
- Computer use su un gestionale italiano senza API, per capire se regge un caso reale e non una demo.
I risultati finiranno qui, con i numeri, buoni o cattivi che siano.
Domande frequenti su GPT-6 Astra
Qual è l'ultima versione di ChatGPT?
Dal 3 settembre 2026 il modello più recente è GPT-6 Astra, che sostituisce GPT-5.6 Sol. Il rollout è progressivo: prima un gruppo limitato di organizzazioni, poi tutti gli abbonati Plus, Pro, Business ed Enterprise.
GPT-6 Astra è disponibile gratis?
Al lancio no. È incluso nei piani a pagamento di ChatGPT, dentro i limiti di utilizzo esistenti, con la possibilità di acquistare crediti aggiuntivi. Per il piano gratuito non è stata annunciata una data.
Quanto costa GPT-6 Astra via API?
10 dollari per milione di token in input e 50 dollari per milione in output nella modalità standard. La modalità Fast raddoppia velocità e prezzo. La cache ha tariffe separate.
Cosa cambia rispetto a GPT-5.6 Sol?
Tre cose principali: uso del computer molto più veloce e preciso, produzione di documenti e slide che rispettano i template, e capacità di cybersecurity al livello Critical. Sul coding il miglioramento è netto nei task lunghi da terminale e più contenuto in quelli brevi.
GPT-6 Astra è meglio di Claude Fable 5.1?
Dipende dal compito. Astra vince su computer use, matematica di frontiera, lavoro d'ufficio strutturato e Terminal-Bench. Fable 5.1 resta avanti su Humanity's Last Exam con strumenti e sull'Artificial Analysis Intelligence Index. Sul coding agentico sono vicini.
Perché Astra a volte si ferma a metà di un task?
Perché, avendo capacità di cybersecurity classificate Critical, OpenAI ha attivato un monitoraggio in produzione che blocca le azioni non autorizzate. In ChatGPT e Codex ti chiede di rivedere l'azione; in API il task si interrompe. Può capitare anche su lavoro legittimo.
GPT-6 Astra è AGI?
OpenAI non lo dichiara formalmente. Ha saturato benchmark pensati per restare davanti alle AI e ha contribuito a risultati matematici reali, ma su altri indici di intelligenza generale resta dietro Claude Fable 5.1. Il termine viene usato come concetto di missione, non come traguardo certificato.
Leggi anche
- Claude Fable 5.1 e Mythos 5.1: cosa cambia e quanto costa
- Codex torna al limite di 5 ore: quante ore hai davvero
- Claude down oggi: risolto dopo 2h50, 14 incidenti in 15 giorni
- Controlli AI Act: l'UE interroga 30 società, cosa fare ora
- Prezzi AI +90%: perché paghi di più e come difenderti
In sintesi
GPT-6 Astra è un passo avanti reale sull'uso del computer e sul lavoro professionale, un miglioramento solido ma non totale sul coding, e il primo modello che arriva con freni di sicurezza che possono fermare il tuo lavoro. Non è la fine della partita con Anthropic: è un cambio di terreno, dal chi ragiona meglio al chi fa meglio le cose al posto tuo.
Se stai valutando come inserire un modello di questa classe nei processi della tua azienda, o vuoi capire se conviene rispetto a quello che usi oggi, scrivimi: rispondo io, e prima di consigliarti qualcosa lo provo sul tuo caso.



