GPT-6 Astra è un modello di OpenAI pensato per programmazione, uso del computer, agenti e flussi di lavoro complessi. La valutazione pratica pubblicata il 14 settembre 2026 indica un salto concreto rispetto a GPT-5.6 in alcuni di questi scenari, ma non una macchina da lasciare senza guardia: può commettere errori seri, richiede supervisione e divora rapidamente il budget d’uso quando si alza il livello di ragionamento.
OpenAI ha annunciato GPT-6 Astra il 3 settembre 2026. In Italia ha pubblicato informazioni dedicate al lancio regionale.
Che cosa cambia davvero
Il punto non è che GPT-6 Astra risponda meglio a ogni domanda da chatbot. Nei compiti ordinari, come scrittura creativa e ricerche sul web, la differenza percepita rispetto a GPT-5.6 può essere ridotta.
Il vantaggio emerge quando il modello deve tenere insieme più passaggi: analizzare file, muoversi tra applicazioni, controllare artefatti software o lavorare su problemi che attraversano più file. È qui che il termine agentico ha un significato utile: non solo genera testo o codice, ma opera dentro un flusso di lavoro composto da azioni successive.
Una valutazione iniziale di revisione del codice ha registrato circa il 4% di bug etichettati e azionabili in più rispetto a GPT-5.6 Sol nell’insieme dei casi esaminati, con un vantaggio del 20% nel sottoinsieme più difficile di revisioni tra più file. Sono risultati circoscritti alla revisione del codice, non una classifica universale dei modelli.
Programmazione, agenti e uso del computer
In una prova pratica esterna, GPT-6 Astra ha individuato un errore di GPT-5.6 durante la creazione di una mod per Crimson Desert e ha suggerito un formato ASI che ha poi funzionato. È un esempio molto concreto del suo valore: collegare il problema tecnico al passaggio operativo giusto.
OpenAI presenta il modello anche per lavoro scientifico, cybersecurity e workflow 3D o in stile CAD. Dimostrazioni di modellazione e di ambienti per Unreal Engine mostrano che questa ambizione non si ferma alla chat. Ma una demo riuscita non trasforma ogni attività in un processo automatico affidabile: prompt, strumenti collegati e controllo del risultato restano parte del lavoro.
Errori, supervisione e consumo
La stessa prova pratica ha rilevato anche l’altro lato della medaglia: GPT-6 Astra ha introdotto un bug che rendeva inutilizzabile un gioco e sono servite ore di prompt al livello di intelligenza più alto per trovarne l’origine. Potente? Sì. Infalibile? Per niente.
Questa è la distinzione che conta per chi sviluppa: saper risolvere molti passaggi non significa comprendere sempre l’architettura complessiva di un progetto. Il modello può essere brillante su modifiche locali e perdere il filo del sistema nel suo insieme.
Il consumo è l’altra trappola. In un’esperienza d’uso, la combinazione tra impostazione di intelligenza massima e più agenti ha esaurito circa una settimana di utilizzo di un piano Pro 5x da 100 $ al mese in una-due ore. Non è il prezzo di GPT-6 Astra, ma un esempio di quanto rapidamente possano pesare i flussi più intensivi.
OpenAI indica invece queste tariffe API standard:
- 10 $ per milione di token in input
- 50 $ per milione di token in output
Un token è una piccola unità di testo elaborata dal modello. Input e output sono quindi fatturati separatamente: inviare molto contesto costa, ma far generare risposte, codice o analisi molto lunghe costa di più.
Il video mostra il controllo Thinking Level, da Light a Ultra, e un workflow di ChatGPT Work che collega cartelle locali a un progetto. È una guida sponsorizzata e strutturata attorno a un caso d’uso, ma rende bene visibile il compromesso: riserva il ragionamento più pesante ai compiti davvero complessi e usa modelli meno intensivi per il lavoro di routine.
ARC-AGI-3 non basta per parlare di AGI
OpenAI riporta per GPT-6 un punteggio del 99,9% su ARC-AGI-3, benchmark che valuta come gli agenti imparano risolvendo compiti interattivi non familiari. È un risultato notevole, ma un benchmark misura uno scenario preciso: non certifica che il modello sia un’intelligenza artificiale generale.
La prova pratica racconta una realtà più sfumata e più utile: GPT-6 Astra può accelerare attività tecniche impegnative, ma continua a richiedere revisioni, correzioni e giudizio umano. L’etichetta AGI, insomma, non è giustificata dal suo comportamento operativo.
Per chi ha senso GPT-6 Astra
GPT-6 Astra è interessante per sviluppatori e team che affrontano revisioni complesse, automazione tra applicazioni, analisi di file e task multi-step dove un errore intercettato può valere più del costo in token. Per domande rapide, bozze e attività ripetitive, il suo vantaggio appare meno netto.
La regola pratica è semplice: affidagli i lavori difficili, ma trattalo come un collaboratore veloce che deve ancora passare la revisione. Il suo punto forte è l’operatività su flussi complessi; il collo di bottiglia resta la supervisione umana.