Il 29 settembre 2026, durante DevDay, OpenAI ha annunciato GPT-6.1 Sol, un aggiornamento di GPT-6 Sol pensato per la programmazione con agenti, l’uso del computer e i flussi di lavoro professionali. Al lancio, OpenAI ha indicato l’accesso tramite API e, per gli utenti dei piani Plus, Pro, Business, Enterprise ed Edu, tramite ChatGPT Work e Codex. Il modello non era ancora disponibile nella Chat standard.
OpenAI ha presentato GPT-6.1 Sol per programmazione e lavoro
OpenAI descrive GPT-6.1 Sol come un modello per attività che richiedono più passaggi, dalla programmazione assistita da agenti ai flussi di lavoro aziendali. La società lo ha presentato come un aggiornamento di GPT-6 Sol. GPT-6 Astra compare invece come termine di confronto in alcune valutazioni specifiche.
La distinzione pratica riguarda anche dove usare il modello: l’annuncio indicava API, ChatGPT Work e Codex, non la Chat standard. Per chi sviluppa software, le tariffe API pubblicate distinguono fra input normale, input in cache e output.
Che cosa riportano le valutazioni di OpenAI
OpenAI ha riferito che, in DeepSWE v1.1, GPT-6.1 Sol ha raggiunto il punteggio di GPT-6 Astra con un costo per la prova pari a circa un quinto. Nella stessa valutazione ha superato di 6,4 punti percentuali il miglior risultato di GPT-6 Sol, con un livello di ragionamento e un costo inferiori.
Su AutomationBench, con ragionamento a livello medio, OpenAI ha riportato un vantaggio di 2,2 punti percentuali su Opus 5.5 e di 4,8 punti su GPT-6 Sol, misurati alla stessa impostazione. Il costo per attività indicato per Sol era circa un terzo di quello di Opus 5.5.
Su OSWorld 2.0, nel set offline e con il massimo livello di ragionamento, GPT-6.1 Sol ha ottenuto secondo OpenAI un risultato superiore di 7 punti percentuali a GPT-6 Sol e inferiore di 2,1 punti a GPT-6 Astra. Il costo per attività era circa un settimo di quello di Astra. Sono confronti legati a prove e impostazioni precise, non a un’unica misura generale di tutte le attività.
OpenAI ha inoltre riferito un calo degli errori fattuali in una valutazione a basso livello di ragionamento: la quota di risposte con almeno un errore è passata dall’11,4% di GPT-6 Sol al 7,7% di GPT-6.1 Sol. La valutazione usava prompt volutamente difficili, che OpenAI non considera rappresentativi dell’uso tipico.
Tariffe API di GPT-6.1 Sol
Le tariffe pubblicate da OpenAI sono espresse in dollari per un milione di token. I token sono le unità di testo elaborate dal modello: input indica ciò che viene inviato, mentre output indica ciò che il modello genera.
| Tipo di token | Prezzo in dollari USA per un milione di token |
| Input | $2 |
| Input in cache | $0,10 |
| Output | $10 |
Che cosa aggiungono le prove personalizzate
Una prova personalizzata di nove test ha assegnato a GPT-6.1 Sol un punteggio ponderato di 96, a pari merito con Sonnet 5.5 e al quarto posto nella classifica usata. Il costo complessivo della sessione è stato indicato in 2,63 dollari. Un’altra classifica di coding ha riportato 20 risultati corretti su 20 nelle prove di difficoltà media; i test di livello alto e X-High erano incompleti.