Il 29 settembre 2026, durante DevDay, OpenAI ha annunciato GPT-6.1 Sol, un aggiornamento di GPT-6 Sol pensato per la programmazione con agenti, l’uso del computer e i flussi di lavoro professionali. Al lancio, OpenAI ha indicato l’accesso tramite API e, per gli utenti dei piani Plus, Pro, Business, Enterprise ed Edu, tramite ChatGPT Work e Codex. Il modello non era ancora disponibile nella Chat standard.

OpenAI ha presentato GPT-6.1 Sol per programmazione e lavoro

OpenAI descrive GPT-6.1 Sol come un modello per attività che richiedono più passaggi, dalla programmazione assistita da agenti ai flussi di lavoro aziendali. La società lo ha presentato come un aggiornamento di GPT-6 Sol. GPT-6 Astra compare invece come termine di confronto in alcune valutazioni specifiche.

La distinzione pratica riguarda anche dove usare il modello: l’annuncio indicava API, ChatGPT Work e Codex, non la Chat standard. Per chi sviluppa software, le tariffe API pubblicate distinguono fra input normale, input in cache e output.

Che cosa riportano le valutazioni di OpenAI

OpenAI ha riferito che, in DeepSWE v1.1, GPT-6.1 Sol ha raggiunto il punteggio di GPT-6 Astra con un costo per la prova pari a circa un quinto. Nella stessa valutazione ha superato di 6,4 punti percentuali il miglior risultato di GPT-6 Sol, con un livello di ragionamento e un costo inferiori.

Su AutomationBench, con ragionamento a livello medio, OpenAI ha riportato un vantaggio di 2,2 punti percentuali su Opus 5.5 e di 4,8 punti su GPT-6 Sol, misurati alla stessa impostazione. Il costo per attività indicato per Sol era circa un terzo di quello di Opus 5.5.

Su OSWorld 2.0, nel set offline e con il massimo livello di ragionamento, GPT-6.1 Sol ha ottenuto secondo OpenAI un risultato superiore di 7 punti percentuali a GPT-6 Sol e inferiore di 2,1 punti a GPT-6 Astra. Il costo per attività era circa un settimo di quello di Astra. Sono confronti legati a prove e impostazioni precise, non a un’unica misura generale di tutte le attività.

OpenAI ha inoltre riferito un calo degli errori fattuali in una valutazione a basso livello di ragionamento: la quota di risposte con almeno un errore è passata dall’11,4% di GPT-6 Sol al 7,7% di GPT-6.1 Sol. La valutazione usava prompt volutamente difficili, che OpenAI non considera rappresentativi dell’uso tipico.

Tariffe API di GPT-6.1 Sol

Le tariffe pubblicate da OpenAI sono espresse in dollari per un milione di token. I token sono le unità di testo elaborate dal modello: input indica ciò che viene inviato, mentre output indica ciò che il modello genera.

Tipo di tokenPrezzo in dollari USA per un milione di token
Input$2
Input in cache$0,10
Output$10

Che cosa aggiungono le prove personalizzate

Una prova personalizzata di nove test ha assegnato a GPT-6.1 Sol un punteggio ponderato di 96, a pari merito con Sonnet 5.5 e al quarto posto nella classifica usata. Il costo complessivo della sessione è stato indicato in 2,63 dollari. Un’altra classifica di coding ha riportato 20 risultati corretti su 20 nelle prove di difficoltà media; i test di livello alto e X-High erano incompleti.