OpenAI ha annunciato GPT-6.1 Sol il 29 settembre 2026, presentandolo come aggiornamento di GPT-6 Sol per la programmazione, l’uso del computer, il lavoro professionale e i flussi aziendali articolati in più passaggi. La società ha indicato tariffe API standard in USD e ha riportato risultati vicini a GPT-6 Astra in alcune valutazioni specifiche.

OpenAI annuncia GPT-6.1 Sol

GPT-6.1 Sol è il successore di GPT-6 Sol nell’offerta descritta da OpenAI. La società lo orienta a compiti di programmazione, uso del computer, comprensione di documenti complessi e flussi di lavoro aziendali composti da più passaggi.

Il suo identificativo API è gpt-6.1-sol. Le prestazioni indicate da OpenAI riguardano benchmark distinti e condizioni di prova specifiche: non sono un risultato unico valido per ogni attività.

Tariffe API e accesso iniziale

OpenAI ha indicato queste tariffe standard per l’API, per ogni milione di token:

  • 2 USD per i token in ingresso;
  • 0,10 USD per i token in ingresso memorizzati nella cache;
  • 10 USD per i token in uscita.

Un token è un’unità di testo elaborata dal modello. Le tre tariffe distinguono ciò che viene inviato al modello, la parte di input già memorizzata nella cache e ciò che il modello genera.

Al lancio, OpenAI ha indicato l’accesso a GPT-6.1 Sol in ChatGPT Work e Codex per gli utenti dei piani Plus, Pro, Business, Enterprise ed Edu. Gli sviluppatori potevano usare il modello tramite API. OpenAI ha precisato che allora non era ancora disponibile nella chat principale di ChatGPT.

Che cosa dicono i benchmark di OpenAI

Su DeepSWE v1.1, OpenAI ha dichiarato che GPT-6.1 Sol raggiunge GPT-6 Astra con un costo pari a circa un quinto e supera di 6,4 punti percentuali il miglior risultato di GPT-6 Sol, con uno sforzo di ragionamento e un costo inferiori.

Su AutomationBench, a sforzo di ragionamento medio, OpenAI ha riportato un vantaggio di 2,2 punti percentuali su Opus 5.5, con un costo pari a circa un terzo. Nella stessa condizione, ha indicato un vantaggio di 4,8 punti percentuali su GPT-6 Sol.

Nel set offline di OSWorld 2.0, a sforzo di ragionamento massimo, OpenAI ha collocato GPT-6.1 Sol a 2,1 punti percentuali da GPT-6 Astra, con un costo per attività pari a circa un settimo. Il risultato era inoltre superiore di sette punti percentuali a quello di GPT-6 Sol.

Su Terminal-Bench Science 0.1, sempre a sforzo massimo, OpenAI ha riportato questi costi medi per attività:

ModelloCosto medio per attività
GPT-6.1 Sol5,47 USD
Opus 5.523,21 USD
GPT-6 Astra23,80 USD

In questa valutazione, OpenAI ha indicato per GPT-6 Astra il punteggio più alto, pari al 68,1%. I costi e i punteggi descrivono quel benchmark e quelle condizioni.

Un test Stonelabs realizzato da un creator

La prova Stonelabs mostra categorie di test, punteggi e registri di esecuzione; il riepilogo riporta un punteggio ponderato di 96 su nove attività e un costo totale di 2,63 USD.

Un test registrato di Stonelabs ha valutato GPT-6.1 Sol su nove attività, tra cui la generazione di una custodia per telefono, la creazione di una pagina di vendita e una simulazione con un drone. Il risultato dichiarato è un punteggio ponderato di 96 e un costo complessivo di 2,63 USD. Nel test è stata segnalata anche un’attività non riuscita, quella del pinguino: un singolo errore che fa parte di questa prova, non un verdetto su ogni uso del modello.

Fattualità e piano Ultrafast annunciato

In una valutazione a basso sforzo basata su prompt deliberatamente difficili, OpenAI ha riportato che la quota di risposte con almeno un errore fattuale è scesa dall’11,4% per GPT-6 Sol al 7,7% per GPT-6.1 Sol. La società ha precisato che quei prompt non rappresentano l’uso tipico.

Il 29 settembre OpenAI ha inoltre annunciato un piano per una versione Ultrafast destinata a Codex, sostenendo che avrebbe potuto generare token fino a otto volte più velocemente della velocità standard. La società ha detto che intendeva proporla nei giorni successivi.