OpenAI ha annunciato GPT-6 Sol e GPT-6 Luna il 22 settembre 2026, con tariffe API inferiori ai prezzi promozionali indicati per i modelli GPT-5.6 e risultati di valutazione propri. L’azienda ha descritto GPT-6 Sol come un modello per attività professionali complesse e GPT-6 Luna come un’opzione a costo inferiore per il lavoro su larga scala.
OpenAI ha annunciato GPT-6 Sol e Luna il 22 settembre
Al lancio, OpenAI ha indicato l’accesso a entrambi i modelli tramite l’API e in ChatGPT Work e Codex per gli utenti dei piani Plus, Pro, Business, Enterprise ed Edu. Gli utenti Free e Go potevano usare GPT-6 Luna nell’app desktop. OpenAI ha precisato che i due modelli non erano ancora disponibili nella chat standard.
Per gli sviluppatori, OpenAI ha indicato gli identificatori API gpt-6-sol e gpt-6-luna. Ha inoltre descritto i modelli come sviluppati con metodi simili a quelli di GPT-6 Astra, per portare alcune capacità di quella famiglia a modelli più veloci e meno costosi.
Le tariffe API distinguono input e output
Un token è una porzione di testo elaborata dal modello: l’API addebita separatamente i token in ingresso, cioè il contenuto inviato, e quelli in uscita, cioè la risposta generata. Le tariffe indicate da OpenAI sono in dollari statunitensi per ogni milione di token.
| Modello | Token in ingresso (USD per 1 milione) | Token in uscita (USD per 1 milione) |
| GPT-6 Sol | 2 USD | 10 USD |
| GPT-6 Luna | 0,10 USD | 0,50 USD |
I prezzi promozionali di riferimento per GPT-5.6 Sol erano 4 USD in ingresso e 20 USD in uscita per milione di token; per GPT-5.6 Luna erano 0,20 USD e 1,20 USD. Il confronto porta a una riduzione del 50% per entrambe le tariffe di GPT-6 Sol e per l’ingresso di GPT-6 Luna. Per l’uscita di GPT-6 Luna, il calo da 1,20 a 0,50 USD è invece di circa il 58,3%.
OpenAI ha indicato anche uno sconto del 90% sulle letture di token in ingresso già memorizzati nella cache. Secondo l’azienda, gli sviluppatori possono modificare l’intensità di ragionamento o la disponibilità degli strumenti mantenendo il contesto precedente riutilizzabile dalla cache.
Che cosa misurano le valutazioni e le prove di programmazione
Nel test di programmazione DeepSWE v1.1, OpenAI ha riportato un punteggio del 68,8% per GPT-6 Sol e del 66,6% per GPT-6 Luna, entrambi con la massima intensità di ragionamento.
OpenAI ha anche riferito che GPT-6 Sol ha commesso circa la metà degli errori di GPT-5.6 Sol in una valutazione interna sulla factualità. Il test usava conversazioni de-identificate in cui gli utenti avevano già segnalato errori; OpenAI ha specificato che non erano rappresentative dell’uso tipico.
Le prove di programmazione pubblicate in video hanno seguito metodi diversi. Una dimostrazione ha confrontato i modelli su tre attività: un sito web, un cruscotto interattivo per il tracciamento delle tempeste e un videogioco 3D. Nel gioco, l’output di Claude Opus 5.5 includeva una simulazione dell’acqua e delle onde più articolata rispetto a quelli di GPT-6 Sol e GPT-6 Luna; durante le prove comparivano anche tempi, token e costi.
Un test distinto ha valutato 24 prompt e 12 configurazioni su progetti in PHP, Dart, Flutter e Go. Nelle configurazioni esaminate, la valutazione ha giudicato la qualità del codice di GPT-6 Sol inferiore a quella di GPT-5.6 Sol, segnalando al tempo stesso costi e tempi inferiori. Le prove avevano compiti e impostazioni diversi rispetto alle valutazioni di OpenAI.