OpenAI kondigde GPT-6.1 Sol op 29 september 2026 aan als upgrade van GPT-6 Sol, gericht op programmeren, computergebruik, professioneel werk en meerstapsworkflows. Het bedrijf presenteerde resultaten op specifieke benchmarks waarbij Sol volgens OpenAI vergelijkbare prestaties als GPT-6 Astra combineerde met lagere taakkosten.
OpenAI kondigde GPT-6.1 Sol aan
OpenAI beschreef GPT-6.1 Sol als een model voor onder meer agentisch programmeren, computergebruik, documentbegrip en bedrijfsworkflows. De API-model-ID is gpt-6.1-sol.
De aangekondigde standaard API-tarieven zijn $2 per miljoen invoertokens, $0,10 per miljoen invoertokens uit de cache en $10 per miljoen uitvoertokens. OpenAI vergeleek de standaard invoer- en uitvoertarieven met die van GPT-6 Astra en zei dat Astra daarvoor vijf keer zoveel kostte.
API-tarieven en eerste toegang
Bij de aankondiging konden gebruikers met een Plus-, Pro-, Business-, Enterprise- of Edu-abonnement GPT-6.1 Sol gebruiken in ChatGPT Work en Codex. Ontwikkelaars konden het model via de API aanroepen. OpenAI meldde dat het op dat moment nog niet beschikbaar was in de gewone ChatGPT-chat.
Wat OpenAI’s benchmarks laten zien
De vergelijkingen van OpenAI hebben betrekking op specifieke tests en instellingen. Op DeepSWE v1.1 zei het bedrijf dat GPT-6.1 Sol GPT-6 Astra evenaarde voor ongeveer een vijfde van de kosten. Sols beste score lag volgens OpenAI bovendien 6,4 procentpunt boven de beste score van GPT-6 Sol, bij een lagere redeneerinspanning en lagere kosten.
Op AutomationBench, bij gemiddelde redeneerinspanning, rapporteerde OpenAI een score voor Sol die 2,2 procentpunt hoger lag dan die van Opus 5.5, voor ongeveer een derde van de kosten. In dezelfde instelling lag Sol volgens OpenAI 4,8 procentpunt boven GPT-6 Sol.
Op de offline testset van OSWorld 2.0, bij maximale redeneerinspanning, kwam Sol volgens OpenAI binnen 2,1 procentpunt van GPT-6 Astra. De kosten per taak waren ongeveer een zevende van die van Astra. Sol scoorde op die testset ook zeven procentpunt hoger dan GPT-6 Sol.
Voor Terminal-Bench Science 0.1 rapporteerde OpenAI de volgende gemiddelde kosten per taak bij maximale redeneerinspanning:
| Model | Gemiddelde kosten per taak (USD) |
| GPT-6.1 Sol | $5,47 |
| Opus 5.5 | $23,21 |
| GPT-6 Astra | $23,80 |
GPT-6 Astra had op die test de hoogste gerapporteerde score: 68,1%. De scores en kosten zijn OpenAI-resultaten voor deze specifieke benchmark en instelling.
Een test van een maker voegt negen taken toe
In een afzonderlijke Stonelabs-test rapporteerde de maker een gewogen score van 96 over negen taken, bij totale testkosten van $2,63. In een taak met een pinguïn meldde de maker een misser. De score en kosten horen bij die testreeks.
Feitelijkheid en het aangekondigde Ultrafast-plan
Bij lage redeneerinspanning daalde volgens OpenAI het aandeel antwoorden met minstens één feitelijke fout van 11,4% voor GPT-6 Sol naar 7,7% voor GPT-6.1 Sol. De resultaten kwamen uit bewust moeilijke prompts; OpenAI zei dat die geen doorsnee gebruik vertegenwoordigden.
OpenAI kondigde ook een Ultrafast-versie voor Codex aan. Het bedrijf zei dat die in de dagen na de aankondiging zou worden aangeboden en claimde een tokengeneratiesnelheid tot acht keer zo hoog als de standaardsnelheid.