OpenAI kündigte GPT-6.1 Sol am 29. September 2026 beim DevDay als Upgrade zu GPT-6 Sol an. Das Modell ist für agentisches Programmieren, die Bedienung von Computern und komplexe berufliche Abläufe ausgelegt. Zum Start nannte OpenAI API-Zugang sowie Zugang für Nutzer mit Plus, Pro, Business, Enterprise und Edu in ChatGPT Work und Codex; im normalen ChatGPT-Chat war GPT-6.1 Sol laut Ankündigung noch nicht verfügbar.

Was OpenAIs ausgewählte Tests berichten

Die Ergebnisse, die OpenAI für GPT-6.1 Sol veröffentlichte, beziehen sich auf bestimmte Aufgaben und Testbedingungen. Bei DeepSWE v1.1 erreichte das Modell laut OpenAI denselben Wert wie GPT-6 Astra und verursachte dabei ungefähr ein Fünftel der Kosten pro Aufgabe. Gegenüber dem besten Ergebnis von GPT-6 Sol lag GPT-6.1 Sol in diesem Test um 6,4 Prozentpunkte vorn – bei geringerem Reasoning-Aufwand und niedrigeren Kosten.

Bei AutomationBench 1.0.6 lag GPT-6.1 Sol laut OpenAI bei mittlerem Reasoning-Aufwand 2,2 Prozentpunkte vor Opus 5.5 und 4,8 Prozentpunkte vor GPT-6 Sol. Die Kosten pro Aufgabe betrugen demnach etwa ein Drittel der Kosten von Opus 5.5.

Auch beim Computergebrauch meldete OpenAI einen Unterschied: Im Offline-Set von OSWorld 2.0 lag GPT-6.1 Sol bei maximalem Reasoning-Aufwand sieben Prozentpunkte vor GPT-6 Sol und 2,1 Prozentpunkte hinter GPT-6 Astra. Die Kosten pro Aufgabe lagen laut OpenAI bei ungefähr einem Siebtel der Kosten von GPT-6 Astra.

In einer weiteren OpenAI-Auswertung mit bewusst schwierigen Prompts enthielten 7,7 Prozent der Antworten von GPT-6.1 Sol bei niedrigem Reasoning-Aufwand mindestens einen sachlichen Fehler; bei GPT-6 Sol waren es 11,4 Prozent. OpenAI ordnete diese Prompts als nicht repräsentativ für die typische Nutzung ein.

Die API-Preise von GPT-6.1 Sol

OpenAI nannte diese Preise pro einer Million Token:

Art der TokenPreis
Eingabe2 US-Dollar
Cache-Eingabe0,10 US-Dollar
Ausgabe10 US-Dollar

Was individuelle Coding-Tests ergänzen

Ein individuell zusammengestellter Neun-Test-Parcours ergab für GPT-6.1 Sol eine gewichtete Punktzahl von 96. Das Modell lag damit gleichauf mit Sonnet 5.5, auf Rang vier; der gesamte Durchlauf kostete 2,63 US-Dollar. In einem separaten Coding-Ranking erreichte GPT-6.1 Sol bei Aufgaben mittlerer Schwierigkeit 20 von 20 Punkten; Tests mit höherem Aufwand blieben unvollständig. Diese eigens zusammengestellten Tests messen andere Aufgaben als die von OpenAI genannten Benchmarks.