OpenAI a annoncé GPT-6.1 Sol le 29 septembre 2026, en le présentant comme une mise à niveau de GPT-6 Sol pour le code, l’utilisation d’un ordinateur et les tâches professionnelles. L’entreprise a publié des tarifs API standard et rapporté des résultats proches de GPT-6 Astra sur plusieurs évaluations précises, à moindre coût selon les tests cités.

OpenAI a annoncé GPT-6.1 Sol pour les tâches complexes

OpenAI destine GPT-6.1 Sol au codage, à l’utilisation d’outils informatiques, à la compréhension de documents et aux flux de travail professionnels en plusieurs étapes. L’identifiant du modèle dans l’API est gpt-6.1-sol.

Tarifs API et accès initial

Les tarifs standard annoncés par OpenAI sont de 2 $US par million de tokens en entrée, 0,10 $US par million de tokens d’entrée en cache et 10 $US par million de tokens en sortie.

Au lancement, les utilisateurs des offres Plus, Pro, Business, Enterprise et Edu pouvaient accéder au modèle dans ChatGPT Work et Codex. Les développeurs pouvaient aussi l’appeler par l’API. OpenAI précisait alors que GPT-6.1 Sol n’était pas encore disponible dans le chat principal de ChatGPT.

Ce que disent les comparaisons d’OpenAI

OpenAI a rapporté des résultats sur plusieurs benchmarks, c’est-à-dire des évaluations définies pour mesurer des capacités dans des tâches particulières. Sur DeepSWE v1.1, l’entreprise indiquait que GPT-6.1 Sol égalait GPT-6 Astra pour environ un cinquième de son coût. Elle signalait aussi un score supérieur de 6,4 points de pourcentage à celui du meilleur résultat de GPT-6 Sol, avec un effort de raisonnement et un coût plus faibles.

Sur AutomationBench, à effort de raisonnement moyen, OpenAI rapportait un score supérieur de 2,2 points de pourcentage à celui d’Opus 5.5, pour environ un tiers du coût. Sur le même benchmark et au même niveau d’effort, l’écart annoncé avec GPT-6 Sol était de 4,8 points.

Pour l’ensemble hors ligne d’OSWorld 2.0, à effort de raisonnement maximal, OpenAI situait GPT-6.1 Sol à 2,1 points de pourcentage de GPT-6 Astra et estimait son coût par tâche à environ un septième de celui d’Astra. L’entreprise rapportait également un score supérieur de 7 points à celui de GPT-6 Sol.

Sur Terminal-Bench Science 0.1, à effort maximal, OpenAI a communiqué les coûts moyens par tâche suivants :

ModèleCoût moyen par tâche
GPT-6.1 Sol5,47 $US
Opus 5.523,21 $US
GPT-6 Astra23,80 $US

Dans cette même évaluation, OpenAI indiquait que GPT-6 Astra avait obtenu le meilleur score, à 68,1 %. Les comparaisons de l’entreprise restent liées à ces benchmarks et à leurs conditions respectives.

Un test Stonelabs réalisé par un créateur

Dans le test Stonelabs, l’interface affiche les catégories d’évaluation, les scores et les journaux d’exécution

Une évaluation filmée de Stonelabs a rapporté un score pondéré de 96 sur neuf tâches, pour un coût total de 2,63 $US. Le résultat égalait celui de Sonnet 5.5 dans cette évaluation, qui a aussi relevé un échec sur une tâche consacrée à un pingouin.

Factualité et projet Ultrafast annoncé

À faible effort de raisonnement, OpenAI a rapporté que la proportion de réponses contenant au moins une erreur factuelle était passée de 11,4 % pour GPT-6 Sol à 7,7 % pour GPT-6.1 Sol. Ce résultat portait sur des prompts factuels volontairement difficiles, qu’OpenAI disait non représentatifs d’un usage courant. L’entreprise a également déclaré n’avoir observé aucune tentative de GPT-6.1 Sol pour contourner un système automatisé de contrôle de sécurité.

Le 29 septembre, OpenAI a aussi annoncé une version Ultrafast pour Codex, qu’elle prévoyait de proposer dans les jours suivants et qui devait générer des tokens jusqu’à huit fois plus vite que la vitesse standard.