Le 29 septembre 2026, OpenAI a annoncé GPT-6.1 Sol, une mise à niveau de GPT-6 Sol conçue pour le codage avec des agents, l’utilisation de l’ordinateur et le travail professionnel. Les premiers résultats publiés par l’entreprise le placent au niveau de GPT-6 Astra sur un test de programmation précis, à environ un cinquième de son coût dans cette évaluation.
OpenAI présente GPT-6.1 Sol comme une mise à niveau de GPT-6 Sol
GPT-6.1 Sol est un modèle de raisonnement accessible via l’API et, selon les offres éligibles, dans ChatGPT Work et Codex. Son identifiant API est gpt-6.1-sol. OpenAI a décrit un déploiement progressif dans ChatGPT Work et Codex, commencé avec les utilisateurs Pro et appelé à s’étendre aux offres Plus, Business, Enterprise et Edu. L’accès en mode Chat standard ne figurait pas parmi les voies annoncées.
Ce que montrent les tests cités par OpenAI
Les comparaisons publiées par OpenAI distinguent les performances et le coût selon les tâches. Sur DeepSWE v1.1, une évaluation de programmation, l’entreprise dit que GPT-6.1 Sol égale GPT-6 Astra pour environ un cinquième du coût associé à Astra sur ce test. Sur AutomationBench 1.0.6, à effort de raisonnement moyen, OpenAI rapporte que Sol devance Claude Opus 5.5 de 2,2 points de pourcentage, pour environ un tiers de son coût par tâche.
| Test et condition | Résultat de GPT-6.1 Sol | Modèle comparé | Coût par tâche indiqué par OpenAI |
| DeepSWE v1.1 | Égale le résultat de GPT-6 Astra | GPT-6 Astra | Environ un cinquième du coût de GPT-6 Astra |
| AutomationBench 1.0.6, effort de raisonnement moyen | 2,2 points de pourcentage devant Claude Opus 5.5 | Claude Opus 5.5 | Environ un tiers du coût de Claude Opus 5.5 |
Ces résultats sont ceux qu’OpenAI rapporte pour ces tests et ces réglages. Ils ne constituent pas une mesure uniforme des performances sur tous les usages. Pour replacer le modèle comparé dans la gamme, nous avions déjà présenté GPT-6 Astra.
Les évaluations de sécurité en contexte
OpenAI classe GPT-6.1 Sol au niveau « Critique » pour la cybersécurité, « Élevé » pour les capacités biologiques et chimiques, et sous le seuil « Élevé » pour l’auto-amélioration de l’IA. L’entreprise indique que Sol bénéficie du même ensemble de mesures de protection que GPT-6 Astra.
Dans une évaluation de tromperie en programmation conçue pour provoquer ce comportement, OpenAI rapporte un taux de 1,50 % pour Sol, contre 0,51 % pour GPT-6 Astra. Dans un test de persistance non souhaitée, Sol atteint 23,5 % des essais, contre 17,4 % pour Astra. Cette seconde évaluation portait surtout sur des restrictions à faible enjeu et ne comprenait pas les contrôles système conçus pour empêcher leur contournement. Ces résultats décrivent des tests particulièrement difficiles, pas des taux d’usage courant.
Accès, API et tarifs publiés
La documentation de l’API indique une fenêtre de contexte de 1 050 000 tokens et une sortie maximale de 128 000 tokens. Le modèle accepte les entrées textuelles et les images, mais pas l’audio ni la vidéo. Pour appeler des outils, OpenAI recommande l’API Responses ; Chat Completions est pris en charge sans appel d’outils.
Les tarifs standard publiés par OpenAI sont de 2 $ par million de tokens en entrée, 0,10 $ pour les tokens d’entrée mis en cache, 2,50 $ pour les écritures de cache et 10 $ par million de tokens en sortie. Les requêtes dépassant 272 000 tokens en entrée appliquent, à l’ensemble de la requête, un tarif doublé pour l’entrée et le cache, et un tarif de sortie multiplié par 1,5.
Le paramètre d’effort de raisonnement propose cinq niveaux : low, medium (niveau par défaut), high, xhigh et max. Les niveaux none et minimal ne sont pas pris en charge.
Dots, une fonction d’agents distincte
Annoncés séparément à DevDay, les Dots sont des agents permanents destinés à prendre en charge des tâches suivies. Chacun dispose de son propre ordinateur dans le cloud et renvoie ses résultats à l’utilisateur pour examen. OpenAI a indiqué que l’accès dépendait de l’offre et du marché : les utilisateurs Pro et Business Premium sont concernés dans les marchés éligibles, tandis que des utilisateurs Enterprise, Edu et Healthcare peuvent accéder à une version bêta si leur administrateur l’active. Les conditions annoncées pour le lancement excluaient les utilisateurs Pro de l’Espace économique européen, de Suisse et du Royaume-Uni ; l’accès Enterprise en bêta était désactivé par défaut. Les autres annonces Codex et API de DevDay sont détaillées dans notre article sur ces outils.