OpenAI a annoncé GPT-6 Sol et GPT-6 Luna le 22 septembre 2026, avec des tarifs d’API plus bas que les tarifs promotionnels indiqués pour GPT-5.6. L’entreprise a aussi précisé les premiers canaux d’accès et publié des résultats d’évaluation, dont la portée dépend des tests concernés.
OpenAI présente GPT-6 Sol comme un modèle destiné aux tâches professionnelles complexes, notamment au développement logiciel et aux flux de travail avec agents. GPT-6 Luna vise plutôt les tâches à grande échelle, à moindre coût. Les deux modèles ont été entraînés selon des méthodes similaires à celles de GPT-6 Astra, d’après OpenAI.
Les accès indiqués au lancement
Au lancement, OpenAI proposait GPT-6 Sol et GPT-6 Luna dans ChatGPT Work et Codex aux utilisateurs des forfaits Plus, Pro, Business, Enterprise et Edu, ainsi que via l’API. Les utilisateurs de Free et Go pouvaient accéder à Luna dans l’application de bureau. OpenAI précisait que les deux modèles n’étaient pas encore disponibles dans ChatGPT classique à cette date.
Les tarifs d’API distinguent entrée et sortie
OpenAI a fixé les tarifs suivants en dollars américains par million de tokens :
| Modèle | Entrée (USD par million de tokens) | Sortie (USD par million de tokens) |
| GPT-6 Sol | 2 $ | 10 $ |
| GPT-6 Luna | 0,10 $ | 0,50 $ |
Par rapport aux tarifs promotionnels indiqués pour GPT-5.6 Sol, les prix de GPT-6 Sol passent de 4 $ à 2 $ pour l’entrée et de 20 $ à 10 $ pour la sortie, soit une baisse de 50 % dans les deux cas. Pour GPT-6 Luna, l’entrée passe de 0,20 $ à 0,10 $, soit 50 % de moins, tandis que la sortie baisse de 1,20 $ à 0,50 $, soit environ 58,3 %.
OpenAI indique également une remise de 90 % sur les lectures de tokens d’entrée mises en cache. Les développeurs peuvent modifier le niveau de raisonnement ou la disponibilité des outils tout en conservant le contexte antérieur pour réutiliser le cache. Ces tarifs à l’usage de l’API sont distincts des limites d’utilisation des forfaits ChatGPT.
Les évaluations d’OpenAI et les tests de programmation
Sur DeepSWE v1.1, une évaluation de tâches de développement logiciel, OpenAI rapporte un score de 68,8 % pour GPT-6 Sol et de 66,6 % pour GPT-6 Luna, tous deux au niveau d’effort maximal.
OpenAI affirme aussi que GPT-6 Sol a commis environ deux fois moins d’erreurs que GPT-5.6 Sol dans son évaluation interne de factualité. Celle-ci s’appuyait sur des conversations désidentifiées où des utilisateurs avaient précédemment signalé des erreurs factuelles. OpenAI précise que cet échantillon ne représente pas l’usage habituel.
Une démonstration vidéo compare les résultats de GPT-6 Sol, GPT-6 Luna et Claude Opus 5.5 sur trois tâches : un site web, un tableau de bord interactif de suivi des tempêtes et un jeu en 3D. Dans ces exercices, Luna apparaît comme l’option la plus rapide et la moins coûteuse, Sol se situe entre les deux, et Claude Opus 5.5 produit le résultat le plus abouti pour le jeu présenté.
Un autre test vidéo, fondé sur 24 prompts et 12 configurations, juge la qualité de code de GPT-6 Sol inférieure à celle de GPT-5.6 Sol dans les configurations évaluées, tout en relevant un coût plus faible et une exécution plus rapide. Ces exercices reposent sur des tâches et des réglages différents de ceux des évaluations d’OpenAI.