OpenAI a lancé GPT-6 Sol et GPT-6 Luna ce mardi 22 septembre, près de trois semaines après GPT-6 Astra, et réussit à diviser par deux les tarifs de son API par rapport à la génération GPT-5.6. Les deux modèles arrivent dans ChatGPT, dans Codex et sur l'API sous les identifiants gpt-6-sol et gpt-6-luna. L'annonce est tombée environ 90 minutes après celle de Claude Opus 5.5 chez Anthropic, qui misait lui aussi sur la baisse des coûts.
GPT-6 Sol passe à 2 dollars le million de tokens en entrée

Sur l'API, GPT-6 Sol coûte dorénavant 2 dollars par million de tokens en entrée et 10 dollars en sortie, contre 4 et 20 dollars pour GPT-5.6 Sol. Luna descend à 0,10 dollar en entrée et 0,50 en sortie, alors que GPT-5.6 Luna était facturé 0,20 et 1,20 dollar depuis la baisse de prix du 30 juillet. OpenAI attribue cette réduction à des progrès sur le cache et l'inférence, précise enfin que ces tarifs sont définitifs. La lecture des tokens d'entrée déjà mis en cache profite en outre d'une remise de 90 %. Sol se place ainsi deux fois sous Claude Opus 5.5, facturé 4 et 20 dollars, tandis que GPT-6 Astra reste deux fois et demie au-dessus du haut de gamme d'Anthropic.
OpenAI destine évidemment Sol aux tâches complexes, comme le code et les agents, tandis que Luna aux « tâches à fort volume avec un objectif clair », du résumé de documents à l'extraction d'informations en passant par les questions rapides. La gamme GPT-5.6 comptait trois modèles, Sol, Terra et Luna, alors que les annonces du 22 septembre ne mentionnent aucun Terra. La génération GPT-6 s'organise donc pour l'instant en trois strats, avec Astra au sommet, Sol pour le travail courant et Luna pour le volume.
GPT-6 Sol fait deux fois moins d'erreurs que GPT-5.6 Sol, selon OpenAI
OpenAI affirme que GPT-6 Sol commet environ deux fois moins d'erreurs que son prédécesseur sur ses évaluations de factualité, que Luna, poussé à son niveau d'effort le plus élevé, égale GPT-5.6 Sol pour environ un centième de son coût. Sur DeepSWE v1.1, qui mesure l'ingénierie logicielle, Sol obtient 68,8 % et Luna 66,6 %, contre 74,1 % pour Astra.

L'entreprise met aussi en avant un duel sur OSWorld 2.0, consacré à l'utilisation d'un ordinateur, où Sol en effort « xhigh » atteint 60,5 %, contre 60,3 % pour Claude Opus 5 en effort « medium », pour un coût par tâche inférieur d'environ 80 %. La comparaison oppose deux niveaux d'effort différents et vient d'OpenAI. Comme pour Opus 5.5, on attendra des tests indépendants avant de départager les deux laboratoires.
Luna arrive sur les comptes gratuits de ChatGPT, Sol reste réservé aux abonnés
Dans ChatGPT, Sol et Luna se déploient depuis le 22 septembre dans le mode Work et dans Codex pour les abonnés Plus, Pro, Business, Enterprise et Edu, mais pas encore dans le mode Chat. Les comptes Free et Go ont accès à Luna dans l'application de bureau. GitHub les a intégrés à Copilot le même jour, Luna dès l'offre Pro et Sol à partir de Pro+.
GPT-6 Astra, sorti le 3 septembre, reste le haut de gamme à 10 dollars

Sol et Luna complètent GPT-6 Astra, lancé le 3 septembre auprès d'organisations sélectionnées, puis ouvert aux abonnés Plus, Pro, Business et Enterprise dans les jours suivants. Facturé 10 dollars par million de tokens en entrée et 50 en sortie, Astra obtient 72,6 % sur OSWorld 2.0 et 97,6 % sur FrontierMath Tier 4, d'après OpenAI.
Il s'agit du premier modèle de l'entreprise classé au niveau « Critical » en cybersécurité dans son Preparedness Framework, sa version grand public refuse certaines requêtes dans ce domaine, ses capacités avancées restant réservées à des testeurs.
Selon Aidan Clark, vice-président de la recherche d'OpenAI, Astra est le premier modèle de l'entreprise pré-entraîné sur plus de 100 000 GPU, dans le site Stargate du Texas. Sol et Luna reprennent les méthodes mises au point pour lui.
