OpenAI vient d'annoncer une nouvelle baisse des tarifs API de GPT-5.6 Sol, son modèle le plus avancé. Le prix passe de 5 $ à 4 $ par million de tokens en entrée, et de 30 $ à 20 $ par million de tokens en sortie. Une réduction de 20 % côté input et de 33 % côté output, valable au moins jusqu'au 21 novembre 2026.
💵 Ce qui change concrètement sur la facture
Le détail des nouveaux tarifs API de GPT-5.6 Sol :
- Tokens en entrée (input) : 5 $ → 4 $ par million de tokens
- Tokens en sortie (output) : 30 $ → 20 $ par million de tokens
- Tokens en cache : 0,50 $ → 0,40 $ par million de tokens
C'est la baisse sur les tokens de sortie qui pèse le plus dans l'équation. Pour les usages qui génèrent de longues réponses, comme la rédaction de rapports, les résumés ou les analyses détaillées, c'est justement ce poste qui gonfle le plus vite la facture. Une réduction d'un tiers sur ce point change réellement l'équilibre économique de ces workflows.
🌿 Pourquoi OpenAI baisse ses prix maintenant
Cette annonce n'arrive pas isolément. Fin juillet déjà, OpenAI avait réduit les tarifs de Luna de 80 % et ceux de Terra de 20 %, les deux autres modèles de la famille GPT-5.6. En un mois, ce sont donc trois ajustements tarifaires sur la même génération de modèles.
Le contexte est celui d'une concurrence frontale sur les prix des modèles de pointe. Avec ce nouveau tarif, Sol se positionne à 4 $ / 20 $ par million de tokens, contre 5 $ / 25 $ pour Claude Opus 5 d'Anthropic. Cette pression tarifaire touche désormais aussi bien les laboratoires américains que les modèles chinois à bas coût, qui tirent l'ensemble du marché vers le bas.
Rendre l'intelligence avancée plus abordable et plus accessible reste au cœur de la stratégie affichée par OpenAI, à mesure que la concurrence sur les modèles frontières s'intensifie.
📋 Ce que couvre la baisse de prix
Le nouveau tarif ne se limite pas aux requêtes classiques. Il s'applique aussi :
- Au mode Fast, pour les réponses accélérées
- Aux requêtes en contexte long
- Au traitement en Batch et en mode Flex
Une nuance à connaître : au-delà de 272 000 tokens en entrée, le tarif applicable double pour l'input et passe à 1,5 fois le tarif standard pour l'output, sur l'intégralité de la requête. Les écritures en cache, elles, restent facturées à 1,25 fois le tarif de l'input non mis en cache. Pour les projets qui manipulent de très gros volumes de contexte, ces seuils méritent d'être surveillés de près avant d'estimer les économies réelles.
🛠️ Ce que ça change concrètement pour les développeurs
Concrètement, cette baisse ouvre de la marge de manœuvre sur plusieurs types de projets :
Agents de code autonomes
Des workflows qui enchaînent de nombreux appels et génèrent beaucoup de texte deviennent plus soutenables sur la durée.
Analyses complexes
Les traitements multi-étapes, qui produisent des rapports détaillés, profitent directement de la baisse sur l'output.
Migration de workloads
Il devient plus réaliste de faire basculer certaines tâches d'un modèle moins cher mais moins performant vers Sol, si le gain de qualité le justifie.
Un point de vigilance à garder en tête : rien ne garantit ce qui se passera après le 21 novembre. Le tarif promotionnel pourrait redevenir le tarif standard à 5 $ / 30 $, ou être prolongé. OpenAI n'a pas encore tranché publiquement sur ce point, donc mieux vaut ne pas ancrer un budget prévisionnel sur cette hypothèse sans vérifier la page tarifaire au moment venu.
Pour aller plus loin, découvrez les outils IA gratuits de Google et votre site internet comme outil de travail.