Actualité IA
GPT-5.6 : OpenAI baisse ses prix de 80 %, ce que ça change
OpenAI a baissé le prix de GPT-5.6 le 30 juillet 2026, trois semaines seulement après avoir lancé la famille. Luna, le modèle le plus léger, chute de 80 % : il passe de 7 $ à 1,40 $ le million de tokens. Terra baisse de 20 %, et Sol, le haut de gamme, ne bouge pas d'un centime. Voilà pour la news. Ce que personne ne te dit, c'est la conséquence : des automatisations qui coûtaient trop cher pour tenir dans un budget — trier des milliers de tickets, résumer en masse, faire tourner un agent en boucle — viennent de redevenir rentables. Et si tu paies juste un abonnement ChatGPT ? Alors cette baisse ne change rien pour toi. Elle ne concerne que l'API.
Combien coûte GPT-5.6 après la baisse de prix ?
OpenAI segmente GPT-5.6 en trois modèles, et un seul a vraiment fondu. Voici les prix par million de tokens, avant et après le 30 juillet.
| Modèle | Avant (entrée / sortie) | Après (entrée / sortie) | Baisse |
|---|---|---|---|
| Luna | 1 $ / 6 $ | 0,20 $ / 1,20 $ | −80 % |
| Terra | 2,50 $ / 15 $ | 2 $ / 12 $ | −20 % |
| Sol | 5 $ / 30 $ | 5 $ / 30 $ | inchangé |
*(prix relevés par Generation-NT et Unite.AI)*
Chaque modèle a son terrain. Luna vise le volume : classification, extraction de données, tests automatisés. Terra tient le rôle du modèle « pro », dans la lignée du GPT-5.5 d'hier. Sol reste le modèle de raisonnement complexe — le seul dont le prix n'a pas bougé, et on y revient : ce détail raconte toute l'histoire. À noter aussi, un mode Fast, 2,5× plus rapide pour le double du prix. Utile pour du temps réel, inutile pour du batch de nuit.
Pourquoi OpenAI casse-t-il ses prix maintenant ?
Parce qu'on lui a mis la pression. Les modèles chinois open-weight offrent des performances proches pour une fraction du prix, et ils grignotent tout le marché des usages à gros volume. OpenAI répond là où ça fait mal : le bas et le milieu de gamme.
L'entreprise justifie aussi la baisse par ses propres gains — −20 % de coûts de service, +15 % d'efficacité de génération de tokens (MacG). Elle produit plus pour moins cher, et elle en répercute une partie. Un analyste d'EMARKETER résume la bascule : « la fin du *tokenmaxxing* » — facturer le token cher n'est plus tenable quand le voisin le brade.
Et Sol ? Son prix n'a pas bougé d'un centime. Ce n'est pas un hasard : la guerre se joue sur le volume, pas sur l'intelligence de pointe. Sol reste d'ailleurs plus cher en sortie que Claude Opus 5. Le haut de gamme, lui, ne se brade pas — comme on l'avait vu en comparant Kimi K3 face à Claude.
Qu'est-ce que la baisse débloque pour automatiser ton entreprise ?
C'est ici que la news devient une décision. Un prix qui chute de 80 %, ce n'est pas une ligne de tech news : c'est une ligne de ton devis d'automatisation qui vient de bouger.
Prends une automatisation dont la facture API tournait à 1 000 € par mois sur un modèle de milieu de gamme. Migrée vers Luna, la même charge tombe autour de 200 €. Sur un an, ce sont près de 9 600 € qui restent dans ta trésorerie — et surtout, des fonctionnalités qu'on écartait « trop chères » redeviennent défendables.
Ce que ça débloque concrètement :
- le tri de milliers de tickets en temps réel,
- le résumé de documents en masse,
- un agent qui itère en boucle sans exploser le budget.
Chez Neova, quand on chiffre un agent vocal pour le service client, une partie du coût par appel vient de là. Et cette partie vient de baisser.
Est-ce que ça change quelque chose si tu paies juste ChatGPT ?
Non. Et c'est important de le dire, parce que la confusion est partout. Cette baisse concerne l'API — l'accès programmatique aux modèles, celui qu'utilisent les développeurs et les automatisations. Ton abonnement ChatGPT, lui, garde son tarif.
« L'IA baisse de 80 % » : faux. Ce qui baisse, c'est le coût de construction d'un produit ou d'un workflow qui appelle le modèle en masse ; en revanche, si tu utilises ChatGPT comme un assistant dans ton navigateur, la nouvelle ne te concerne pas directement. Elle concerne ton prestataire, ou le studio qui bâtit ton outil. Dit autrement : la baisse profite à celui qui construit, pas à celui qui consomme.
Quelle leçon en tirer pour ton produit ?
Le prix de Luna a fondu de 80 % en trois semaines. Voilà le vrai enseignement pour qui construit : le coût variable de l'IA est une cible mouvante, pas une donnée stable.
Architecturer une application autour d'un seul modèle et d'un seul prix, c'est se peindre dans un coin. Ce prix ne tiendra pas. Le bon réflexe : pouvoir changer de moteur sans réécrire l'app — brancher Luna aujourd'hui, un modèle chinois demain, Sol pour les tâches qui l'exigent vraiment. Quand on livre, on isole toujours l'appel au modèle derrière une couche qui se remplace en une journée. Une baisse de prix devient alors une bonne surprise, pas un chantier.
Tu as une automatisation ou un produit à construire, et tu veux qu'il profite de ces baisses au lieu de les subir ? Regarde ce que coûte une application sur mesure, puis parle-nous de ton projet : on chiffre, on branche le bon modèle, on livre.