Actualité IA

GPT-5.6 : OpenAI baisse ses prix de 80 %, ce que ça change

L'équipe Neova Publié le 31 juillet 2026 5 min de lecture

OpenAI a baissé le prix de GPT-5.6 le 30 juillet 2026, trois semaines seulement après avoir lancé la famille. Luna, le modèle le plus léger, chute de 80 % : il passe de 7 $ à 1,40 $ le million de tokens. Terra baisse de 20 %, et Sol, le haut de gamme, ne bouge pas d'un centime. Voilà pour la news. Ce que personne ne te dit, c'est la conséquence : des automatisations qui coûtaient trop cher pour tenir dans un budget — trier des milliers de tickets, résumer en masse, faire tourner un agent en boucle — viennent de redevenir rentables. Et si tu paies juste un abonnement ChatGPT ? Alors cette baisse ne change rien pour toi. Elle ne concerne que l'API.

Combien coûte GPT-5.6 après la baisse de prix ?

OpenAI segmente GPT-5.6 en trois modèles, et un seul a vraiment fondu. Voici les prix par million de tokens, avant et après le 30 juillet.

ModèleAvant (entrée / sortie)Après (entrée / sortie)Baisse
Luna1 $ / 6 $0,20 $ / 1,20 $−80 %
Terra2,50 $ / 15 $2 $ / 12 $−20 %
Sol5 $ / 30 $5 $ / 30 $inchangé

*(prix relevés par Generation-NT et Unite.AI)*

Chaque modèle a son terrain. Luna vise le volume : classification, extraction de données, tests automatisés. Terra tient le rôle du modèle « pro », dans la lignée du GPT-5.5 d'hier. Sol reste le modèle de raisonnement complexe — le seul dont le prix n'a pas bougé, et on y revient : ce détail raconte toute l'histoire. À noter aussi, un mode Fast, 2,5× plus rapide pour le double du prix. Utile pour du temps réel, inutile pour du batch de nuit.

Pourquoi OpenAI casse-t-il ses prix maintenant ?

Parce qu'on lui a mis la pression. Les modèles chinois open-weight offrent des performances proches pour une fraction du prix, et ils grignotent tout le marché des usages à gros volume. OpenAI répond là où ça fait mal : le bas et le milieu de gamme.

L'entreprise justifie aussi la baisse par ses propres gains — −20 % de coûts de service, +15 % d'efficacité de génération de tokens (MacG). Elle produit plus pour moins cher, et elle en répercute une partie. Un analyste d'EMARKETER résume la bascule : « la fin du *tokenmaxxing* » — facturer le token cher n'est plus tenable quand le voisin le brade.

Et Sol ? Son prix n'a pas bougé d'un centime. Ce n'est pas un hasard : la guerre se joue sur le volume, pas sur l'intelligence de pointe. Sol reste d'ailleurs plus cher en sortie que Claude Opus 5. Le haut de gamme, lui, ne se brade pas — comme on l'avait vu en comparant Kimi K3 face à Claude.

Qu'est-ce que la baisse débloque pour automatiser ton entreprise ?

C'est ici que la news devient une décision. Un prix qui chute de 80 %, ce n'est pas une ligne de tech news : c'est une ligne de ton devis d'automatisation qui vient de bouger.

Prends une automatisation dont la facture API tournait à 1 000 € par mois sur un modèle de milieu de gamme. Migrée vers Luna, la même charge tombe autour de 200 €. Sur un an, ce sont près de 9 600 € qui restent dans ta trésorerie — et surtout, des fonctionnalités qu'on écartait « trop chères » redeviennent défendables.

Facture API mensuelle d'une automatisation, avant / après Facture API mensuelle d'une automatisation, avant / aprèsAvant~1 000 €Après (migré vers Luna)~200 €
Exemple d'un traitement à gros volume basculé du milieu de gamme vers Luna.

Ce que ça débloque concrètement :

Chez Neova, quand on chiffre un agent vocal pour le service client, une partie du coût par appel vient de là. Et cette partie vient de baisser.

Est-ce que ça change quelque chose si tu paies juste ChatGPT ?

Non. Et c'est important de le dire, parce que la confusion est partout. Cette baisse concerne l'API — l'accès programmatique aux modèles, celui qu'utilisent les développeurs et les automatisations. Ton abonnement ChatGPT, lui, garde son tarif.

« L'IA baisse de 80 % » : faux. Ce qui baisse, c'est le coût de construction d'un produit ou d'un workflow qui appelle le modèle en masse ; en revanche, si tu utilises ChatGPT comme un assistant dans ton navigateur, la nouvelle ne te concerne pas directement. Elle concerne ton prestataire, ou le studio qui bâtit ton outil. Dit autrement : la baisse profite à celui qui construit, pas à celui qui consomme.

Quelle leçon en tirer pour ton produit ?

Le prix de Luna a fondu de 80 % en trois semaines. Voilà le vrai enseignement pour qui construit : le coût variable de l'IA est une cible mouvante, pas une donnée stable.

Architecturer une application autour d'un seul modèle et d'un seul prix, c'est se peindre dans un coin. Ce prix ne tiendra pas. Le bon réflexe : pouvoir changer de moteur sans réécrire l'app — brancher Luna aujourd'hui, un modèle chinois demain, Sol pour les tâches qui l'exigent vraiment. Quand on livre, on isole toujours l'appel au modèle derrière une couche qui se remplace en une journée. Une baisse de prix devient alors une bonne surprise, pas un chantier.

Tu as une automatisation ou un produit à construire, et tu veux qu'il profite de ces baisses au lieu de les subir ? Regarde ce que coûte une application sur mesure, puis parle-nous de ton projet : on chiffre, on branche le bon modèle, on livre.

Questions fréquentes

Quel est le nouveau prix de GPT-5.6 Luna ?

Depuis le 30 juillet 2026, Luna coûte 0,20 $ en entrée et 1,20 $ en sortie par million de tokens, soit environ 1,40 $ au total contre 7 $ avant. C'est une baisse de 80 %.

Tous les modèles GPT-5.6 ont-ils baissé ?

Non. Luna baisse de 80 % et Terra de 20 %, mais Sol, le modèle de raisonnement le plus avancé, garde son prix : 5 $ en entrée et 30 $ en sortie par million de tokens. La baisse cible le volume, pas le haut de gamme.

La baisse de prix concerne-t-elle mon abonnement ChatGPT ?

Non. Elle ne touche que l'API, l'accès utilisé par les développeurs et les automatisations. Un abonnement ChatGPT garde exactement le même tarif.

Pourquoi OpenAI baisse-t-il ses prix maintenant ?

Sous la pression des modèles chinois open-weight, très bon marché sur les gros volumes. OpenAI répercute aussi ses propres gains d'efficacité : −20 % de coûts de service et +15 % d'efficacité de génération de tokens.

Comment profiter concrètement de cette baisse pour mon entreprise ?

En migrant les tâches à gros volume — classification, extraction, résumé — vers Luna, et en concevant l'app pour changer de modèle facilement. Une automatisation qui coûtait 1 000 € d'API par mois peut tomber autour de 200 €.

Passer à l'action

Une idée d'app ? On la construit et on la livre.

Neova est un studio de développement. Nous concevons votre application sur mesure et nous engageons sur le résultat. Diagnostic gratuit, sans engagement.

Réserver mon diagnostic gratuit →