Plutôt que d'empocher ses gains d'efficacité, OpenAI les rend à ses clients. Depuis le 30 juillet, l'entreprise a réduit de 80 % le prix de sa variante d'entrée de gamme GPT-5.6 Luna et de 20 % celui de la version intermédiaire Terra, sans toucher au modèle phare Sol. Un geste commercial qui en dit long sur la guerre des prix qui structure désormais le marché des modèles de langage.
Deux variantes bradées, une inchangée
Le détail des tarifs, facturés par million de tokens (les unités de texte traitées par le modèle), tient en quelques chiffres. Selon le communiqué relayé par InfoWorld, GPT-5.6 Luna passe de 1 dollar à 20 cents en entrée et de 6 à 1,20 dollar en sortie, une division par cinq. Terra, la version intermédiaire, recule plus modestement, de 2,50 à 2 dollars en entrée et de 15 à 12 dollars en sortie.
Le modèle le plus puissant, GPT-5.6 Sol, conserve son tarif mais gagne un nouveau « Fast mode » dans l'API : jusqu'à 2,5 fois plus rapide pour le double du prix standard, en remplacement de l'ancien palier de traitement prioritaire. Autrement dit, OpenAI baisse le prix du volume et facture désormais la vitesse en option sur le haut de gamme.
Quand le modèle optimise son propre coût
L'entreprise justifie ces baisses par des optimisations de sa pile logicielle et matérielle, du GPU jusqu'à l'inférence. Le détail le plus frappant : GPT-5.6 Sol aurait lui-même contribué à réécrire des kernels de production — le code au plus près du matériel — réduisant d'environ 20 % le coût de service des modèles. Un cas concret d'IA mise à contribution pour abaisser ses propres coûts d'exploitation.
Pour les développeurs, l'arithmétique change. Les tâches routinières — classification, extraction, résumé — n'ont jamais eu besoin du modèle phare ; elles basculent désormais vers Luna à un cinquième du prix, OpenAI assurant que cette variante rivalise avec la génération précédente sur les requêtes simples. Les abonnés ChatGPT Plus héritent au passage de quotas élargis.
Reste la logique concurrentielle, la plus parlante. Ces coupes visent frontalement la vague de modèles ouverts, notamment chinois comme GLM-5.2, qui tirent les tarifs vers le bas sur l'entrée de gamme. OpenAI répercute ses économies pour ne pas se laisser déborder par le prix, quitte à comprimer ses marges. Les analystes n'y voient pas un signe de dépenses en berne : selon le paradoxe de Jevons, des coûts unitaires plus faibles élargissent les usages et gonflent la facture globale des entreprises. Une dynamique à contre-courant de l'« IAflation » qui, ailleurs, fait grimper les prix plutôt que les baisser.