Les trois prochains mois, les prix des API et des credits (consommation payante à la demande au-delà des quotas inclus dans les plans) seront réduits de plus de 20 %.
La réduction est déjà effective du côté des API, et les credits éligibles pour ChatGPT Work et Codex sont en cours d'attribution progressive.

Cependant, les abonnements Pro, Plus et Business ne baissent pas d'un centime. Les quotas inclus dans ces forfaits n'augmentent pas non plus.
Seule la partie facturée au token est réduite. Autrement dit, plus vos appels API sont importants, plus vous économisez.
Combien peut-on vraiment économiser ?
Le tarif API précédent de Sol était de 5 dollars par million de tokens en entrée et 30 dollars en sortie, le plus cher de la famille GPT-5.6.
Sur la page tarifaire mise à jour, l'entrée coûte 4 dollars et la sortie 20 dollars.
Une baisse de 20% sur l'entrée, c'est cohérent. Mais la sortie passe brutalement de 30 à 20 dollars, soit une réduction d'un tiers.

Donc, l'affirmation officielle d'une baisse « supérieure à 20% » est plutôt modeste. Le coût réellement le plus élevé, celui du token de sortie, chute soudainement de 33 %.
Prenons un exemple : un Agent de grande taille consommant 100 millions de tokens d'entrée et 20 millions de tokens de sortie par mois. Auparavant, cela coûtait 1100 dollars. Maintenant, c'est 800 dollars, soit une baisse globale d'environ 27,3 %.
Le montant exact des économies dépend entièrement de votre ratio entrée/sortie. Pour des tâches lourdes en entrée comme le traitement par lots de documents, les économies tournent autour de 20 %. Pour des scénarios comme Codex où l'on génère massivement du code (sortie prédominante), les économies peuvent dépasser 30 %.

En résumé, plus vous utilisez Sol intensivement comme outil de production, plus vous économisez cette fois-ci.
Le niveau « cache » a également été ajusté : l'entrée en cache passe de 0,5 à 0,4 dollar, l'écriture en cache de 6,25 à 5 dollars. Les tarifs des fenêtres de contexte longues ont aussi baissé : entrée de 10 à 8 dollars, sortie de 45 à 30 dollars.

OpenAI Developers a ensuite posté un message indiquant que cette baisse de prix était rendue possible par l'amélioration de l'efficacité opérationnelle de Sol.

ASI, le duel des titans : le prix devient le deuxième champ de bataille
Lors de la dernière vague de baisses de prix d'OpenAI, Sol était le seul modèle dont le tarif était resté inchangé.
Luna avait vu ses prix réduits de 80%, le principal modèle Terra de 20%. Seul le produit phare Sol maintenait son prix initial, se contentant d'ajouter un mode « Fast » plus rapide sans supplément.
La stratégie d'OpenAI à l'époque était claire : les modèles peu chers assurent le volume, la carte la plus prestigieuse maintient l'image de marque.
Cette fois, c'est Sol lui-même qui passe à l'action. Et à ce moment précis, cela ne semble pas être une coïncidence.
L'influenceur technologique Chubby est catégorique : c'est une manœuvre clairement dirigée contre Anthropic.
La situation actuelle d'Anthropic n'est pas simple. Les retours négatifs sur Opus 5 ne sont pas encore digérés, et les limitations de débit du plan d'abonnement Fable 5 sont vivement critiquées par les utilisateurs.
En baissant massivement ses prix maintenant, OpenAI cherche clairement à attirer les utilisateurs d'Anthropic.
Le journaliste technologique Tae Kim est encore plus direct : OpenAI utilise ici une tactique de guerre commerciale en plein roadshow pour l'IPO d'Anthropic.

Cette affirmation n'est pas infondée.
Le 1er juin de cette année, Anthropic a déposé un dossier S-1 confidentiel auprès de la SEC, lançant officiellement le processus d'introduction en bourse (IPO). Selon plusieurs médias, les banques chargées de l'opération ont commencé mi-juillet à organiser des rencontres entre la direction et les investisseurs potentiels. La fenêtre du roadshow se situe précisément entre août et septembre.
Date cible pour l'introduction : au plus tôt en octobre, au NASDAQ, avec une valorisation visant les 2 000 milliards de dollars.
Lors d'un roadshow, rien n'est plus redouté qu'un coup de la concurrence.
Après les comparaisons de performances, le prix est devenu le deuxième champ de bataille du duel final entre les deux géants de l'ASI.
La décision d'OpenAI de réduire radicalement ses prix n'est pas non plus un coup de tête.
Leurs investissements antérieurs agressifs dans une infrastructure de calcul propre et leur pari sur des architectures de modèles plus efficaces commencent à porter leurs fruits.
Il y a seulement quelques jours, OpenAI annonçait avoir sécurisé environ 8 IT-GW de capacité de calcul dans le parc PORTS-Pike du comté de Pike, Ohio. OpenAI a signé un bail de 20 ans ; NVIDIA fournira exclusivement l'infrastructure de calcul IA.
Précédemment, OpenAI avait également conclu un partenariat de plus de 3000 milliards de dollars avec Oracle, correspondant à une capacité supplémentaire maximale de 4,5 GW sur cinq ans, et signé un accord avec AMD pour le déploiement de 6 GW de GPU.
En avril dernier, OpenAI a confirmé avoir verrouillé une capacité d'infrastructure IA de plus de 10 GW, avec l'objectif de l'étendre à 30 GW d'ici 2030.
Plus l'infrastructure est solide, plus les coûts marginaux sont bas, et plus la marge de manœuvre pour baisser les prix est grande. C'est une boucle vertueuse : amélioration de l'efficacité du modèle → baisse des coûts d'inférence → possibilité de baisser les prix → afflux d'utilisateurs → croissance des revenus → réinvestissement dans l'infrastructure.

On peut dire que cette boucle vertueuse d'OpenAI est en plein décollage. L'entreprise elle-même a déclaré que GPT-5.6 Sol avait participé à l'optimisation de son propre moteur d'inférence de production, réduisant le coût de bout en bout du service de 20 % et améliorant l'efficacité de génération de tokens de plus de 15 %.
Mais au-delà de cette offensive proactive, cette baisse de prix a aussi une dimension défensive.
DeepSeek V4 Flash a été officiellement lancé le 31 juillet, à des prix défiant toute concurrence.
Plus stimulant encore, un modèle mystérieux au nom de code « Ox Alpha » est apparu il y a deux jours. Fenêtre de contexte de 1M, support des entrées texte, image et vidéo, gratuit pendant une semaine.
Aujourd'hui, les modèles open-source chinois sont non seulement peu chers, mais leurs capacités se rapprochent constamment des modèles de pointe.
Ainsi, cette baisse de prix de Sol constitue à la fois une offensive proactive contre Anthropic et une réaction défensive contre les modèles chinois à bas prix.
Codex dépasse les 20 millions
Le même jour, un autre chiffre a été annoncé.
Tibo, responsable de Codex, a déclaré que le nombre d'utilisateurs actifs hebdomadaires de Codex avait dépassé les 20 millions.

Pour célébrer cet événement, l'équipe a attribué à tous les utilisateurs de Codex et ChatGPT Work une remise à zéro unique de leur limite « BANKED ».
Cependant, concernant les retours de la communauté sur une consommation trop rapide des quotas, Tibo a indiqué qu'aucune anomalie n'avait été détectée pour le moment, mais qu'une enquête formelle était lancée et que les résultats seraient communiqués dès qu'ils seraient disponibles.
Il a également tracé une ligne rouge : la pratique consistant à convertir des comptes d'abonnement en trafic API via sub2api pour ensuite les revendre ou les partager entre plusieurs utilisateurs n'est pas prise en charge par l'official. Ce type d'usage sera directement signalé par le système de contrôle des risques.
La voie consistant à diviser un abonnement mensuel pour le vendre à une centaine de personnes est donc bloquée.
En revanche, une utilisation normale via le client officiel, ou des clients open-source comme Pi ou OpenCode, ne pose aucun problème.
Références :
https://x.com/OpenAI/status/2090885187634905500
https://x.com/OpenAI/status/2090885188897460249
https://x.com/kimmonismus/status/2090890956287492564
https://x.com/rohanpaul_ai/status/2090885980849050036
https://x.com/rohanpaul_ai/status/2090891370663989566
https://x.com/thsottiaux/status/2090766694897619318
Cet article provient du compte public WeChat « 新智元 » (New Zhiyuan), auteur : ASI启示录, éditeur : 所罗门 (Salomon)







