GPT-5.6 Sol baisse radicalement ses prix, OpenAI exporte la guerre des prix sur son produit phare

marsbit发布于2026-08-24更新于2026-08-24

文章摘要

OpenAI réduit de manière significative les prix de son modèle phare GPT-5.6 Sol. Les tarifs d'API passent de 5 à 4 dollars par million de tokens en entrée (baisse de 20%) et de 30 à 20 dollars en sortie (baisse de 33%). Cette réduction globale de plus de 20% bénéficie surtout aux gros utilisateurs dont la facture peut diminuer de plus de 27%. Les abonnements Pro, Plus et Business restent au même prix. OpenAI justifie cette baisse par des gains d'efficacité du modèle et de ses infrastructures, créant un cercle vertueux coût-prix-croissance. Ce mouvement est perçu comme une offensive stratégique. Il cible directement Anthropic, dont le modèle concurrent Opus 5 rencontre des critiques et qui est en pleine période de roadshow pour son introduction en bourse. La guerre des prix devient un front clé dans la rivalité entre les géants de l'IA. La manœuvre est aussi une réponse défensive face à la pression des modèles chinois, comme DeepSeek V4 Flash, de plus en plus performants et très bon marché. Parallèlement, OpenAI annonce que Codex, son outil de développement, a dépassé les 20 millions d'utilisateurs actifs hebdomadaires. L'entreprise célèbre ce cap en offrant un crédit supplémentaire aux utilisateurs concernés, tout en avertissant qu'elle surveillera les tentatives de contournement commercial des abonnements.

Les trois prochains mois, les prix des API et des credits (consommation payante à la demande au-delà des quotas inclus dans les plans) seront réduits de plus de 20 %.

La réduction est déjà effective du côté des API, et les credits éligibles pour ChatGPT Work et Codex sont en cours d'attribution progressive.

Cependant, les abonnements Pro, Plus et Business ne baissent pas d'un centime. Les quotas inclus dans ces forfaits n'augmentent pas non plus.

Seule la partie facturée au token est réduite. Autrement dit, plus vos appels API sont importants, plus vous économisez.

Combien peut-on vraiment économiser ?

Le tarif API précédent de Sol était de 5 dollars par million de tokens en entrée et 30 dollars en sortie, le plus cher de la famille GPT-5.6.

Sur la page tarifaire mise à jour, l'entrée coûte 4 dollars et la sortie 20 dollars.

Une baisse de 20% sur l'entrée, c'est cohérent. Mais la sortie passe brutalement de 30 à 20 dollars, soit une réduction d'un tiers.

Donc, l'affirmation officielle d'une baisse « supérieure à 20% » est plutôt modeste. Le coût réellement le plus élevé, celui du token de sortie, chute soudainement de 33 %.

Prenons un exemple : un Agent de grande taille consommant 100 millions de tokens d'entrée et 20 millions de tokens de sortie par mois. Auparavant, cela coûtait 1100 dollars. Maintenant, c'est 800 dollars, soit une baisse globale d'environ 27,3 %.

Le montant exact des économies dépend entièrement de votre ratio entrée/sortie. Pour des tâches lourdes en entrée comme le traitement par lots de documents, les économies tournent autour de 20 %. Pour des scénarios comme Codex où l'on génère massivement du code (sortie prédominante), les économies peuvent dépasser 30 %.

En résumé, plus vous utilisez Sol intensivement comme outil de production, plus vous économisez cette fois-ci.

Le niveau « cache » a également été ajusté : l'entrée en cache passe de 0,5 à 0,4 dollar, l'écriture en cache de 6,25 à 5 dollars. Les tarifs des fenêtres de contexte longues ont aussi baissé : entrée de 10 à 8 dollars, sortie de 45 à 30 dollars.

OpenAI Developers a ensuite posté un message indiquant que cette baisse de prix était rendue possible par l'amélioration de l'efficacité opérationnelle de Sol.

ASI, le duel des titans : le prix devient le deuxième champ de bataille

Lors de la dernière vague de baisses de prix d'OpenAI, Sol était le seul modèle dont le tarif était resté inchangé.

Luna avait vu ses prix réduits de 80%, le principal modèle Terra de 20%. Seul le produit phare Sol maintenait son prix initial, se contentant d'ajouter un mode « Fast » plus rapide sans supplément.

La stratégie d'OpenAI à l'époque était claire : les modèles peu chers assurent le volume, la carte la plus prestigieuse maintient l'image de marque.

Cette fois, c'est Sol lui-même qui passe à l'action. Et à ce moment précis, cela ne semble pas être une coïncidence.

L'influenceur technologique Chubby est catégorique : c'est une manœuvre clairement dirigée contre Anthropic.

La situation actuelle d'Anthropic n'est pas simple. Les retours négatifs sur Opus 5 ne sont pas encore digérés, et les limitations de débit du plan d'abonnement Fable 5 sont vivement critiquées par les utilisateurs.

En baissant massivement ses prix maintenant, OpenAI cherche clairement à attirer les utilisateurs d'Anthropic.

Le journaliste technologique Tae Kim est encore plus direct : OpenAI utilise ici une tactique de guerre commerciale en plein roadshow pour l'IPO d'Anthropic.

Cette affirmation n'est pas infondée.

Le 1er juin de cette année, Anthropic a déposé un dossier S-1 confidentiel auprès de la SEC, lançant officiellement le processus d'introduction en bourse (IPO). Selon plusieurs médias, les banques chargées de l'opération ont commencé mi-juillet à organiser des rencontres entre la direction et les investisseurs potentiels. La fenêtre du roadshow se situe précisément entre août et septembre.

Date cible pour l'introduction : au plus tôt en octobre, au NASDAQ, avec une valorisation visant les 2 000 milliards de dollars.

Lors d'un roadshow, rien n'est plus redouté qu'un coup de la concurrence.

Après les comparaisons de performances, le prix est devenu le deuxième champ de bataille du duel final entre les deux géants de l'ASI.

La décision d'OpenAI de réduire radicalement ses prix n'est pas non plus un coup de tête.

Leurs investissements antérieurs agressifs dans une infrastructure de calcul propre et leur pari sur des architectures de modèles plus efficaces commencent à porter leurs fruits.

Il y a seulement quelques jours, OpenAI annonçait avoir sécurisé environ 8 IT-GW de capacité de calcul dans le parc PORTS-Pike du comté de Pike, Ohio. OpenAI a signé un bail de 20 ans ; NVIDIA fournira exclusivement l'infrastructure de calcul IA.

Précédemment, OpenAI avait également conclu un partenariat de plus de 3000 milliards de dollars avec Oracle, correspondant à une capacité supplémentaire maximale de 4,5 GW sur cinq ans, et signé un accord avec AMD pour le déploiement de 6 GW de GPU.

En avril dernier, OpenAI a confirmé avoir verrouillé une capacité d'infrastructure IA de plus de 10 GW, avec l'objectif de l'étendre à 30 GW d'ici 2030.

Plus l'infrastructure est solide, plus les coûts marginaux sont bas, et plus la marge de manœuvre pour baisser les prix est grande. C'est une boucle vertueuse : amélioration de l'efficacité du modèle → baisse des coûts d'inférence → possibilité de baisser les prix → afflux d'utilisateurs → croissance des revenus → réinvestissement dans l'infrastructure.

On peut dire que cette boucle vertueuse d'OpenAI est en plein décollage. L'entreprise elle-même a déclaré que GPT-5.6 Sol avait participé à l'optimisation de son propre moteur d'inférence de production, réduisant le coût de bout en bout du service de 20 % et améliorant l'efficacité de génération de tokens de plus de 15 %.

Mais au-delà de cette offensive proactive, cette baisse de prix a aussi une dimension défensive.

DeepSeek V4 Flash a été officiellement lancé le 31 juillet, à des prix défiant toute concurrence.

Plus stimulant encore, un modèle mystérieux au nom de code « Ox Alpha » est apparu il y a deux jours. Fenêtre de contexte de 1M, support des entrées texte, image et vidéo, gratuit pendant une semaine.

Aujourd'hui, les modèles open-source chinois sont non seulement peu chers, mais leurs capacités se rapprochent constamment des modèles de pointe.

Ainsi, cette baisse de prix de Sol constitue à la fois une offensive proactive contre Anthropic et une réaction défensive contre les modèles chinois à bas prix.

Codex dépasse les 20 millions

Le même jour, un autre chiffre a été annoncé.

Tibo, responsable de Codex, a déclaré que le nombre d'utilisateurs actifs hebdomadaires de Codex avait dépassé les 20 millions.

Pour célébrer cet événement, l'équipe a attribué à tous les utilisateurs de Codex et ChatGPT Work une remise à zéro unique de leur limite « BANKED ».

Cependant, concernant les retours de la communauté sur une consommation trop rapide des quotas, Tibo a indiqué qu'aucune anomalie n'avait été détectée pour le moment, mais qu'une enquête formelle était lancée et que les résultats seraient communiqués dès qu'ils seraient disponibles.

Il a également tracé une ligne rouge : la pratique consistant à convertir des comptes d'abonnement en trafic API via sub2api pour ensuite les revendre ou les partager entre plusieurs utilisateurs n'est pas prise en charge par l'official. Ce type d'usage sera directement signalé par le système de contrôle des risques.

La voie consistant à diviser un abonnement mensuel pour le vendre à une centaine de personnes est donc bloquée.

En revanche, une utilisation normale via le client officiel, ou des clients open-source comme Pi ou OpenCode, ne pose aucun problème.

Références :

https://x.com/OpenAI/status/2090885187634905500

https://x.com/OpenAI/status/2090885188897460249

https://x.com/kimmonismus/status/2090890956287492564

https://x.com/rohanpaul_ai/status/2090885980849050036

https://x.com/rohanpaul_ai/status/2090891370663989566

https://x.com/thsottiaux/status/2090766694897619318

Cet article provient du compte public WeChat « 新智元 » (New Zhiyuan), auteur : ASI启示录, éditeur : 所罗门 (Salomon)

热门币种推荐

相关问答

QQuels sont les principaux changements annoncés par OpenAI concernant les prix de GPT-5.6 Sol ?

AOpenAI a annoncé une baisse des prix de l'API pour GPT-5.6 Sol, avec une réduction de plus de 20 % sur les prix au token. Les prix par million de tokens d'entrée sont passés de 5 $ à 4 $, et les tokens de sortie de 30 $ à 20 $, soit une baisse d'un tiers pour ces derniers. Les prix pour l'utilisation de la mise en cache et des contextes longs ont également été réduits.

QSelon l'article, pourquoi OpenAI peut-il se permettre de réduire ses prix ?

AOpenAI peut réduire ses prix principalement grâce à l'amélioration de l'efficacité opérationnelle de Sol, qui réduit les coûts de production et d'inférence. De plus, l'entreprise a massivement investi dans des infrastructures de calcul propriétaires et des partenariats à long terme, ce qui diminue ses coûts marginaux et lui donne une marge de manœuvre pour baisser les prix tout en restant compétitive.

QQuel est le contexte concurrentiel évoqué dans l'article pour expliquer cette baisse de prix ?

ALa baisse de prix est interprétée comme une manœuvre concurrentielle dirigée principalement contre Anthropic, qui est en pleine préparation de son introduction en bourse (IPO). En réduisant les coûts de son modèle phare, OpenAI cherche à attirer les utilisateurs d'Anthropic. C'est aussi une réponse défensive face à la montée des modèles chinois à bas coût, comme DeepSeek V4 Flash.

QComment la réduction de prix affecte-t-elle différemment les utilisateurs selon leur type d'utilisation ?

AL'impact de la baisse varie selon le ratio entrée/sortie de l'utilisateur. Les applications à forte consommation de tokens de sortie, comme la génération de code avec Codex, bénéficient des plus grosses économies (plus de 30 %). Les tâches à dominante d'entrée, comme le traitement par lots de documents, voient une réduction d'environ 20 %. Globalement, plus l'utilisation via l'API est intensive, plus les économies sont importantes.

QQuelle autre annonce importante OpenAI a-t-il faite en parallèle de la baisse de prix de Sol ?

ALe même jour, le responsable de Codex, Tibo, a annoncé que la plateforme Codex avait dépassé les 20 millions d'utilisateurs actifs hebdomadaires. Pour célébrer cet événement, l'équipe a réinitialisé le quota 'BANKED' pour tous les utilisateurs de Codex et de ChatGPT Work. Il a également précisé que l'utilisation d'un abonnement pour revendre de l'accès API à plusieurs utilisateurs était interdite et serait détectée par leur système.

你可能也喜欢

最重要的事件即将来临,请注意周五:这可能是美联储今年最重要的事件

美联储主席凯文·沃什本周将在杰克逊霍尔发表其任内最重要的演讲之一。市场与美联储关注的核心问题是:美国通胀高企是源于关税、对伊战争等暂时性冲击,还是因经济需求过于强劲所致?对此的判断将影响美联储未来的利率决策。目前美联储内部存在明显分歧,已有三位官员上月投票支持加息。 在周五的演讲中,投资者将密切关注沃什对经济状况的评估以及可能收紧政策的条件。当前经济前景存在两种可能:一是通胀超目标主要由一系列临时冲击造成,冲击减弱后通胀或自行回落;二是这些事件掩盖了更深层次的经济失衡,需求持续超过供给,通胀难以自行缓解,美联储或需加息。近期通胀数据有所缓和,但战争、新关税及人工智能投资热潮可能带来持续上行压力。 沃什自上任以来显著减少了向市场提供指引,主张央行官员应少说话。但在内部分歧加剧的背景下,其不愿明确表态的沟通风格可能影响其对委员会的领导力。上月会议上有三人反对利率决定,为近十年来最多。 市场走势反映出投资者认为美联储可能短期内容忍较高通胀,但未来或需更大幅度加息。30年期美国国债收益率已升至2007年以来最高水平。沃什认为,若央行不持续指导市场,反而能从金融市场价格变动中获取更多信息。 因此,此次杰克逊霍尔演讲不仅关乎短期利率预期,也关乎沃什领导下的美联储未来政策沟通方式的走向。

cryptonews.ru56分钟前

最重要的事件即将来临,请注意周五:这可能是美联储今年最重要的事件

cryptonews.ru56分钟前

交易

现货

热门文章

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对SOL(SOL)币价的意见。

活动图片