Price Cut Just 20%, Bill Drops 80%: GPT-5.6 Steps into Claude's Turf to Recalculate the Programming Bill

marsbitPublié le 2026-08-28Dernière mise à jour le 2026-08-28

Résumé

While the official price for GPT-5.6 Terra only dropped by 20%, developer costs for successful coding tasks have reportedly been slashed by 82% when using the model within AWS's Kiro platform. This dramatic reduction stems not from model price cuts alone, but from significant efficiency gains within the integrated "agent + model" system. By optimizing the workflow—reducing unnecessary tokens, tool calls, and failed attempts—the collaboration between OpenAI and AWS has minimized costly computational detours. Key to this efficiency is Kiro's "spec-driven" approach, which refines vague user requests into clear technical specifications before the model begins coding, preventing expensive misunderstandings and rewrites. Benchmark results highlight that the choice of AI agent framework significantly impacts cost, with different frameworks yielding vastly different bills for similar performance scores. The integration marks OpenAI's entry into Kiro, a platform previously dominated by Anthropic's Claude. AWS now offers developers a choice between GPT-5.6 models (Sol, Terra, Luna) and Claude, fostering direct competition. This shift reframes the model selection question from "cost per million tokens" to "total cost to complete the task," emphasizing end-to-end efficiency over raw benchmark scores.

For the same model, the official price is reduced by only 20%, but your bill shrinks by eighty percent.

On August 24th, OpenAI announced test results conducted jointly with AWS:

On Terminal-Bench 2.1, the cost for GPT-5.6 Terra to successfully complete a task in Kiro was reduced by approximately 82%.

Kiro is AWS's intelligent software developer agent platform, covering IDE, CLI, and Web.

The three siblings of the GPT-5.6 family—Sol, Terra, and Luna—have been running inside for over a month.

This 82% reduction is not the official price cut.

Terra's last price adjustment was on July 30th, by 20%.

OpenAI price adjustment announcement on July 30th, Terra lowered by 20%.

The unit price dropped only 20%, but the bill could be slashed by eighty percent.

The source of the remaining sixty percentage points saved in the middle is what truly deserves our attention.

GPT-5.6 landed on Kiro in July this year.

First, on the 13th, AWS announced that GPT-5.6 Sol, Terra, and Luna were officially available on Amazon Bedrock.

The very next day, Kiro published a blog post announcing the availability of the three models on IDE, CLI, and Web.

This marked the first time OpenAI models entered Kiro, coinciding with Kiro's one-year public preview anniversary.

First, put the models on the shelf, then put them to work. Over a month later, OpenAI came back with its homework:

The two companies jointly tuned the Kiro environment and OpenAI models, reducing the cost for Terra to complete a successful task by about 82%.

What's Saved

Is the Money Spent on Detours

During the price adjustment on July 30th, Terra was reduced by 20%, but in Kiro's tests, the cost per task dropped by 82%.

Where did the extra sixty percent savings come from?

The directions are limited:

The model generated fewer tokens, the number of back-and-forth tool calls decreased, and there were fewer retries and detours after failures.

Therefore, the large chunk saved is not the cost per call, but the cost of those calls that would have been wasted.

The logic is simple: if an AI agent fails a task once, the bill is still charged. If it chooses the wrong path, goes off-track three times, and then circles back, those tokens are also billed.

In real development, money often leaks out this way.

OpenAI has pointed out the same logic in its official blog: efficiency comes from three layers:

The agent framework that initiates requests and organizes context, the orchestration system that schedules requests in the middle, and finally the model itself running on GPUs.

OpenAI breaks down the sources of GPT-5.6's efficiency: requests start from the agent framework, are scheduled by the orchestration system, and finally run the model on GPU, saving at every layer.

Savings can also come from model specialization.

OpenAI also gave an example of usage: a coding workflow can first use Sol to think through the problem and define the plan, then switch to Luna to implement the well-defined changes, write tests, and run evaluations.

Same pipeline, different levels of intelligence allocated to different stages.

The Model Accounts for Only Half the Bill

Change the Framework, Change the Price

The Terminal-Bench 2.1 benchmark doesn't ask the model to answer questions alone.

It places the model in a terminal environment with a vague objective, letting it plan its own path, call tools, write scripts, handle errors, and iterate repeatedly.

So the resulting score is the performance of the "agent + model" combination.

The public Terminal-Bench 2.1 leaderboard, with cost added to the right of accuracy. (Source: Terminal-Bench)

The four lines of numbers in the leaderboard illustrate the point best:

Claude Code with Fable 5, 83.8%, $552.67;

Codex with GPT-5.5, 83.1%, $2059.19;

Codex with GPT-5.6 Terra, 78.4%, $421.15;

Codex with GPT-5.6 Luna, 75.7%, $241.45.

The scores in the first two rows differ by only 0.7 percentage points, but the bills differ by nearly 4 times.

The same model, placed into different frameworks with different context organization and tool strategies, results in completely different prices.

According to data provided by Kiro, Terra scored 77.4 on the Coding Agent Index, only slightly higher than Claude Fable 5's 77.2.

Its selling point isn't the score, but the price corresponding to that score.

This is also where Kiro's spec-driven focus lies. The core approach is simple: don't start writing code immediately.

It first breaks down the user's vague goal into a formal requirements document, technical design, and executable task list before handing it over to the model.

Thus, the model receives not a vague statement, but a well-defined job.

Those familiar with Agents will immediately realize that this step saves the most expensive part of the expenditure.

Models going off-track, reworking, and starting over often burn more tokens than doing the actual work.

Kiro also includes two checkpoints in the process: pause for human review before code is actually modified; and automatically run a round of tests after the work is done to verify correctness.

Each rework stopped by these two checkpoints saves real money.

Claude in Amazon's Territory

GPT Takes Half

A year ago, Kiro was just a spec-driven IDE, and the model selector was Anthropic's domain.

A year later, AWS placed three tiers of OpenAI models into its own developer agent platform at once.

Sol, Terra, Luna listed alongside Claude in the same dropdown menu—a scene hard to imagine a year ago.

Although GPT-5.6 is "fully deployed" this time, it's not "fully open."

The three models are released progressively and experimentally, targeting Pro, Pro+, Pro Max, and Power users. Availability is limited to two regions: US North Virginia and Europe Frankfurt, supporting cross-region inference.

There's also a point many find hard to adjust to: these models in Kiro operate with a hidden chain-of-thought; you can't see its reasoning steps, only the final result.

Those accustomed to watching the Agent reason step-by-step feel like throwing work into an opaque box.

The official statement is that this is expected behavior and doesn't affect output quality.

The three model tiers are clearly priced in Kiro.

When they first launched on July 14th, the same task cost 2.4x for Sol, 1.2x for Terra, and 0.6x for Luna.

After OpenAI's price reduction on July 30th took effect, Kiro followed the next day: Luna was slashed from 0.6x all the way to 0.1x, Terra reduced from 1.2x to 1.0x, with only Sol unchanged.

AWS's stance is clear: a development platform cannot be tied to just one model.

In the same selector, two cutting-edge models are beginning to undercut each other on price.

The evaluation criteria for models is also changing: a higher score no longer guarantees a win; spending less can also win.

For developers, the question used to be "How much per million tokens for this model?" Now it must be "How much will it actually cost me to get this thing done?"

References:

https://x.com/OpenAIDevs/status/2091966982015103068

https://openai.com/index/gpt-5-6-in-kiro/

This article is from WeChat Official Account "AI_era" (ID: AI_era), author: ASI Revelation, editor: Yuanyu

Cryptos en tendance

Questions liées

QAccording to the article, the cost of completing a successful task with GPT-5.6 Terra in Kiro decreased by 82%, but the official price reduction was only 20%. Where did the additional 60% cost saving come from?

AThe additional 60% cost saving primarily came from optimizations that reduced wasted token usage. These savings were achieved by minimizing the number of tokens generated, reducing unnecessary tool calls, and decreasing the frequency of failed attempts and inefficient detours. Essentially, the savings came from avoiding the costs associated with the AI agent making mistakes, choosing wrong paths, or having to backtrack, all of which would have incurred charges.

QWhat is the primary difference in how Kiro approaches coding tasks compared to a traditional AI agent, and how does this contribute to cost savings?

AKiro uses a spec-driven approach. Instead of letting the AI write code immediately from a vague user instruction, it first breaks down the instruction into a formal requirements document, technical design, and a list of executable tasks. This provides the model with a clear and structured job description upfront. This method saves costs by significantly reducing the expensive overhead of the model going off-track, needing rework, or starting over, which consumes a large number of tokens.

QWhat was a notable change in the Kiro platform's model offerings one year after its public preview, and what does this signify?

AA notable change was the introduction of three OpenAI GPT-5.6 models (Sol, Terra, Luna) into Kiro's model selector, where previously Anthropic's Claude models were dominant. This signifies a strategic move by AWS to avoid being tied to a single model provider on its development platform. It creates direct competition between leading models, which can drive performance improvements and price reductions for developers.

QHow does the article explain the layered efficiency improvements for AI agents like GPT-5.6 in platforms such as Kiro?

AThe article explains that efficiency gains come from three layers: 1) The agent framework that initiates requests and organizes context. 2) The orchestration system that schedules and dispatches these requests. 3) The model itself running on the GPU. Cost savings are achieved through optimizations at every one of these layers, not just the model's raw processing cost.

QAccording to the Terminal-Bench 2.1 data cited, why might a developer's choice of agent framework be as important as the choice of model itself for overall cost?

AThe Terminal-Bench 2.1 data shows that different frameworks paired with the same or similar models can result in vastly different costs. For example, Claude Code with Fable 5 achieved 83.8% accuracy at a cost of $552.67, while Codex with GPT-5.5 achieved 83.1% accuracy but at a much higher cost of $2059.19. This demonstrates that the framework's context organization, tool strategies, and workflow efficiency have a massive impact on the final bill, making the framework choice critically important.

Lectures associées

Le président de la Fed, Warsh, "prend un ton de faucon", Goldman Sachs ne croit toujours pas à une "hausse des taux en septembre", JPMorgan affirme qu'"il faut attendre les chiffres de l'emploi et de l'IPC d'août"

Le président de la Fed, Kevin Warsh, a adopté un ton plus ferme ("hawkish") lors de son discours à Jackson Hole, soulignant que l'inflation restait une "préoccupation primordiale". Il a indiqué que la tendance sous-jacente ne s'améliorait pas substantiellement et que des mesures pourraient être nécessaires. Suite à ses propos, les rendements des obligations d'État à 2 ans ont augmenté et les probabilités de marché d'une hausse des taux en septembre ont dépassé 50%. Cependant, les grandes banques d'investissement maintiennent des prévisions plus prudentes. Morgan Stanley et Goldman Sachs ne voient pas une hausse en septembre comme le scénario de base. Morgan Stanley maintient sa prévision d'une hauxe en décembre, soulignant que les prochaines données sur l'emploi et l'IPC d'août seront déterminantes. Goldman Sachs estime qu'une hausse en septembre ne serait possible qu'en cas de données inflationnistes nettement plus fortes que prévu, anticipant plutôt une augmentation modeste de l'inflation sous-jacente. Dans son discours, Warsh a également clarifié sa position sur l'objectif d'inflation à 2%, qu'il a décrit comme ferme, et a réaffirmé le rôle central du taux des fonds fédéraux. Il a évalué l'économie comme robuste, avec des dépenses de consommation saines et une forte croissance des investissements des entreprises, notamment liés à l'IA. Il a jugé que les conditions financières actuelles ne pouvaient être décrites comme restrictives.

marsbitIl y a 8 mins

Le président de la Fed, Warsh, "prend un ton de faucon", Goldman Sachs ne croit toujours pas à une "hausse des taux en septembre", JPMorgan affirme qu'"il faut attendre les chiffres de l'emploi et de l'IPC d'août"

marsbitIl y a 8 mins

Sélection Hebdomadaire de la Rédaction Weekly Editor's Picks (22-28 Août)

Voici une sélection hebdomadaire d'analyses approfondies pour filtrer le bruit des flux d'information. **Situation macroéconomique :** Les institutions de Wall Street anticipent que le Trésor américain pourrait, dès novembre, privilégier l'émission de bons du Trésor à court terme et élargir ses rachats pour apaiser les pressions sur les rendements obligataires de longue durée. Parallèlement, Goldman Sachs maintient sa prévision d'or à 4900 $/oz fin 2026, notant une demande synchronisée des fonds chinois et occidentaux. **Investissement & Crypto :** Arthur Hayes, dans une interview, prédit 30 000 $ pour l'ETH, estimant que les crypto-monnaies constituent la principale soupape face aux politiques monétaires expansionnistes. Le marché des altcoins montre un rebond significatif, la capitalisation totale dépassant à nouveau 1000 milliards de dollars. Des actions comme Circle ont connu des hausses importantes, portées par la croissance de l'USDC et les attentes autour de son réseau de paiement. **IA & Stockage :** Les résultats de Nvidia confirment une demande d'IA toujours accélérée, la société s'orientant vers un rôle d'« organisateur de capital » pour les infrastructures. SK Hynix a annoncé un programme de rachat d'actions de 40 000 milliards de wons. **CeFi & DeFi :** Galaxy Digital propose désormais des lignes de crédit adossées à un portefeuille de crypto-actifs (BTC, ETH, SOL). Dans le DeFi, les projets à revenus élevés comme UNI, AAVE ou JUP attirent l'attention. **Divers :** Le prix du BTC a retrouvé les 80 000 $. Des rumeurs sur un éventuel nouveau jeton lié à Trump ont été démenties par sa famille. La concentration de près de 5% de l'offre totale d'ETH par BitMine soulève des discussions sur les risques et les perspectives, certains experts visant 10 000 $ pour l'ETH.

marsbitIl y a 15 mins

Sélection Hebdomadaire de la Rédaction Weekly Editor's Picks (22-28 Août)

marsbitIl y a 15 mins

Cadre de Strive : Repenser la roue de la hausse du prix du Bitcoin

L'auteur, Joe Burnett de Strive, revisite la trajectoire à long terme du bitcoin. Il reconnaît que le modèle de loi de puissance (power law) a bien décrit la diminution des rendements et de la volatilité au fil des cycles. Cependant, il avance que cette phase de "maturation" (phase 2) prépare en réalité une troisième phase où le prix pourrait réaccélérer. Le raisonnement est le suivant : la baisse de volatilité améliore le rendement ajusté au risque du bitcoin, permettant aux investisseurs d'allouer plus de capitaux. De plus, un actif moins volatile devient un collatéral de meilleure qualité. Cela permet d'emprunter davantage (en dollars) contre ce collatéral, à un coût moindre. Les capitaux propres et le crédit nouvellement créé se disputent alors l'offre fixe de bitcoin (21 millions), créant un cercle vertueux : hausse des prix -> valeur du collatéral en hausse -> capacité d'emprunt accrue -> nouvelle pression acheteuse. L'auteur utilise une analogie avec la fatigue des métaux : après une phase de propagation stable de la fissure (loi de puissance, phase 2), arrive une phase d'accélération menant à la rupture (phase 3). Ici, la "fissure" est la pression sur le système de crédit en dollar, et la "rupture" serait le moment où le prix du bitcoin en dollars dépasse sa trajectoire de loi de puissance. Ainsi, la diminution apparente des rendements pourrait précéder une nouvelle phase de forte expansion, alimentée par l'adoption financière et le levier.

marsbitIl y a 33 mins

Cadre de Strive : Repenser la roue de la hausse du prix du Bitcoin

marsbitIl y a 33 mins

Coup de tonnerre, OpenAI coupe définitivement Cursor de ses modèles

OpenAI a annoncé la fin de sa fourniture directe de modèles à Cursor, effective le 12 novembre. Cette décision intervient après le rachat de Cursor par SpaceX (propriété d'Elon Musk) pour 60 milliards de dollars, il y a 15 jours. OpenAI justifie cette rupture par des violations passées des conditions d'utilisation par des entités liées à Musk, et refuse notamment tout accès à son futur modèle puissant Astra, jugé trop sensible. Pour les utilisateurs, cela signifie la fin de l'intégration officielle et forfaitaire des modèles GPT dans l'abonnement Cursor. Ils devront désormais utiliser leur propre clé API OpenAI, payant directement au token, ce qui équivaut à une augmentation de coût pour les utilisateurs intensifs. Une période de transition de 75 jours est accordée. Le PDG de Cursor, Michael Truell, a répondu que les modèles OpenAI ne représentaient qu'environ 5% du trafic de la plateforme et que des négociations étaient en cours. Il a également souligné le rôle historique de Cursor comme partenaire précoce d'OpenAI, appelant à une infrastructure neutre. Cet événement s'inscrit dans une tendance plus large de fragmentation de l'écosystème de l'IA, où les grands détenteurs de modèles (OpenAI, Anthropic) restreignent progressivement l'accès via des plateformes tierces, surtout après des changements de propriété. Le contrôle sur les modèles fondateurs devient un enjeu stratégique majeur, remettant en cause le modèle commercial d'outils comme Cursor, qui s'était construit sans posséder de modèle propre.

marsbitIl y a 1 h

Coup de tonnerre, OpenAI coupe définitivement Cursor de ses modèles

marsbitIl y a 1 h

Trading

Spot

Articles tendance

Comment acheter BILL

Bienvenue sur HTX.com ! Nous vous permettons d'acheter Billions Network (BILL) de manière simple et pratique. Suivez notre guide étape par étape pour commencer votre parcours crypto.Étape 1 : Création de votre compte HTXUtilisez votre adresse e-mail ou votre numéro de téléphone pour ouvrir un compte sur HTX gratuitement. L'inscription se fait en toute simplicité et débloque toutes les fonctionnalités.Créer mon compteÉtape 2 : Choix du mode de paiement (rubrique Acheter des cryptosCarte de crédit/débit : utilisez votre carte Visa ou Mastercard pour acheter instantanément Billions Network (BILL).Solde :utilisez les fonds du solde de votre compte HTX pour trader en toute simplicité.Prestataire tiers :pour accroître la commodité d'utilisation, nous avons ajouté des modes de paiement populaires tels que Google Pay et Apple Pay.P2P :tradez directement avec d'autres utilisateurs sur HTX.OTC (de gré à gré) : nous offrons des services personnalisés et des taux de change compétitifs aux traders.Étape 3 : stockage de vos Billions Network (BILL)Après avoir acheté vos Billions Network (BILL), stockez-les sur votre compte HTX. Vous pouvez également les envoyer ailleurs via un transfert sur la blockchain ou les utiliser pour trader d'autres cryptos.Étape 4 : tradez des Billions Network (BILL)Tradez facilement Billions Network (BILL) sur le marché Spot de HTX. Il vous suffit d'accéder à votre compte, de sélectionner la paire de trading, d'exécuter vos trades et de les suivre en temps réel. Nous offrons une expérience conviviale aux débutants comme aux traders chevronnés.

603 vues totalesPublié le 2026.05.07Mis à jour le 2026.06.02

Comment acheter BILL

Discussions

Bienvenue dans la Communauté HTX. Ici, vous pouvez vous tenir informé(e) des derniers développements de la plateforme et accéder à des analyses de marché professionnelles. Les opinions des utilisateurs sur le prix de BILL (BILL) sont présentées ci-dessous.

活动图片