Une baisse de prix de seulement 20%, mais la facture est réduite de 80% : GPT-5.6 s'invite sur le terrain de Claude pour recalculer la facture du développement

marsbitОпубликовано 2026-08-28Обновлено 2026-08-28

Введение

Un même modèle, dont le prix officiel n’a baissé que de 20 %, permet de réduire votre facture de 80 %. Le 24 août, OpenAI a publié les résultats d’un test mené avec AWS sur Terminal-Bench 2.1 : dans la plateforme de développement Kiro d’AWS, le coût pour accomplir une tâche avec GPT-5.6 Terra a diminué d’environ 82 %. Cette économie ne vient pas seulement de la baisse du prix du modèle, mais surtout d’une optimisation conjointe de l’environnement Kiro et du modèle, réduisant les chemins inutiles, les échecs et les retours en arrière coûteux. La clé réside dans l’efficacité de l’agent de codage. Dans Terminal-Bench, les performances mesurées sont celles du couple « agent + modèle ». Par exemple, avec le même modèle, des cadres de travail différents entraînent des coûts très variables. L’approche spec-driven de Kiro, qui décompose les objectifs vagues en spécifications précises avant de générer du code, limite les dérives et les retouches onéreuses. OpenAI a introduit trois modèles GPT-5.6 (Sol, Terra, Luna) dans Kiro, concurrent directement avec Claude d’Anthropic. Les prix ont été ajustés, notamment pour Luna, passant d’un multiplicateur de 0,6 à 0,1. AWS montre ainsi sa volonté de ne pas dépendre d’un seul fournisseur de modèles. Pour les développeurs, le critère de choix évolue : au-delà du coût par token, c’est le coût total pour accomplir une tâche qui compte désormais.

Le même modèle, son prix officiel n'a baissé que de 20 %, mais votre facture est réduite de huit dixièmes.

Le 24 août, OpenAI a publié les résultats d'un test réalisé conjointement avec AWS :

Sur Terminal-Bench 2.1, le coût pour que GPT-5.6 Terra accomplisse une tâche réussie dans Kiro a diminué d'environ 82 %.

Kiro est la plateforme d'agents intelligents de développement logiciel d'AWS, couvrant l'IDE, le CLI et le Web.

Les trois modèles de la famille GPT-5.6, Sol, Terra et Luna, y fonctionnent depuis plus d'un mois.

Ces 82 % ne proviennent pas d'une baisse de prix officielle.

Le dernier ajustement de prix de Terra remonte au 30 juillet, d'une ampleur de 20 %.

Annonce de l'ajustement des prix d'OpenAI du 30 juillet, Terra -20%.

Le prix unitaire ne baisse que de 20 %, mais la facture peut être réduite de huit dixièmes.

La source des soixante points de pourcentage d'économie intermédiaires, c'est cela qui mérite vraiment notre attention.

L'arrivée de GPT-5.6 sur Kiro date de juillet de cette année.

Le 13, AWS a d'abord annoncé la disponibilité générale de GPT-5.6 Sol, Terra et Luna sur Amazon Bedrock.

Le lendemain, Kiro a publié un article de blog annonçant la mise en ligne des trois modèles dans l'IDE, le CLI et le Web.

C'est la première fois que les modèles d'OpenAI intègrent Kiro, coïncidant avec le premier anniversaire de la prévisualisation publique de Kiro.

Après avoir placé les modèles en rayon, puis les avoir mis au travail, plus d'un mois plus tard, OpenAI présente ses résultats :

Les deux entreprises ont conjointement optimisé l'environnement Kiro et les modèles OpenAI, réduisant le coût d'accomplissement d'une tâche réussie par Terra d'environ 82 %.

Ce qui est économisé

est l'argent des détours

Lors de l'ajustement de prix du 30 juillet, Terra a baissé de 20 %, mais dans les tests de Kiro, le coût par tâche a chuté de 82 %.

D'où proviennent les 60 % supplémentaires d'économies ?

Les possibilités sont limitées :

Le modèle émet moins de tokens, les allers-retours entre outils sont moins fréquents, et les échecs suivis de nouvelles tentatives et de détours sont réduits.

Ainsi, cette importante économie ne provient pas de l'argent de chaque appel, mais de l'argent qui aurait été gaspillé dans des appels inutiles.

La logique est simple : lorsqu'un agent IA échoue une tâche, la facture s'accumule normalement. S'il choisit un mauvais chemin, s'égare pendant trois tours avant de faire demi-tour, ces tokens sont également facturés.

Dans le développement réel, c'est souvent ainsi que l'argent s'échappe.

OpenAI a également souligné la même logique dans son blog officiel : l'efficacité provient de trois couches :

Le framework d'agent qui initie les requêtes et organise le contexte, le système d'orchestration qui planifie les requêtes au milieu, et enfin le modèle lui-même exécuté sur les GPU.

OpenAI décompose les sources d'efficacité de GPT-5.6 : la requête part du framework d'agent, est planifiée par le système d'orchestration, puis arrive au GPU pour exécuter le modèle, chaque couche contribuant aux économies.

Les économies peuvent également concerner la division du travail entre modèles.

OpenAI a également donné un exemple d'utilisation : un flux de travail de codage peut d'abord utiliser Sol pour clarifier le problème et établir un plan, puis passer à Luna pour implémenter les modifications déjà définies, écrire des tests et exécuter des évaluations.

Sur la même ligne de production, différentes étapes sont équipées de niveaux d'intelligence différents.

Le modèle ne représente que la moitié de la facture

Changer de framework, c'est changer de prix

Le test Terminal-Bench 2.1 ne consiste pas à faire répondre le modèle seul à un questionnaire.

Il place le modèle dans un environnement terminal avec un objectif vague, le laissant planifier son propre chemin, appeler des outils, écrire des scripts, gérer les erreurs et itérer à plusieurs reprises.

Ainsi, le score obtenu est celui de la combinaison « Agent + Modèle ».

Le classement public de Terminal-Bench 2.1, avec en plus une colonne coût à droite de la précision. (Source : Terminal-Bench)

Les quatre lignes de chiffres du classement illustrent parfaitement le propos :

Claude Code avec Fable 5, 83,8%, 552,67 $ ;

Codex avec GPT-5.5, 83,1%, 2059,19 $ ;

Codex avec GPT-5.6 Terra, 78,4%, 421,15 $ ;

Codex avec GPT-5.6 Luna, 75,7%, 241,45 $.

Les deux premières lignes ne diffèrent que de 0,7 point de pourcentage, mais la facture diffère de près de 4 fois.

Le même modèle, intégré dans des frameworks différents, avec des stratégies d'organisation de contexte et d'outils différentes, donne des prix radicalement différents.

Selon les données officielles de Kiro, Terra obtient 77,4 points sur le Coding Agent Index, soit juste un peu plus que les 77,2 de Claude Fable 5.

Son argument n'est pas le score, mais le prix correspondant à ce score.

C'est également là que se situe l'approche "spec-driven" de Kiro, dont le principe fondamental est le suivant : interdiction d'écrire du code dès le départ.

Il décompose d'abord l'objectif vague de l'utilisateur en une documentation des besoins formelle, une conception technique et une liste de tâches exécutables, avant de la transmettre au modèle.

Ainsi, le modèle ne reçoit plus une phrase vague, mais un travail clarifié.

Les personnes familières avec les Agents reconnaîtront immédiatement que cette étape économise précisément la partie la plus coûteuse des dépenses.

Les tokens gaspillés lorsque le modèle dévie, doit recommencer, ou tout reprendre à zéro, sont souvent plus nombreux que ceux utilisés pour le travail réel.

Kiro a également intégré deux barrières dans le processus : avant toute modification réelle du code, une pause pour validation humaine ; et après le travail, une série de tests automatisés pour vérifier l'exactitude.

Chaque reprise évitée par ces deux barrières permet d'économiser de l'argent réel.

Claude sur le terrain d'Amazon

GPT en prend la moitié

Il y a un an, Kiro n'était qu'un IDE "spec-driven", et le sélecteur de modèles était le terrain d'Anthropic.

Un an plus tard, AWS a placé d'un coup trois modèles OpenAI sur sa propre plateforme d'agents intelligents de développement.

Voir Sol, Terra et Luna listés côte à côte avec Claude dans le même menu déroulant était difficile à imaginer il y a un an.

Bien que GPT-5.6 soit arrivé "en famille", il n'est pas "entièrement ouvert".

Les trois modèles sont déployés progressivement, de manière expérimentale, pour les utilisateurs Pro, Pro+, Pro Max et Power, et seulement dans deux régions : Virginie du Nord (USA) et Francfort (Europe), avec support pour l'inférence inter-régions.

Un autre point que beaucoup trouvent déroutant : ces modèles dans Kiro utilisent une chaîne de raisonnement cachée ; vous ne voyez pas ses étapes de raisonnement, seulement le résultat final.

Ceux qui ont l'habitude de surveiller le raisonnement étape par étape de l'Agent peuvent avoir l'impression de jeter le travail dans une boîte noire.

Selon la déclaration officielle, c'est le comportement attendu, et cela n'affecte pas la qualité de la sortie.

Les trois modèles sont clairement tarifés dans Kiro.

Lors de leur mise en ligne le 14 juillet, pour la même tâche, Sol facturait 2,4 fois plus, Terra 1,2 fois plus, et Luna 0,6 fois plus.

Après la baisse de prix d'OpenAI du 30 juillet, Kiro a suivi le lendemain : Luna est passé de 0,6x à 0,1x, Terra de 1,2x à 1,0x, seul Sol n'a pas bougé.

La position d'AWS est claire : une plateforme de développement ne peut pas être liée à un seul modèle.

Dans le même sélecteur, deux modèles de pointe commencent à se faire concurrence sur les prix.

Les critères d'évaluation des modèles changent également : un score élevé ne signifie plus automatiquement la victoire, dépenser moins peut également l'emporter.

Pour les développeurs, la question n'est plus "Combien coûte ce modèle par million de tokens ?", mais "Combien vais-je vraiment dépenser pour qu'il accomplisse cette tâche ?".

Références :

https://x.com/OpenAIDevs/status/2091966982015103068

https://openai.com/index/gpt-5-6-in-kiro/

Cet article provient du compte WeChat officiel "新智元" (ID : AI_era), auteur : ASI启示录, éditeur : 元宇

Трендовые криптовалюты

Связанные с этим вопросы

QQuelle est l'annonce principale faite par OpenAI concernant GPT-5.6 Terra dans Kiro ?

AOpenAI a annoncé que le coût pour accomplir une tâche avec succès sur le benchmark Terminal-Bench 2.1 en utilisant GPT-5.6 Terra dans Kiro a été réduit d'environ 82 %.

QQuelle était la réduction de prix officielle de GPT-5.6 Terra annoncée par OpenAI le 30 juillet ?

ALa réduction de prix officielle pour GPT-5.6 Terra annoncée par OpenAI le 30 juillet était de 20 %.

QD'après l'article, d'où provient la majeure partie des économies de coût (les 60% supplémentaires) réalisées dans Kiro avec GPT-5.6 ?

ALa majeure partie des économies supplémentaires provient de l'optimisation du flux de travail, permettant de réduire les appels d'outils inutiles, les retours en arrière, les échecs de tâches et les réessais, plutôt que d'une simple baisse du prix par token.

QQuelle est la principale caractéristique de l'approche 'spec-driven' de Kiro mentionnée dans l'article ?

AL'approche 'spec-driven' de Kiro consiste à transformer l'objectif vague de l'utilisateur en un document de besoins, une conception technique et une liste de tâches exécutables avant de les soumettre au modèle, réduisant ainsi les erreurs et les retours coûteux.

QComment l'intégration des modèles GPT-5.6 dans Kiro change-t-elle la dynamique du marché selon l'article ?

AL'intégration de GPT-5.6 dans Kiro introduit une concurrence directe avec Claude d'Anthropic sur la plateforme AWS, déplaçant les critères de choix des modèles vers le coût total pour accomplir une tâche plutôt que vers le simple prix par token ou le score de performance brut.

Похожее

Avici обязуется выплатить пользователям полную компенсацию, поскольку хакеры переходят к новым жертвам

Необанк Avici на блокчейне Solana пообещал полностью возместить средства пользователей после взлома 28 августа, в результате которого были опустошены карты на сумму около 500 859 долларов. Инцидент произошёл из-за ошибки в устаревшей версии смарт-контракта, использовавшейся для карт. Злоумышленник, используя уязвимость в логике вывода, похитил средства, что привело к обвалу нативного токена AVICI. На следующий день, 29 августа, аналогичная атака затронула протокол кредитования Ajna в сети Ethereum, где в результате манипуляций с ликвидациями было потеряно около 775 000 долларов. Несмотря на предупреждения, команда Ajna не отреагировала вовремя. Эти случаи вписываются в общую тревожную тенденцию 2025-2026 годов. Согласно отчету CoinGecko, за этот период произошло более 245 инцидентов с общим ущербом в 3,63 миллиарда долларов. Большинство атак (88,44% украденных средств) были направлены на проверенные протоколы, эксплуатируя уязвимости инфраструктуры или человеческий фактор, а не ошибки в аудированном коде. При этом возможности страхования таких рисков в DeFi-секторе сокращаются.

cryptonews.ru22 мин. назад

Avici обязуется выплатить пользователям полную компенсацию, поскольку хакеры переходят к новым жертвам

cryptonews.ru22 мин. назад

Сбербанк готовит кредиты под залог криптовалют: в списке Ethereum и Tether

Сбербанк планирует развивать кредитование под залог цифровых активов. В настоящее время базовым обеспечением выступает биткоин, однако банк намерен со временем принимать также Ethereum и стейблкоин Tether. Это станет возможным после того, как Центральный банк разрешит их публичное обращение, что является ключевым условием для использования таких активов в банковских продуктах. Кредит под залог криптовалюты рассматривается как традиционный банковский продукт, где цифровой актив выполняет обеспечительную функцию, а не служит средством платежа. Банк уже имеет опыт работы с подобными инструментами и готов адаптировать свои предложения после вступления в силу соответствующих нормативных актов. Ранее Сбербанк также был назначен уполномоченным банком для расчетов с релокантами, уклоняющимися от исполнения наказания.

cryptonews.ru24 мин. назад

Сбербанк готовит кредиты под залог криптовалют: в списке Ethereum и Tether

cryptonews.ru24 мин. назад

Эксплойт Ajna на сумму 775 000 долларов США выявляет риски, выходящие за рамки ценовых оракулов DeFi

Протокол кредитования Ajna, сознательно отказавшийся от использования ценовых оракулов для определения стоимости залога, пострадал от эксплойта на сумму около 775 000 долларов в ETH. Атака, затронувшая несколько пулов ликвидности, была осуществлена не через манипуляцию внешними данными, а путем эксплуатации внутреннего механизма учета ликвидаций протокола. Злоумышленник манипулировал расчетами внутри контрактов, заставив систему принять искаженные данные о ликвидационной прибыли как допустимые. Это позволило вывести средства, обойдя встроенные защитные механизмы, такие как требование внесения залога для инициатора ликвидации. Несмотря на предупреждение от сервиса безопасности за час до начала атаки, протокол не успел принять меры. На момент инцидента ущерб превысил общую заблокированную стоимость (TVL) Ajna V2. Хотя сумма потерь невелика в сравнении с крупнейшими взломами года, этот случай иллюстрирует ключевой риск DeFi: уязвимость может крыться не во внешних зависимостях (оракулах), а в сложной внутренней логике и предположениях, заложенных в код протокола.

cryptonews.ru25 мин. назад

Эксплойт Ajna на сумму 775 000 долларов США выявляет риски, выходящие за рамки ценовых оракулов DeFi

cryptonews.ru25 мин. назад

Комиссия по ценным бумагам и фьючерсам Гонконга (SFC) внесла компанию SBCFX и связанные с ней компании Star Bridge Capital в свой список предупреждений о нелицензированных операциях

Комиссия по ценным бумагам и фьючерсам Гонконга (SFC) внесла брокера SBCFX и связанные с ним компании Star Bridge Capital Group в список предупреждений о нелицензированной деятельности. Ни одна из этих организаций не имеет лицензии SFC для работы в Гонконге, что лишает местных клиентов защиты регулятора. Предупреждение последовало за массовыми потерями инвесторов, вызванными сбоем в торговле золотом в Лондоне 22 августа, в результате которого тысячи счетов были обнулены. По оценкам, убытки понесли около 3000 инвесторов, многие из которых использовали кредитное плечо и депозиты в стейблкоине USDT. Несмотря на наличие у группы компаний лицензий в других юрисдикциях (Австралия, ЮАР, Сейшельские острова), SFC подчеркивает, что это не дает им права на деятельность в Гонконге. Возврат средств, вложенных в USDT, осложнен из-за особенностей криптовалютных транзакций, даже при возможности их заморозки.

cryptonews.ru26 мин. назад

Комиссия по ценным бумагам и фьючерсам Гонконга (SFC) внесла компанию SBCFX и связанные с ней компании Star Bridge Capital в свой список предупреждений о нелицензированных операциях

cryptonews.ru26 мин. назад

Генеральный директор Helius в последний момент заручился голосами, необходимыми для сокращения инфляции в сети Solana

Сеть Solana одобрила предложение SGP-0002 («Двойная дезинфляция»), которое увеличит темп ежегодного сокращения инфляции с -15% до -30%. Голосование валидаторов завершилось с минимальным перевесом: 67% голосов (176,29 млн SOL) — «за», 25,16% (66,19 млн SOL) — «против». Генеральный директор Helius Мерт Мумтаз сыграл ключевую роль, убедив в последний момент крупных валидаторов, включая Kraken, изменить свою позицию и поддержать предложение. Он раскритиковал противников, голосовавших, по его мнению, из-за ошибочных экономических соображений. Не все валидаторы были против дезинфляции в принципе. Например, Everstake объяснила свой голос «против» слишком быстрыми темпами изменений и потенциальными рисками для мелких валидаторов и стейкеров. Параллельно были рассмотрены ещё два предложения: Конституция Solana (SGP-0001) была принята, а SGP-0003 о новой модели комиссий — отклонена.

cryptonews.ru27 мин. назад

Генеральный директор Helius в последний момент заручился голосами, необходимыми для сокращения инфляции в сети Solana

cryptonews.ru27 мин. назад

Торговля

Спот

Популярные статьи

Как купить BILL

Добро пожаловать на HTX.com! Мы сделали приобретение Billions Network (BILL) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки Billions Network (BILL).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение Billions Network (BILL)После приобретения вами Billions Network (BILL) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля Billions Network (BILL)С легкостью торгуйте Billions Network (BILL) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

796 просмотров всегоОпубликовано 2026.05.07Обновлено 2026.06.02

Как купить BILL

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на BILL (BILL) представлены ниже.

活动图片