Une baisse de prix de seulement 20%, mais la facture est réduite de 80% : GPT-5.6 s'invite sur le terrain de Claude pour recalculer la facture du développement

marsbitXuất bản vào 2026-08-28Cập nhật gần nhất vào 2026-08-28

Tóm tắt

Un même modèle, dont le prix officiel n’a baissé que de 20 %, permet de réduire votre facture de 80 %. Le 24 août, OpenAI a publié les résultats d’un test mené avec AWS sur Terminal-Bench 2.1 : dans la plateforme de développement Kiro d’AWS, le coût pour accomplir une tâche avec GPT-5.6 Terra a diminué d’environ 82 %. Cette économie ne vient pas seulement de la baisse du prix du modèle, mais surtout d’une optimisation conjointe de l’environnement Kiro et du modèle, réduisant les chemins inutiles, les échecs et les retours en arrière coûteux. La clé réside dans l’efficacité de l’agent de codage. Dans Terminal-Bench, les performances mesurées sont celles du couple « agent + modèle ». Par exemple, avec le même modèle, des cadres de travail différents entraînent des coûts très variables. L’approche spec-driven de Kiro, qui décompose les objectifs vagues en spécifications précises avant de générer du code, limite les dérives et les retouches onéreuses. OpenAI a introduit trois modèles GPT-5.6 (Sol, Terra, Luna) dans Kiro, concurrent directement avec Claude d’Anthropic. Les prix ont été ajustés, notamment pour Luna, passant d’un multiplicateur de 0,6 à 0,1. AWS montre ainsi sa volonté de ne pas dépendre d’un seul fournisseur de modèles. Pour les développeurs, le critère de choix évolue : au-delà du coût par token, c’est le coût total pour accomplir une tâche qui compte désormais.

Le même modèle, son prix officiel n'a baissé que de 20 %, mais votre facture est réduite de huit dixièmes.

Le 24 août, OpenAI a publié les résultats d'un test réalisé conjointement avec AWS :

Sur Terminal-Bench 2.1, le coût pour que GPT-5.6 Terra accomplisse une tâche réussie dans Kiro a diminué d'environ 82 %.

Kiro est la plateforme d'agents intelligents de développement logiciel d'AWS, couvrant l'IDE, le CLI et le Web.

Les trois modèles de la famille GPT-5.6, Sol, Terra et Luna, y fonctionnent depuis plus d'un mois.

Ces 82 % ne proviennent pas d'une baisse de prix officielle.

Le dernier ajustement de prix de Terra remonte au 30 juillet, d'une ampleur de 20 %.

Annonce de l'ajustement des prix d'OpenAI du 30 juillet, Terra -20%.

Le prix unitaire ne baisse que de 20 %, mais la facture peut être réduite de huit dixièmes.

La source des soixante points de pourcentage d'économie intermédiaires, c'est cela qui mérite vraiment notre attention.

L'arrivée de GPT-5.6 sur Kiro date de juillet de cette année.

Le 13, AWS a d'abord annoncé la disponibilité générale de GPT-5.6 Sol, Terra et Luna sur Amazon Bedrock.

Le lendemain, Kiro a publié un article de blog annonçant la mise en ligne des trois modèles dans l'IDE, le CLI et le Web.

C'est la première fois que les modèles d'OpenAI intègrent Kiro, coïncidant avec le premier anniversaire de la prévisualisation publique de Kiro.

Après avoir placé les modèles en rayon, puis les avoir mis au travail, plus d'un mois plus tard, OpenAI présente ses résultats :

Les deux entreprises ont conjointement optimisé l'environnement Kiro et les modèles OpenAI, réduisant le coût d'accomplissement d'une tâche réussie par Terra d'environ 82 %.

Ce qui est économisé

est l'argent des détours

Lors de l'ajustement de prix du 30 juillet, Terra a baissé de 20 %, mais dans les tests de Kiro, le coût par tâche a chuté de 82 %.

D'où proviennent les 60 % supplémentaires d'économies ?

Les possibilités sont limitées :

Le modèle émet moins de tokens, les allers-retours entre outils sont moins fréquents, et les échecs suivis de nouvelles tentatives et de détours sont réduits.

Ainsi, cette importante économie ne provient pas de l'argent de chaque appel, mais de l'argent qui aurait été gaspillé dans des appels inutiles.

La logique est simple : lorsqu'un agent IA échoue une tâche, la facture s'accumule normalement. S'il choisit un mauvais chemin, s'égare pendant trois tours avant de faire demi-tour, ces tokens sont également facturés.

Dans le développement réel, c'est souvent ainsi que l'argent s'échappe.

OpenAI a également souligné la même logique dans son blog officiel : l'efficacité provient de trois couches :

Le framework d'agent qui initie les requêtes et organise le contexte, le système d'orchestration qui planifie les requêtes au milieu, et enfin le modèle lui-même exécuté sur les GPU.

OpenAI décompose les sources d'efficacité de GPT-5.6 : la requête part du framework d'agent, est planifiée par le système d'orchestration, puis arrive au GPU pour exécuter le modèle, chaque couche contribuant aux économies.

Les économies peuvent également concerner la division du travail entre modèles.

OpenAI a également donné un exemple d'utilisation : un flux de travail de codage peut d'abord utiliser Sol pour clarifier le problème et établir un plan, puis passer à Luna pour implémenter les modifications déjà définies, écrire des tests et exécuter des évaluations.

Sur la même ligne de production, différentes étapes sont équipées de niveaux d'intelligence différents.

Le modèle ne représente que la moitié de la facture

Changer de framework, c'est changer de prix

Le test Terminal-Bench 2.1 ne consiste pas à faire répondre le modèle seul à un questionnaire.

Il place le modèle dans un environnement terminal avec un objectif vague, le laissant planifier son propre chemin, appeler des outils, écrire des scripts, gérer les erreurs et itérer à plusieurs reprises.

Ainsi, le score obtenu est celui de la combinaison « Agent + Modèle ».

Le classement public de Terminal-Bench 2.1, avec en plus une colonne coût à droite de la précision. (Source : Terminal-Bench)

Les quatre lignes de chiffres du classement illustrent parfaitement le propos :

Claude Code avec Fable 5, 83,8%, 552,67 $ ;

Codex avec GPT-5.5, 83,1%, 2059,19 $ ;

Codex avec GPT-5.6 Terra, 78,4%, 421,15 $ ;

Codex avec GPT-5.6 Luna, 75,7%, 241,45 $.

Les deux premières lignes ne diffèrent que de 0,7 point de pourcentage, mais la facture diffère de près de 4 fois.

Le même modèle, intégré dans des frameworks différents, avec des stratégies d'organisation de contexte et d'outils différentes, donne des prix radicalement différents.

Selon les données officielles de Kiro, Terra obtient 77,4 points sur le Coding Agent Index, soit juste un peu plus que les 77,2 de Claude Fable 5.

Son argument n'est pas le score, mais le prix correspondant à ce score.

C'est également là que se situe l'approche "spec-driven" de Kiro, dont le principe fondamental est le suivant : interdiction d'écrire du code dès le départ.

Il décompose d'abord l'objectif vague de l'utilisateur en une documentation des besoins formelle, une conception technique et une liste de tâches exécutables, avant de la transmettre au modèle.

Ainsi, le modèle ne reçoit plus une phrase vague, mais un travail clarifié.

Les personnes familières avec les Agents reconnaîtront immédiatement que cette étape économise précisément la partie la plus coûteuse des dépenses.

Les tokens gaspillés lorsque le modèle dévie, doit recommencer, ou tout reprendre à zéro, sont souvent plus nombreux que ceux utilisés pour le travail réel.

Kiro a également intégré deux barrières dans le processus : avant toute modification réelle du code, une pause pour validation humaine ; et après le travail, une série de tests automatisés pour vérifier l'exactitude.

Chaque reprise évitée par ces deux barrières permet d'économiser de l'argent réel.

Claude sur le terrain d'Amazon

GPT en prend la moitié

Il y a un an, Kiro n'était qu'un IDE "spec-driven", et le sélecteur de modèles était le terrain d'Anthropic.

Un an plus tard, AWS a placé d'un coup trois modèles OpenAI sur sa propre plateforme d'agents intelligents de développement.

Voir Sol, Terra et Luna listés côte à côte avec Claude dans le même menu déroulant était difficile à imaginer il y a un an.

Bien que GPT-5.6 soit arrivé "en famille", il n'est pas "entièrement ouvert".

Les trois modèles sont déployés progressivement, de manière expérimentale, pour les utilisateurs Pro, Pro+, Pro Max et Power, et seulement dans deux régions : Virginie du Nord (USA) et Francfort (Europe), avec support pour l'inférence inter-régions.

Un autre point que beaucoup trouvent déroutant : ces modèles dans Kiro utilisent une chaîne de raisonnement cachée ; vous ne voyez pas ses étapes de raisonnement, seulement le résultat final.

Ceux qui ont l'habitude de surveiller le raisonnement étape par étape de l'Agent peuvent avoir l'impression de jeter le travail dans une boîte noire.

Selon la déclaration officielle, c'est le comportement attendu, et cela n'affecte pas la qualité de la sortie.

Les trois modèles sont clairement tarifés dans Kiro.

Lors de leur mise en ligne le 14 juillet, pour la même tâche, Sol facturait 2,4 fois plus, Terra 1,2 fois plus, et Luna 0,6 fois plus.

Après la baisse de prix d'OpenAI du 30 juillet, Kiro a suivi le lendemain : Luna est passé de 0,6x à 0,1x, Terra de 1,2x à 1,0x, seul Sol n'a pas bougé.

La position d'AWS est claire : une plateforme de développement ne peut pas être liée à un seul modèle.

Dans le même sélecteur, deux modèles de pointe commencent à se faire concurrence sur les prix.

Les critères d'évaluation des modèles changent également : un score élevé ne signifie plus automatiquement la victoire, dépenser moins peut également l'emporter.

Pour les développeurs, la question n'est plus "Combien coûte ce modèle par million de tokens ?", mais "Combien vais-je vraiment dépenser pour qu'il accomplisse cette tâche ?".

Références :

https://x.com/OpenAIDevs/status/2091966982015103068

https://openai.com/index/gpt-5-6-in-kiro/

Cet article provient du compte WeChat officiel "新智元" (ID : AI_era), auteur : ASI启示录, éditeur : 元宇

Tiền kỹ thuật số thịnh hành

Câu hỏi Liên quan

QQuelle est l'annonce principale faite par OpenAI concernant GPT-5.6 Terra dans Kiro ?

AOpenAI a annoncé que le coût pour accomplir une tâche avec succès sur le benchmark Terminal-Bench 2.1 en utilisant GPT-5.6 Terra dans Kiro a été réduit d'environ 82 %.

QQuelle était la réduction de prix officielle de GPT-5.6 Terra annoncée par OpenAI le 30 juillet ?

ALa réduction de prix officielle pour GPT-5.6 Terra annoncée par OpenAI le 30 juillet était de 20 %.

QD'après l'article, d'où provient la majeure partie des économies de coût (les 60% supplémentaires) réalisées dans Kiro avec GPT-5.6 ?

ALa majeure partie des économies supplémentaires provient de l'optimisation du flux de travail, permettant de réduire les appels d'outils inutiles, les retours en arrière, les échecs de tâches et les réessais, plutôt que d'une simple baisse du prix par token.

QQuelle est la principale caractéristique de l'approche 'spec-driven' de Kiro mentionnée dans l'article ?

AL'approche 'spec-driven' de Kiro consiste à transformer l'objectif vague de l'utilisateur en un document de besoins, une conception technique et une liste de tâches exécutables avant de les soumettre au modèle, réduisant ainsi les erreurs et les retours coûteux.

QComment l'intégration des modèles GPT-5.6 dans Kiro change-t-elle la dynamique du marché selon l'article ?

AL'intégration de GPT-5.6 dans Kiro introduit une concurrence directe avec Claude d'Anthropic sur la plateforme AWS, déplaçant les critères de choix des modèles vers le coût total pour accomplir une tâche plutôt que vers le simple prix par token ou le score de performance brut.

Nội dung Liên quan

Sberbank chuẩn bị cho vay thế chấp bằng tiền điện tử: Ethereum và Tether nằm trong danh sách

Ngân hàng Sberbank đang lên kế hoạch phát triển dịch vụ cho vay thế chấp bằng tiền điện tử. Ngoài Bitcoin là tài sản đảm bảo cơ bản, ngân hàng dự định sẽ chấp nhận cả Ethereum và stablecoin Tether sau khi Ngân hàng Trung ương Nga cho phép các tài sản số này lưu thông công khai. Tiền điện tử trong mô hình này đóng vai trò là tài sản đảm bảo cho sản phẩm ngân hàng, không phải phương tiện thanh toán. Đối với người cho vay, tính thanh khoản, khả năng định giá minh bạch và trạng thái pháp lý của mỗi công cụ là rất quan trọng. Sberbank đã có kinh nghiệm thực tế với các công cụ tiền điện tử và đã chuẩn bị trước cho các quy định mới. Sau khi các quy tắc cần thiết có hiệu lực, ngân hàng dự kiến sẽ điều chỉnh các sản phẩm hiện có và mở rộng danh mục đề xuất. Khoản vay này về cơ bản kết nối tài chính ngân hàng truyền thống với tài sản kỹ thuật số trong sổ sách của khách hàng. Đây là một sản phẩm ngân hàng, không phải mô hình hoạt động theo cách của các dịch vụ tài chính phi tập trung (DeFi). Việc cho phép lưu thông công khai các tài sản kỹ thuật số vẫn phụ thuộc vào quyết định của cơ quan quản lý.

cryptonews.ru23 phút trước

Sberbank chuẩn bị cho vay thế chấp bằng tiền điện tử: Ethereum và Tether nằm trong danh sách

cryptonews.ru23 phút trước

Lỗ hổng Ajna trị giá 775.000 USD cho thấy rủi ro vượt ra ngoài các oracle giá của DeFi

Lỗ hổng bảo mật trị giá 775.000 USD trên giao thức cho vay Ajna đã làm lộ ra những rủi ro vượt xa vấn đề oracle giá trong DeFi. Thay vì tấn công vào nguồn cấp dữ liệu giá bên ngoài, kẻ tấn công đã khai thác chính cơ chế kế toán thanh lý nội bộ của giao thức. Ajna được thiết kế để hoạt động không cần oracle, quản trị hay nguồn dữ liệu giá bên ngoài, dựa vào cơ chế "giỏ" do người cho vay thiết lập. Tuy nhiên, điểm mạnh này lại trở thành mục tiêu để khai thác. Vụ tấn công ảnh hưởng đến nhiều pool thanh khoản như syrupUSDC, wstETH và WBTC/WETH. Mặc dù được cảnh báo trước hơn một giờ, nhóm Ajna đã không kịp ngăn chặn. Tổng giá trị bị khóa (TVL) của Ajna V2 vào thời điểm đó chỉ khoảng 206.000 USD, thấp hơn nhiều so với thiệt hại được báo cáo, cho thấy mức độ nghiêm trọng. Phân tích cho thấy kẻ tấn công không hack code mà đã "lừa" hệ thống logic hợp đồng thông minh chấp nhận các tính toán méo mó về giá trị và lợi nhuận trong quá trình thanh lý. Sự cố này nêu bật một thách thức lớn trong DeFi: rủi ro có thể ẩn trong các giả định thiết kế và logic nghiệp vụ phức tạp, chứ không chỉ nằm ở các oracle hay quyền kiểm soát truy cập.

cryptonews.ru24 phút trước

Lỗ hổng Ajna trị giá 775.000 USD cho thấy rủi ro vượt ra ngoài các oracle giá của DeFi

cryptonews.ru24 phút trước

Ủy ban Chứng khoán và Tương lai Hồng Kông (SFC) đưa công ty SBCFX và các công ty liên quan Star Bridge Capital vào danh sách cảnh báo hoạt động không giấy phép

Ủy ban Chứng khoán và Tương lai Hồng Kông (SFC) đã đưa công ty SBCFX và các công ty liên quan là Star Bridge Capital vào danh sách cảnh báo vì hoạt động không có giấy phép. Động thái này diễn ra sau sự cố sập đổ giao dịch vàng London khiến hàng nghìn nhà đầu tư mất số dư USDT. SFC tuyên bố SBCFX, Star Bridge Capital Group, Star Bridge Capital Pty Limited và Topical Wealth International Ltd không có giấy phép hoạt động tại Hồng Kông, mặc dù nhóm này công bố các giấy phép từ Úc, Nam Phi và Seychelles. Điều này đồng nghĩa nhà đầu tư Hồng Kông giao dịch với các thực thể này không được bảo vệ theo quy định của SFC. Sự cố ngày 22/8 dẫn đến thanh lý hàng loạt, ảnh hưởng khoảng 3.000 nhà đầu tư. Các vấn đề nổi cộm bao gồm giao dịch thuật toán đòn bẩy cao và việc sử dụng tiền gửi bằng stablecoin (USDT) trên thị trường phái sinh OTC, khiến việc truy hồi tài sản trở nên khó khăn do đặc điểm phi tập trung của giao dịch tiền mã hóa ngang hàng. Cảnh báo của SFC nhấn mạnh việc các công ty nước ngoài không được phép tiếp thị dịch vụ cho cư dân Hồng Kông nếu không được SFC cho phép trước.

cryptonews.ru26 phút trước

Ủy ban Chứng khoán và Tương lai Hồng Kông (SFC) đưa công ty SBCFX và các công ty liên quan Star Bridge Capital vào danh sách cảnh báo hoạt động không giấy phép

cryptonews.ru26 phút trước

Giám đốc điều hành của Helius đã kịp thời giành được phiếu bầu cần thiết để giảm lạm phát trên mạng Solana

Các trình xác thực của mạng Solana đã đạt được cột mốc quan trọng khi thông qua đề xuất quản trị SGP-0002, có tiêu đề "Giảm lạm phát gấp đôi". Đề xuất này nhằm giảm tỷ lệ lạm phát bằng cách tăng tốc độ giảm phát từ mức hiện tại -15% lên -30%. Cuộc bỏ phiếu diễn ra vô cùng sít sao. Chỉ vài giờ trước khi kết thúc, đề xuất dường như sẽ không được thông qua. Tuy nhiên, với 67% số phiếu ủng hộ (176,29 triệu SOL), đề xuất cuối cùng đã được chấp thuận. 25,16% phiếu chống và 7,84% phiếu trắng. Mert Mumtaz, đồng sáng lập và CEO của Helius, đã đóng vai trò then chốt. Ông cảnh báo đề xuất có nguy cơ thất bại và chỉ trích một số trình xác thực bỏ phiếu chống vì cho rằng điều này sẽ giữ lại nguồn thu cho họ - mà ông gọi là "sự vô lý về mặt toán học". Trong những giờ cuối, ông đã vận động tích cực, bao gồm việc thuyết phục sàn Kraken đổi phiếu thành ủng hộ, giúp đề xuất vượt qua với cách biệt tối thiểu. Tuy nhiên, không phải tất cả phiếu chống đều xuất phát từ lý do trên. Một trình xác thực lớn như Everstake cho biết họ phản đối vì lo ngại về tốc độ thay đổi quá nhanh, tác động không cân xứng lên các trình xác thực nhỏ, áp lực lên hoạt động staking và các kịch bản rủi ro tiềm ẩn. Cùng lúc, hai đề xuất quản trị khác cũng được bỏ phiếu: SGP-0001 về Hiến pháp Solana đã được thông qua, trong khi SGP-0003 về phí tài nguyên và đưa vào khối đã bị từ chối.

cryptonews.ru27 phút trước

Giám đốc điều hành của Helius đã kịp thời giành được phiếu bầu cần thiết để giảm lạm phát trên mạng Solana

cryptonews.ru27 phút trước

Giao dịch

Giao ngay

Bài viết Nổi bật

Làm thế nào để Mua BILL

Chào mừng bạn đến với HTX.com! Chúng tôi đã làm cho mua Billions Network (BILL) trở nên đơn giản và thuận tiện. Làm theo hướng dẫn từng bước của chúng tôi để bắt đầu hành trình tiền kỹ thuật số của bạn.Bước 1: Tạo Tài khoản HTX của BạnSử dụng email hoặc số điện thoại của bạn để đăng ký tài khoản miễn phí trên HTX. Trải nghiệm hành trình đăng ký không rắc rối và mở khóa tất cả tính năng. Nhận Tài khoản của tôiBước 2: Truy cập Mua Crypto và Chọn Phương thức Thanh toán của BạnThẻ Tín dụng/Ghi nợ: Sử dụng Visa hoặc Mastercard của bạn để mua Billions Network (BILL) ngay lập tức.Số dư: Sử dụng tiền từ số dư tài khoản HTX của bạn để giao dịch liền mạch.Bên thứ ba: Chúng tôi đã thêm những phương thức thanh toán phổ biến như Google Pay và Apple Pay để nâng cao sự tiện lợi.P2P: Giao dịch trực tiếp với người dùng khác trên HTX.Thị trường mua bán phi tập trung (OTC): Chúng tôi cung cấp những dịch vụ được thiết kế riêng và tỷ giá hối đoái cạnh tranh cho nhà giao dịch.Bước 3: Lưu trữ Billions Network (BILL) của BạnSau khi mua Billions Network (BILL), lưu trữ trong tài khoản HTX của bạn. Ngoài ra, bạn có thể gửi đi nơi khác qua chuyển khoản blockchain hoặc sử dụng để giao dịch những tiền kỹ thuật số khác.Bước 4: Giao dịch Billions Network (BILL)Giao dịch Billions Network (BILL) dễ dàng trên thị trường giao ngay của HTX. Chỉ cần truy cập vào tài khoản của bạn, chọn cặp giao dịch, thực hiện giao dịch và theo dõi trong thời gian thực. Chúng tôi cung cấp trải nghiệm thân thiện với người dùng cho cả người mới bắt đầu và người giao dịch dày dạn kinh nghiệm.

Tổng lượt xem 751Xuất bản vào 2026.05.07Cập nhật vào 2026.06.02

Làm thế nào để Mua BILL

Thảo luận

Chào mừng đến với Cộng đồng HTX. Tại đây, bạn có thể được thông báo về những phát triển nền tảng mới nhất và có quyền truy cập vào thông tin chuyên sâu về thị trường. Ý kiến ​​của người dùng về giá của BILL (BILL) được trình bày dưới đây.

活动图片