Hanya Turun 20%, Tagihan Malah Berkurang 80%. GPT-5.6 Masuki Wilayah Claude, Menghitung Ulang Biaya Pemrograman.

marsbitDipublikasikan tanggal 2026-08-28Terakhir diperbarui pada 2026-08-28

Abstrak

OpenAI dan AWS melaporkan bahwa biaya untuk menyelesaikan tugas pengembangan perangkat lunak yang berhasil menggunakan model GPT-5.6 Terra di platform agen pengembang Kiro telah turun sekitar 82%. Penurunan drastis ini tidak hanya berasal dari penyesuaian harga model sebesar 20% pada akhir Juli, tetapi terutama dari pengoptimalan bersama pada lingkungan Kiro dan model OpenAI. Penghematan besar dicapai dengan mengurangi token yang tidak perlu, panggilan alat yang berlebihan, serta percobaan ulang dan penyimpangan yang gagal selama agen AI bekerja. Platform Kiro menerapkan pendekatan "spec-driven" yang memecah tujuan pengguna menjadi dokumen spesifikasi yang jelas sebelum mengeksekusi kode, sehingga meminimalkan kesalahan mahal dan pengulangan pekerjaan. Benchmark Terminal-Bench 2.1 menunjukkan bahwa biaya akhir sangat dipengaruhi oleh kombinasi "agen + model". Misalnya, meski akurasi serupa, biaya untuk Claude Code dengan Fable 5 jauh lebih rendah dibandingkan konfigurasi lain, membuktikan efisiensi kerangka kerja agen. GPT-5.6 Sol, Terra, dan Luna kini tersedia di Kiro bersama model Claude, menandai diversifikasi pilihan model di platform AWS. Harga yang kompetitif, seperti pengurangan biaya Luna menjadi 0,1x, menggeser fokus dari sekadar kinerja model menjadi total biaya penyelesaian tugas bagi pengembang.

Model yang sama, harga resmi cuma turun 20%, tagihan Anda malah berkurang delapan puluh persen.

Pada 24 Agustus, OpenAI mempublikasikan hasil tes yang dilakukan bersama AWS:

Pada Terminal-Bench 2.1, biaya GPT-5.6 Terra untuk menyelesaikan satu tugas yang sukses di dalam Kiro, turun sekitar 82%.

Kiro adalah platform agen pengembangan perangkat lunak AWS, mencakup IDE, CLI, dan Web.

Tiga serangkai GPT-5.6, Sol, Terra, dan Luna, telah berjalan di dalamnya selama lebih dari sebulan.

Angka 82% ini, bukan berasal dari penurunan harga resmi.

Penyesuaian harga Terra terakhir adalah pada 30 Juli, sebesar 20%.

Pengumuman penyesuaian harga OpenAI tanggal 30 Juli, Terra turun 20%.

Harga per unit cuma turun 20%, tagihan malah bisa ditebang delapan puluh persen.

Enam puluh persen poin selisih yang dihemat dari mana, itulah yang patut kita perhatikan.

GPT-5.6 mendarat di Kiro adalah hal yang terjadi pada Juli tahun ini.

Pertama, pada tanggal 13, AWS mengumumkan GPT-5.6 Sol, Terra, dan Luna tersedia secara resmi di Amazon Bedrock.

Keeseokan harinya, Kiro memposting blog yang mengumumkan ketiga model tersebut tersedia di IDE, CLI, dan Web.

Ini adalah pertama kalinya model OpenAI masuk ke Kiro, tepat pada saat Kiro merayakan satu tahun pratinjau publiknya.

Pertama-tama taruh model di rak, lalu ajak kerja, lebih dari sebulan kemudian, OpenAI kembali memberikan hasil pekerjaan:

Kedua perusahaan bersama-sama menyetel lingkungan Kiro dan model OpenAI, biaya Terra untuk menyelesaikan satu tugas yang sukses, turun sekitar 82%.

Yang Dihemat

Adalah Uang untuk Jalan Memutar

Penyesuaian harga pada 30 Juli itu, Terra turun 20%, tapi dalam tes Kiro, biaya per tugas turun 82%.

Enam puluh persen ekstra yang dihemat itu, berasal dari mana?

Arahnya ya cuma beberapa ini:

Token yang dikeluarkan model lebih sedikit, jumlah pemanggilan bolak-balik alat lebih sedikit, percobaan ulang dan jalan memutar setelah gagal lebih sedikit.

Jadi sebagian besar yang dihemat ini, bukanlah uang untuk setiap pemanggilan, melainkan uang untuk pemanggilan-pemanggilan yang tadinya akan terbuang percuma.

Logikanya sederhana: Sebuah agen AI yang gagal mengerjakan tugas sekali, tagihan tetap dicatat. Di tengah jalan ia salah pilih jalur, nyasar tiga putaran lalu balik lagi, token-token ini juga tetap dibayar.

Dalam pengembangan nyata, uang seringkali bocor begini caranya.

OpenAI juga pernah menyebutkan logika yang sama di blog resminya, efisiensi berasal dari tiga lapisan:

Kerangka kerja agen yang meluncurkan permintaan dan mengorganisir konteks, sistem orkestrasi yang mengatur permintaan di tengah, dan terakhir adalah model itu sendiri yang berjalan di GPU.

OpenAI memecah sumber efisiensi GPT-5.6: Permintaan dimulai dari kerangka kerja agen, melalui sistem orkestrasi, akhirnya ke GPU untuk menjalankan model, setiap lapisan menghemat.

Menghemat uang juga bisa sampai pada pembagian tugas model.

OpenAI juga pernah memberikan contoh penggunaan: alur kerja pengkodean bisa menggunakan Sol untuk memikirkan masalah dengan jelas dan membuat rencana, lalu ganti ke Luna untuk mengimplementasikan perubahan-perubahan yang sudah jelas definisinya, menulis tes, dan menjalankan evaluasi.

Di jalur perakitan yang sama, bagian-bagian berbeda dilengkapi dengan kecerdasan level yang berbeda.

Model Hanya Menempati Setengah Tagihan

Ganti Kerangka, Ganti Harga

Soal-soal Terminal-Bench 2.1 ini, bukanlah soal yang dijawab model sendirian.

Ia memasukkan model ke dalam lingkungan terminal, memberikan satu tujuan yang ambigu, membiarkannya merencanakan jalur sendiri, memanggil alat, menulis skrip, menangani laporan error, beriterasi berulang kali.

Jadi skor yang keluar, adalah skor kombinasi "agen + model".

Papan peringkat publik Terminal-Bench 2.1, di sebelah kanan akurasi ada tambahan kolom biaya. (Sumber: Terminal-Bench)

Empat baris angka dalam papan peringkat paling bisa menjelaskan masalah:

Claude Code dengan Fable 5, 83,8%, $552,67;

Codex dengan GPT-5.5, 83,1%, $2059,19;

Codex dengan GPT-5.6 Terra, 78,4%, $421,15;

Codex dengan GPT-5.6 Luna, 75,7%, $241,45.

Dua baris pertama skornya hanya beda 0,7 poin persen, tagihannya beda hampir 4 kali lipat.

Model yang sama, dimasukkan ke kerangka kerja yang berbeda, dikombinasi dengan strategi organisasi konteks dan alat yang berbeda, harganya juga sama sekali berbeda.

Menurut data resmi dari Kiro, Terra mendapat skor 77,4 pada Coding Agent Index, hanya sedikit lebih tinggi dari Claude Fable 5 yang 77,2.

Keunggulannya bukan pada skor, melainkan pada harga yang sesuai dengan skor ini.

Fokus upaya Kiro yang berbasis spec-driven juga di sini, inti permainannya cuma satu kalimat: Jangan langsung menulis kode.

Pertama-tama ia memecah tujuan ambigu pengguna menjadi dokumen kebutuhan yang jelas, desain teknis, dan daftar tugas yang dapat dieksekusi, baru diserahkan ke model.

Dengan demikian, yang sampai ke tangan model bukan lagi kalimat yang tidak jelas, melainkan setumpuk pekerjaan yang sudah dijelaskan.

Orang yang familiar dengan Agent akan segera menyadari, langkah ini menghemat justru bagian pengeluaran yang paling mahal.

Model yang melenceng, mengulang, membongkar dan mengerjakan ulang, token yang terbakar seringkali lebih banyak daripada mengerjakan dengan benar.

Kiro juga menyisipkan dua penahan dalam alur: Sebelum kode benar-benar dimodifikasi, berhenti dulu untuk dilihat orang; setelah pekerjaan selesai, otomatis jalankan serangkaian tes untuk memverifikasi benar atau salah.

Setiap pengulangan yang dihentikan oleh dua penahan ini, dapat menghemat uang sungguhan.

Wilayah Claude di Domain Amazon

GPT Merebut Setengahnya

Satu tahun lalu, Kiro masih hanya sebuah IDE berbasis spec-driven, pemilih model adalah wilayah utama Anthropic.

Satu tahun kemudian, AWS di platform agen pengembangannya sendiri, sekaligus memasukkan tiga model OpenAI dalam sekali waktu.

Sol, Terra, Luna berdampingan dengan Claude dalam menu drop-down yang sama, gambaran ini sulit dibayangkan setahun lalu.

Meskipun GPT-5.6 kali ini "masuk seluruh keluarga", tapi tidak "terbuka sepenuhnya".

Tiga model tersebut dibuka secara bertahap dan eksperimental, ditujukan untuk pengguna Pro, Pro+, Pro Max, dan Power, wilayahnya hanya dua, Virginia Utara AS dan Frankfurt Eropa, mendukung inferensi lintas wilayah.

Ada satu hal lagi yang membuat banyak orang tidak terbiasa: Model-model ini di Kiro menggunakan jalur pemikiran tersembunyi, Anda tidak bisa melihat langkah-langkah penalarannya, hanya melihat hasil akhirnya.

Orang yang terbiasa mengawasi penalaran agen langkah demi langkah, akan merasa seperti melempar pekerjaan ke dalam kotak yang tidak transparan.

Pernyataan resmi mengatakan, ini adalah perilaku yang diharapkan, tidak mempengaruhi kualitas output.

Tiga model tersebut memiliki harga jelas di dalam Kiro.

Saat pertama kali diluncurkan tanggal 14 Juli, untuk tugas yang sama, Sol dikenakan 2,4 kali, Terra 1,2 kali, Luna 0,6 kali.

Ketika penurunan harga OpenAI pada 30 Juli diterapkan, keesokan harinya Kiro mengikutinya: Luna dipotong dari 0,6 kali menjadi 0,1 kali, Terra turun dari 1,2 kali ke 1,0 kali, hanya Sol yang tidak berubah.

Sikap AWS sudah jelas: Sebuah platform pengembangan, tidak boleh hanya terikat pada satu model.

Di dalam pemilih yang sama, dua model mutakhir mulai saling menekan harga.

Standar evaluasi model juga ikut berubah: Skor tinggi tidak lagi otomatis menang, mengeluarkan uang lebih sedikit juga bisa menang.

Bagi pengembang, memilih model dulu bertanya "model ini berapa per satu juta token", sekarang harus bertanya "untuk menyelesaikan hal ini, saya harus bayar berapa".

Referensi:

https://x.com/OpenAIDevs/status/2091966982015103068

https://openai.com/index/gpt-5-6-in-kiro/

Artikel ini berasal dari akun WeChat publik "新智元" (ID: AI_era), penulis: ASI启示录, editor: 元宇

Kripto yang Sedang Tren

Pertanyaan Terkait

QMenurut artikel, mengapa tagihan pengembang bisa turun 80% meski harga resmi model GPT-5.6 Terra hanya turun 20%?

APenurunan tagihan sebesar 80% bukan hanya karena penurunan harga model sebesar 20%, tetapi terutama berkat optimasi lingkungan Kiro dan model OpenAI yang dilakukan bersama oleh AWS dan OpenAI. Pengoptimalan ini mengurangi token yang tidak perlu, panggilan alat yang berulang, serta percobaan ulang dan jalan memutar yang gagal, sehingga menghemat biaya panggilan yang sebelumnya terbuang sia-sia.

QApa peran Kiro dalam membantu mengurangi biaya pengembangan perangkat lunak berbasis AI menurut artikel?

AKiro, platform agen pengembangan perangkat lunak AWS, menerapkan pendekatan 'spec-driven' yang mengubah tujuan pengguna yang samar menjadi dokumen kebutuhan, desain teknis, dan daftar tugas yang dapat dieksekusi sebelum memberikannya ke model. Ini mencegah model menyimpang dan mengulang pekerjaan, yang merupakan sumber pemborosan token terbesar. Kiro juga menambahkan dua 'gerbang' tinjauan manusia dan pengujian otomatis untuk lebih mengurangi pengulangan yang mahal.

QBagaimana GPT-5.6 dibandingkan dengan Claude dalam hal biaya dan kinerja di platform Kiro berdasarkan artikel?

ADalam Indeks Coding Agent Kiro, GPT-5.6 Terra mencetak 77,4, sedikit lebih tinggi dari Claude Fable 5 yang mendapat 77,2. Namun, keunggulan utama Terra bukan pada skor, tetapi pada biaya yang jauh lebih rendah untuk skor yang setara. Sebagai contoh, di Terminal-Bench 2.1, kombinasi Claude Code dan Fable 5 menghasilkan akurasi 83,8% dengan biaya $552,67, sedangkan kombinasi Codex dan GPT-5.6 Terra mencapai akurasi 78,4% dengan biaya hanya $421,15, menunjukkan efisiensi biaya yang lebih baik.

QApa saja tiga model dalam keluarga GPT-5.6 yang disebutkan dalam artikel, dan bagaimana strategi harganya di Kiro?

ATiga model tersebut adalah Sol, Terra, dan Luna. Saat diluncurkan di Kiro pada 14 Juli, untuk tugas yang sama, Sol dikenakan biaya 2,4 kali, Terra 1,2 kali, dan Luna 0,6 kali. Setelah penurunan harga OpenAI pada 30 Juli, Kiro menyesuaikan harga: Luna turun drastis dari 0,6 kali menjadi 0,1 kali, Terra dari 1,2 kali menjadi 1,0 kali, sementara harga Sol tidak berubah.

QMenurut artikel, bagaimana perubahan paradigma dalam memilih model AI untuk pengembangan perangkat lunak?

AParadigma pemilihan model telah berubah dari sekadar mempertanyakan 'berapa harga per juta token' menjadi 'berapa biaya total untuk menyelesaikan tugas ini'. Kinerja tinggi tidak lagi secara otomatis menang; efisiensi biaya sekarang menjadi faktor kemenangan yang sama pentingnya. Pengembang perlu mempertimbangkan kombinasi 'agen + model' secara keseluruhan, termasuk efisiensi kerangka kerja agen, strategi pengaturan konteks, dan kebijakan alat, yang semuanya secara signifikan memengaruhi total biaya penyelesaian tugas.

Bacaan Terkait

Venture Capital China, Mulai Beralih dari “Memilih Orang” ke “Memilih Kota”

Dana ventura China kini bergeser dari fokus "memilih pendiri" ke "memilih kota". Di era internet sebelumnya, investor seperti Shen Nanpeng (Sequoia China) sering bertaruh pada pendiri berbakat seperti Wang Xing (Meituan) atau Li Bin (NIO), mengandalkan visi dan kemampuan mereka. Namun, di era teknologi keras (hard tech) seperti robotika, AI, dan bioteknologi, lokasi menjadi sangat kritis. Kota dengan ekosistem industri yang matang menawarkan peluang sukses yang lebih tinggi. Contohnya, Shenzhen mendominasi industri robotika dengan rantai pasok lengkap, Beijing menjadi pusat AI berkat konsentrasi talenta, dan Suzhou unggul dalam bioteknologi. Perubahan ini juga didorong oleh meningkatnya peran modal pemerintah daerah sebagai "modal sabar" dalam investasi. Data 2025 menunjukkan dana pemerintah menyumbang 90.2% dari komitmen LP di pasar ekuitas swasta. Pada intinya, logika investasi tetap sama: mencari probabilitas sukses tertinggi di tengah ketidakpastian. Jika dulu terletak pada individu pendiri, kini meluas ke seluruh ekosistem kota—infrastruktur industri, ketersediaan talenta, stabilitas kebijakan, dan rekam jejak kota dalam membina perusahaan sukses. Modal kini mengalir terkonsentrasi ke daerah dengan proyek potensial berkelanjutan seperti Jiangsu, Guangdong, Beijing, Shanghai, dan Zhejiang. Untuk menarik modal, kota perlu fokus membangun keunggulan spesifik dalam beberapa bidang industri, menyediakan pijakan proyek yang jelas, serta menciptakan iklim investasi yang stabil dan dapat dipercayai.

marsbit54m yang lalu

Venture Capital China, Mulai Beralih dari “Memilih Orang” ke “Memilih Kota”

marsbit54m yang lalu

Trading

Spot

Artikel Populer

Cara Membeli BILL

Selamat datang di HTX.com! Kami telah membuat pembelian Billions Network (BILL) menjadi mudah dan nyaman. Ikuti panduan langkah demi langkah kami untuk memulai perjalanan kripto Anda.Langkah 1: Buat Akun HTX AndaGunakan alamat email atau nomor ponsel Anda untuk mendaftar akun gratis di HTX. Rasakan perjalanan pendaftaran yang mudah dan buka semua fitur.Dapatkan Akun SayaLangkah 2: Buka Beli Kripto, lalu Pilih Metode Pembayaran AndaKartu Kredit/Debit: Gunakan Visa atau Mastercard Anda untuk membeli Billions Network (BILL) secara instan.Saldo: Gunakan dana dari saldo akun HTX Anda untuk melakukan trading dengan lancar.Pihak Ketiga: Kami telah menambahkan metode pembayaran populer seperti Google Pay dan Apple Pay untuk meningkatkan kenyamanan.P2P: Lakukan trading langsung dengan pengguna lain di HTX.Over-the-Counter (OTC): Kami menawarkan layanan yang dibuat khusus dan kurs yang kompetitif bagi para trader.Langkah 3: Simpan Billions Network (BILL) AndaSetelah melakukan pembelian, simpan Billions Network (BILL) di akun HTX Anda. Selain itu, Anda dapat mengirimkannya ke tempat lain melalui transfer blockchain atau menggunakannya untuk memperdagangkan mata uang kripto lainnya.Langkah 4: Lakukan trading Billions Network (BILL)Lakukan trading Billions Network (BILL) dengan mudah di pasar spot HTX. Cukup akses akun Anda, pilih pasangan perdagangan, jalankan trading, lalu pantau secara real-time. Kami menawarkan pengalaman yang ramah pengguna baik untuk pemula maupun trader berpengalaman.

535 Total TayanganDipublikasikan pada 2026.05.07Diperbarui pada 2026.06.02

Cara Membeli BILL

Diskusi

Selamat datang di Komunitas HTX. Di sini, Anda bisa terus mendapatkan informasi terbaru tentang perkembangan platform terkini dan mendapatkan akses ke wawasan pasar profesional. Pendapat pengguna mengenai harga BILL (BILL) disajikan di bawah ini.

活动图片