Dalam tiga bulan ke depan, harga API dan harga kredit (pemakaian pay-as-you-go di luar kuota paket) akan dipotong lebih dari 20%.
Saat ini, penyesuaian harga di sisi API sudah berlaku seketika, sedangkan penyesuaian kredit untuk ChatGPT Work dan Codex yang memenuhi syarat sedang didistribusikan bertahap.

Namun, ketiga langganan, yaitu Pro, Plus, dan Business, tidak turun sepeser pun. Kuota pemakaian yang termasuk dalam paket juga tidak dinaikkan.
Yang turun hanyalah bagian yang dibebankan per token. Artinya, semakin besar volume panggilan API Anda, semakin banyak yang Anda hemat.
Bisa Hemat Berapa Sih?
Harga API Sol sebelumnya adalah $5 per juta token input dan $30 per juta token output, yang termahal dalam keluarga GPT-5.6.
Sekarang buka halaman harga, input $4, output $20.
Input turun dua puluh persen, tidak masalah. Tapi output dipangkas dari $30 ke $20, turun sepertiga tepatnya.

Jadi, pernyataan resmi tentang penurunan harga "lebih dari 20%" sebenarnya cukup moderat. Token output yang paling mahal turun drastis 33%.
Misalkan sebuah Agen besar mengkonsumsi 100 juta token input dan 20 juta token output per bulan, sebelumnya biayanya $1100, sekarang hanya $800, penurunan komprehensif sekitar 27,3%.
Berapa banyak penghematannya, sepenuhnya tergantung pada rasio input-output Anda. Untuk pekerjaan yang berat input seperti pemrosesan dokumen batch, penghematannya sekitar dua puluh persenan; sedangkan untuk skenario seperti menulis kode gila-gilaan di Codex di mana output mendominasi, penghematan bisa mencapai tiga puluh persen ke atas.

Intinya, semakin keras Anda menggunakan Sol sebagai alat produktivitas, semakin banyak yang Anda hemat kali ini.
Harga tier cache juga ikut disesuaikan: cache input turun dari $0,5 menjadi $0,4, cache write turun dari $6,25 menjadi $5. Harga untuk slot konteks panjang juga turun, input dari $10 menjadi $8, output dari $45 menjadi $30.

OpenAI Developers kemudian membalas dengan menyatakan, harga bisa turun karena sekarang Sol berjalan lebih efisien.

Duel Dua Juara ASI: Harga Menjadi Medan Tempur Kedua
Ketika OpenAI melakukan penurunan harga sebelumnya, Sol adalah satu-satunya model yang tidak tersentuh.
Luna dipotong 80%, Terra andalan turun dua puluh persen. Hanya flagship Sol yang bertahan dengan harga asli, hanya menambahkan mode Fast yang lebih cepat tanpa kenaikan harga.
Waktu itu strategi OpenAI sangat jelas: model murah bertugas mengejar volume, kartu termahal bertahan menjaga gengsi.
Kali ini, giliran Sol sendiri yang turun tangan. Dan pada momen ini, sepertinya bukan kebetulan.
Pendapat influencer teknologi Chubby sangat langsung: Ini jelas-jelas menyasar Anthropic.
Saat ini Anthropic sedang tidak baik-baik saja. Umpan balik negatif Opus 5 belum selesai dicerna, pembatasan kecepatan pada paket langganan Fable 5 juga dikecam habis-habisan oleh pengguna.
OpenAI menurunkan harga besar-besaran saat ini adalah untuk merebut pengguna Anthropic.
Wartawan teknologi Tae Kim berkata lebih keras: OpenAI sedang menggunakan taktik perang dagang di tengah roadshow IPO Anthropic.

Ucapan ini bukanlah rumor tanpa dasar.
Anthropic pada 1 Juni tahun ini mengajukan dokumen rahasia S-1 ke SEC, secara resmi memulai proses IPO. Menurut berbagai laporan media, bank-bank penjamin emisi mulai pertengahan Juli mengatur pertemuan manajemen dengan calon investor potensial, jendela roadshow kebetulan jatuh pada bulan Agustus hingga September.
Target waktu penawaran saham perdana: paling cepat Oktober, di Nasdaq, dengan valuasi mengincar $2 triliun.
Dalam perjalanan roadshow, hal yang paling ditakuti adalah pesaing yang berbuat ulah.
Setelah pertandingan benchmark selesai, harga menjadi medan tempur kedua dalam final duel dua juara ASI.
OpenAI berani memotong harga secara gila-gilaan, bukanlah tindakan impulsif.
Infrastruktur komputasi mandiri yang mereka bangun dengan agresif sebelumnya, dan taruhan mereka pada arsitektur model yang lebih efisien, sekarang mulai menunjukkan kekuatannya.
Hanya beberapa hari yang lalu, OpenAI baru saja mengumumkan telah mengamankan daya komputasi sekitar 8 IT-GW di kawasan PORTS-Pike, Pike County, Ohio, dengan OpenAI menandatangani sewa selama 20 tahun; NVIDIA menjadi penyedia eksklusif infrastruktur komputasi AI.
Sebelumnya, OpenAI juga telah mencapai kerja sama lima tahun senilai lebih dari $300 miliar dengan Oracle, yang berpotensi menambah kapasitas hingga 4,5GW, dan menandatangani perjanjian penyebaran 6GW GPU dengan AMD.
OpenAI pada April tahun ini telah mengonfirmasi, kapasitas infrastruktur AI yang telah diamankan melebihi 10GW, dengan target diperluas menjadi 30GW pada tahun 2030.
Semakin lengkap infrastrukturnya, semakin rendah biaya marjinal, semakin besar ruang untuk menurunkan harga. Ini adalah roda yang berputar positif: Efisiensi model meningkat → Biaya inferensi turun → Ruang harga terbuka → Pengguna berduyun-duyun → Pendapatan tumbuh → Reinvestasi ke infrastruktur.

Bisa dikatakan, roda terbang OpenAI ini sedang lepas landas. Mereka sendiri juga mengatakan, GPT-5.6 Sol turut serta mengoptimasi kernel inferensi produksinya sendiri, memotong biaya layanan end-to-end sebesar 20%, dan meningkatkan efisiensi pembangkitan token lebih dari 15%.
Tapi selain menciptakan tekanan secara aktif, penurunan harga kali ini juga ada unsur terpaksa.
DeepSeek V4 Flash diluncurkan resmi pada 31 Juli, harganya sangat murah.
Yang lebih menarik adalah sebuah model misterius dengan kode nama "Ox Alpha" yang muncul dua hari lalu. Jendela konteks 1M, mendukung input teks, gambar, dan video, gratis digunakan selama seminggu.
Sekarang, model open-source dari China tidak hanya murah, tetapi kemampuannya juga terus mendekati model-model terdepan.
Jadi, gelombang penurunan harga Sol ini, sekaligus merupakan serangan aktif terhadap Anthropic, dan juga pertahanan balik terhadap model murah dari China.
Codex Tembus 20 Juta
Di hari yang sama ada juga angka lain.
Kepala Codex, Tibo, mengumumkan bahwa pengguna aktif Codex minggu ini menembus 20 juta.

Untuk merayakan tonggak sejarah ini, tim memberikan reset kuota BANKED satu kali kepada semua pengguna Codex dan ChatGPT Work.
Namun, terkait keluhan komunitas tentang kuota yang terkonsumsi terlalu cepat, Tibo mengatakan saat ini belum menemukan keanehan, tetapi penyelidikan formal telah dimulai, dan hasilnya akan disampaikan secepatnya.
Dia juga secara tidak langsung menegaskan batasan: Perilaku mengubah akun berlangganan menjadi lalu lintas API melalui sub2api, kemudian menjualnya kembali atau membaginya dengan banyak orang, tidak didukung oleh pihak resmi. Penggunaan seperti ini akan langsung ditandai oleh sistem kontrol risiko.
Jalan memecah satu akun berlangganan bulanan untuk dijual ke seratus orang, sudah ditutup.
Menggunakan melalui klien resmi, atau klien open-source seperti Pi dan OpenCode secara normal, tidak masalah sama sekali.
Referensi:
https://x.com/OpenAI/status/2090885187634905500
https://x.com/OpenAI/status/2090885188897460249
https://x.com/kimmonismus/status/2090890956287492564
https://x.com/rohanpaul_ai/status/2090885980849050036
https://x.com/rohanpaul_ai/status/2090891370663989566
https://x.com/thsottiaux/status/2090766694897619318
Artikel ini berasal dari akun WeChat "新智元", penulis: ASI启示录, editor: 所罗门







