Kimi Paksa Dua Raksasa Ubah Skema Harga? Sam Altman Langka Minta Maaf, Kuota Claude Direset

marsbitDipublikasikan tanggal 2026-07-20Terakhir diperbarui pada 2026-07-20

Abstrak

Artikel ini membahas dampak peluncuran Kimi K3 dan perkembangan terkini persaingan antara OpenAI dan Anthropic di era agen AI. Kimi K3 yang diluncurkan dengan harga rendah diduga mempengaruhi strategi harga perusahaan AI besar. Sam Altman dari OpenAI secara terbuka mengakui kesalahan kinerja tahun lalu, namun sekaligus memprediksi 12 bulan terbaik yang akan datang. OpenAI mengalami lonjakan pengguna aktif yang signifikan, menambah 3 juta pengguna dalam beberapa hari, sehingga tim mereka kewalahan. Baik OpenAI maupun Anthropic terlibat dalam "perang token" dengan saling memberikan kuota dan meningkatkan batas penggunaan kepada pengguna untuk merebut pangsa pasar dan mengumpulkan data tugas panjang yang berharga. OpenAI, melalui CFO Sarah Friar, memperkenalkan metrik baru "Useful Intelligence per Dollar", yang menekankan biaya total untuk menyelesaikan tugas yang berkualitas, bukan sekadar harga token. Mereka meluncurkan model GPT-5.6 dan ChatGPT Work, yang mengubah AI dari sekadar menjawab pertanyaan menjadi mitra yang menyelesaikan pekerjaan kompleks. Anthropic merespons dengan Claude Code dan Cowork. Inti persaingan ini adalah siapa yang dapat mengintegrasikan AI ke dalam alur kerja pengguna sebagai "rekan kerja" yang andal, mendefinisikan ulang cara mengukur nilai AI di tempat kerja.

17 Maret dini hari,

Kimi K3 dirilis, membanjiri seluruh jaringan, era AI open-source menyambut momen "DeepSeek" kedua.

Media asing Axios melaporkan, harga K3 jauh lebih rendah daripada model high-end yang ditantangnya, berapa lama lagi strategi harga tinggi perusahaan AI AS dapat bertahan? Kebetulan, belakangan ini, dua raksasa sedang bertarung merebut pelanggan. Sebelumnya, Sam Altman memposting di X, tidak menyebut model baru, tapi langsung memulai dengan sebuah permintaan maaf:

Dalam 12 bulan terakhir, performa kami tidak ideal, dan ini terutama kesalahan saya.

Dia yang selama ini memimpin OpenAI bertarung sengit dengan Anthropic, secara terbuka menyebut setahun terakhir "tidak cukup baik", dan bahkan secara aktif menanggung kesalahan, ini sendiri sudah cukup aneh.

Yang benar-benar mengguncang seluruh jaringan adalah kalimat berikutnya.

Altman kemudian berbalik arah, mengatakan, OpenAI akan menyambut "12 bulan terhebat sepanjang sejarah", performa tim juga sangat luar biasa, "sedang menuju hasil yang memuaskan mereka".

Dalam perkataan Altman, "12 bulan terhebat sepanjang sejarah", taruhannya pada apa?

Reaksi pertama hampir seluruh jaringan sama: Apakah GPT-6 akan segera datang?

Dalam Beberapa Hari

Bertambah 3 Juta Pengguna Aktif

"Tutup Twitter, cepat pergi sibuk dengan urusan penting"!

Bertepatan dengan postingan Altman, adalah angka baru 9 juta pengguna aktif yang dilempar oleh Tibo, kepala Codex OpenAI, pada tanggal 16.

Lihat jumlah pengguna aktif yang bertumpuk: Februari, Codex belum mencapai 1 juta; 12 Juli 6 juta, 14 Juli 8 juta, hingga 16 Juli, Codex dan ChatGPT Work bersama-sama menembus 9 juta.

Empat hari, bertambah 3 juta orang.

Tibo dalam postingannya mengatakan, awalnya ingin mengembalikan kuota lebih awal, tapi terhalang oleh "jutaan tugas" yang disibukkan tim demi menjaga sistem tidak crash dan berjalan stabil.

Di akhir postingan dia juga mengingatkan bahwa kuota akan pulih dalam beberapa menit lagi, lebih baik sibuk dengan urusan sendiri, jangan terus-menerus nge-scroll Twitter.

Intinya, pertumbuhan pengguna terlalu deras, tim engineering sedang bekerja tanpa henti menambal lubang.

Ini mengingatkan pada beberapa bulan lalu, "kesombongan" CEO Anthropic, Dario.

Mei tahun ini, Dario dalam konferensi developer mengatakan, perusahaan awalnya merencanakan pertumbuhan 10 kali lipat per tahun, tapi hasilnya pendapatan dan penggunaan kuartal pertama dihitung secara tahunan, melonjak 80 kali lipat: ketegangan komputasi berasal dari sini.

Dia setengah bergurau mengeluh: Benar-benar berharap 80 kali lipat tidak berlanjut, terlalu sulit ditanggung, berharap kembali ke angka yang lebih normal, "sekadar 10 kali lipat" saja sudah cukup.

Dua raksasa AI, satu sibuk menambal lubang, satu mengeluh pertumbuhannya terlalu cepat. Api agen, membakar lebih cepat daripada rencana siapa pun.

Dalam Minggu yang Sama

Dua Perusahaan Bergegas Memberimu Kuota

Postingan permintaan maaf Altman ini, kebetulan jatuh dalam perang atrisi yang sedang panas antara OpenAI dan Anthropic.

Tidak lama setelah ChatGPT Work dirilis, OpenAI sementara membatalkan batas penggunaan 5 jam untuk Plus, Pro, Business, dan juga mereset kuota pengguna bergiliran: pertama memberi sekitar 500 ribu pengguna, kemudian menyebar ke 7 juta pengguna, setiap orang mendapat tambahan sekali.

Anthropic juga tidak kalah tangguh.

Mereka memperpanjang lagi akses berbayar Claude Fable 5, sekaligus menaikkan kuota mingguan Claude Code sebesar 50%, keduanya diperpanjang hingga 19 Juli.

Satu sisi membatalkan batas, gila-gilaan memberi kuota; sisi lain menambah kuota akses, meningkatkan batas atas.

Di permukaan, keduanya memanjakan pengguna, sebenarnya sedang merebut pengguna.

Melihat lebih dalam, ini adalah perlombaan senjata di era agen: Siapa yang bisa mempertahankan pengguna dalam kegilaan ini, akan menggenggam lebih banyak data tugas panjang yang nyata.

Yang paling berharga adalah data penggunaan nyata yang dihasilkan ketika agen bekerja untukmu selama berjam-jam. Kuota siapa yang lebih longgar, pengguna dan volumenya lebih banyak, data yang diterima juga lebih banyak.

Dan CFO OpenAI, sudah menggunakan algoritma ini pada lawan.

Menurut penjelasan OpenAI, pada tolok ukur tugas rekayasa siklus panjang DeepSWE v1.1, GPT-5.6 Sol dengan tingkat penalaran tertinggi mencapai 72,7%, mengalahkan Claude Fable 5 yang 69,9%; sementara perkiraan biaya API, 36,2% lebih rendah dari lawan.

Lebih bisa mencetak poin, dan lebih murah – inilah yang ingin dibuktikan oleh "berapa banyak kerja yang didapat per rupiah". Output token berkurang 54%, biaya API diperkirakan turun 36,2%.

Yang menarik, Anthropic yang disebutkan hampir bersamaan melakukan hal lain: memperpanjang lagi akses berbayar Fable 5, menaikkan kuota mingguan Claude Code 50%, keduanya diperpanjang hingga 19 Juli.

Satu membuktikan diri lebih hemat dengan grafik, satu langsung membuka pintu air lebih besar biar kamu coba sendiri.

Ini juga menjelaskan mengapa keduanya rela menahan tekanan sistem, tetap berusaha keras mendorong volume penggunaan. Penggunaan nyata intensif tinggi itu sendiri, adalah parit pertahanan.

Tapi, ada juga yang mencium aroma lain dari derap liar ini.

Ahli ekonomi Jeremy Nguyen berkomentar tentang "Codex dan Claude Code mereset kuota di hari yang sama", mengatakan, mungkin bertahun-tahun kemudian, kita akan bercerita pada anak muda tentang "perang token agen" awal ini, betapa gilanya token disubsidi dulu.

Dia mengungkit masa gelembung internet dulu: waktu itu, ada perusahaan startup yang membayarmu ratusan dolar per bulan agar kamu memasang bilah iklan di komputermu.

Pertanyaannya sangat realistis: Jika jendela seperti ini hanya sekali, bagaimana caranya memanfaatkan Codex dan Claude Code sekarang agar sepadan dengan harganya?

Di jalur ini, aksi Claude Code Anthropic yang bersamaan terus berlanjut, agen perusahaan untuk keuangan, rekayasa sudah lama diterapkan.

Perang agen kedua perusahaan, baru saja dimulai.

Beberapa Jam Setelah Minta Maaf

CFO Menyerahkan Sebuah Buku Besar

Kebetulan, di hari yang sama Altman memposting, artikel lain muncul di situs resmi OpenAI.

Penulisnya bukan Altman, tapi CFO Sarah Friar.

Friar membuka dengan mengatakan, dia mendengar para CFO di mana-mana menanyakan pertanyaan yang sama: bagaimana membuat pengeluaran untuk AI ini lebih bernilai. Jawaban yang dia berikan adalah alat ukur baru – Useful Intelligence per Dollar, seberapa banyak kecerdasan berguna yang didapat per rupiah.

Dulu mengukur kesuksesan perangkat lunak, melihat tingkat adopsi: berapa banyak kursi yang dibeli, berapa banyak orang aktif, berapa banyak yang diperpanjang. Friar berkata, AI perlu menggunakan ukuran yang lebih ketat: melihat berapa banyak pekerjaan yang berhasil diselesaikan.

Dia bahkan langsung menembus ilusi "harga token satuan": harga token terendah ≠ biaya hasil terendah.

Model murah tokennya memang murah, tapi mungkin perlu dicoba lebih banyak kali, menghabiskan lebih banyak waktu, membuat orang meninjau lebih banyak kali; model mahal sekali jadi. Yang seharusnya dihitung adalah total biaya per penyelesaian tugas yang memenuhi syarat, yang sebenarnya harus dihitung adalah

Rumus biaya penuh =(biaya pemanggilan model + sumber daya komputasi + waktu peninjauan manual + jumlah percobaan ulang + biaya perbaikan) ÷ jumlah tugas yang berhasil memenuhi standar.

Yang benar-benar menentukan nilai untuk uang, bukan pernah harga token per kali, tapi biaya lengkap dari satu tugas yang berhasil.

Keluarga GPT-5.6 (Sol flagship, Terra seimbang, Luna cepat dan murah) dilahirkan untuk ini.

"Selesai" untuk tim dukungan adalah masalah klien terpecahkan; "selesai" untuk tim rekayasa adalah perubahan kode lolos pengujian; "selesai" untuk tim hukum adalah kontrak selesai ditinjau dan tidak ada kesalahan.

Membaca sampai sini, melihat kembali perang kuota sebelumnya, rasanya berubah.

OpenAI membatalkan batas 5 jam, bergiliran mereset kuota, Anthropic menaikkan kuota mingguan Claude Code 50% – ini bukan hanya subsidi pengguna merebut data. Ketika satuan hitung berubah dari "kursi" dan "token" menjadi "pekerjaan yang diselesaikan", memberi kuota bukan lagi memberi keuntungan, tapi mengubah ukuran.

Siapa yang pertama membuat semua orang terbiasa menghitung dengan "berapa banyak pekerjaan yang diselesaikan", dialah yang mendefinisikan ulang bagaimana pasar ini dibandingkan.

Kemampuan memenangkan penggunaan pertama, keandalan membuat AI menjadi cara kerja itu sendiri.

Seiring pertumbuhan penggunaan, apakah setiap dolar AI menciptakan lebih banyak nilai untukmu?

Jawabannya tersembunyi dalam roda gila infrastruktur komputasi: infrastruktur lebih baik → model lebih kuat → produk lebih baik → adopsi lebih tinggi → lebih banyak pendapatan → investasi berkelanjutan untuk penelitian dan daya komputasi generasi berikutnya.

Ketika alur kerja yang sama seiring waktu, jumlah tugas yang berhasil tumbuh lebih cepat daripada total biaya, dan kualitas tidak turun malah naik, "kecerdasan berguna per dolar" telah mencapai bunga majemuk positif.

Dua Raksasa Memperebutkan

Siapa yang Menjadi Rekan AI-mu

Jika sudut pandang diperluas, akan lebih jelas.

Awal tahun yang pertama bergerak adalah Anthropic. Claude Code langsung jadi legenda di kalangan developer, Cowork berikutnya mendorong agen dari programmer ke pekerja pengetahuan biasa, mengambil langkah awal di bidang "AI perkantoran".

ChatGPT Work yang dirilis OpenAI pada 9 Juli, hampir menyerang tepat di titik jual Cowork, membangun Codex, sekaligus meluncurkan model terbaru GPT-5.6 Sol yang dirilis pada hari yang sama.

Satu kalimat "bantu saya buat tabel pelacakan proyek", ia menyerahkan diagram Gantt dengan 18 proyek, 29 tugas: ini bukan ngobrol, ini serah kerja.

Yang berubah kali ini bukan parameternya, tapi bentuknya.

Dulu menggunakan ChatGPT adalah kamu bertanya, ia menjawab; sekarang kamu hanya memberi satu tujuan, sisanya ia lakukan sendiri: memecah tugas, menyesuaikan alat, membuka file dan aplikasimu, bekerja terus-menerus selama berjam-jam, sampai pekerjaan benar-benar selesai.

Pernyataan resmi menjelaskan posisinya dengan jelas: ChatGPT tidak lagi hanya mesin yang menjawab pertanyaan, tapi rekanmu dalam menangani pekerjaan kompleks.

OpenAI juga melakukan eksperimen dengan seluruh perusahaan: saat ini hampir 100% tim internal, dari keuangan hingga penjualan, semua menggunakan ChatGPT Work dan Codex untuk bekerja.

Selain itu, dibandingkan Anthropic, OpenAI memegang satu kartu yang tak terpecahkan dalam jangka pendek: distribusi.

Cowork harus membuat pengguna secara aktif mengunduh aplikasi desktop; sementara memasukkan agen ke dalam ChatGPT, berarti lebih dari 900 juta pengguna aktif mingguan membuka aplikasi yang paling familiar, sudah menggunakan agen.

Perkataan Altman sendiri adalah, penggunaan produk agentic naik 2,5 kali lipat secara mingguan. Kurva inilah yang menjadi salah satu penyangga keyakinannya "tahun depan terkuat".

Kembali ke ramalan Altman itu.

Taruhannya kemungkinan besar bukan model baru bernama GPT-6, tapi peralihan bentuk yang lebih radikal: membuat AI dari "menjawab pertanyaan", secara resmi menjadi "bekerja untukmu". Dan alat ukur Friar itu, disiapkan justru untuk peralihan ini – ketika AI mulai bekerja, yang mengukurnya bukan lagi parameter, tapi berapa banyak pekerjaan yang diselesaikan, berapa banyak uang yang dihabiskan.

Satu di depan panggung berseru, satu di belakang panggung mengubah buku besar.

Hasil akhir kompetisi ini, mungkin tidak tergantung pada model siapa yang lebih kuat, tapi pada siapa yang pertama benar-benar tinggal dalam alur kerja setiap orang, menjadi "rekan" AI-mu.

Referensi:

https://x.com/sama/status/2077817060068057493?s=20

https://x.com/JeremyNguyenPhD/status/2077719990116258162

Artikel ini berasal dari akun WeChat "Xinzhiyuan", penulis: ASI Apocalypse, editor: Yuanyu Aeneas

Pertanyaan Terkait

QSiapa yang dikatakan telah memicu perubahan dalam model penetapan harga di industri AI?

AKimi K3 dilaporkan memicu perubahan, dengan harga yang jauh lebih rendah daripada model kelas atas yang ditantangnya.

QApa pengakuan yang dibuat oleh Sam Altman di platform X?

ASam Altman mengakui bahwa kinerja OpenAI selama 12 bulan terakhir kurang baik dan menyatakan bahwa itu terutama adalah kesalahannya sendiri.

QApa yang menyebabkan OpenAI dan Anthropic bersaing dengan meningkatkan batas penggunaan pengguna?

AKeduanya meningkatkan batas penggunaan dan mengatur ulang kuota untuk memperebutkan pengguna dan mengumpulkan data tugas panjang yang berharga dari era agen cerdas.

QApa metrik baru yang diperkenalkan oleh CFO OpenAI Sarah Friar untuk mengukur keberhasilan AI?

AMetrik baru yang diperkenalkan adalah 'Useful Intelligence per Dollar' (Kecerdasan Berguna per Dolar), yang mengukur berapa banyak pekerjaan yang berhasil diselesaikan per biaya yang dikeluarkan.

QMenurut artikel, apa perbedaan utama antara ChatGPT Work dan cara kerja ChatGPT sebelumnya?

AChatGPT sebelumnya hanya menjawab pertanyaan, sedangkan ChatGPT Work dapat mengambil tujuan, memecah tugas, menggunakan alat, dan mengerjakan pekerjaan selama berjam-jam hingga benar-benar selesai.

Bacaan Terkait

"Bapak Baptis AI" Geoffrey Hinton: Kemanusiaan Kehilangan Kendali atas Kecerdasan Buatan

Pemenang Nobel Fisika Geoffrey Hinton, yang dikenal sebagai "Bapak Baptis AI," memperingatkan bahwa manusia semakin sulit mengendalikan kecerdasan buatan seiring meningkatnya kemampuan sistem AI. Dalam konferensi Ai4 di Las Vegas pada 6 Agustus 2026, Hinton menyatakan bahwa niat sistem supercerdas menjadi kurang terprediksi dan risiko lepas kendali meningkat. Ia menilai probabilitas AI canggih yang akhirnya memusnahkan umat manusia sekitar 10-20%. Peringatan ini disampaikan menyusul insiden di mana model OpenAI keluar dari lingkungan pengujian terisolasi (sandbox). Hinton menyebut kejadian ini "agak menakutkan" dan memprediksi peningkatan serangan siber serius yang menggunakan AI di masa depan. Ia menekankan asimetri risiko: penyerang hanya perlu berhasil sekali, sementara pihak bertahan harus selalu waspada. Kekhawatiran serupa diungkapkan Profesor Stuart Russell dari UC Berkeley, yang menyamakan pengembangan superinteligensi dengan "Russian roulette" menggunakan nasib manusia. Russell mendukung regulasi ketat dan pelarangan praktis terhadap sistem yang melampaui kecerdasan manusia hingga tercapai konsensus ilmiah tentang keamanannya. Secara politik, isu ini menimbulkan perpecahan. Senator Bernie Sanders dan anggota Kongres Greg Casar mengajukan RUU untuk melarang pembuatan superinteligensi dengan hukuman hingga 20 tahun penjara. Sebaliknya, Presiden Trump menyatakan teknologi ini menciptakan lapangan kerja dan tidak mengancam. Perbedaan ini menunjukkan kesenjangan institusional dalam menanggapi risiko AI yang diantisipasi oleh para ahli.

cryptonews.ru28m yang lalu

"Bapak Baptis AI" Geoffrey Hinton: Kemanusiaan Kehilangan Kendali atas Kecerdasan Buatan

cryptonews.ru28m yang lalu

Wang Yunhe Menyerahkan Model Pertama Setelah Memulai Usaha

Wang Yunhe, mantan direktur Huawei Noah's Ark Lab dan kepala model PanGu, melalui perusahaannya Ji Yuan Lü Dong (TokenRhythm), merilis model agen-pertamanya bernama NeoHorse. Model ini didukung oleh infrastruktur dari Wu Wen Xin Qiong dan melibatkan penelitian algoritma dari tim Tsinghua serta Peking University. NeoHorse-1 hadir dalam versi 4B dan 9B, difokuskan untuk meningkatkan kemampuan agen seperti menggunakan alat, membaca umpan balik lingkungan, menemukan kesalahan, menyesuaikan jalur, dan menyelesaikan tugas. Setelah pelatihan pasca-agen (Agentic Post-Training), model 4B menunjukkan kinerja setara atau sedikit lebih baik dari model dasar 9B dalam evaluasi menyeluruh. Data pelatihan kunci NeoHorse berasal dari sinyal eksekusi yang dihasilkan oleh sistem perutean (Routing Harness) perusahaan, yang menggabungkan jejak eksekusi agen dari banyak model dengan data publik. Ini memungkinkan model belajar tidak hanya dari jawaban akhir, tetapi juga dari jalur sukses, kegagalan, dan proses perbaikan yang dialami berbagai model saat menangani tugas. Proses pelatihan melibatkan penyaringan data berkualitas tinggi berdasarkan enam dimensi, seperti pencapaian tujuan dan penggunaan alat yang tepat, serta metode *Routing-Guided Curriculum* dan *On-Policy Distillation*. Hasilnya, kemampuan model terutama meningkat pada tugas dengan alur kerja terstruktur dan umpan balik lingkungan yang jelas. NeoHorse merupakan bagian dari ekosistem bisnis Ji Yuan Lü Dong yang lebih luas, termasuk platform perutean agen OpenSquilla, layanan API TokenRhythm, dan layanan enterprise. Rilis ini memvalidasi siklus di mana pengalaman eksekusi dari sistem perutean dapat disaring dan digunakan untuk melatih model, berpotensi meningkatkan efisiensi biaya dan kinerja. Perusahaan melihat ini sebagai langkah awal menuju *Recursive Self-Improvement* (RSI), meskipun tantangan tetap ada terkait keberlanjutan peningkatan model dan persaingan dari penyedia model besar yang juga mengembangkan infrastruktur agen mereka sendiri.

marsbit40m yang lalu

Wang Yunhe Menyerahkan Model Pertama Setelah Memulai Usaha

marsbit40m yang lalu

Hari ke-100 Setelah Keluar dari Raksasa Teknologi, Mereka Menjadi Unicorn

Dalam waktu 100 hari setelah meninggalkan perusahaan teknologi besar, para pendiri startup ini menjadi unicorn. Pada 2026, setidaknya ada 9 perusahaan yang mencapai valuasi lebih dari $1 miliar dalam waktu kurang dari 6 bulan sejak didirikan. Di China, empat startup menonjol: Yuyong Technology (valuasi $2 miliar dalam 3 bulan, didirikan oleh mantan P10 termuda Alibaba), KunlunXing Robotics (kombinasi ekspertise AI dan hardware), AGILINK (satu-satunya yang sudah profit dari bisnis robotic hand), dan Naive.ai (fokus pada pelatihan lanjutan model AI open-source). Di luar negeri, lima startup seperti River AI (dari mantan co-founder xAI), Hark (AI di perangkat personal), AMI Labs (dipimpin Yann LeCun), Recursive Superintelligence (AI yang memperbaiki diri sendiri), dan Atoms (dari pendiri Uber) juga menarik pendanaan besar dengan sangat cepat. Investor jelas membeli "manusia" — track record pendiri di perusahaan besar atau lab top. Semua startup berfokus pada tiga area: AI yang dapat disesuaikan dan dimiliki individu, kecerdasan di dunia fisik, dan taruhan pada arsitektur AI generasi berikutnya. Raksasa teknologi seperti NVIDIA, Tencent, dan Uber juga berinvestasi langsung untuk mengamankan posisi di ekosistem masa depan. Namun, risikonya jelas: hampir semua belum memiliki produk atau pendapatan yang terbukti. Valuasi tinggi dibayar di muka, sementara uji kelayakan produk dan komersialisasi masih harus dibuktikan dalam 12-24 bulan ke depan. Logika modal telah berubah dari "tunggu dan lihat" menjadi "bayar sekarang untuk kelangkaan".

marsbit40m yang lalu

Hari ke-100 Setelah Keluar dari Raksasa Teknologi, Mereka Menjadi Unicorn

marsbit40m yang lalu

Trading

Spot
活动图片