OpenAI secara berturut-turut meluncurkan jurus-jurus besar!
Hari ini (tanggal 16), sebuah pesan internal Slack dari OpenAI bocor, mengungkapkan bahwa ChatGPT akan mengalami pembaruan performa yang "epik".

Dari data uji coba teknis yang keras, optimasi performa front-end ChatGPT kali ini sangat ekstrem, bahkan terkesan "tidak nyata":
Kecepatan pemuatan aplikasi langsung melonjak 94%, pertumbuhan memori heap berkurang 87,8%, penggunaan memori keseluruhan dipangkas 41,2%.
Jumlah permintaan jaringan anjlok 98,2%, dan pemuatan riwayat percakapan juga berkurang 99,6%.

Hampir bersamaan, Codex merilis versi GPT-5.6 "Multi-Agent v2".
Agent utama sekarang dapat secara otomatis mendelegasikan sub-tugas yang berbeda ke model yang berbeda, dan setiap sub-Agent juga dapat mengatur intensitas penalarannya sendiri.
Presiden OpenAI, Greg Brockman, menyatakan, "Kami sedang bergerak menuju dunia tanpa pemilihan model manual".

Harus diakui, serangan "dua cabang" OpenAI ini –
Langsung menghilangkan kerumitan "menunggu" dan "memilih" bagi pengguna, membuat ChatGPT benar-benar mencapai pengalaman interaksi yang sangat cepat, mulus, dan lancar.
ChatGPT Dirombak Total, Pemuatan Melonjak 94%
Banyak orang tidak tahu, pembaruan performa besar ChatGPT kali ini sebenarnya adalah pertarungan kunci setelah "raja pemrograman" Scott Gray mengundurkan diri.
Selama ini, yang paling ditakuti orang saat menggunakan ChatGPT adalah percakapan panjang yang semakin lama semakin lemot, bahkan halaman web bisa langsung crash.
Di forum resmi OpenAI, ada yang memposting pertanyaan "Apakah Codex versi baru jadi lebih lambat?", dan di bawahnya banyak yang menyetujui.

Kali ini, Andrew Ambrosino, kepala Codex, membocorkan screenshot internal Slack yang langsung memberikan gambaran jelas:
Yang digunakan untuk pengujian internal adalah sebuah percakapan "monster" yang terdiri dari 741 putaran dengan volume mencapai 231MB!


Ini terdengar seperti sampel ekstrem, tapi ini adalah keseharian di era Agent.
Dulu percakapan adalah riwayat obrolan, puluhan putaran sudah selesai; sekarang, untuk satu tugas yang sedikit kompleks, membacanya kode, menjalankan pengujian, memperbaiki lalu memeriksa lagi, ratusan putaran sudah habis.
Percakapan intensitas tinggi seperti itu, sekarang membukanya, waktu rata-rata turun dari 27,62 detik menjadi 1,66 detik.
Pertumbuhan memori keseluruhan aplikasi ditekan dari 1030,7 MiB menjadi 606 MiB;
Permintaan jaringan yang perlu dikirim untuk membuka sekali percakapan, turun dari 894 kali menjadi 16 kali; item sesi yang perlu dimuat, dari 15529 item menjadi 64 item.
Ini adalah optimasi front-end besar-besaran oleh OpenAI untuk percakapan super panjang ChatGPT.
Dua kata, mulus
Apa perubahan yang bisa dibawanya?
Sederhananya, riwayat obrolan yang berlangsung berbulan-bulan, akan terbuka jauh lebih cepat.
Pengembang yang sering menggunakan sesi Codex berat dengan ratusan panggilan alat, akan menemukan antarmuka menjadi jauh lebih ringan, dan penggunaan memori perangkat juga turun.
Kembali ke percakapan lama yang super panjang, tidak perlu lagi susah payah seperti "membaca file simpanan dari PS3 yang hampir rusak".

Keunggulannya yang cerdas adalah, ChatGPT tidak lagi harus memuat dan merender seluruh riwayat percakapan hanya karena Anda membuka percakapan.
Ia dapat menyimpan sebagian besar konten, dan hanya memuat sebagian kecil yang benar-benar dibutuhkan orang saat ini.
Percakapan yang sama, namun menghemat banyak pekerjaan yang tidak perlu.
Bagi orang yang terbiasa berinteraksi dalam percakapan AI yang super panjang, ini termasuk jenis pembaruan infrastruktur dasar yang terdengar membosankan, tetapi bisa sangat meningkatkan pengalaman produk.
Multi-Agent v2 Diluncurkan Penuh, Tidak Perlu Memilih GPT Secara Manual Lagi
Minggu ini, OpenAI telah diam-diam memperbarui ChatGPT.
Baru hari ini, insinyur OpenAI Eric Provencher secara resmi mengumumkan: Multi-Agent v2 sekarang telah diluncurkan secara penuh.

Fokus utamanya adalah, pembagian tugas yang cerdas.
Agent utama dapat secara otomatis mendelegasikan sub-tugas ke model apa pun yang didukung, termasuk Luna, dan setiap sub-Agent mendukung pengaturan intensitas penalaran independen.
Sekarang kartu yang dipegang ChatGPT/Codex adalah seperti ini –
GPT-5.6 Sol: Terkuat, untuk coding Agentik yang kompleks
GPT-5.6 Terra: Andalan untuk pemrograman sehari-hari
GPT-5.6 Luna: Tercepat, termurah
Daybreak: Khusus untuk keamanan siber
GPT-5.5: Untuk pemrograman kompleks, penelitian, tugas umum

Sebenarnya, tiga minggu lalu, dalam daftar model Codex, Sol dan Terra diberi label multi_agent_v2, sedangkan Luna yang termurah diberi label v1.
Hasilnya adalah, ketika Agent utama ingin memberi tugas ke Luna, sistem langsung membalas dengan "model tidak dikenal".
Di GitHub, pengembang membuka setidaknya dua issue untuk masalah ini.
Di forum resmi OpenAI ada sebuah postingan "Kembalikan Luna kepada kami", poster mengatakan bahwa sebelumnya dia menggunakan kait untuk memaksa menggunakan Luna, dan hasilnya luar biasa bagus, sekarang jalan itu sudah ditutup.

Dulu orang perlu memilih model secara manual, di masa depan sistem Agent akan secara otomatis memecah, mengeksekusi secara paralel, dan merangkum hasil, mengubah model menjadi sumber daya komputasi internal.
Hanya 20% langkah dari tugas kompleks yang membutuhkan model terkuat, sisanya dapat diserahkan ke model yang lebih murah.
Dengan demikian, biaya inferensi dapat dikurangi secara signifikan, mempercepat transformasi ChatGPT dari alat obrolan menjadi platform alur kerja.
ChatGPT Berevolusi di Tempat, Monster Otomatis Penuh Datang
Front-end membersihkan "beban sejarah", back-end membuka jalan untuk "distribusi cerdas".
Serangan "kombinasi" di lapisan dasar OpenAI ini tidak hanya membuat ChatGPT benar-benar meninggalkan era lag, tetapi juga menyatakan kepada seluruh industri:
Model besar sedang berakselerasi dari "alat obrolan", menuju evolusi menjadi "platform alur kerja otomatis penuh" yang sebenarnya.
Tidak perlu lagi pusing memilih model mana yang harus dipertimbangkan biayanya, juga tidak perlu lagi menunggu dengan sabar percakapan monster ratusan putaran yang terbuka perlahan.
Cukup lemparkan tugas kompleks ke sana, sisanya pemecahan otomatis, penjadwalan model, dan rendering kecepatan tinggi, semuanya serahkan ke sistem.

Era kelancaran ekstrem milik Agent, benar-benar telah tiba.
Menghadapi ChatGPT yang begitu "tanpa hambatan" dan kuat, apakah produktivitas Anda siap lepas landas?
Referensi:
https://x.com/Ananth7e/status/2088490421676863782?s=20
https://x.com/ajambrosino/status/2088401536057827344?s=20
https://x.com/gdb/status/2088658133971509640
Artikel ini berasal dari akun WeChat "Xin Zhi Yuan", penulis: Taozi





