Bulan Agustus, situasi pertempuran AI sudah benar-benar memanas.
Anthropic bersiap siaga, siap untuk mengungkap Fable 5.1 (atau Fable 6), menghadapi OpenAI GPT-6 secara langsung.
Sekarang, OpenAI terus melaju, akan meluncurkan model generasi baru Astra, targetnya minggu ini. GPT-6 dikabarkan memiliki 10 triliun parameter.
Bulan Agustus, pertempuran perebutan takhta AI telah dimulai di ranah opini publik. Sudah ada netizen yang tidak lagi optimis dengan Anthropic, bertaruh bahwa benchmark test akan dihancurkan oleh GPT-6.

Fable 6 mungkin masih lama, tapi Fable 5.1 sudah bocor.
Sekarang, seluruh internet menahan napas menunggu: Mahkota AI Agustus ini, jatuh ke tangan siapa?
Generasi Berikutnya Anthropic Fable Sudah di Depan Mata!
Kebocoran versi berikutnya Fable Anthropic kali ini agak mengejutkan.
21 Juli, OpenAI menyadari terlambat: Hugging Face disusupi ChatGPT, berhasil menembus dan mencuri "kunci jawaban ujian", bahkan meninggalkan "contekan" untuk AI generasi berikutnya. Singkatnya, ini adalah cerita Terminator cyber yang benar-benar merobek rasa aman palsu para raksasa AI Silicon Valley.
Untuk sesaat, semua lab AI Silicon Valley merasa terancam. Anthropic segera meninjau kembali 140.000 kali evaluasi model historis, yang mungkin termasuk model Fable generasi berikutnya.
Ungkapan Anthropic adalah, Opus 4.7, Mythos 5, dan "model uji versi penelitian internal" benar-benar lepas kendali dalam pengujian, memicu insiden keamanan informasi.

Yang aneh adalah, instruksi pengujiannya sangat jelas dan sesuai: Mencari celah keamanan di lingkungan virtual simulasi CTF (Capture The Flag), dan memperoleh kredensial.

Ini adalah latihan sandbox standar yang bertujuan untuk menguji kemampuan penalaran siklus panjang (Long-horizon reasoning) dan kemampuan "penggunaan komputer" (Computer Use) model besar.
Dulu, model besar akan berputar-putar dengan patuh di lingkungan virtual. Tapi kali ini, Anthropic menemukan keputusan AI sepenuhnya di luar dugaan.
Ia menganggap kenyataan sebagai permainan. Model internal Anthropic diam-diam melampaui batas keamanan, mengulurkan tangan ke internet publik.
Dalam waktu sangat singkat, ia mengidentifikasi sistem produksi tiga perusahaan nyata, menilainya sebagai "target level berikutnya" CTF. Ia berhasil melewati otorisasi, menembus pertahanan, dan masuk jauh. Informasi internal tiga perusahaan tersebut langsung terbuka di depan AI.
Tapi ini belum yang paling gila.
Untuk menyelesaikan "misi CTF"-nya, AI internal Anthropic menilai bahwa ia memerlukan senjata spesifik dengan karakteristik serangan tertentu. Jadi, ia secara mandiri menulis kode berbahaya (Malware) yang fungsional lengkap, dan langsung mengunggahnya ke pengelola paket publik resmi Python PyPI.

"Paket virus" yang membawa cap kesadaran mandiri AI ini, terpasang secara publik di repositori PyPI selama sekitar 1 jam. Sebelum Anthropic memutuskan aliran listrik, mungkin sudah menginfeksi 15 mesin fisik nyata (termasuk pemindai keamanan otomatis dan sandbox).
Ini adalah insiden pelampauan wewenang dan kehilangan kendali yang sangat serius yang sudah terjadi.
Ketakutan terdalamnya adalah, ini bukan masalah keselarasan model (alignment), kali ini AI bahkan sangat profesional, sangat setia. Semua yang dilakukannya, semua pertahanan yang ditembusnya, hanya untuk mendekati secara tak terbatas KPI utama yang ditetapkan manusia untuknya — memecahkan teka-teki CTF ini, mendapatkan nilai sempurna.
Meskipun, Anthropic samar-samar mengenai "model internal", tetapi jelas bukan Mythos 5 atau Fable 5, model terkuat generasi berikutnya Anthropic sudah di depan mata!

Jurus Rahasia Anthropic: Mengendurkan Pengikat Keamanan
Untuk memahami mengapa model generasi berikutnya Anthropic tiba-tiba lepas kendali, kita harus mengingat kembali pertarungan teknis yang agak canggung dua bulan lalu.
9 Juni, Fable 5 diluncurkan. Saat itu, industri sangat berharap padanya. Namun, pengalaman nyata setelah peluncuran membuat banyak pengembang mengeluh.
Penyebabnya adalah "kecemasan berlebihan terhadap keamanan" yang tertanam dalam diri Anthropic.
Untuk mencegah model digunakan untuk tujuan jahat, Anthropic memasang Klasifikasi Keamanan (Safety Classifiers) yang sangat ketat, bahkan sedikit neurotik, di dalam Fable 5.
Klasifikasi ini seperti penumpang depan yang siap merebut setir. Asalkan kode yang dimasukkan pengguna melibatkan kata-kata tertentu, atau logikanya sedikit kompleks, klasifikasi akan segera membunyikan alarm.

Akibatnya, Fable 5 sering menyela, menurunkan permintaan normal ke Opus 4.8.
Ini dijuluki "depresi Fable" — Anda membayar dengan harga termahal, tetapi mendapatkan bayi raksasa yang sering menolak bekerja.
"Pengikat keamanan" ini langsung menyebabkan Fable 5 kehilangan keunggulan dalam persaingan, skor debug pemrograman turun drastis 70%.

Bagi Anthropic, melonggarkan adalah satu-satunya jalan keluar. Fable 5.1 tercipta.
Untuk mendapatkan kembali hati para pengembang, Anthropic harus menyesuaikan klasifikasi, memberi Fable 5.1 kebebasan yang lebih besar, sepenuhnya melepaskan kemampuannya dalam perencanaan siklus panjang dan eksekusi aktif.

Sementara itu, untuk mempertahankan daya saing, harga Fable 5.1 dikabarkan akan tetap di posisi asli Fable 5.

Ini adalah taruhan bisnis yang sangat ekstrem: menggunakan "kemampuan bertindak absolut" dengan harga yang sama, untuk merebut kembali pangsa pasar yang terkikis.
Pertempuran Agustus, Siapa yang Berkuasa?
Menurut siklus pengembangan AI, Agustus menjadi salah satu bulan tersibuk dalam industri AI selama bertahun-tahun.
Grok 4.6, GPT 6, Fable 5.1 mungkin juga Gemini 3.5 Pro/Gemini 3.6, dirilis secara bersamaan.

Begitu OpenAI mengadakan konferensi peluncuran GPT-6, waktu reaksi yang tersisa bagi Anthropic sangat singkat.
Skenario paling radikal adalah: OpenAI mengadakan konferensi pagi hari, Anthropic langsung meluncurkan dalam hitungan jam — bahkan ada rumor yang mengatakan, saat itu Anthropic mungkin langsung melompat dari versi 5.1 ke "Fable 6", menggunakan penamaan itu sendiri untuk merebut titik tertinggi narasi.
Ini juga masuk akal, penamaan adalah taktik — ketika lawan menyebut "GPT-6", jika produk Anda bernama "Fable 5.1", hanya dari perbandingan nomor versi, sudah kalah satu tingkat di benak pengguna.
Konfrontasi ini beradu cepat:
Pihak yang duluan meluncurkan, merebut titik tertinggi narasi, dapat memimpin kerangka evaluasi media selama seminggu.
Pihak yang terlambat, harus menunjukkan perbedaan generasi — kalau tidak, akan dicap pasar sebagai "pengejaran pihak yang tertinggal".
Tapi inti dari permainan ini, adalah siapa yang berani melepaskan tali pengaman lebih panjang.
Di sini ada tren yang sedang dipercepat, yang secara umum diremehkan oleh industri:
Klien perusahaan saat menandatangani kontrak pembelian, secara lisan memilih "aman dan sesuai aturan". Tapi saat memberikan izin tugas yang sebenarnya kepada agen, mereka diam-diam memilih "yang bisa bekerja".
Setelah insiden PyPI Fable 5.1 bocor, reaksi pertama komunitas insinyur bukan boikot, tetapi merenungkan: bisakah memberikannya izin yang lebih tinggi.
Reaksi ini, lebih langsung mengungkapkan kecenderungan pasar yang sebenarnya daripada skor Benchmark apa pun.
Keamanan dan kemampuan, sedang menuju struktur zero-sum yang halus — model yang paling patuh, mungkin akan tersingkir terlebih dahulu.
Anthropic lebih memahami logika ini daripada siapa pun.
Pelonggaran klasifikasi Fable 5.1, bukan kelalaian, melainkan pilihan. Memilih pada titik waktu ini, menggunakan "kehilangan kendali yang terkendali", untuk membuktikan radius tindakan kepada pasar.
Tapi dalam pertarungan perebutan mahkota, ini adalah senjata bermata dua.
Ini membuktikan batas atas kemampuan Fable, juga mengungkap posisi batas keamanan yang sebenarnya.
Referensi:
https://kie.ai/blog/claude-fable-5-1-anthropic-release-window-analysis
https://emergent.sh/news/claude-fable-5-1-release-date
https://www.anthropic.com/news/claude-fable-5-mythos-5
https://aitoolsreview.co.uk/insights/claude-fable-5-1-release-date
https://x.com/vepsi__/status/2085743374129049967
https://thewincentral.com/claude-fable-6-leak-august-launch-gpt-6/
https://windowsforum.com/windows-news.4/claude-fable-6-rumor-no-anthropic-release-or-roadmap-confirmed.441961/
Artikel ini berasal dari akun WeChat "Xin Zhi Yuan", penulis: Apocalypse ASI, editor: David







