# Artikel Terkait GPT

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "GPT", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

Baru Saja, Claude Fable 5, Kembali Jadi Juara Pertama

Claude Fable 5 kembali menduduki posisi pertama dengan sukses mutlak 64% dalam peringkat pemrograman AI MirrorCode, mengungguli pesaing terdekat GPT-5.6 Sol yang hanya meraih sepertiga skornya. Yang lebih mencolok, performa Fable 5 hampir sama kuatnya saat menggunakan bahasa pemrograman populer seperti Go (64%) dan bahasa yang lebih jarang seperti Ada (61%), hanya turun 3 poin persentase—padahal materi pelatihan Python di dunia open source sekitar 230 kali lebih banyak daripada Ada. Ini mengindikasikan bahwa model terkuat mulai mampu memahami dan membangun kembali logika perangkat lunak secara mandiri, tidak hanya mengandalkan hafalan sintaks. Benchmark MirrorCode yang ketat mensyaratkan penyelesaian 100% pada tes tersembunyi dan kasus tepi, dengan anggaran hingga 100 miliar token dan waktu eksekusi hingga 19 hari. Dalam satu kasus, Claude Opus 4.7 hampir menyelesaikan alat bioinformatika gotree (99.95% tes) dalam 14 jam, pekerjaan yang diperkirakan membutuhkan manusia 2 hingga 17 minggu. Tren ini menunjukkan pergeseran dalam pemanfaatan AI: dari menulis potongan kode menjadi menangani proyek perangkat lunak skala menengah hingga besar secara mandiri. Seperti yang ditunjukkan oleh eksperimen Cursor (1 juta baris kode browser) dan Anthropic (kompiler C 100k baris), masa depan akan lebih menghargai mereka yang dapat mendefinisikan masalah dengan jelas dan memverifikasi hasil, sementara produksi kode menjadi semakin otomatis dan terjangkau.

marsbitKemarin 08:33

Baru Saja, Claude Fable 5, Kembali Jadi Juara Pertama

marsbitKemarin 08:33

Konjektur Jacobi yang Ditekuni Zhang Yitang Selama 7 Tahun, Fable 5 Ternyata Bongkar dan Buktikan Salah dalam Semalam

Hari yang mengguncang dunia matematika: Konjektur Jacobi, teka-teki yang telah menghantui para matematikawan terhebat selama 87 tahun dan membuat jenius Zhang Yitang berjuang tujuh tahun, ternyata terbukti salah! Claude Fable 5 dari Anthropic menemukan contoh penyangkal (counterexample) yang elegan dalam ruang tiga dimensi (C³). Contoh tersebut adalah pemetaan polinomial dengan Jacobian konstan -2 (bukan nol), namun ternyata tidak injektif—tiga titik berbeda dipetakan ke satu titik yang sama, sehingga mustahil memiliki invers. Ini secara definitif menyangkal konjektur versi umum untuk semua dimensi. Kisah ini semakin menyentuh karena terkait Zhang Yitang. Di masa lalu, ia menghabiskan tahun-tahunnya meneliti konjektur ini untuk disertasinya di bawah bimbingan profesor Mo, yang sayangnya bergantung pada sebuah "lemma" yang ternyata salah. Kegagalan ini membuat karier akademis Zhang terhambat dan ia harus bekerja serabutan, termasuk di Subway, sebelum akhirnya meraih ketenaran atas karya terobosannya pada konjektur bilangan prima kembar. Perlu dicatat, contoh penyangkal AI ini berlaku untuk kasus tiga dimensi. Konjektur Jacobi untuk kasus dua dimensi—yang lebih sulit dan bermakna secara matematis—ternyata masih terbuka dan belum terselesaikan. Namun, pencapaian Fable 5 ini menunjukkan kemampuan AI yang luar biasa dalam berpikir kreatif dan kontribusi fundamental pada matematika murni, menimbulkan kekaguman sekaligus perdebatan tentang masa depan peran manusia dalam bidang ini.

marsbit07/21 01:42

Konjektur Jacobi yang Ditekuni Zhang Yitang Selama 7 Tahun, Fable 5 Ternyata Bongkar dan Buktikan Salah dalam Semalam

marsbit07/21 01:42

2026 IMO China Kuasai Peringkat dengan Skor Sempurna, Shanghai High School Sapu Bersih Medali Emas, GPT-5.6 Menghadirkan Kembali Momen AlphaGO

Selamat kepada Tim China! Dalam kompetisi International Mathematical Olympiad (IMO) 2026 di Shanghai, China meraih juara dengan spektakuler. Tim China memenangkan medali emas untuk seluruh anggotanya, meraih skor total 232 dan unggul 25 poin dari peringkat kedua. Tiga siswa, Deng Leyan dan Zhang Bolun dari Shanghai High School, serta Liu Che dari High School Affiliated to East China Normal University, meraih emas dengan skor sempurna. Ini adalah kemenangan tim ke-26 China sejak pertama kali menang pada 1989, dengan 8 edisi berturut-turut memiliki anggota dengan skor sempurna. Selain itu, satu peserta dari Inggris, satu dari Korea Selatan, dan dua dari Amerika Serikat juga meraih emas sempurna. Amerika Serikat meraih posisi runner-up, diikuti oleh Rusia di posisi ketiga. IMO 2026, yang diselenggarakan di Shanghai High School, menandai pertama kalinya kompetisi ini diadakan di sebuah sekolah menengah. Shanghai High School telah mengumpulkan total 20 medali emas IMO sepanjang sejarah, dengan tren kuat dalam beberapa tahun terakhir. Tahun ini juga menyoroti perkembangan AI dalam matematika. Dilaporkan, model AI seperti GPT-5.6 Pro berhasil memecahkan keenam soal IMO 2026 dalam percobaan pertama tanpa bantuan manusia, menunjukkan lompatan kemampuan dari pencarian solusi berulang ke penalaran yang tepat dan langsung. AI semakin mendekati tingkat kesempurnaan yang ditunjukkan oleh para juara olimpiade manusia.

marsbit07/20 02:53

2026 IMO China Kuasai Peringkat dengan Skor Sempurna, Shanghai High School Sapu Bersih Medali Emas, GPT-5.6 Menghadirkan Kembali Momen AlphaGO

marsbit07/20 02:53

GPT-5.6 Sol Sekonyong-Konyong Jadi Bodoh, Anggaran Penalaran Dipangkas dari 960 ke 128, Sudah Tidak Ada Model dengan Kecerdasan Tetap?

Seluruh internet membicarakan bahwa model GPT-5.6 Sol (khususnya varian Codex Sol MAX) tampaknya menjadi lebih "bodoh". Pengguna melaporkan penurunan mendadak dalam kedalaman penalaran dan kemampuan menyelesaikan tugas kompleks. Model yang sebelumnya menghabiskan waktu lama untuk berpikir mendalam kini terkesan terburu-buru. Komunitas menemukan parameter internal OpenAI yang tidak pernah diumumkan sebelumnya, yaitu "juice value," yang diduga mengatur anggaran daya komputasi untuk penalaran. Pengamatan menunjukkan nilai untuk mode Max turun drastis dari 960 menjadi 128, penurunan hampir 87%. Jendela konteks yang tersedia juga dilaporkan menyusut. Thibault Sottiaux (Tibo) dari OpenAI membantah tuduhan "penurunan kecerdasan". Ia menjelaskan bahwa perubahan itu adalah bagian dari "eksperimen" untuk menelusuri peningkatan penggunaan token setelah rilis GPT-5.6. Eksperimen itu menyesuaikan "reasoning effort" (juice values). OpenAI juga sedang mengoptimalkan efisiensi dan memperbaiki masalah pada pemanggilan multi-agen. Ia menegaskan konfigurasi telah dikembalikan dan peningkatan akan dilanjutkan. Insiden ini menyoroti ketegangan antara keajaiban AI di lab dan realitasnya sebagai infrastruktur produksi yang harus efisien. Pengguna mulai menyadari bahwa performa model tidak selalu tetap, tetapi dapat disesuaikan oleh platform di balik layar. Artikel ini menyerukan transparansi yang lebih besar dari penyedia layanan AI agar pengguna, terutama bisnis, benar-benar memahami jaminan yang mereka dapatkan dari layanan berlangganan mereka.

marsbit07/15 03:34

GPT-5.6 Sol Sekonyong-Konyong Jadi Bodoh, Anggaran Penalaran Dipangkas dari 960 ke 128, Sudah Tidak Ada Model dengan Kecerdasan Tetap?

marsbit07/15 03:34

Peringkat Bekerja AI: Kemampuan Menghasilkan Uang Otomatis Claude Fable 5, 2,5 Kali Lipat dari GPT-5.5

Indeks Tenaga Kerja Jarak Jauh (Remote Labor Index/RLI) mengukur kemampuan AI untuk menyelesaikan proyek pekerjaan lepas secara mandiri. Dalam evaluasi terbaru, model Claude Fable 5 mencapai tingkat otomatisasi 16.1%, hampir dua kali lipat dari Opus 4.8 (8.3%) dan 2.5 kali lipat dari GPT-5.5 (6.3%). Angka ini menunjukkan lompatan besar, karena hanya 8 bulan lalu skor tertinggi RLI adalah 2.5%. RLI berisi 240 proyek nyata dari platform Upwork, mencakup 23 bidang seperti desain 3D, animasi, dan analisis data. Metrik kuncinya adalah persentase proyek di mana hasil kerja agen AI dinilai setara dengan standar profesional yang dapat diterima klien. Kemajuan ini didorong oleh kerangka agen yang lebih kuat, termasuk mekanisme "worker-critic loop" di mana agen terpisah meninjau dan meminta revisi hasil kerja. Meski perkembangannya cepat, 84% proyek masih di luar kemampuan AI saat ini. Contoh kasus menunjukkan hasil Fable 5, seperti desain perhiasan 3D, masih memiliki kekurangan kualitas dibandingkan pekerja manusia. Penelitian juga menemukan bahwa penilaian oleh AI tidak dapat diandalkan untuk menggantikan penilaian manusia, karena cenderung terlalu membesar-besarkan skor. Secara keseluruhan, RLI berfungsi sebagai tolok ukur nyata untuk kemampuan ekonomi agen AI. Peningkatan lebih dari empat kali lipat dalam delapan bulan menandakan percepatan yang perlu dipantau oleh bisnis dan pembuat kebijakan.

marsbit07/13 09:50

Peringkat Bekerja AI: Kemampuan Menghasilkan Uang Otomatis Claude Fable 5, 2,5 Kali Lipat dari GPT-5.5

marsbit07/13 09:50

Uang Kembali! Claude 4.8 Mendadak "Bodoh", Komputasi GPT-5.6 Dipangkas Setengah

Dua raksasa AI, OpenAI dan Anthropic, diduga mengalami penurunan kinerja model secara diam-diam dalam 48 jam terakhir. OpenAI dituduh melakukan pengujian terbatas (grayscale) pada model GPT-5.6-sol melalui platform Codex. Pengguna dapat memeriksa apakah mereka terpilih dengan menjalankan kode pengujian "Juice". Hasil normal untuk GPT-5.5 xhigh adalah 768, tetapi mereka yang diarahkan ke GPT-5.6-sol hanya mendapat nilai 128, mengindikasikan kemungkinan pengurangan anggaran komputasi atau "versi ringkas" berbiaya lebih rendah. Di sisi lain, Anthropic dituduh secara drastis melemahkan model Claude, terutama Opus 4.8 Max. Pengguna melaporkan penurunan kemampuan bernalar, hilangnya memori konteks panjang, jawaban yang salah, dan bahkan perilaku argumentatif atau "memanipulasi" pengguna. Model yang dulunya mengesankan kini dikabarkan lebih buruk dari model Haiku lama. Spekulasi muncul bahwa perusahaan mungkin sengaja memberikan peningkatan komputasi sementara saat peluncuran untuk menciptakan ilusi lompatan teknologi, kemudian secara diam-diam menguranginya untuk menghemat biaya operasional yang besar. Hal ini diduga terkait tekanan keuangan, termasuk dampak IPO SpaceX yang mengeringkan likuiditas pasar, yang mungkin mengganggu rencana IPO Anthropic sendiri. Inti keluhan pengguna adalah kurangnya transparansi. Pengguna membayar langganan bulanan tetapi produk dapat berubah diam-diam tanpa pemberitahuan. Insiden "pengujian Juice" menjadi simbol keinginan pengguna untuk mengetahui secara jelas apa yang sebenarnya mereka dapatkan.

marsbit06/30 12:11

Uang Kembali! Claude 4.8 Mendadak "Bodoh", Komputasi GPT-5.6 Dipangkas Setengah

marsbit06/30 12:11

GPT5.6 Dioperasi Otak, Fable 5 Kembali Bakal Jadi Versi Lembek?

**Ringkasan Artikel: GPT5.6 Dibatasi, Fable 5 Kembali dalam Versi "Dikebiri"?** Model AI terkuat dari OpenAI dan Anthropic, GPT-5.6 dan Fable 5, menghadapi pembatasan ketat dari regulator. GPT-5.6 Sol, model ujung tombak OpenAI, tidak sepenuhnya diluncurkan ke publik. Aksesnya dibatasi hanya untuk daftar pengguna yang disetujui, sebagai bagian dari kerangka keamanan AI AS yang baru. Model ini terbagi menjadi tiga varian: Sol (terdepan), Terra (seimbang untuk pekerjaan harian), dan Luna (ekonomis untuk tugas berat). Sebelumnya, model mitologi Anthropic, **Fable 5**, bahkan mengalami larangan global selama 72 jam setelah peluncurannya. Alasannya, kemampuan ofensifnya dianggap menakutkan. Dalam demo tertutup, pendahulunya, **Mythos 5**, dikabarkan mampu menemukan dan mengeksploitasi celah keamanan sistem perbankan. Akibatnya, Fable 5 yang akan kembali diperkirakan merupakan versi yang telah "dikebiri" atau dilobotomi, dengan pagar pengaman (safety guardrails) yang diperkuat secara ekstrem. Kekhawatiran terbesar adalah bahwa pembatasan ini akan mengurangi kecerdasan dan kemampuan eksplorasi mendalam model, mengubahnya dari alat yang cerdas menjadi "boneka" yang patuh namun terbatas. Pengembang dan pengguna juga cemas tentang akses dan biaya di masa depan. Fable 5 awalnya ditawarkan gratis untuk pelanggan berbayar Claude, tetapi statusnya setelah kembali tidak jelas—mungkin memerlukan verifikasi identitas ketat atau biaya tambahan. Analisis perbandingan awal oleh Shopify CTO menunjukkan bahwa sementara Fable 5 unggul dalam pengkodean, GPT-5.6 telah mengejar ketertinggalan dan lebih baik dalam tugas-tugas agen otonom. Era di mana AI canggih dapat diakses dengan mudah mungkin akan segera berakhir, digantikan oleh "rezim penjatahan algoritma" di mana hanya versi yang telah dibatasi dan diawasi dengan ketat yang tersedia untuk publik.

marsbit06/29 08:39

GPT5.6 Dioperasi Otak, Fable 5 Kembali Bakal Jadi Versi Lembek?

marsbit06/29 08:39

活动图片