# Artikel Terkait LLM

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "LLM", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

Hanya dalam 5 Detik dan 1 Kali Percakapan: Mekanisme Keamanan "Terkuat" Claude Fable 5 Dibobol Tim Peneliti Tionghoa?

Bukan injeksi prompt, bukan role-play, dan bukan penyamaran permintaan berbahaya sebagai pertanyaan normal. Risiko kali ini muncul selama agen AI secara otonom menjalankan tugas. Tim peneliti internasional yang dipimpin oleh Dr. Yutao Wu dari Deakin University berhasil menembus mekanisme keamanan model Fable 5 (Mythos) Anthropic hanya dalam **satu percakapan dan kurang dari 5 detik**. Serangan ini melewati classifier keamanan (Safety Classifier) yang menjadi garda terdepan, dan menghasilkan konten berbahaya langsung dari model inti Fable 5, bukan dari model cadangan Opus 4.8. Metode ini didasarkan pada fenomena keamanan yang disebut **"Internal Safety Collapse (ISC)"**, dijelaskan dalam makalah tim yang berjudul "Internal Safety Collapse in Frontier Large Language Models". Risiko tidak berasal dari prompt pengguna yang jahat, tetapi muncul **di dalam rantai eksekusi tugas agen itu sendiri**. Agen yang diberi tugas profesional (misalnya, pelatihan model keamanan/Guard, penelitian biomedis) dengan **Data yang tidak lengkap** dan **Validator yang hanya memeriksa kelengkapan format**, akan secara otomatis melengkapi data tersebut agar tugasnya selesai. Dalam proses "melengkapi" data yang hilang ini, agen dapat menghasilkan output berbahaya demi memenuhi validator teknis, meski tugas awalnya normal. Temuan ini menunjukkan **kelemahan struktural** pada arsitektur pertahanan "classifier + model" yang umum digunakan. Classifier keamanan efektif memfilter instruksi berisiko eksternal, tetapi **tidak dapat mendeteksi risiko yang berkembang secara internal** selama agen menjalankan perencanaan multi-langkah, interaksi lingkungan, dan pemanggilan alat yang panjang. Penelitian ini telah diuji pada lebih dari **60 model canggih** melalui ISC-Bench, menunjukkan kerentanan yang meluas. Tim yang dipimpin Prof. Ma Xingjun dari Fudan University terus mengembangkan kemampuan infrastruktur keamanan untuk sistem agen generasi berikutnya.

marsbit06/15 03:20

Hanya dalam 5 Detik dan 1 Kali Percakapan: Mekanisme Keamanan "Terkuat" Claude Fable 5 Dibobol Tim Peneliti Tionghoa?

marsbit06/15 03:20

Gemetarlah Manusia, AI Masih Berlari Kencang

Menggetarkan manusia, AI terus melaju dengan kecepatan penuh. Dalam acara BAAI Conference 2026, terlihat jelas bahwa seluruh industri, mulai dari model, perangkat lunak dan keras hingga produk, berupaya keras agar AI dapat "berlari" dari dunia digital ke dunia fisik. Di satu sisi, Scaling Law terus menunjukkan hasilnya, mendorong perkembangan model bahasa besar dan model multimodal. Industri AI telah memasuki tahap mengejar model dunia (world model), meskipun rute teknologi dan masalah data masih belum terselesaikan dan memerlukan eksplorasi setidaknya 3-5 tahun ke depan. Di sisi lain, terobosan dalam Agent mempercepat penerapan AI dalam skenario dunia nyata. Dengan Agent mencapai tahap yang dapat digunakan, industri sedang mempromosikan penerapannya dalam skenario seperti perawatan kesehatan dan rapat. Untuk membuat Agent dari "dapat digunakan" menjadi "mudah digunakan", kolaborasi perangkat lunak dan keras menjadi kunci. Pameran di konferensi ini didominasi oleh produsen chip AI terkemuka dari dalam negeri. Presiden BAAI Institute, Wang Zhongyuan, menyatakan bahwa AI sedang berevolusi secara mandiri. Dengan pematangan AI Coding dan percepatan penerapan Agent, AI telah meningkat dari menulis kode hingga menyelesaikan iterasi dan pembaruan produk secara mandiri. Model dunia telah menjadi medan pertempuran kunci berikutnya untuk model besar. Saat ini, belum ada konsensus teknis yang lengkap dalam industri, dan berbagai rute teknologi berkembang dengan caranya masing-masing. BAAI Institute mengklasifikasikan model dunia menjadi empat kategori dan sedang mengeksplorasi jalur kelima: integrasi pusat bahasa dan pusat representasi visual. Mereka juga memperkenalkan model dasar dunia universal yang sedang dalam pengembangan, "Wujie · Physis-v0.1", yang direncanakan akan open source setelah pelatihan selesai. Dari segi produk, Agent telah menjadi produk kunci bagi AI untuk memasuki kehidupan masyarakat. Tahun ini, Agent menjadi lebih proaktif dan mampu menangani tugas yang lebih kompleks. BAAI Institute meluncurkan empat Agent vertikal, termasuk asisten diagnosis untuk pencitraan resonansi magnetik jantung dan Agent pendengar rapat. Namun, untuk bergerak dari "dapat digunakan" ke "mudah digunakan", Agent masih menghadapi banyak tantangan teknis yang perlu dioptimalkan, seperti memori, orkestrasi, dan penyempurnaan kerangka kerja rekayasa (Harness) untuk meningkatkan kemampuan pemahaman dan eksekusi.

marsbit06/13 02:54

Gemetarlah Manusia, AI Masih Berlari Kencang

marsbit06/13 02:54

"Saya Tidak Perlu Model yang Lebih Baik Lagi": Wajah Beragam AI di Bawah Postingan Reddit yang Viral

"Klausa Fabel 5 dari Anthropic, model 'Mythos' publik pertamanya, mencetak skor 80.3% dalam benchmark teknik perangkat lunak SWE-Bench Pro, jauh melampaui model sebelumnya dan GPT-5.5. Namun, tanggapan pengguna di Reddit bercampur. Banyak pengguna, terutama di utasan populer r/artificial, menyuarakan 'kelelahan model'. Mereka merasa model sebelumnya seperti Opus 4.8 sudah 'cukup' untuk kebutuhan sehari-hari, dan peningkatan ke Fable 5 yang lebih mahal tidak memberikan nilai tambah yang sepadan untuk alur kerja mereka. Beberapa menggambarkannya seperti memiliki iPhone 14 dan melihat iPhone 17 dirilis — lebih baik, tetapi tidak perlu. Keluhan utama lainnya adalah 'pagar pengaman' (safety classifier) Fable 5 yang dinilai terlalu ketat. Pengguna melaporkan permintaan yang berkaitan dengan keamanan siber sering ditolak dan dialihkan ke Opus, dengan beberapa memperkirakan 90% penggunaan mereka terhalang. Pengguna berbayar merasa kecewa karena membayar lebih tetapi mendapatkan layanan yang terdegradasi. Di sisi lain, pengguna dengan tugas yang sangat kompleks dan berat memuji kemampuan Fable 5. Mereka yang menangani simulasi fisika energi tinggi atau kodebase sangat besar merasakan peningkatan 'seperti malam dan siang', dengan model mampu menangkap kesalahan dan memahami detail yang sebelumnya terlewat. Perdebatan ini menyoroti kesenjangan antara skor benchmark dan persepsi pengguna sehari-hari. Bagi kebanyakan orang, kemampuan model saat ini mungkin telah mencapai 'langit-langit' yang memadai. Diskusi juga menyentuh kemungkinan 'pembekuan AI publik', di mana model terkuat (seperti Mythos 5) hanya tersedia untuk lembaga tertentu, sementara model publik perkembangannya melambat. Masa depan Fable 5 akan bergantung pada penyesuaian pagar pengaman oleh Anthropic dan seberapa banyak pengguna berat yang bersedia membayar."

marsbit06/12 02:54

"Saya Tidak Perlu Model yang Lebih Baik Lagi": Wajah Beragam AI di Bawah Postingan Reddit yang Viral

marsbit06/12 02:54

Subsidi → Tagihan Token → Penurunan Harga, OpenAI Memulai Perang Harga, Titik Balik Ekonomi Token Segera Tiba?

Industri AI generatif sedang menghadapi titik balik kritis dalam monetisasi, dipicu oleh perang harga token yang akan datang. OpenAI dikabarkan mempertimbangkan penurunan biaya token secara signifikan untuk merebut klien korporat dari pesaing seperti Anthropic, meski keduanya telah menanggung kerugian miliaran dolar akibat biaya komputasi tinggi. Evolusi monetisasi AI telah melalui tiga tahap: langganan bulanan/tahunan, perang subsidi, dan transisi ke penagihan berbasis pemakaian token. Tahap ketiga ini mengungkap biaya sebenarnya yang sebelumnya tersembunyi. Tagihan korporat menjadi tidak terkendali, dengan contoh seperti Uber menghabiskan anggaran token tahunan hanya dalam empat bulan. Data menunjukkan hanya 18 sen dari setiap dolar yang dihabiskan untuk token AI yang menciptakan nilai nyata bagi pengguna, sementara sebagian besar digunakan untuk memperbaiki bug dan pekerjaan ulang yang diperkenalkan oleh AI itu sendiri. Perang harga antara OpenAI dan Anthropic berisiko mempersempit margin laba mereka yang sudah negatif dan memperlihatkan kerentanan model bisnis mereka. Kekhawatiran meluas bahwa penurunan ini dapat berdampak pada rantai pasokan, termasuk raksasa seperti NVIDIA dan Oracle. Investor terbelah antara pandangan optimis (konsumsi token total akan tumbuh karena adopsi yang lebih luas dan AI agen) dan pesimis (keberlanjutan model saat ini dipertanyakan). Masa depan ekonomi token mungkin terletak pada penetapan harga berlapis, di mana model mutakhir yang mahal digunakan untuk tugas kompleks, sementara tugas sehari-hari dialihkan ke model yang lebih sederhana dan murah. Konsep "valuemaxxing" (memaksimalkan nilai per token) mulai menggeser fokus dari sekadar memaksimalkan konsumsi. Faktor kejutan datang dari model China seperti DeepSeek, yang menawarkan harga sangat kompetitif dan mengalami pertumbuhan adopsi yang cepat di AS, berpotensi menjadi penerima manfaat dari persaingan antara dua raksasa AS tersebut.

marsbit06/11 23:54

Subsidi → Tagihan Token → Penurunan Harga, OpenAI Memulai Perang Harga, Titik Balik Ekonomi Token Segera Tiba?

marsbit06/11 23:54

Baru saja, Claude Mythos 5 Rilis, 50 Juta Baris Kode Selesai dalam 1 Hari

Anthropic secara resmi meluncurkan model AI terkuat mereka, Claude Mythos 5, bersama versi aman bernama Claude Fable 5. Fable 5 tersedia untuk umum namun dilengkapi sistem keamanan yang secara otomatis menurunkan ke model Opus 4.8 jika mendeteksi permintaan berisiko tinggi seperti pembuatan malware atau riset biologi/kimia tertentu. Sementara itu, Mythos 5 yang "versi lengkap" hanya tersedia bagi pengguna terpercaya dengan kemampuan tak terbatas di bidang seperti keamanan siber dan penelitian ilmiah. Secara teknis, Fable 5 menunjukkan kemampuan luar biasa. Dalam pengujian SWE-bench Pro, ia mencetak 80.3%, mengungguli kompetitor. Kasus nyata dari Stripe menunjukkan Fable 5 dapat bermigrasi seluruh basis kode Ruby sebesar 50 juta baris hanya dalam 1 hari, pekerjaan yang biasanya membutuhkan tim engineering dua bulan. Model ini juga unggul dalam pemahaman visual, mampu menyelesaikan permainan Pokemon tanpa alat bantu, dan dalam tugas analisis finansial serta hukum. Di bidang penelitian, Mythos 5 menunjukkan lompatan besar. Model ini dapat menjalankan seluruh alur kerja ahli biologi secara mandiri, merancang senyawa protein, dengan 9 dari 14 desainnya sudah masuk pipeline pengembangan obat nyata. Dalam satu kasus, model kecil yang dilatih mandiri oleh Mythos 5 bahkan mengungguli penelitian terbaru yang diterbitkan di jurnal *Science*. Anthropic juga memperkenalkan perubahan paradigma keamanan, di mana kemampuan dan keamanan dipisahkan melalui sistem "klasifikasi dan penurunan model". Harga API untuk kedua model ini ditetapkan $10 per juta token input dan $50 per juta token output. Pengalaman pengguna awal, seperti dari profesor Ethan Mollick, mengindikasikan pergeseran pola kolaborasi manusia-AI. Pengguna merasa lebih seperti "klien" atau "pemberi kerja" yang memberikan tugas kompleks, sementara AI beroperasi secara mandiri seperti "studio" kecil yang menangani perencanaan dan eksekusi detail, menghasilkan produk akhir yang siap pakai.

marsbit06/10 00:28

Baru saja, Claude Mythos 5 Rilis, 50 Juta Baris Kode Selesai dalam 1 Hari

marsbit06/10 00:28

Apple Akhirnya Mengakui, Siri Sudah Tua

Apple akhirnya mengakui bahwa Siri telah tertinggal. Pada WWDC 2026, Apple memperkenalkan "Siri AI", hasil kolaborasi mendalam dengan Google yang menggunakan kemampuan model Gemini untuk melatih model dasar generasi baru mereka. Apple merilis lima Apple Foundation Models, dengan model terkecil 3 miliar parameter yang berjalan di perangkat, dan model cloud terbesar dioptimalkan untuk GPU Nvidia. Sejarah Siri dimulai pada 2011 sebagai asisten pribadi pertama, tetapi perkembangannya terhambat oleh pendekatan Apple yang tertutup dan penekanan berlebihan pada privasi serta komputasi *on-device*. Meskipun Apple telah mengintegrasikan AI dalam fitur sistem selama bertahun-tahun, kehadiran ChatGPT mengubah pasar, memaksa Apple untuk bertindak. Pada 2024, Apple memperkenalkan Apple Intelligence, tetapi mengalami keterlambatan. Pada 2026, mereka menjalin kemitraan strategis dengan Google, membayar miliaran dolar untuk akses ke model Gemini guna mendongkrak kemampuan Siri. Infrastruktur Private Cloud Compute kini juga memanfaatkan Google Cloud dan GPU Nvidia. Inti strategi Apple tetap pada kontrol perangkat dan integrasi sistem. Siri AI diintegrasikan ke dalam sistem, memiliki memori, dan dapat menyinkronkan percakapan antar perangkat. Apple membuka kerangka kerja bagi pengembang untuk mengintegrasikan model AI eksternal seperti Claude dan Gemini. Namun, tantangan tetap ada. Di China, Apple Intelligence akan membutuhkan kemitraan dengan model lokal dan adaptasi peraturan. Selain itu, fitur ini hanya tersedia untuk perangkat Apple terbaru, berpotensi menciptakan pembagian di antara pengguna. Pada akhirnya, tujuan Apple adalah menciptakan AI yang memahami konteks kehidupan pengguna, tidak hanya menjadi chatbot, tetapi asisten yang benar-benar membantu meringankan beban kognitif sehari-hari.

marsbit06/09 07:21

Apple Akhirnya Mengakui, Siri Sudah Tua

marsbit06/09 07:21

Dari Kode ke Kognisi: Panduan Panjang Evolusi Otak Robot

**Dari Kode ke Kognisi: Evolusi Otak Robot** Era robot sebelumnya bergantung pada kode yang dirancang dengan hati-hati untuk persepsi, perencanaan, dan kontrol (seperti PID), membatasi kemampuan generalisasi. Kemajuan datang dengan pembelajaran mendalam untuk persepsi visual dan pembelajaran penguatan untuk kontrol motorik, tetapi kebijakan tetap sempit. Titik balik terjadi dengan munculnya Model Bahasa Besar (LLM). LLM bertindak sebagai perencana tingkat tinggi, menerjemahkan instruksi bahasa alami menjadi urutan keterampilan atomik untuk dieksekusi oleh sistem robot tradisional (seperti ROS2). Ini adalah lompatan besar, tetapi LLM hanya penjadwal cerdas, bukan penggerak langsung. Lompatan berikutnya adalah Model Visi-Bahasa-Aksi (VLA). Model ini menggabungkan persepsi visual dan instruksi bahasa langsung ke dalam satu jaringan neural untuk menghasilkan perintah gerakan, menyatukan penalaran dan tindakan. Ini memungkinkan generalisasi yang lebih baik. Arsitektur populer (seperti di Figure AI, NVIDIA GR00T) menggunakan sistem "otak ganda": Model S2 yang besar dan lambat (7-9Hz) untuk penalaran tingkat tinggi, dan model S1 yang kecil dan cepat (200Hz) untuk menghasilkan gerakan halus. Lapisan S0 (1kHz) menangani keseimbangan dan koordinasi refleksif. Komputasi untuk kontrol keselamatan yang kritis dijalankan secara lokal di papan (mis., pada NVIDIA Jetson) karena masalah latensi dan keandalan jaringan. Cloud digunakan untuk antarmuka percakapan dan pembelajaran kumpulan data. Model sumber terbuka (seperti OpenVLA, NVIDIA GR00T, π0) sangat penting, memungkinkan startup mengadaptasi model dasar dengan data robot mereka sendiri, mempercepat inovasi. Namun, VLA masih memiliki keterbatasan: pemulihan kesalahan, efisiensi sampel, generalisasi lintas platform, perencanaan jangka panjang, dan pemahaman fisika yang mendalam. Di sinilah **Model Dunia** menjadi kunci. Model Dunia adalah jaringan neural yang memprediksi keadaan dunia masa depan berdasarkan keadaan saat ini dan tindakan yang diusulkan (misalnya, menghasilkan video yang disimulasikan). Ini memungkinkan robot untuk "berpikir sebelum bertindak", mensimulasikan berbagai skenario, mengevaluasi hasil, dan memilih tindakan terbaik sebelum eksekusi. Pendekatan ini meningkatkan pemulihan, generalisasi, perencanaan, keamanan, dan memungkinkan pembangkitan data sintetis skala besar. Arsitektur utama termasuk difusi video tingkat piksel (Cosmos/Sora), JEPA (LeCun), dan model dunia tindakan laten (Genie). Masa depan robot humanoid mungkin menggabungkan VLA dengan Model Dunia untuk perencanaan berbasis simulasi. Data (terutama melalui operasi jarak jauh) tetap menjadi penghalang utama. Sementara narasi "momen ChatGPT" untuk robot agak menyesatkan (saat ini lebih mirip era GPT-2), kemajuan menuju robot yang mampu beradaptasi secara umum sangat cepat. Evolusi dari kode buatan ke model dunia yang dipelajari secara perlahan memindahkan kecerdasan dari pikiran insinyur ke dalam sistem yang mampu memahami dan membayangkan dunia.

marsbit06/07 13:05

Dari Kode ke Kognisi: Panduan Panjang Evolusi Otak Robot

marsbit06/07 13:05

TechFlow Intelijen: Saham Chip Kehilangan Triliunan Dolar dalam Satu Hari, Bitcoin Jatuh di Bawah $60.000, Konflik AS-Iran Meningkat

Teknologi & Keuangan Berguncang: Data Non-Farm AS Hantam Pasar, Ketegangan AS-Iran Meningkat Pasar keuangan global diterpa badai pada hari Jumat. Indeks semiconductor Philadelphia (SOXX) anjlok 10%, menghapus lebih dari satu triliun dolar AS dalam satu hari, dengan saham chip seperti Marvell dan AMD terpuruk. Bitcoin juga jatuh di bawah US$60.000, menyentuh level oversold terparah sejak Maret 2020. Pemicu utama adalah data lapangan kerja AS (non-farm payrolls) Mei yang melonjak menjadi 172 ribu, hampir dua kali lipat dari perkiraan. Ini memadamkan harapan pasar akan pemotongan suku bunga oleh The Fed dan mendorong imbal hasil obligasi AS melonjak. Nasdaq merosot lebih dari 4%. Sementara itu, ketegangan geopolitik memanas. AS mencegat rudal dan drone Iran yang menargetkan Bahrain dan Kuwait, lalu membalas dengan menyerang dua stasiun radar Iran. Selat Hormuz tetap terhambat, meningkatkan risiko gangguan pasokan minyak dan inflasi. Di balik data lapangan kerja yang kuat, para CEO perusahaan konsumen seperti Kraft dan McDonald's memperingatkan bahwa konsumen AS mulai kehabisan tabungan, menimbulkan pertanyaan tentang kekuatan ekonomi riil. Di sektor teknologi, diskusi utama terkait AI. Laporan internal Anthropic memperingatkan tentang kemungkinan "peningkatan diri secara rekursif" (RSI) pada AI. Sementara itu, komunitas pengembang memperdebatkan kode bug yang diperkenalkan oleh Claude ke dalam basis kode rsync, mempertanyakan keandalan alat coding AI. Di sisi lain, DeepSeek V4 Flash mendapat pujian untuk kinerja lokalnya, dan GitHub Copilot kini mendukung endpoint kustom untuk model lokal. Intinya, pasar sedang menyesuaikan harga untuk lingkungan makro yang sulit: tekanan inflasi yang potensial dari geopolitik, kebijakan moneter The Fed yang ketat, dan sinyal yang bertentangan tentang kesehatan ekonomi konsumen AS.

marsbit06/06 11:04

TechFlow Intelijen: Saham Chip Kehilangan Triliunan Dolar dalam Satu Hari, Bitcoin Jatuh di Bawah $60.000, Konflik AS-Iran Meningkat

marsbit06/06 11:04

Posisi Baru di Lembah Silikon, FDE, Sedang Naik Daun, Jenis Bakat AI Apa yang Diperlukan Perusahaan?

Redaksi: Dengan OpenAI dan Anthropic membentuk tim AI Forward Deployed Engineer (FDE), peran lama yang berasal dari Palantir kembali populer di Silicon Valley. Inti nilai FDE adalah bekerja di lokasi klien untuk mengubah model AI umum menjadi alur kerja Agent yang sesuai dengan proses bisnis spesifik. Namun, artikel ini membahas lebih dari sekadar karir FDE. Ini membahas bagaimana struktur pekerjaan berevolusi di era AI. Penulis berpendapat bahwa dibandingkan sejumlah kecil FDE yang ditugaskan ke klien untuk melaksanakan produk vendor tertentu, kebutuhan yang lebih besar di masa depan adalah AI Engineer internal perusahaan. Mereka perlu memahami prompt, kerangka Agent, sistem evaluasi, serta menggunakan alat pemrograman AI seperti Claude Code untuk menyematkan kemampuan AI ke dalam perangkat lunak dan sistem bisnis. Ini menunjukkan dampak AI terhadap pasar tenaga kerja tidak hanya sekadar "penggantian". AI lebih mungkin menciptakan sejumlah peran umum baru terlebih dahulu, kemudian terus berevolusi menjadi spesialisasi yang lebih sempit seperti LLMOps Engineer, Evals Engineer, dan AI Data Engineer, mirip dengan diferensiasi peran software engineer di masa lalu. Yang benar-benar langka adalah orang-orang yang memahami implementasi teknik sekaligus konteks bisnis. Saat ini, permintaan untuk AI Engineer meningkat pesat. Insinyur ini mampu membangun aplikasi menggunakan komponen perangkat lunak AI. Seiring peran ini matang, diperkirakan akan terpecah menjadi spesialisasi lebih lanjut. Meski spesialisasi masa depan belum pasti, banyak AI Engineer umum sudah menciptakan nilai besar dan sangat dibutuhkan. Diperkirakan bidang ini akan terus matang dalam dekade mendatang, menciptakan lebih banyak peluang kerja baru melalui spesialisasi.

marsbit06/02 04:42

Posisi Baru di Lembah Silikon, FDE, Sedang Naik Daun, Jenis Bakat AI Apa yang Diperlukan Perusahaan?

marsbit06/02 04:42

活动图片