Data Anthropic: Hampir Setengah Panggilan AI Agent Terfokus pada Teknik Perangkat Lunak, 16 Area Vertikal Ini Masih Menjadi Lautan Biru

marsbitDipublikasikan tanggal 2026-02-24Terakhir diperbarui pada 2026-02-24

Abstrak

Studi terbaru dari Anthropic mengungkapkan bahwa hampir 50% panggilan alat AI Agent terkonsentrasi pada rekayasa perangkat lunak, sementara 16 bidang vertikal lainnya—seperti kesehatan, hukum, keuangan, dan pendidikan—masih sangat sedikit tersentuh, masing-masing di bawah 5%. Ini menunjukkan peluang besar untuk menciptakan sekitar 300 unicorn AI vertikal di masa depan. Temuan kunci lainnya adalah kesenjangan antara kemampuan AI dan kepercayaan pengguna: meskipun model seperti Claude Code dapat menyelesaikan tugas selama hampir 5 jam, pengguna rata-rata hanya menggunakannya sekitar 42 menit. Hal ini mencerminkan "defisit kepercayaan" yang justru menjadi peluang produk berikutnya. Pengguna berpengalaman cenderung lebih banyak melakukan intervensi daripada pengguna baru, menunjukkan pergeseran strategi dari persetujuan bertahap ke pengawasan aktif. Selain itu, AI Agent sering kali berhenti untuk meminta klarifikasi dalam tugas kompleks, yang merupakan fitur keamanan penting. Pendiri Box, Aaron Levie, menekankan pentingnya membangun AI yang mengintegrasikan data proprietary, konteks domain spesifik, dan kemampuan manajemen perubahan di sisi klien. Sektor-sektor seperti kesehatan, hukum, dan pendidikan disebut sebagai lahan subur untuk inovasi, dengan potensi yang jauh lebih besar daripada SaaS tradisional.

Penulis: Garry's List

Kompilasi: Deep Tide TechFlow

Panduan Deep Tide: Anthropic baru saja merilis penelitian penggunaan nyata AI Agent yang paling komprehensif hingga saat ini, dengan data inti: teknik perangkat lunak menyumbang hampir 50% volume panggilan alat Agent, sementara 16 area vertikal seperti kesehatan, hukum, pendidikan, dll. jika digabungkan masih kurang dari setengah sisanya, dengan masing-masing area memiliki porsi di bawah 5%.

Ini bukan sinyal pasar yang jenuh, melainkan peta 300 unicorn AI vertikal—yang lebih berharga adalah temuan kontra-intuitif yang dikutip dalam artikel: model sudah dapat bekerja mandiri hampir 5 jam, tetapi pengguna sebenarnya hanya mengizinkannya bekerja 42 menit, "defisit kepercayaan" ini sendiri adalah peluang produk berikutnya.

Teks lengkap sebagai berikut:

Teknik perangkat lunak menyumbang hampir 50% dari semua panggilan alat AI Agent. Area vertikal seperti kesehatan, hukum, keuangan, dan 16 area lainnya hampir belum tersentuh, masing-masing di bawah 5%. Ini berarti ada 300 unicorn AI vertikal yang menunggu untuk dibangun.

Jika saya memulai bisnis hari ini, saya akan menatap area merah pada grafik batang di atas sampai saya melihat masa depan saya.

Pendiri Box, Aaron Levie, mengatakan:

Grafik ini adalah pengingat yang baik tentang seberapa besar peluang di bidang AI Agent saat ini.

Tentu akan ada banyak peluang Agent di tingkat horizontal, tetapi juga banyak alur kerja yang membutuhkan keahlian domain yang mendalam untuk benar-benar membantu pengguna mengotomatisasi proses unik di area vertikal mereka.

Template-nya adalah: membangun perangkat lunak Agent yang mengakses data proprietary, untuk secara efektif menghubungkan pengguna dengan kolaborasi Agent dalam menangani alur kerja, sambil memiliki kemampuan rekayasa konteks khusus domain yang mendalam, serta kemampuan mendorong manajemen perubahan di sisi klien.

Saat ini masih banyak area yang memiliki celah besar.

Teknik perangkat lunak mendominasi setengah dari semua aktivitas AI Agent. Setengah lainnya tersebar di 16 area vertikal, tidak ada yang melebihi 9%. Kesehatan 1%, hukum 0.9%, pendidikan 1.8%. Ini bukan pasar yang jenuh, melainkan pasar yang hampir belum ada.

Anthropic baru saja merilis penelitian penggunaan nyata AI Agent yang paling komprehensif hingga saat ini. Temuan intinya adalah: teknik perangkat lunak menyumbang 49.7% volume panggilan alat Agent di API mereka. Kesimpulan inti yang tersembunyi di belakangnya adalah: segala hal lainnya adalah lautan biru.

Keterlambatan Deployment

Ada satu data yang seharusnya membuat pendiri bisnis bersemangat: kemampuan model sudah jauh melampaui batas yang ingin dipercayai pengguna.

Evaluasi kemampuan METR menunjukkan bahwa Claude dapat menyelesaikan tugas yang membutuhkan waktu hampir lima jam bagi manusia. Namun dalam penggunaan aktual, durasi sesi pada persentil ke-99.9 hanya sekitar 42 menit. Kesenjangan ini—apa yang dapat dilakukan AI versus apa yang kita izinkan—adalah peluang besar.

Gambar: Durasi pelatihan terpanjang Claude Code hampir dua kali lipat dalam tiga bulan. Ini tidak hanya meningkatkan kemampuan, tetapi juga meningkatkan kepercayaan.

Sumber:x.com

Dari Oktober 2025 hingga Januari 2026, durasi sesi tunggal pada persentil ke-99.9 hampir dua kali lipat, dari kurang dari 25 menit menjadi lebih dari 45 menit. Pertumbuhan stabil di berbagai versi model. Ini bukan hanya model yang lebih kuat, tetapi pengguna belajar melalui penggunaan berulang, secara bertahap memperluas kepercayaan pada Agent.

"Dari Agustus hingga Desember, tingkat keberhasilan Claude Code pada tugas paling menantang pengguna internal dua kali lipat, sementara intervensi manusia per sesi berkurang dari 5.4 kali menjadi 3.3 kali."

Kemampuan sudah ada, deployment belum mengikuti. Ini bukan masalah, melainkan peluang produk.

Bagaimana Kepercayaan Berevolusi

20% pengguna baru secara otomatis menyetujui operasi Claude Code. Pada 750 sesi, lebih dari 40% sesi berjalan dalam mode persetujuan otomatis penuh. Namun ada temuan kontra-intuitif: pengguna berpengalaman justru lebih banyak melakukan intervensi, bukan lebih sedikit. Pengguna baru melakukan intervensi pada 5% putaran, pengguna lama 9%.

Gambar: Kepercayaan adalah keterampilan yang terus terakumulasi. Pengguna baru secara otomatis menyetujui 20% sesi. Pada 750 sesi, proporsi ini melebihi 40%.

Gambar: Anthropic

Sumber: x.com

Ini tidak kontradiktif, melainkan perubahan strategi pengawasan. Pemula menyetujui langkah demi langkah sebelum operasi terjadi, pengguna lama memberikan otorisasi terlebih dahulu, lalu turun tangan jika ada masalah—mereka telah beralih dari persetujuan sebelumnya ke pemantauan aktif.

Berikut adalah temuan yang perlu diperhatikan di tingkat keamanan: pada tugas kompleks, Claude Code meminta klarifikasi lebih dari dua kali frekuensi intervensi manusia aktif. Agent akan berhenti untuk mengonfirmasi, bukan meneruskan tanpa henti. Ini adalah fitur, bukan cacat.

"Inti dari penelitian ini adalah: otonomi yang dijalankan Agent dalam praktik, dibangun bersama oleh model, pengguna, dan produk. Claude akan berhenti dan bertanya ketika tidak yakin, sehingga membatasi independensinya. Pengguna membangun kepercayaan dalam berkolaborasi dengan model, dan menyesuaikan strategi pengawasan mereka sesuai."

Pendekatan AI Vertikal Levie

Aaron Levie menunjuk pada kekayaan dan nilai besar yang menunggu untuk dibuka: membangun perangkat lunak Agent yang mengakses data proprietary, membuatnya benar-benar menyelesaikan orang dan masalah nyata, mengisi konteks hingga penuh untuk memaksimalkan output cerdas, dan—ini bagian yang diabaikan kebanyakan pendiri—mendorong manajemen perubahan di sisi klien.

Poin terakhir inilah yang membuat AI vertikal sangat sulit untuk direplikasi. Siapa pun dapat membuat pembungkus API, tetapi sedikit yang dapat benar-benar menavigasi alur kerja khusus, kendala regulasi, dan resistensi organisasi dalam penagihan medis, penemuan hukum, atau persetujuan izin bangunan.

SaaS telah tumbuh sepuluh kali lipat setiap dekade dalam beberapa dekade terakhir. Lebih dari 40% modal ventura dalam 20 tahun terakhir mengalir ke perusahaan SaaS. Industri ini melahirkan lebih dari 170 unicorn SaaS. Logikanya sederhana: setiap unicorn ini memiliki versi AI vertikal yang menunggu untuk muncul. Dan versi AI mungkin sepuluh kali lebih besar, karena menggantikan bukan hanya perangkat lunak, tetapi juga operator.

Esensi Pembangunan Bersama

Temuan inti Anthropic patut diperhatikan serius oleh siapa pun yang terlibat dalam pembuatan kebijakan AI. Otonomi bukan atribut bawaan model, tetapi dibangun bersama oleh model, pengguna, dan produk. Evaluasi sebelum deployment tidak dapat menangkap ini, Anda harus mengukurnya dalam penggunaan nyata.

Anthropic secara resmi menyatakan:

Teknik perangkat lunak menyumbang sekitar 50% panggilan alat Agent di API kami, tetapi kami juga melihat area lain yang muncul. Seiring batas risiko dan otonomi terus berkembang, pemantauan pasca-deployment menjadi sangat penting. Kami mendorong pengembang model lain untuk memperluas penelitian ini.

Angka di tingkat keamanan meyakinkan: 73% panggilan alat melibatkan manusia dalam loop, hanya 0.8% operasi yang tidak dapat dibatalkan. Skenario deployment berisiko tinggi—seperti kebocoran kunci API atau perdagangan kripto otonom—sebagian besar adalah penilaian keamanan, bukan lingkungan produksi nyata.

"Persyaratan peraturan yang menentukan mode interaksi spesifik—misalnya mewajibkan persetujuan manusia untuk setiap operasi—hanya akan menciptakan gesekan, tidak selalu membawa keuntungan keamanan."

Kebijakan yang memaksa "menyetujui setiap operasi" akan membunuh keuntungan produktivitas, tanpa menambah keamanan. Target yang lebih baik adalah memastikan manusia dapat memantau dan turun tangan, bukan menentukan alur kerja persetujuan spesifik.

Di Mana Unicorn Bersembunyi

Peta sudah digambar. Teknik perangkat lunak sudah ada yang mengerjakan. Kesehatan, hukum, keuangan, pendidikan, layanan pelanggan, logistik—16 area vertikal, masing-masing dengan pangsa pasar satu digit—semuanya menunggu seseorang untuk benar-benar menyematkan keahlian domain ke dalam Agent.

Sebelumnya melahirkan 300 unicorn SaaS, 300 unicorn AI vertikal berikutnya akan segera muncul. Pendiri yang memilih area vertikal, menyematkan keahlian domain ke dalam Agent, dan mencari tahu cara menggerakkan manajemen perubahan, akan memiliki pasar perangkat lunak perusahaan dekade berikutnya.

Model sudah dapat bekerja lima jam, pengguna hanya mengizinkannya bekerja 42 menit. Inilah sinyalnya: kita masih berada di tahap sangat awal, masih banyak hal yang dapat dibangun, dan di banyak tempat yang bahkan belum melihat satu menit pun kecerdasan berperan.

Pertanyaan Terkait

QMenurut data Anthropic, bidang apa yang mendominasi panggilan alat AI Agent?

ARekayasa perangkat lunak (software engineering) mendominasi hampir 50% dari semua panggilan alat AI Agent.

QBerapa lama Claude dapat bekerja secara mandiri menurut evaluasi METR, dan berapa lama pengguna sebenarnya menggunakannya?

AMenurut evaluasi METR, Claude dapat menyelesaikan tugas yang membutuhkan manusia hampir lima jam, tetapi dalam penggunaan aktual, sesi pada persentil ke-99.9 hanya berlangsung sekitar 42 menit.

QApa yang dimaksud dengan 'defisit kepercayaan' dalam konteks AI Agent menurut artikel?

A'Defisit kepercayaan' mengacu pada kesenjangan antara apa yang AI mampu lakukan dan apa yang pengguna bersedia mempercayainya untuk dilakukan, yang merupakan peluang produk besar.

QBidang vertikal apa saja yang disebutkan sebagai peluang yang belum terjamah dalam artikel?

ABidang vertikal yang disebutkan sebagai peluang yang belum terjamah termasuk kesehatan (1%), hukum (0.9%), pendidikan (1.8%), keuangan, layanan pelanggan, dan logistik, dengan masing-masing di bawah 5%.

QBagaimana pola pengawasan pengguna berpengalaman terhadap AI Agent dibandingkan dengan pengguna baru?

APengguna berpengalaman cenderung lebih banyak melakukan intervensi (9% putaran) dibandingkan pengguna baru (5%), karena mereka beralih dari persetujuan langkah-demi-langkah ke pemantauan proaktif.

Bacaan Terkait

Bank Italia Tidak Melihat Keunggulan Sistemik Stablecoin dalam Transfer

Studi Bank Italia menunjukkan bahwa stablecoin tidak memberikan keunggulan sistemik yang berkelanjutan dalam hal biaya dan kecepatan transfer uang. Semua keuntungan hilang akibat biaya untuk deposit dan penarikan ke/dari fiat serta proses dalam infrastruktur pembayaran lokal. Peneliti membandingkan transfer 200 USDC di 10 koridor bilateral antara Italia dengan Brasil, Argentina, Jepang, UEA, dan Afrika Selatan. Metriknya adalah biaya total dan waktu penyelesaian dibandingkan layanan uang standar. Biaya akhir transfer stablecoin bervariasi dari 0,3% hingga hampir 9%, tergantung arahnya. Di koridor dengan sistem pembayaran instan, penyelesaian membutuhkan waktu kurang dari 20 menit. Sementara di daerah tanpa infrastruktur tersebut, proses memakan waktu satu hingga dua hari kerja. Biaya dan penundaan utama dikaitkan dengan pertukaran dan konversi mata uang, serta kualitas infrastruktur lokal. Komisi blockchain bukan faktor utama. Rata-rata biaya transfer uang global adalah 6,65%. Di sebagian besar koridor yang diteliti, stablecoin lebih murah dari level ini, namun dibandingkan dengan Wise, stablecoin hanya lebih unggul di tiga dari tujuh rute yang sebanding. Penulis berpendapat efeknya akan lebih terasa jika stablecoin bisa dibelanjakan langsung untuk barang/jasa tanpa konversi ke mata uang lokal. Mereka juga mencatat bahwa rezim regulasi yang melarang tidak menghilangkan permintaan akan "koin stabil", dan aturan yang terlalu ketat justru mempersulit penggunaan oleh klien ritel.

cryptonews.ru1j yang lalu

Bank Italia Tidak Melihat Keunggulan Sistemik Stablecoin dalam Transfer

cryptonews.ru1j yang lalu

Boom Bitcoin Memanas: Pernyataan Baru Saylor Picu Spekulasi Pembelian

Ketua Eksekutif MicroStrategy Inc., Michael Saylor, kembali memicu spekulasi pembelian Bitcoin baru perusahaan setelah memposting pesan "Bitcoin Drive engaged" pada 2 Agustus. Postingan hari Minggu ini disertai dengan pelacak pembelian biasa MicroStrategy, yang sejalan dengan praktik Saylor memberi sinyal perubahan treasury sebelum laporan mingguan. Laporan Saylor menunjukkan bahwa cadangan Bitcoin MicroStrategy adalah 843.775 BTC dengan nilai pasar sekitar $53,25 miliar. Dua penjualan Bitcoin baru-baru ini, total 3.588 BTC, telah mengurangi cadangan dari 847.363 BTC. Penjualan ini, menurut pengajuan SEC, ditujukan untuk mendanai pembayaran saham preferen dan menambah cadangan dolar AS. Perusahaan juga dilaporkan tidak melakukan pembelian Bitcoin dalam minggu yang berakhir 26 Juli, sambil meningkatkan cadangan dolar AS menjadi sekitar $3,75 miliar. Ekspektasi untuk pengumuman treasury pada hari Senin diperkuat oleh pola sebelumnya, di mana sinyal serupa pada hari Minggu mendahului pengungkapan cadangan uang yang lebih besar pada 27 Juli. Pembaruan data hari Senin ini akan menunjukkan apakah MicroStrategy kembali ke akumulasi Bitcoin, karena perusahaan menyeimbangkan cadangan Bitcoinnya yang besar dengan kewajiban tunai yang meningkat dan manajemen modal yang aktif. Risiko keuangan tetap tinggi setelah MicroStrategy melaporkan kerugian operasional $8,33 miliar untuk kuartal II 2026, termasuk kerugian belum terealisasi $8,32 miliar pada aset digitalnya.

cryptonews.ru1j yang lalu

Boom Bitcoin Memanas: Pernyataan Baru Saylor Picu Spekulasi Pembelian

cryptonews.ru1j yang lalu

Saham Perusahaan yang Bergerak di Bidang Kecerdasan Buatan Diperdagangkan Seperti 'Meme Coin', Sementara Bitcoin Hampir Tak Berubah Harganya — Tinjauan Mingguan

Tinjauan minggu ini menyoroti dominasi berita pasar saham tradisional dan makroekonomi atas berita kripto. Peringatan keamanan mendesak dikeluarkan untuk pengguna Coldcard terkait potensi kompromi kunci pribadi. Sementara itu, Bitcoin relatif stabil di sekitar $64.000, perhatian pasar justru terfokus pada volatilitas ekstrem di saham AI dan pasar Asia, terutama Korea Selatan yang mengalami penurunan signifikan. Likuidasi besar oleh dana "Situational Awareness" diduga berkontribusi pada penurunan ini. Di sektor kripto, tren bearish berlanjut dengan beberapa perusahaan seperti BitMart dan Storj Labs mengumumkan penutupan atau kebangkrutan. Perusahaan yang masih beroperasi, seperti Coinbase, mengalami tekanan dengan penurunan harga saham dan gelombang PHK di industri. Di sisi lain, MicroStrategy terus menambah cadangan kasnya dan membeli kembali sahamnya. Ekosistem DeFi menghadapi tantangan potensial dari kesuksesan proyek seperti Trade.xyz dan Pump.fun, yang dapat memutuskan untuk beroperasi secara mandiri. Isu perdagangan orang dalam juga mencuat di platform Hyperliquid. Sementara itu, token AI seperti Bittensor (TAO) menarik perhatian investor venture capital, meski disertai peringatan agar investor retail berhati-hati. Artikel ditutup dengan penekanan kembali pada pentingnya kewaspadaan keamanan, khususnya dalam penyimpanan aset kripto secara mandiri, di tengah potensi meningkatnya kerentanan perangkat keras dompet digital.

cryptonews.ru1j yang lalu

Saham Perusahaan yang Bergerak di Bidang Kecerdasan Buatan Diperdagangkan Seperti 'Meme Coin', Sementara Bitcoin Hampir Tak Berubah Harganya — Tinjauan Mingguan

cryptonews.ru1j yang lalu

Trading

Spot
活动图片