Harvard MIT Buat 'The Matrix', 8.3 Miliar Agen Cerdas Tiru Secara Akurat Manusia di Seluruh Dunia

marsbitDipublikasikan tanggal 2026-08-10Terakhir diperbarui pada 2026-08-10

Abstrak

Tim ilmuwan dari Harvard dan MIT, dengan partisipasi ahli dari OpenAI, Anthropic, Google DeepMind, dan xAI, meluncurkan MatrAIx—sebuah sistem yang menciptakan 8,3 miliar agen cerdas untuk memodelkan perilaku seluruh populasi dunia secara realistik. Setiap agen memiliki profil dengan 1.290 dimensi yang mencakup latar belakang, psikologi, kemampuan, perilaku, dan gaya hidup. Data sintetis ini dihasilkan dari sumber seperti statistik PBB dan survei sosial, kemudian disaring melalui grafik ketergantungan agar tetap logis dan konsisten. MatrAIx mengevaluasi agen-agen ini dalam empat lingkungan simulasi: kuesioner survey, chatbot AI, penjelajahan website, dan interaksi dengan aplikasi di sistem operasi nyata. Sistem telah menjalankan lebih dari 18.000 eksperimen simulasi di 25 bidang seperti bisnis, keuangan, dan kesehatan. Dalam pengujian, agen menunjukkan tingkat konsistensi 91,5% dengan profil yang ditetapkan, dan evaluasi oleh model AI seperti Claude Opus hampir menyamai penilaian pakar manusia. Terobosan ini berpotensi merevolusi riset pengguna dengan menggantikan metode tradisional yang lambat dan mahal. Namun, tim peneliti mengingatkan bahwa simulasi tidak dapat sepenuhnya menggantikan umpan balik manusia nyata, terutama untuk keputusan berisiko tinggi. Proyek ini juga memunculkan pertanyaan filosofis tentang individualitas ketika kepribadian manusia dapat direduksi menjadi distribusi probabilitas dalam ruang dimensi tinggi.

Jika kamu bersiap untuk bereinkarnasi, negara mana yang paling mungkin kamu lahir?

Pekerjaan, pendapatan, nilai-nilai, bahkan preferensi kecil terhadap warna tombol di sebuah aplikasi, seperti apa yang akan kamu miliki?

Dulu, untuk menghitung rangkaian probabilitas yang melintasi sosiologi, ekonomi perilaku, dan psikologi ini, banyak sosiolog dan statistikawan harus bekerja keras sampai botak.

Adegan fiksi ilmiah di film 'The Matrix' tahun 1999, baru saja menjadi kenyataan!

Dipimpin oleh doktor Harvard+MIT, melibatkan 40+ orang dari OpenAI, Anthropic, Google DeepMind, xAI, dan total lebih dari 200 ilmuwan top, mereka merilis MatrAIx, membangun 8.3 miliar agen cerdas untuk mensimulasikan perilaku nyata seluruh manusia di dunia.

Dalam pertempuran perebutan tahta model besar yang sedang berlangsung sengit, raksasa-raksasa teknologi kali ini, diam-diam bekerja sama membangun sebuah jaringan—sebuah 'tirai digital' yang mengurung seluruh perilaku manusia.

Makalah: https://arxiv.org/abs/2608.04205

Repo GitHub: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

Mereka memberikan kepribadian pada agen AI:

1. Membuat 8.3 miliar catatan profil karakter yang mencakup skala populasi global, meliputi 1290 dimensi seperti latar belakang, psikologi, kemampuan, perilaku, dan gaya hidup.

2. Mendukung evaluasi agen cerdas profil karakter dalam empat jenis lingkungan: survei kuesioner, chatbot AI, situs web, dan aplikasi.

3. Menyediakan lebih dari 1000+ tugas evaluasi yang mencakup 25+ bidang, termasuk bisnis, perangkat lunak, keuangan, dan kesehatan.

Keterampilan inti peneliti pengguna dan manajer produk tradisional tiba-tiba kehilangan nilai.

Pada saat yang sama, setiap orang harus menghadapi sebuah pertanyaan:

Ketika 'kepribadianmu' hanyalah distribusi probabilitas yang konsisten dalam 1290 ruang dimensi tinggi, bagaimana kamu membuktikan bahwa dirimu tetap adalah satu-satunya yang tidak dapat sepenuhnya disimulasikan?

AI Hitung Seluruh Kepribadian Manusia!

Momen 'Oppenheimer' Manajer Produk

Penelitian pengguna tradisional (User Research) pada hari ini, mengalami 'momen Oppenheimer'-nya.

Dulu, raksasa teknologi yang ingin meluncurkan aplikasi atau strategi baru perlu menghabiskan waktu berbulan-bulan, merekrut ratusan hingga ribuan relawan nyata dengan latar belakang dan warna kulit berbeda, melakukan banyak uji coba bertahap dan wawancara langsung.

Di dunia silikon MatrAIx, proses dengan hambatan tinggi, latensi tinggi, dan biaya tinggi ini ditekan menjadi sekejap.

Skala database Persona-8B adalah 8.3 miliar, mencerminkan dengan tepat satu banding satu dengan total populasi nyata di bumi fisik saat ini.

Mereka tidak perlu membayar asuransi sosial, tetapi mereka lebih paham daripada kamu bagaimana cara dengan elegan menolak desain UI yang buruk di macOS.

Dengan 8.3 miliar penduduk asli digital ini yang dapat dipanggil kapan saja, yang perlu dilakukan selanjutnya adalah menempatkan mereka ke dalam kehidupan sosial.

Tim MatrAIx merancang empat lingkungan interaksi simulasi yang terhubung penuh, menyebutnya sebagai MatrAIx Playground:

Survei Kuesioner (Surveys): Menguji konsep, sensitivitas harga, dan kesediaan membayar kelompok berbeda.

Obrolan AI (AI Chatbots): Mencatat secara lengkap jejak percakapan, melacak fluktuasi emosi nyata dan kebiasaan mengejar pertanyaan pengguna virtual ketika menghadapi kesalahan atau omong kosong AI [1.1.5].

Situs Web (Websites): Agen cerdas di jaringan sandbox ini seperti pengguna internet biasa, mencari, membandingkan harga, membaca ulasan, dan akhirnya membuat keputusan pembelian.

Aplikasi (Applications): Bahkan ini bukan lagi pertarungan di tingkat teks. Agen cerdas dapat secara langsung mengontrol desktop Linux, macOS, dan iOS, melakukan berbagai operasi perangkat lunak sehari-hari yang kompleks melalui mouse virtual, keyboard, dan sentuhan. Sistem akan mencatat tanpa terlewat perubahan file, perubahan izin, dan jejak operasi mereka.

Di sandbox ini, tim peneliti telah menyebarkan 1.010 tugas evaluasi kompleks yang mencakup 25 bidang berbeda (meliputi bisnis, perangkat lunak, keuangan, kesehatan, dll).

Mereka total menjalankan 18.189 kali eksperimen interaksi pengguna skala besar yang disimulasikan.

Dalam 400 eksperimen kontrol yang sangat ketat, agen virtual yang didorong oleh model besar di lapisan bawah ini, mencapai tingkat konsistensi yang mencengangkan 91.5% dalam memenuhi profil karakter yang ditentukan!

Saat mengevaluasi konsistensi profil karakter yang diekstrak dari manusia nyata, ahli manusia memberikan skor tinggi 4.135 (skala maksimum 5).

Sedangkan model besar yang mendorong manusia virtual ini, performanya sudah mendekati standar emas penilai manusia:

Claude Opus 4.8: Dalam 93.8% kasus, deviasi penilaiannya dengan penilaian ahli manusia terkontrol dalam 1 poin!

GPT-5.5: Dalam 79.2% kasus, deviasinya dalam 1 poin.

Ini menunjukkan bahwa model besar top saat ini tidak hanya menguasai logika dan akal sehat, tetapi bahkan sudah menguasai 'simulator empati' sosiologi.

Mereka dapat menghitung dengan tepat bagaimana 'ibu rumah tangga konservatif berusia 50 tahun dari kelas menengah AS' akan menunjukkan kemarahan dan kekecewaan yang halus ketika menghadapi bug pada produk teknologi.

Bagaimana sebenarnya 8.3 miliar hantu digital ini 'dibentuk'?

Di balik setiap 'orang', ada matriks atribut presisi yang berisi 1290 dimensi profil karakter. Dimensi ini dibagi menjadi lima area inti: informasi latar belakang, karakteristik psikologis, kemampuan profesional, interaksi perilaku, kehidupan sehari-hari.

Sumber data termasuk statistik populasi PBB, General Social Survey, biografi Wikipedia, ulasan konsumen nyata Amazon, survei pengembang Stack Overflow......

Jika hanya dikombinasikan secara acak, AI hanya akan menghasilkan 'monster siber' yang logikanya runtuh. Misalnya, seseorang yang tinggal di pedesaan Kenya, hanya berpendidikan SD, tetapi hanya mengerti bahasa Islandia, memiliki gelar doktor dari Harvard, berpenghasilan juta per tahun.

Untuk mengatasi masalah ini, tim peneliti membangun sebuah grafik asiklik berarah (DAG) yang sangat besar. Antara atribut dan atribut lain terdapat ketergantungan kondisi yang ketat:

Ketika sistem menentukan 'kemampuan bahasa Inggris' seseorang virtual, ia harus menghitung probabilitas gabungan dari dua node induk yaitu 'bahasa utama' dan 'wilayah tempat tinggal' terlebih dahulu.

Ditambah filter kompatibilitas yang kejam: selama ada konflik antara atribut induk-anak yang melawan akal sehat, penilaian segera menjadi nol, kombinasi itu langsung dihapus.

Setelah disaring oleh formula ini, manusia virtual yang disintesis mempertahankan keragaman makro yang luas, sementara secara internal individu tetap konsisten secara logika yang tidak tergoyahkan.

Ditambah lagi dengan jutaan 'potongan jiwa nyata' yang diekstrak dari Wikipedia, sejarah konsumsi Amazon, survei pengembang Stack Overflow, dan peninggalan sejarah manusia nyata lainnya, setiap hantu dalam database Persona-8B, seperti orang yang benar-benar hidup di alam semesta paralel, dengan darah dan daging.

Pernahkah kamu berpikir: preferensimu terhadap warna tertentu di sebuah aplikasi, sebenarnya dapat direduksi menjadi perkalian probabilitas node induk?

Ketika kepribadian diukur dengan tepat oleh 1290 skala, apa yang disebut 'unik' oleh manusia, di mata AI, hanyalah sebuah distribusi probabilitas yang konsisten.

Lingkaran Mobius yang Kosong

Ini adalah keajaiban teknologi, tetapi jika mengupas kulit luar efisiensi, kamu akan melihat sebuah kebenaran yang mengerikan.

Model besar (seperti GPT-5.5, Claude Opus 4.8) dalam MatrAIx berperan sebagai 'konsumen' dan 'anggota masyarakat', untuk mengevaluasi dan menguji 'manusia virtual' lain yang didorong oleh model besar.

Ini seperti seseorang, menggunakan tangan kirinya berperan sebagai pelanggan, untuk membeli roti yang dibuat oleh tangan kanannya sendiri, lalu tangan kirinya memberi tangan kanannya ulasan bintang lima.

Dalam loop tertutup ini, manusia nyata, hilang.

Jika pengguna virtual di sandbox memberi nilai tinggi 91.5% untuk obat baru atau aplikasi sosial, apakah itu pasti akan menyenangkan manusia berwujud yang bisa menangis, bertingkah tanpa alasan, dan dipengaruhi oleh cuaca dan hormon di dunia nyata?

Efek samping paling menakutkan dari 'ekosistem siklus sendiri' ini, terletak pada lenyapnya 'Angsa Hitam dan Jiwa'.

Seni terhebat dalam sejarah manusia, model bisnis paling mengganggu, bahkan terobosan ilmiah paling menakjubkan, seringkali tidak berasal dari 'konsistensi' yang dihitung oleh 1290 skala probabilitas.

Mereka sering lahir dari obsesi yang tidak masuk akal, serta kekacauan logika yang terjadi secara kebetulan—nilai-nilai anomali yang dianggap 'tidak kompatibel' oleh filter algoritma DAG dan langsung dihapus.

Jika semua produk digital, kebijakan, dan konten di masa depan diuji dan dioptimalkan oleh '8.3 miliar populasi yang disimulasikan AI', maka dunia ini akan menjadi sangat mulus.

Tapi juga akan menjadi sangat hampa dan membosankan.

Ini adalah dunia yang hambar yang dirancang khusus untuk memenuhi 'preferensi hantu digital'.

Di akhir makalah, tim peneliti tetap menjaga sikap ilmiah yang terkendali dan jernih:

Pengguna virtual tidak akan pernah dapat sepenuhnya menggantikan manusia nyata, untuk keputusan berisiko tinggi yang menyangkut nasib masyarakat dan kesimpulan ilmiah besar, partisipasi langsung pengguna nyata tetap tidak tergantikan.

Referensi:

https://matraix.ai/

https://arxiv.org/abs/2608.04205

https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

https://x.com/MatrAIx2026/status/2085217711781564492

Artikel ini dari akun WeChat publik "Xin Zhi Yuan", penulis: ASI Apokalips, editor: David

Pertanyaan Terkait

QApa itu MatrAIx dan apa tujuan utamanya?

AMatrAIx adalah proyek kolaborasi yang dipimpin oleh peneliti dari Harvard dan MIT dengan partisipasi dari ilmuwan terkemuka di bidang AI. Tujuannya adalah untuk membangun 8,3 miliar agen cerdas yang secara akurat mencerminkan populasi manusia global di dunia nyata. Agen-agen ini digunakan untuk mensimulasikan perilaku manusia dalam berbagai lingkungan virtual untuk tujuan penelitian dan pengujian produk.

QBerapa banyak dimensi yang digunakan untuk membuat profil setiap agen cerdas dalam Persona-8B?

ASetiap agen cerdas dalam database Persona-8B memiliki profil yang mencakup 1.290 dimensi. Dimensi-dimensi ini dikelompokkan menjadi lima area inti: informasi latar belakang, karakteristik psikologis, kemampuan profesional, interaksi perilaku, dan kehidupan sehari-hari.

QApa saja empat jenis lingkungan simulasi yang disediakan oleh MatrAIx Playground?

AMatrAIx Playground menyediakan empat lingkungan simulasi: 1) Survei (Surveys) untuk menguji konsep dan sensitivitas harga, 2) Chatbot AI (AI Chatbots) untuk merekam interaksi percakapan, 3) Situs Web (Websites) untuk simulasi penjelajahan dan pembelian online, serta 4) Aplikasi (Applications) di mana agen dapat mengoperasikan sistem seperti Linux, macOS, dan iOS secara langsung.

QMenurut artikel, apa potensi risiko atau kekhawatiran utama dari simulasi MatrAIx ini?

ARisiko utamanya adalah terciptanya 'lingkaran tertutup' atau ekosistem yang mandiri, di mana AI mensimulasikan pengguna (konsumen) dan juga mengevaluasi produk yang dibuat oleh AI lainnya. Hal ini dapat menghilangkan peran dan preferensi manusia nyata yang tidak terduga, spontan, dan emosional, sehingga berpotensi menghasilkan dunia digital yang sangat mulus tetapi juga membosankan dan kurang inovatif.

QApa yang dikatakan tim peneliti tentang kemampuan agen virtual untuk menggantikan manusia sepenuhnya?

ADi akhir penelitian, tim peneliti menyatakan dengan jelas bahwa agen virtual tidak akan pernah dapat sepenuhnya menggantikan manusia nyata. Untuk keputusan berisiko tinggi yang berdampak pada masyarakat dan kesimpulan ilmiah besar, partisipasi langsung pengguna manusia nyata tetap sangat penting dan tidak tergantikan.

Bacaan Terkait

Bisnis Paling Menguntungkan di India Tercabut Sampai ke Akar-akarnya oleh AI?

Pada 31 Maret, seorang insinyur perangkat lunak berusia 32 tahun di Bengaluru bunuh diri setelah kehilangan pekerjaan bergaji tinggi di AS karena dampak AI. Ia mewakili guncangan besar yang sedang melanda industri outsourcing IT India, bisnis bernilai miliaran dolar yang menyumbang 7% PDB India. AI mengubah segalanya. Biaya tenaga kerja murah—keunggulan utama India selama 30 tahun—kini tak lagi relevan dibanding efisiensi AI yang hanya memerlukan biaya listrik. Laporan McKinsey memperkirakan hingga 30% jam kerja di India dapat tergantikan otomatisasi pada 2030. Gelombang PHK telah dimulai: Oracle memangkas 12.000 pekerjaan di India, sementara raksasa TCS berencana memangkas ribuan posisi. Pertumbuhan pendapatan perusahaan-perusahaan besar seperti TCS dan Wipro melambat, bahkan negatif. Industri yang dulu dimulai dari penanganan "Y2K" kini terperangkap dalam model "menjual kepala". Ketergantungan pada pekerjaan rutin membuat India gagal membangun perusahaan produk teknologi kelas dunia. Di era AI, hanya sedikit unicorn AI India yang mampu bersaing secara global, kebanyakan berfokus pada layanan atau penyewaan infrastruktur. India berusaha bertransisi ke layanan bernilai tambah tinggi seperti konsultasi AI. Namun, tekanan sosial nyata: laporan menunjukkan tingkat pengangguran pemuda berpendidikan tinggi mencapai 40%. Perjalanan India menjadi peringatan bagi negara berkembang lain—apakah jalan "bonus demografi → industrialisasi → peningkatan industri" masih valid di era AI? Kecepatan transformasi industri kini beradu dengan kecepatan hilangnya lapangan kerja.

marsbit11m yang lalu

Bisnis Paling Menguntungkan di India Tercabut Sampai ke Akar-akarnya oleh AI?

marsbit11m yang lalu

Bitcoin Perebutan Posisi Kunci antara Bull dan Bear, Sinyal Dukungan Pemulihan HYPE Mulai Tampak|Analisis Tamu

Analisis Teknis BTC & HYPE: Perjuangan di Titik Kunci dan Sinyal Pemulihan **BTC: Gelombang c Lanjutan, Perhatian pada Zona Resistensi** Harga Bitcoin saat ini berada dalam kelanjutan gelombang c rebound dari level rendah $62,268. Target utama adalah menembus zona resistensi kunci $65,700-$67,300. Jika berhasil, target berikutnya adalah area $69,500-$71,000. Analisis multi-siklus menunjukkan struktur rebound masih utuh. Level dukungan kunci berada di $63,600-$64,000, $60,950-$61,500, dan $57,820. **Strategi Operasional BTC:** * **Strategi Menengah:** Posisi short telah dikurangi di bawah 20%. Jika harga berhasil menembus $67,300 dan menunjukkan sinyal jenuh beli di area $69,500-$71,000, pertimbangkan untuk menambah posisi short hingga sekitar 50%. * **Strategi Jangka Pendek:** Gunakan 30% modal dengan dua skenario: * **Skema A:** Short percobaan (30%) jika harga jenuh beli di area $69,500-$71,000. * **Skema B:** Long percobaan ringan (15%) jika harga memantul dari dukungan $63,600-$64,000. **HYPE: Rebound dari Zona Dukungan Tiga Lapis** Harga HYPE menemukan dukungan kuat di area konfluensi: tren naik jangka panjang, garis bawah saluran turun, dan zona dukungan $50-$52. Sinyal rebound harian telah muncul. Fokus minggu ini adalah pada apakah harga dapat menantang dan menembus garis atas saluran turun, yang akan menentukan apakah ini sekadar rebound teknis atau pembalikan tren. **Strategi & Level Penting HYPE:** * **Level Teknis:** Dukungan di $50-$52 dan $45. Resistensi di $58.5-$60, garis atas saluran turun, dan sekitar $72.97. * **Strategi:** Pemegang long dari area $50-$52 dapat mempertahankan dengan stop loss. Investor yang belum masuk dapat mempertimbangkan long ringan jika harga kembali menguji area $50-$52 dengan sinyal stabil. **Verifikasi & Catatan:** Analisis sebelumnya untuk BTC (akhir gelombang b di atas $60,900-$61,500) dan HYPE (stabil di $50-$52) telah dikonfirmasi oleh pasar. Transaksi short-term BTC minggu lalu menghasilkan keuntungan sekitar 2.28%. **Peringatan:** Semua analisis dan strategi berasal dari analisis teknis pribadi, bukan saran investasi. Pasar berisiko, lakukan manajemen risiko yang ketat.

Odaily星球日报21m yang lalu

Bitcoin Perebutan Posisi Kunci antara Bull dan Bear, Sinyal Dukungan Pemulihan HYPE Mulai Tampak|Analisis Tamu

Odaily星球日报21m yang lalu

Bitcoin Bulls and Bears Are Competing for Critical Points, HYPE Shows Initial Signs of Rebound Support | Invited Analysis

Analisis teknis Bitcoin (BTC) dan HYPE minggu ini menyoroti pergerakan kunci dan level support/resistance. **Bitcoin (BTC):** * Tren harian berada dalam gelombang c naik dari posisi terendah $62,268. Target utama adalah menembus zona resistensi kritis $65,700–$67,300. Jika berhasil, target berikutnya adalah $69,500–$71,000. * Level support utama: $63,600–$64,000, diikuti $60,950–$61,500, dan $57,820. * **Strategi:** Posisi jangka menengah dikurangi di bawah 20%. Untuk trading jangka pendek, dua skenario dipertimbangkan: * **Skema A:** Mencoba posisi jual (30%) jika harga mencapai $69,500–$71,000 dan menunjukkan sinyal kelelahan. * **Skema B:** Mencoba posisi beli ringan (15%) jika harga menarik diri ke support $63,600–$64,000 dan stabil. **HYPE:** * Harga menemukan support kuat di zona konfluensi: garis tren naik jangka panjang, garis bawah channel turun, dan area support $50–$52, memicu sinyal反弹 harian. * **Strategi:** Fokus pada apakah反弹 dapat menembus garis atas channel turun untuk mengkonfirmasi kekuatan. Pemegang posisi beli dapat menahan, sementara trader kosong dapat mempertimbangkan posisi beli ringan jika harga uji kembali area $50–$52 dengan stabil. **Verifikasi & Hasil Minggu Lalu:** * Analisis BTC tentang penyelesaian gelombang b di atas $60,900–$61,500 terbukti akurat. Satu trade beli jangka pendek menghasilkan keuntungan ~2.28%. * Prediksi HYPE untuk stabil di $50–$52 juga terbukti valid. **Peringatan:** Semua analisis bersifat dinamis dan untuk catatan pribadi, bukan rekomendasi investasi. Pasar memiliki risiko, berhati-hatilah.

marsbit21m yang lalu

Bitcoin Bulls and Bears Are Competing for Critical Points, HYPE Shows Initial Signs of Rebound Support | Invited Analysis

marsbit21m yang lalu

Trading

Spot
活动图片