Jika kamu bersiap untuk bereinkarnasi, negara mana yang paling mungkin kamu lahir?
Pekerjaan, pendapatan, nilai-nilai, bahkan preferensi kecil terhadap warna tombol di sebuah aplikasi, seperti apa yang akan kamu miliki?
Dulu, untuk menghitung rangkaian probabilitas yang melintasi sosiologi, ekonomi perilaku, dan psikologi ini, banyak sosiolog dan statistikawan harus bekerja keras sampai botak.

Adegan fiksi ilmiah di film 'The Matrix' tahun 1999, baru saja menjadi kenyataan!
Dipimpin oleh doktor Harvard+MIT, melibatkan 40+ orang dari OpenAI, Anthropic, Google DeepMind, xAI, dan total lebih dari 200 ilmuwan top, mereka merilis MatrAIx, membangun 8.3 miliar agen cerdas untuk mensimulasikan perilaku nyata seluruh manusia di dunia.

Dalam pertempuran perebutan tahta model besar yang sedang berlangsung sengit, raksasa-raksasa teknologi kali ini, diam-diam bekerja sama membangun sebuah jaringan—sebuah 'tirai digital' yang mengurung seluruh perilaku manusia.

Makalah: https://arxiv.org/abs/2608.04205
Repo GitHub: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
Mereka memberikan kepribadian pada agen AI:
1. Membuat 8.3 miliar catatan profil karakter yang mencakup skala populasi global, meliputi 1290 dimensi seperti latar belakang, psikologi, kemampuan, perilaku, dan gaya hidup.
2. Mendukung evaluasi agen cerdas profil karakter dalam empat jenis lingkungan: survei kuesioner, chatbot AI, situs web, dan aplikasi.
3. Menyediakan lebih dari 1000+ tugas evaluasi yang mencakup 25+ bidang, termasuk bisnis, perangkat lunak, keuangan, dan kesehatan.

Keterampilan inti peneliti pengguna dan manajer produk tradisional tiba-tiba kehilangan nilai.
Pada saat yang sama, setiap orang harus menghadapi sebuah pertanyaan:
Ketika 'kepribadianmu' hanyalah distribusi probabilitas yang konsisten dalam 1290 ruang dimensi tinggi, bagaimana kamu membuktikan bahwa dirimu tetap adalah satu-satunya yang tidak dapat sepenuhnya disimulasikan?
AI Hitung Seluruh Kepribadian Manusia!
Momen 'Oppenheimer' Manajer Produk
Penelitian pengguna tradisional (User Research) pada hari ini, mengalami 'momen Oppenheimer'-nya.
Dulu, raksasa teknologi yang ingin meluncurkan aplikasi atau strategi baru perlu menghabiskan waktu berbulan-bulan, merekrut ratusan hingga ribuan relawan nyata dengan latar belakang dan warna kulit berbeda, melakukan banyak uji coba bertahap dan wawancara langsung.
Di dunia silikon MatrAIx, proses dengan hambatan tinggi, latensi tinggi, dan biaya tinggi ini ditekan menjadi sekejap.
Skala database Persona-8B adalah 8.3 miliar, mencerminkan dengan tepat satu banding satu dengan total populasi nyata di bumi fisik saat ini.

Mereka tidak perlu membayar asuransi sosial, tetapi mereka lebih paham daripada kamu bagaimana cara dengan elegan menolak desain UI yang buruk di macOS.
Dengan 8.3 miliar penduduk asli digital ini yang dapat dipanggil kapan saja, yang perlu dilakukan selanjutnya adalah menempatkan mereka ke dalam kehidupan sosial.
Tim MatrAIx merancang empat lingkungan interaksi simulasi yang terhubung penuh, menyebutnya sebagai MatrAIx Playground:

Survei Kuesioner (Surveys): Menguji konsep, sensitivitas harga, dan kesediaan membayar kelompok berbeda.
Obrolan AI (AI Chatbots): Mencatat secara lengkap jejak percakapan, melacak fluktuasi emosi nyata dan kebiasaan mengejar pertanyaan pengguna virtual ketika menghadapi kesalahan atau omong kosong AI [1.1.5].
Situs Web (Websites): Agen cerdas di jaringan sandbox ini seperti pengguna internet biasa, mencari, membandingkan harga, membaca ulasan, dan akhirnya membuat keputusan pembelian.
Aplikasi (Applications): Bahkan ini bukan lagi pertarungan di tingkat teks. Agen cerdas dapat secara langsung mengontrol desktop Linux, macOS, dan iOS, melakukan berbagai operasi perangkat lunak sehari-hari yang kompleks melalui mouse virtual, keyboard, dan sentuhan. Sistem akan mencatat tanpa terlewat perubahan file, perubahan izin, dan jejak operasi mereka.
Di sandbox ini, tim peneliti telah menyebarkan 1.010 tugas evaluasi kompleks yang mencakup 25 bidang berbeda (meliputi bisnis, perangkat lunak, keuangan, kesehatan, dll).

Mereka total menjalankan 18.189 kali eksperimen interaksi pengguna skala besar yang disimulasikan.
Dalam 400 eksperimen kontrol yang sangat ketat, agen virtual yang didorong oleh model besar di lapisan bawah ini, mencapai tingkat konsistensi yang mencengangkan 91.5% dalam memenuhi profil karakter yang ditentukan!

Saat mengevaluasi konsistensi profil karakter yang diekstrak dari manusia nyata, ahli manusia memberikan skor tinggi 4.135 (skala maksimum 5).
Sedangkan model besar yang mendorong manusia virtual ini, performanya sudah mendekati standar emas penilai manusia:
Claude Opus 4.8: Dalam 93.8% kasus, deviasi penilaiannya dengan penilaian ahli manusia terkontrol dalam 1 poin!
GPT-5.5: Dalam 79.2% kasus, deviasinya dalam 1 poin.
Ini menunjukkan bahwa model besar top saat ini tidak hanya menguasai logika dan akal sehat, tetapi bahkan sudah menguasai 'simulator empati' sosiologi.
Mereka dapat menghitung dengan tepat bagaimana 'ibu rumah tangga konservatif berusia 50 tahun dari kelas menengah AS' akan menunjukkan kemarahan dan kekecewaan yang halus ketika menghadapi bug pada produk teknologi.
Bagaimana sebenarnya 8.3 miliar hantu digital ini 'dibentuk'?
Di balik setiap 'orang', ada matriks atribut presisi yang berisi 1290 dimensi profil karakter. Dimensi ini dibagi menjadi lima area inti: informasi latar belakang, karakteristik psikologis, kemampuan profesional, interaksi perilaku, kehidupan sehari-hari.

Sumber data termasuk statistik populasi PBB, General Social Survey, biografi Wikipedia, ulasan konsumen nyata Amazon, survei pengembang Stack Overflow......
Jika hanya dikombinasikan secara acak, AI hanya akan menghasilkan 'monster siber' yang logikanya runtuh. Misalnya, seseorang yang tinggal di pedesaan Kenya, hanya berpendidikan SD, tetapi hanya mengerti bahasa Islandia, memiliki gelar doktor dari Harvard, berpenghasilan juta per tahun.
Untuk mengatasi masalah ini, tim peneliti membangun sebuah grafik asiklik berarah (DAG) yang sangat besar. Antara atribut dan atribut lain terdapat ketergantungan kondisi yang ketat:

Ketika sistem menentukan 'kemampuan bahasa Inggris' seseorang virtual, ia harus menghitung probabilitas gabungan dari dua node induk yaitu 'bahasa utama' dan 'wilayah tempat tinggal' terlebih dahulu.
Ditambah filter kompatibilitas yang kejam: selama ada konflik antara atribut induk-anak yang melawan akal sehat, penilaian segera menjadi nol, kombinasi itu langsung dihapus.

Setelah disaring oleh formula ini, manusia virtual yang disintesis mempertahankan keragaman makro yang luas, sementara secara internal individu tetap konsisten secara logika yang tidak tergoyahkan.
Ditambah lagi dengan jutaan 'potongan jiwa nyata' yang diekstrak dari Wikipedia, sejarah konsumsi Amazon, survei pengembang Stack Overflow, dan peninggalan sejarah manusia nyata lainnya, setiap hantu dalam database Persona-8B, seperti orang yang benar-benar hidup di alam semesta paralel, dengan darah dan daging.
Pernahkah kamu berpikir: preferensimu terhadap warna tertentu di sebuah aplikasi, sebenarnya dapat direduksi menjadi perkalian probabilitas node induk?
Ketika kepribadian diukur dengan tepat oleh 1290 skala, apa yang disebut 'unik' oleh manusia, di mata AI, hanyalah sebuah distribusi probabilitas yang konsisten.
Lingkaran Mobius yang Kosong
Ini adalah keajaiban teknologi, tetapi jika mengupas kulit luar efisiensi, kamu akan melihat sebuah kebenaran yang mengerikan.
Model besar (seperti GPT-5.5, Claude Opus 4.8) dalam MatrAIx berperan sebagai 'konsumen' dan 'anggota masyarakat', untuk mengevaluasi dan menguji 'manusia virtual' lain yang didorong oleh model besar.
Ini seperti seseorang, menggunakan tangan kirinya berperan sebagai pelanggan, untuk membeli roti yang dibuat oleh tangan kanannya sendiri, lalu tangan kirinya memberi tangan kanannya ulasan bintang lima.

Dalam loop tertutup ini, manusia nyata, hilang.
Jika pengguna virtual di sandbox memberi nilai tinggi 91.5% untuk obat baru atau aplikasi sosial, apakah itu pasti akan menyenangkan manusia berwujud yang bisa menangis, bertingkah tanpa alasan, dan dipengaruhi oleh cuaca dan hormon di dunia nyata?
Efek samping paling menakutkan dari 'ekosistem siklus sendiri' ini, terletak pada lenyapnya 'Angsa Hitam dan Jiwa'.
Seni terhebat dalam sejarah manusia, model bisnis paling mengganggu, bahkan terobosan ilmiah paling menakjubkan, seringkali tidak berasal dari 'konsistensi' yang dihitung oleh 1290 skala probabilitas.
Mereka sering lahir dari obsesi yang tidak masuk akal, serta kekacauan logika yang terjadi secara kebetulan—nilai-nilai anomali yang dianggap 'tidak kompatibel' oleh filter algoritma DAG dan langsung dihapus.
Jika semua produk digital, kebijakan, dan konten di masa depan diuji dan dioptimalkan oleh '8.3 miliar populasi yang disimulasikan AI', maka dunia ini akan menjadi sangat mulus.
Tapi juga akan menjadi sangat hampa dan membosankan.
Ini adalah dunia yang hambar yang dirancang khusus untuk memenuhi 'preferensi hantu digital'.
Di akhir makalah, tim peneliti tetap menjaga sikap ilmiah yang terkendali dan jernih:
Pengguna virtual tidak akan pernah dapat sepenuhnya menggantikan manusia nyata, untuk keputusan berisiko tinggi yang menyangkut nasib masyarakat dan kesimpulan ilmiah besar, partisipasi langsung pengguna nyata tetap tidak tergantikan.
Referensi:
https://matraix.ai/
https://arxiv.org/abs/2608.04205
https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
https://x.com/MatrAIx2026/status/2085217711781564492
Artikel ini dari akun WeChat publik "Xin Zhi Yuan", penulis: ASI Apokalips, editor: David





