Nếu bạn chuẩn bị đầu thai, bạn có khả năng cao sẽ sinh ra ở quốc gia nào?
Bạn sẽ có nghề nghiệp, thu nhập, giá trị quan, thậm chí là sở thích nhỏ về màu sắc của một nút ứng dụng như thế nào?
Trước đây, để tính toán xác suất này trải dài qua xã hội học, kinh tế học hành vi và tâm lý học, vô số nhà xã hội học và thống kê học đã phải đau đầu.

Khung cảnh khoa học viễn tưởng trong "Ma trận" năm 1999 vừa thành hiện thực!
Dẫn đầu bởi Tiến sĩ Harvard+MIT, với sự tham gia của hơn 40 người từ OpenAI, Anthropic, Google DeepMind, xAI và tổng cộng hơn 200 nhà khoa học hàng đầu, công bố MatrAIx, xây dựng 8,3 tỷ tác nhân thông minh để mô phỏng hành vi thực của con người trên toàn thế giới.

Trong cuộc chiến giành ngai vàng của mô hình lớn, các ông lớn từng chém giết nhau một cách khốc liệt, lần này, bất ngờ đồng lòng dệt nên một tấm lưới — một "màn chắn kỹ thuật số" giam cầm toàn bộ hành vi của nhân loại.

Bài báo: https://arxiv.org/abs/2608.04205
GitHub Repo: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
Họ trao nhân cách cho các tác nhân AI:
1. Tạo ra 8,3 tỷ hồ sơ chân dung nhân vật trên quy mô toàn cầu, bao gồm 1290 chiều như nền tảng, tâm lý, khả năng, hành vi và lối sống.
2. Hỗ trợ đánh giá tác nhân chân dung trong bốn loại môi trường: bảng câu hỏi khảo sát, chatbot AI, trang web và ứng dụng.
3. Cung cấp hơn 1000 nhiệm vụ đánh giá bao phủ 25+ lĩnh vực, từ kinh doanh, phần mềm, tài chính đến y tế.

Kỹ năng cốt lõi của nhà nghiên cứu người dùng và quản lý sản phẩm truyền thống lập tức mất giá.
Đồng thời, mỗi người phải đối mặt với một câu hỏi:
Khi "cá tính" của bạn chỉ là một phân phối xác suất tự nhất quán trong không gian 1290 chiều, bạn làm thế nào để chứng minh mình vẫn là duy nhất không thể bị mô phỏng hoàn toàn?
AI tính toán hết tính cách toàn nhân loại!
"Thời khắc Oppenheimer" của Quản lý Sản phẩm
Nghiên cứu người dùng truyền thống (User Research) trong ngày này, đã đón nhận "Thời khắc Oppenheimer" của nó.
Trước đây, để tung ra một ứng dụng mới, chiến lược mới, các ông lớn công nghệ cần tiêu tốn hàng tháng, tuyển hàng trăm hàng ngàn tình nguyện viên thực với màu da và nền tảng khác nhau, thực hiện vô số lần thử nghiệm thang xám và phỏng vấn trực tiếp.
Trong thế giới silicon của MatrAIx, quy trình có rào cản cao, độ trễ cao, chi phí cao này đã bị nén thành một khoảnh khắc.
Quy mô của cơ sở dữ liệu Persona-8B là 8,3 tỷ, đã đạt được sự phản chiếu chính xác một đối một với tổng dân số thực tế trên Trái đất vật lý hiện tại.

Chúng không cần đóng bảo hiểm, nhưng lại hiểu cách từ chối một thiết kế UI tồi trên macOS một cách lịch sự hơn bạn.
Với 8,3 tỷ cư dân số nguyên bản kỹ thuật số này có thể điều động bất cứ lúc nào, việc tiếp theo là đưa chúng vào đời sống xã hội.
Nhóm MatrAIx đã thiết kế riêng cho chúng bốn môi trường tương tác mô phỏng toàn diện, gọi là MatrAIx Playground:

Bảng câu hỏi khảo sát (Surveys): Kiểm tra khái niệm, độ nhạy cảm về giá, sẵn sàng chi trả của các nhóm khác nhau.
Chatbot AI (AI Chatbots): Ghi lại đầy đủ quỹ đạo hội thoại, theo dõi biến động cảm xúc thực và thói quen truy vấn của người dùng ảo khi đối mặt với lỗi của AI, nói nhảm [1.1.5].
Trang web (Websites): Các tác nhân thông minh trong hộp cát mạng này tìm kiếm, so sánh giá, xem đánh giá như một cư dân mạng bình thường, cuối cùng đưa ra quyết định mua hàng.
Ứng dụng (Applications): Đây thậm chí không còn là giao đấu ở cấp độ văn bản nữa. Tác nhân thông minh có thể trực tiếp điều khiển desktop Linux, macOS và iOS, thực hiện các thao tác phần mềm phức tạp hàng ngày thông qua chuột ảo, bàn phím và cảm ứng. Hệ thống sẽ ghi lại một cách chi tiết mọi thay đổi file, thay đổi quyền và quỹ đạo hoạt động của chúng.
Trong hộp cát này, nhóm nghiên cứu đã triển khai 1.010 nhiệm vụ đánh giá phức tạp cho 25 lĩnh vực khác nhau (bao gồm kinh doanh, phần mềm, tài chính, y tế, v.v.).

Họ đã chạy tổng cộng 18.189 lần thử nghiệm tương tác người dùng mô phỏng quy mô lớn.
Trong 400 thí nghiệm kiểm soát cực kỳ khắt khe, các tác nhân ảo được vận hành bởi mô hình lớn cốt lõi này đã đạt được tỷ lệ nhất quán đáng kinh ngạc 91,5% khi phù hợp với nhân vật chỉ định!

Khi đánh giá tính nhất quán của nhân vật được trích xuất từ con người thực, các chuyên gia con người đã cho điểm cao 4,135 (thang điểm tối đa 5).
Còn mô hình lớn cốt lõi vận hành những người ảo này, biểu hiện của chúng đã tiệm cận vô hạn tiêu chuẩn vàng của người đánh giá con người:
Claude Opus 4.8: Trong 93,8% trường hợp, sai số đánh giá của nó so với điểm số của chuyên gia con người được kiểm soát trong vòng 1 điểm!
GPT-5.5: Trong 79,2% trường hợp, sai số trong vòng 1 điểm.
Điều này cho thấy, các mô hình lớn hàng đầu hiện nay không chỉ nắm vững logic và kiến thức thông thường, mà thậm chí đã nắm vững "bộ mô phỏng đồng cảm" của xã hội học.
Chúng có thể tính toán chính xác một "phụ nữ nội trợ 50 tuổi, thuộc tầng lớp trung lưu Mỹ, tính cách bảo thủ hướng nội" sẽ thể hiện sự tức giận và thất vọng tinh tế như thế nào khi đối mặt với một lỗ hổng của sản phẩm công nghệ.
8,3 tỷ bóng ma số này, rốt cuộc đã được "nặn" ra như thế nào?
Đằng sau mỗi "người", đều có một ma trận thuộc tính tinh xảo chứa 1290 chiều chân dung. Các chiều này được chia thành năm vùng cốt lõi: thông tin nền tảng, đặc điểm tâm lý, năng lực chuyên môn, tương tác hành vi, đời sống hàng ngày.

Nguồn dữ liệu bao gồm thống kê dân số Liên Hợp Quốc, Khảo sát Xã hội Tổng quát (General Social Survey), tiểu sử nhân vật Wikipedia, đánh giá tiêu dùng thực trên Amazon, khảo sát nhà phát triển Stack Overflow...
Nếu chỉ kết hợp ngẫu nhiên, AI sẽ chỉ nặn ra những "quái vật mạng" logic đổ vỡ. Ví dụ, một người sống ở nông thôn Kenya, chỉ có trình độ tiểu học, nhưng chỉ biết tiếng Iceland, có bằng tiến sĩ Harvard, thu nhập hàng triệu một năm.
Để giải quyết vấn đề này, nhóm nghiên cứu đã xây dựng một đồ thị có hướng không chu trình (DAG) vĩ đại. Giữa các thuộc tính tồn tại sự phụ thuộc có điều kiện nghiêm ngặt:

Khi hệ thống quyết định "khả năng tiếng Anh" của một người ảo, trước tiên phải tính xác suất kết hợp của hai nút cha "ngôn ngữ chính" và "khu vực sinh sống".
Sau đó thêm bộ lọc tương thích khắc nghiệt: Chỉ cần xuất hiện xung đột trái với lẽ thường giữa thuộc tính cha và con, phán định lập tức về không, tổ hợp đó bị xóa sạch ngay lập tức.

Sau quá trình lọc của công thức này, người ảo tổng hợp vừa duy trì được sự đa dạng vĩ đại, vừa duy trì tính tự nhất quán logic bất khả xâm phạm bên trong cá nhân.
Thêm vào đó là hàng trăm triệu "mảnh linh hồn thực" được trích xuất từ các di sản lịch sử con người thực như Wikipedia, lịch sử tiêu dùng Amazon, khảo sát nhà phát triển Stack Overflow, mỗi bóng ma trong cơ sở dữ liệu Persona-8B, đều giống như một người có xương có thịt, đã từng thực sự sống trong một vũ trụ song song.
Bạn đã bao giờ nghĩ: sở thích của mình về màu sắc của một ứng dụng nào đó, thực ra có thể được khôi phục thành tích của xác suất nút cha?
Khi cá tính được đo lường chính xác bằng 1290 thang đo, cái gọi là "duy nhất" của con người, trong mắt AI, chỉ là một phân phối xác suất tự nhất quán.
Vòng Mobius hư vô
Đây là một kỳ tích công nghệ, nhưng nếu lột bỏ lớp vỏ hiệu quả bên ngoài, bạn sẽ thấy một sự thật rùng rợn.
Mô hình lớn (như GPT-5.5, Claude Opus 4.8) đóng vai "người tiêu dùng" và "thành viên xã hội" trong MatrAIx, để đánh giá và kiểm tra một "người ảo" khác được vận hành bởi mô hình lớn.
Điều này giống như một người, dùng tay trái đóng vai khách hàng, đi mua chiếc bánh mì do chính tay phải mình làm ra, sau đó tay trái cho tay phải một đánh giá năm sao.

Trong vòng lặp khép kín này, con người thực sự, biến mất.
Nếu người dùng ảo trong hộp cát cho một loại thuốc mới hoặc một ứng dụng mạng xã hội điểm cao 91,5%, nó trong thực tế có nhất định làm hài lòng những con người bằng xương bằng thịt, những người có thể khóc, có thể cãi vô lý, bị ảnh hưởng bởi thời tiết và hormone không?
Tác dụng phụ đáng sợ nhất của "hệ sinh thái tự tuần hoàn" này, nằm ở sự biến mất hoàn toàn của "Thiên nga đen và linh hồn".
Những tác phẩm nghệ thuật vĩ đại nhất, mô hình kinh doanh mang tính đột phá nhất, thậm chí những đột phá khoa học đáng kinh ngạc nhất trong lịch sử nhân loại, thường không đến từ tính "tự nhất quán" được tính toán bởi 1290 thang đo xác suất.
Chúng thường được sinh ra từ những ám ảnh không thể lý giải, và những rối loạn logic xảy ra ngẫu nhiên — những giá trị ngoại lệ bị bộ lọc thuật toán DAG coi là "không tương thích" và bị xóa sạch ngay lập tức.
Nếu tất cả sản phẩm số, chính sách và nội dung trong tương lai, "8,3 tỷ dân số được AI mô phỏng" có thể kiểm tra và tối ưu hóa, thì thế giới này sẽ trở nên cực kỳ trơn tru.
Nhưng đồng thời cũng sẽ trở nên cực kỳ trống rỗng và nhàm chán.
Đây là một thế giới vô vị được thiết kế riêng để chiều theo "sở thích của bóng ma số".
Cuối bài báo, nhóm nghiên cứu vẫn giữ sự kiềm chế và tỉnh táo đặc trưng của các nhà khoa học:
Người dùng ảo vĩnh viễn không thể thay thế hoàn toàn con người thực, đối với những quyết định rủi ro cao liên quan đến vận mệnh xã hội và kết luận khoa học trọng đại, sự tham gia trực tiếp của người dùng thực vẫn không thể thay thế.
Tài liệu tham khảo:
https://matraix.ai/
https://arxiv.org/abs/2608.04205
https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
https://x.com/MatrAIx2026/status/2085217711781564492
Bài viết này đến từ tài khoản WeChat công chúng "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục, biên tập: Đại Vệ





