Harvard et MIT créent une « Matrice », 8,3 milliards d'agents IA miroir précis de l'humanité réelle

marsbitPublié le 2026-08-10Dernière mise à jour le 2026-08-10

Résumé

Une équipe de chercheurs de Harvard, du MIT et de grandes entreprises technologiques comme OpenAI et Google DeepMind a créé MatrAIx, un projet simulant 8,3 milliards d'agents IA, soit une réplique numérique de la population mondiale. Chaque agent possède un profil détaillé de 1290 dimensions (contexte, psychologie, compétences, comportements et style de vie) et peut interagir dans quatre environnements simulés : questionnaires, chatbots, sites web et applications. Cela permet de tester des produits, des stratégies ou des interfaces de manière rapide et à grande échelle. Les agents ont démontré un taux de cohérence de 91,5 % avec leurs profils attribués. Bien que cette technologie promette une optimisation efficace, elle suscite des questions sur la possibilité de capturer la complexité humaine réelle et sur les risques de créer une boucle fermée où l'IA évalue l'IA, éliminant ainsi l'imprévisible et la singularité humaines. Les chercheurs reconnaissent que ces agents virtuels ne peuvent remplacer les humains pour les décisions sociales à haut risque.

Si vous vous apprêtez à renaître, dans quel pays avez-vous le plus de chances de vous incarner ?

Quelle profession, quel revenu, quelles valeurs, voire quelle petite préférence pour la couleur d'un bouton d'application, allez-vous posséder ?

Dans le passé, pour calculer cette probabilité à l'intersection de la sociologie, de l'économie comportementale et de la psychologie, d'innombrables sociologues et statisticiens se seraient arraché les cheveux.

La scène de science-fiction du film « The Matrix » de 1999 vient de devenir réalité !

Sous la direction de doctorants de Harvard et du MIT, avec la participation d'OpenAI, Anthropic, Google DeepMind, xAI et plus de 40 autres, soit plus de 200 scientifiques de premier plan, MatrAIx est publié. Il construit 8,3 milliards d'agents intelligents pour simuler les comportements réels de l'humanité mondiale.

Dans la bataille sanglante pour le trône des grands modèles, les géants, cette fois, ont tacitement uni leurs forces pour tisser un filet — un « voile numérique » qui emprisonne les comportements de toute l'humanité.

Article : https://arxiv.org/abs/2608.04205

Dépôt GitHub : https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

Ils ont doté les agents IA d'une personnalité :

1. Créé 8,3 milliards de profils personnels à l'échelle de la population mondiale, couvrant 1290 dimensions telles que le contexte, la psychologie, les capacités, le comportement et le mode de vie.

2. Prise en charge de l'évaluation d'agents de profils dans quatre types d'environnements : questionnaires, chatbots IA, sites web et applications.

3. Fourniture d'une couverture de plus de 25 domaines, plus de 1000 tâches d'évaluation, couvrant les secteurs du commerce, des logiciels, de la finance et de la santé.

Les compétences clés des chercheurs utilisateurs et des product managers traditionnels se déprécient instantanément.

Simultanément, chacun doit faire face à une question :

Lorsque votre « individualité » n'est qu'une distribution de probabilité cohérente dans un espace à 1290 dimensions, comment prouvez-vous que vous êtes toujours un être unique et irréductiblement simulable ?

L'IA calcule toutes les personnalités humaines !

Le « Moment Oppenheimer » du Product Manager

La recherche utilisateur traditionnelle (User Research) a vécu, ce jour-là, son « Moment Oppenheimer ».

Autrefois, lorsqu'une grande entreprise technologique lançait une nouvelle application ou stratégie, cela nécessitait des mois d'efforts, le recrutement de centaines de volontaires réels de différentes origines, et d'innombrables tests A/B et entretiens en présentiel.

Dans le monde silicium de MatrAIx, ce processus à fort coût, haute latence et haute barrière est compressé en un instant.

La base de données Persona-8B contient 8,3 milliards d'entrées, réalisant un miroir exact, un pour un, avec la population réelle totale de la Terre physique à cet instant.

Ils n'ont pas besoin de cotisations sociales, mais ils savent mieux que vous comment refuser élégamment un mauvais design d'interface sur macOS.

Avec ces 8,3 milliards de natifs numériques mobilisables à tout moment, la prochaine étape consiste à les déployer dans la vie sociale.

L'équipe MatrAIx leur a conçu sur mesure quatre environnements d'interaction simulée à voie complète, appelés MatrAIx Playground :

Questionnaires (Surveys) : Tester des concepts, la sensibilité aux prix, la volonté de payer de différents groupes.

Chatbots IA (AI Chatbots) : Enregistrement complet des parcours de conversation, suivi des fluctuations émotionnelles réelles et des habitudes de questionnement des utilisateurs virtuels face aux erreurs ou divagations de l'IA [1.1.5].

Sites Web (Websites) : Les agents naviguent dans ce bac à sable web comme des internautes ordinaires, recherchent, comparent les prix, lisent les avis, et prennent finalement une décision d'achat.

Applications (Applications) : Cela ne se limite même plus à des échanges textuels. Les agents peuvent directement contrôler les bureaux de Linux, macOS et iOS, via des souris, claviers et gestes tactiles virtuels pour effectuer diverses opérations logicielles complexes du quotidien. Le système enregistre méticuleusement leurs modifications de fichiers, changements de permissions et trajectoires d'action.

Dans ce bac à sable, l'équipe de recherche a déjà déployé 1 010 tâches d'évaluation complexes couvrant 25 domaines différents (commerce, logiciels, finance, santé, etc.).

Ils ont mené au total 18 189 expériences de simulation à grande échelle d'interactions utilisateurs.

Dans 400 expériences de contrôle extrêmement rigoureuses, ces agents virtuels pilotés par des modèles de fond, ont atteint un taux de cohérence avec les personnalités spécifiées de 91,5% !

Lors de l'évaluation de la cohérence de personnalités extraites d'humains réels, des experts humains ont attribué un score élevé de 4,135 (sur 5).

La performance des grands modèles sous-jacents qui pilotent ces personnes virtuelles s'approche infiniment de l'étalon-or des évaluateurs humains :

Claude Opus 4.8 : Dans 93,8% des cas, son erreur d'évaluation se situe à moins d'1 point de l'écart de notation des experts humains !

GPT-5.5 : Dans 79,2% des cas, l'erreur se situe à moins d'1 point.

Cela montre que les grands modèles de pointe actuels maîtrisent non seulement la logique et le sens commun, mais aussi un « simulateur d'empathie » sociologique.

Ils peuvent calculer avec précision comment une « femme au foyer de 50 ans, appartenant à la classe moyenne américaine, de caractère conservateur et introverti », manifesterait une colère et une déception subtiles face à un bug dans un produit technologique.

Comment ces 8,3 milliards de fantômes numériques ont-ils été « sculptés » ?

Derrière chaque « personne », se trouve une matrice d'attributs précise contenant 1290 dimensions de profil. Ces dimensions sont réparties en cinq zones principales : informations de contexte, traits psychologiques, capacités professionnelles, interactions comportementales, vie quotidienne.

Les sources de données comprennent les statistiques démographiques de l'ONU, l'Enquête Sociale Générale (General Social Survey), les biographies Wikipedia, les avis consommateurs réels d'Amazon, les enquêtes développeurs Stack Overflow...

Si on se contentait de combinaisons aléatoires, l'IA ne créerait que des « monstres cybernétiques » incohérents. Par exemple, quelqu'un vivant dans une zone rurale du Kenya, avec seulement une éducation primaire, mais ne parlant que l'islandais, détenant un doctorat de Harvard et gagnant des millions par an.

Pour résoudre ce problème, l'équipe de recherche a construit un vaste graphe acyclique orienté (DAG). Les attributs ont des dépendances conditionnelles strictes entre eux :

Lorsque le système détermine la « compétence en anglais » d'une personne virtuelle, il doit d'abord calculer la probabilité conjointe des nœuds parents « langue principale » et « région de résidence ».

Ensuite, un filtre de compatibilité impitoyable est appliqué : dès qu'un conflit contraire au bon sens apparaît entre attributs parent et enfant, l'évaluation est immédiatement annulée et la combinaison est supprimée d'un clic.

Sous l'épreuve de cette formule, les personnes virtuelles synthétisées maintiennent à la fois une grande diversité et une cohérence logique indestructible au sein de chaque individu.

En ajoutant des centaines de millions de « tranches d'âme réelles » extraites de l'histoire humaine concrète sur Wikipedia, des historiques d'achat Amazon, des enquêtes développeurs Stack Overflow, etc., chaque fantôme de la base de données Persona-8B ressemble à une personne réelle, en chair et en os, ayant vécu dans un univers parallèle.

Avez-vous déjà pensé que votre préférence pour la couleur d'un bouton d'application pouvait être réduite au produit des probabilités des nœuds parents ?

Lorsque la personnalité est mesurée avec précision par 1290 échelons, la prétendue « unicité » humaine n'est, aux yeux de l'IA, qu'une distribution de probabilité cohérente.

La boucle de Möbius du néant

C'est un miracle technique, mais si on écarte le manteau de l'efficacité, on découvre une vérité terrifiante.

Les grands modèles (comme GPT-5.5, Claude Opus 4.8) jouent le rôle de « consommateurs » et de « membres de la société » dans MatrAIx, pour évaluer et tester une autre « personne virtuelle » pilotée par un grand modèle.

C'est comme si une personne jouait le client avec sa main gauche pour acheter le pain fabriqué par sa main droite, puis que la main gauche donnait cinq étoiles à la main droite.

Dans cette boucle fermée, l'humain réel disparaît.

Si les utilisateurs virtuels attribuent une note élevée de 91,5% à un nouveau médicament ou à une nouvelle application sociale dans le bac à sable, cela garantit-il qu'ils plairont dans la réalité à ces humains de chair et de sang qui pleurent, sont capricieux, et sont influencés par la météo et leurs hormones ?

L'effet secondaire le plus effrayant de cet « écosystème en boucle fermée » réside dans la disparition totale du « Cygne Noir et de l'Âme ».

Les plus grandes œuvres d'art, les modèles économiques les plus disruptifs, voire les percées scientifiques les plus étonnantes de l'histoire humaine, ne proviennent souvent pas de la « cohérence » calculée par 1290 échelons de probabilité.

Elles naissent souvent d'obsessions inexplicables, et de chaos logiques accidentels — ces valeurs aberrantes que le filtre algorithmique DAG considère comme « incompatibles » et supprime d'un clic.

Si à l'avenir, tous les produits numériques, politiques et contenus sont testés et optimisés par « la simulation IA de 8,3 milliards de personnes », alors le monde deviendra incroyablement lisse.

Mais il deviendra simultanément extrêmement creux et ennuyeux.

C'est un monde insipide, taillé sur mesure pour correspondre aux préférences des « fantômes numériques ».

À la fin de l'article, l'équipe de recherche conserve la retenue et la lucidité propres aux scientifiques :

Les utilisateurs virtuels ne pourront jamais remplacer complètement les humains réels. Pour les décisions à haut risque concernant le destin de la société et les conclusions scientifiques majeures, la participation directe des utilisateurs réels reste irremplaçable.

Références :

https://matraix.ai/

https://arxiv.org/abs/2608.04205

https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

https://x.com/MatrAIx2026/status/2085217711781564492

Cet article provient du compte public WeChat « Xin Zhi Yuan », auteur : ASI Apocalypse, édité par David.

Questions liées

QQu'est-ce que MatrAIx et quel est son objectif principal ?

AMatrAIx est un projet de recherche mené par des scientifiques d'Harvard, du MIT, OpenAI, Anthropic et d'autres, visant à créer une simulation à l'échelle mondiale de 8,3 milliards d'agents intelligents. Son objectif est de modéliser avec précision le comportement humain réel à travers 1290 dimensions pour évaluer des produits, services et politiques dans un environnement simulé.

QQuelle est la taille de la base de données Persona-8B et que représente-t-elle ?

ALa base de données Persona-8B contient exactement 8,3 milliards de profils, soit une réplique numérique à l'échelle 1:1 de la population humaine mondiale actuelle.

QQuels sont les quatre environnements de simulation (MatrAIx Playground) décrits dans l'article ?

ALes quatre environnements de simulation sont : 1) Les enquêtes (Surveys), 2) Les chatbots IA (AI Chatbots), 3) Les sites web (Websites), et 4) Les applications (Applications) où les agents peuvent interagir avec des systèmes d'exploitation comme Linux, macOS et iOS.

QQuel est le principal risque ou limitation éthique soulevé par l'article concernant MatrAIx ?

ALe principal risque est la création d'une boucle fermée ou d'un 'circuit auto-entretenu' où des IA évaluent d'autres IA, éliminant progressivement la participation et les perspectives imprévisibles des humains réels, ce qui pourrait conduire à un monde uniforme et sans âme.

QQuelles sources de données réelles ont été utilisées pour construire les profils des agents intelligents ?

ALes sources de données incluent les statistiques démographiques des Nations Unies, l'Enquête Sociale Générale (GSS), les biographies Wikipedia, les avis de consommateurs d'Amazon, les enquêtes auprès des développeurs de Stack Overflow et d'autres traces numériques de comportements humains réels.

Lectures associées

La plus grosse affaire de l'Inde en matière de profits, déracinée par l'IA ?

Bangalore, 31 mars. Un couple d'ingénieurs informaticiens se suicide, un drame lié à la perte d'emploi après que l'IA a remplacé le mari, anciennement employé aux États-Unis. Ce cas illustre l'impact profond de l'IA sur le secteur indien de l'externalisation informatique, un pilier de l'économie valant 2800 milliards de dollars et employant des millions de personnes. Le modèle, basé sur une main-d'œuvre qualifiée à bas coût pour des tâches répétitives (développement, tests), est directement menacé. L'IA automatise ces tâches à un coût marginal, rendant l'avantage concurrentiel indien obsolète. Des entreprises comme OpenDoor et Oracle réduisent ou ferment des équipes en Inde au profit de solutions locales basées sur l'IA. Les géants indiens TCS, Infosys et Wipro enregistrent des baisses de revenus et des réductions d'effectifs massives, le chômage des jeunes diplômés atteignant des niveaux critiques. La dépendance historique de l'Inde à la "vente de temps de cerveau" remonte à la crise de l'an 2000. Si elle a forgé l'industrie, elle a aussi empêché l'émergence de champions technologiques nationaux. Aujourd'hui, le pays ne compte que trois licornes de l'IA, de taille modeste et loin derrière les leaders mondiaux. La transition vers des services à plus forte valeur ajoutée (conseil en IA, transformation numérique) est en cours, mais la vitesse du changement technologique et la pression de l'emploi pour une population jeune posent un défi immense. La crise indienne questionne le modèle de développement des pays émergents à l'ère de l'IA.

marsbitIl y a 13 mins

La plus grosse affaire de l'Inde en matière de profits, déracinée par l'IA ?

marsbitIl y a 13 mins

Bitcoin : la bataille haussier-baissier pour un niveau clé se poursuit, HYPE montre des signaux préliminaires de rebond en zone de support | Analyse exclusive

Le Bitcoin poursuit sa reprise technique (c) sur les graphiques journaliers après un repli (b), avec un objectif immédiat dans la zone de résistance clé de 65 700 à 67 300 USD. Un modèle quantitatif propriétaire suggère que la vague c a commencé depuis le creux à 62 268 USD. Les niveaux de support clés sont identifiés à 63 600-64 000 USD et 60 950-61 500 USD. Pour le BTC, la stratégie à moyen terme prévoit de réduire les positions courtes à moins de 20% si le prix se maintient au-dessus de 63 600 USD. Une reconstitution des positions courtes à 50% est envisagée si le prix dépasse 67 300 USD puis montre des signes d'essoufflement vers 69 500-71 000 USD. La stratégie à court terme propose deux scénarios : vendre à titre d'essai près de la résistance forte (69 500-71 000 USD) ou acheter légèrement près du support fort (63 600-64 000 USD). Le token HYPE montre des signes préliminaires de rebond sur les graphiques journaliers, ayant trouvé un support à la convergence de sa tendance haussière de long terme, de la borne inférieure d'un canal descendant et de la zone de 50-52 USD. La pression à la hausse immédiate se situe entre 58,5 et 60 USD, suivie de la borne supérieure du canal descendant. Une transaction à court terme sur Bitcoin, exécutée la semaine dernière avec un effet de levier de 1x basée sur des signaux de modèles propriétaires, a généré un gain d'environ 2,28%. Toutes les analyses et stratégies sont dynamiques et basées sur une analyse technique personnelle. Elles ne constituent pas un conseil en investissement. Les marchés sont risqués, une prudence est de mise.

Odaily星球日报Il y a 23 mins

Bitcoin : la bataille haussier-baissier pour un niveau clé se poursuit, HYPE montre des signaux préliminaires de rebond en zone de support | Analyse exclusive

Odaily星球日报Il y a 23 mins

Le Bitcoin est en train de livrer une bataille décisive autour d'un point clé, les signaux de support pour un rebond du HYPE commencent à apparaître|Analyse par un invité spécial

**Analyse des marchés BTC et HYPE – Semaine en cours** Le Bitcoin poursuit sa phase de rebond c sur le graphique journalier, après avoir trouvé un point bas à 62 268 $. Le test clé de la semaine sera la résistance cruciale située entre 65 700 $ et 67 300 $. Un franchissement effectif pourrait ouvrir la voie vers la zone 69 500 - 71 000 $. Le modèle de positionnement indique une structure baissière dominante, mais une réduction des positions courtes est en cours. Les stratégies à court terme se concentrent sur la recherche d'opportunités de trading dans les fourchettes, avec deux scénarios principaux : vente à l'essai dans la zone de forte résistance ou achat léger dans la zone de support solide (63 600 - 64 000 $). Concernant HYPE, le prix a trouvé un support significatif à la convergence de trois éléments techniques : la ligne de tendance haussière de long terme, la borne inférieure d'un canal baissier et la zone de support clé de 50-52 $. Un signal de rebond journalier est apparu. L'objectif de la semaine est de surveiller la réaction du prix près de la borne supérieure du canal baissier (58.5 - 60 $), ce qui déterminera si cette hausse est un simple rebond technique ou un potentiel renversement de tendance. La stratégie pour les traders consiste à maintenir ou à initier des positions longues avec prudence dans la zone de support 50-52 $, en respectant strictement les ordres de stop-loss. L'analyse inclut également une validation des prévisions de la semaine dernière, qui se sont avérées exactes pour les deux actifs, ainsi qu'un compte-rendu d'une opération courte réussie sur BTC ayant généré un gain d'environ 2.28%.

marsbitIl y a 23 mins

Le Bitcoin est en train de livrer une bataille décisive autour d'un point clé, les signaux de support pour un rebond du HYPE commencent à apparaître|Analyse par un invité spécial

marsbitIl y a 23 mins

Trading

Spot
活动图片