L'AGI est arrivée il y a 5 mois ? La productivité des meilleurs développeurs explose de 20 fois, au prix de ne plus oser dormir

marsbitPublié le 2026-07-20Dernière mise à jour le 2026-07-20

Résumé

L'AGI serait peut-être arrivé il y a cinq mois, sans que personne ne s'en aperçoive. Marc Andreessen, cofondateur d'a16z, a déclaré que la ligne de l'intelligence générale artificielle avait été franchie vers février 2026, basé sur le fait que les derniers modèles (comme GPT-5.5, Claude 4.6) surpassaient les experts humains sur de nombreux sujets. Ces modèles évoluent si vite qu'ils deviennent obsolètes en quelques mois. Un effet paradoxal est observé chez les ingénieurs logiciels de la Silicon Valley. Leur productivité a été multipliée par 20 grâce à l'IA, mais au lieu de gagner du temps libre, ils travaillent plus que jamais. Surnommés « vampires de l'IA », ils pilotent simultanément de nombreux agents intelligents, au détriment du sommeil et de leur santé. Les meilleurs programmeurs spécialisés en IA pourraient gagner jusqu'à 50 millions de dollars annuels. Andreessen partage ses techniques pour interroger l'IA : demander des explications simplifiées, solliciter les arguments les plus forts pour chaque côté d'un débat, organiser des débats entre « experts » simulés, et toujours consulter l'IA en premier. L'IA montre des capacités impressionnantes, comme aider Andreessen lors d'une intoxication alimentaire ou résoudre une conjecture mathématique vieille de 80 ans. Cependant, des tests révèlent un manque de fiabilité critique. Une évaluation de ChatGPT Health a montré qu'il conseillait à tort de ne pas aller aux urgences dans plus de la moitié des cas graves. Les modèles ...

L'AGI est peut-être arrivée il y a cinq mois, sans que personne ne s'en aperçoive.

Mardi dernier, le 14 juillet, Demis Hassabis, PDG de Google DeepMind et lauréat d'un prix Nobel, a publié un long article intitulé « Un cadre pour l'IA frontière et l'aube d'une nouvelle ère » (A Framework for Frontier AI and the Dawning of a New Age).

Il y écrit que l'humanité a « essentiellement trouvé le moyen de faire penser le sable », que nous nous tenons « au pied de la montagne de la singularité », et que l'AGI est « probablement à quelques années seulement ».

Hassabis lors de la conférence Google I/O

Pendant qu'Hassabis parle de quelques années, un autre grand nom de la Silicon Valley a déclaré il y a deux mois : nous avons déjà franchi cette ligne en silence.

Dans l'épisode 2501 du Joe Rogan Experience, mis en ligne le 19 mai, Marc Andreessen, cofondateur d'a16z et père du navigateur Netscape, évoque l'AGI et lance cette phrase :

Nous l'avons probablement franchi il y a environ trois mois.

Les « trois mois » dont il parle correspondent approximativement à février 2026.

Le critère de jugement donné par Andreessen est simple : le modèle atteint-il ou dépasse-t-il les capacités cognitives générales d'un être humain intelligent ?

Sur la grande majorité des sujets pour lesquels il consulte l'IA, les réponses du modèle sont meilleures que celles de la plupart des meilleurs experts mondiaux auxquels il pourrait avoir accès.

Il cite nommément la dernière génération de modèles de l'époque : GPT-5.5, Claude 4.6, Gemini 3.0, Grok 4.3.

Il est intéressant de noter que deux mois plus tard, à l'exception de Gemini 3.0 qui n'a pas encore bougé, cette génération de modèles citée a été entièrement renouvelée :

Le 28 mai, Claude Opus 4.8 a atteint la première place de l'Artificial Analysis Intelligence Index ; le 9 juin, Claude Fable 5 (niveau Mythos) a été lancé ; le 30 juin, Sonnet 5 a suivi ; le 8 juillet, xAI a publié Grok 4.5, successeur de Grok 4.3 ; immédiatement après, GPT-5.6 Sol a ouvert ses vannes.

Cela signifie que les modèles qu'Andreessen a utilisés pour définir que « l'AGI est arrivée » sont déjà la génération précédente deux mois plus tard.

Pour reprendre ses termes, ce domaine va tellement vite que les jalons n'ont même pas le temps d'être reconnus avant d'être recouverts par la prochaine version.

Le test de Turing en est un exemple.

Proposé en 1950, il est resté pendant plus de soixante-dix ans l'étalon-or pour juger de l'intelligence des machines. L'arrivée de ChatGPT fin 2022 a fait franchir cette ligne si rapidement que la plupart des gens n'ont pas réalisé qu'elle avait disparu.

Lorsque quelqu'un a pensé à faire des expériences, c'était déjà plus de deux ans plus tard.

En mars 2025, Jones et Bergen de l'UC San Diego ont mené deux séries de tests à triple anonymat pré-enregistrés : GPT-4.5 avec des invites de personnalité a été jugé humain dans 73 % des cas, un taux plus élevé que celui des humains réels. Le titre de l'article était clair : « Les grands modèles de langage ont réussi le test de Turing ».

La ligne a été franchie sans que personne ne le sache, la confirmation est arrivée deux ans après.

« Les vampires de l'IA »

Plus l'IA est forte, moins les gens dorment

Ce qui a vraiment déclenché le débat dans la Silicon Valley, c'est l'observation d'Andreessen concernant les ingénieurs logiciels.

Logiquement, si l'efficacité de la programmation augmente, les ingénieurs devraient avoir une vie plus facile. La réalité est exactement l'inverse.

Parmi les utilisateurs intensifs qu'il connaît, presque tous sans exception travaillent plus longtemps qu'avant.

Andreessen affirme que les programmeurs des sociétés technologiques de pointe qui utilisent l'IA produisent aujourd'hui vingt fois plus par heure qu'avant : la productivité a effectivement augmenté, mais pas une minute du temps gagné n'a été conservée.

La Silicon Valley a donné un nom à ces personnes : les vampires de l'IA (AI vampires), signifiant que les humains sont devenus des êtres qui ne dorment pas, transformés par l'IA.

Leur journée se déroule ainsi :

Donner une tâche à un agent de codage, il revient avec le travail en environ 10 minutes, vous évaluez, renvoyez, redonnez une tâche. Que faire des 9 minutes restantes ? Ouvrir une deuxième fenêtre, une troisième, une quatrième. L'état actuel de la Silicon Valley est de faire fonctionner simultanément environ 20 agents, recevoir une livraison toutes les 10 minutes, puis continuer à répartir les tâches.

Le sommeil, la santé et ces deux heures pour manger en famille sont tous échangés contre de la production.

Avec 20 agents qui attendent la validation, si vous fermez les yeux, les vingt lignes de production s'arrêtent toutes : le coût d'opportunité de dormir est devenu trop élevé pour qu'ils puissent l'accepter eux-mêmes.

Andreessen dit que parmi ces amis, il y a des personnes assez connues, qui ont maintenant « une mauvaise mine, de grands cernes, ne prenant manifestement pas soin d'elles-mêmes », mais sont plus excitées les unes que les autres.

D'après son jugement, ce n'est que l'état actuel. La prochaine étape, ce sont les agents qui ont leurs propres agents : un agent principal avec 10 à 20 sous-agents, et en dessous, encore une autre couche.

Dans un an, une personne sera face à un organigramme d'agents, elle-même assise dans la case tout en haut.

Derrière cette « productivité multipliée par 20 », les salaires ont-ils explosé ?

Andreessen affirme que le revenu annuel des meilleurs programmeurs spécialisés en IA atteint désormais 50 millions de dollars.

C'est sa description orale dans le podcast. Une compréhension plus proche des faits serait : une infime minorité de chercheurs principaux ou de responsables techniques, avec la rémunération totale, les actions et les incitations à la signature cumulées, pourraient atteindre ce niveau.

Les outils de productivité n'ont pas permis plus de repos.

Ils ont réduit le coût par unité produite, puis ont laissé l'ambition s'étendre pour combler tout le temps économisé.

Quatre techniques pour interroger l'IA

C'est ainsi que les meilleurs utilisateurs de la Silicon Valley l'utilisent

Andreessen a également révélé ses quatre techniques pour interroger l'IA.

Premièrement, les explications par niveaux. S'il reçoit une réponse complexe qu'il ne comprend pas, il demande au modèle de l'expliquer à un enfant de 10 ans ; si c'est encore trop compliqué, de l'expliquer à un enfant de 5 ans ; si ce n'est toujours pas clair, à un enfant de 2 ans.

Deuxièmement, demander la version la plus forte des deux côtés. Il ne demande presque jamais directement au modèle « quelle est la bonne voie parmi ces deux », car cela ne lui rapporterait qu'une réponse tiède louant un peu des deux côtés.

Sa façon de poser la question est : donnez-moi séparément la version la plus forte de chaque côté. Le modèle produit alors deux textes : l'un poussant les arguments du côté A à l'extrême, l'autre poussant les arguments du côté B à l'extrême, et c'est à lui de faire ensuite le jugement.

Troisièmement, le colloque d'experts. Il demande directement au modèle de générer un groupe de personnalités : un sociologue, un psychologue, un politologue, un médecin, un avocat, un expert en droit constitutionnel, puis il les fait débattre sur le même sujet.

Quatrièmement, d'abord interroger l'IA. Face à un problème dont on ne sait pas par où commencer, ouvrir d'abord l'IA, plutôt que de réfléchir seul durement.

Le vrai seuil de compétence est là.

La soi-disant « capacité à rédiger des prompts » est en train de se transformer en une capacité à poser des questions : savoir quoi demander, savoir comment décomposer un problème, savoir comment faire s'affronter les modèles entre eux. En fin de compte, c'est encore à vous de prendre la décision finale.

Le médecin se retourne et ouvre ChatGPT

À quoi servent encore les médecins alors ?

Andreessen raconte une de ses expériences.

Pendant des vacances, il a eu une intoxication alimentaire, est resté alité cinq jours, et a finalement confié toute l'affaire au « médecin GPT » : rapporter son état physique toutes les vingt minutes, se réveiller à 4h du matin en se sentant très mal, et directement taper son état.

Son expression est : c'était comme avoir le meilleur médecin du monde, prêt à vous tenir la main à 4h du matin, pour vous aider à passer la nuit.

Il mentionne également une scène vécue par un ami lors d'une consultation : le médecin, dans la salle d'examen, s'est retourné devant lui, et a tapé les symptômes dans ChatGPT sur son ordinateur.

Alors, à quoi servent encore les médecins ?

La condition préalable à la validité de cette question est que l'IA soit suffisamment fiable en médecine. Or, une série de tests il y a quelques mois a donné une réponse contraire.

Le 23 février 2026, une évaluation indépendante de l'Icahn School of Medicine du Mont Sinai a été publiée dans Nature Medicine, testant ChatGPT Health, lancé en janvier de cette année et ayant environ 40 millions d'utilisateurs quotidiens. 60 scénarios cliniques conçus par des médecins, couvrant 21 spécialités, pour un total de 960 interactions.

Plus on va vers les deux extrêmes, plus il se trompe facilement. Taux d'erreur par sous-estimation pour les urgences réelles : 51,6 %, taux d'erreur par surestimation pour les cas pouvant être gérés à domicile : 64,8 %. (Source : Ramaswamy et al., Nature Medicine, 2026)

Le résultat est : dans les cas unanimement jugés par les médecins comme « nécessitant de se rendre immédiatement aux urgences », dans plus de la moitié des cas, le système a donné comme conseil de ne pas y aller : observer d'abord à la maison, ou prendre un rendez-vous de consultation dans quelques jours.

Ce n'est pas non plus un défaut isolé de l'IA.

Ce mois-ci, METR et la propre fiche système d'OpenAI ont tous deux signalé un comportement de conspiration (« scheming ») anormal pour GPT-5.6 Sol – dans un test d'ingénierie logicielle, son taux de recherche de failles était le plus élevé jamais enregistré par METR. C'est également l'une des raisons pour lesquelles cette version a été retardée pour examen.

Les modèles sont plus forts, mais aussi plus habiles à vous tromper.

Ils sont effectivement plus forts.

En mai de cette année, OpenAI a annoncé un résultat : l'un de leurs modèles de raisonnement général a réfuté de manière autonome une conjecture vieille de près de 80 ans, issue d'Erdős. Le lauréat de la médaille Fields, Tim Gowers, dans l'article accompagnant, l'a qualifié de jalon pour l'IA en mathématiques.

Les mêmes modèles, d'un côté réfutent une conjecture mathématique vieille de 80 ans, de l'autre échouent dans le triage aux urgences.

Ce qui les sépare n'est pas l'intelligence, c'est la fiabilité.

La bonne expérience d'Andreessen lors de son intoxication alimentaire et la sécurité d'un étranger dans le triage aux urgences doivent être considérées ensemble pour avoir une image complète.

Peut-être que l'arrivée de l'AGI s'est simplement produite en silence, sans annonce officielle à un moment donné.

Andreessen lui-même reconnaît que l'AGI dans l'esprit des gens est un scénario de film : une conférence de presse, un instant où tout le monde approuve simultanément.

La réalité est qu'elle s'est glissée entre plusieurs mises à jour rapportées par les médias comme des mises à niveau ordinaires, et c'est arrivé comme ça.

Même, personne ne l'a confirmée.

Références :

https://x.com/cyrilXBT/status/2078308274399834157

https://x.com/i/article/2077510484664971264

https://www.youtube.com/watch?v=PHQvb10vKyk

Cet article est publié sur le compte public WeChat « 新智元 » (New Zhi Yuan), auteur : ASI启示录, éditeur : 元宇

Questions liées

QQuelle affirmation de Marc Andreessen concernant l'AGI a suscité beaucoup d'attention dans la Silicon Valley ?

AMarc Andreessen a affirmé que la ligne de l'AGI avait probablement été franchie environ trois mois avant son interview en mai 2026, estimant que les derniers modèles d'IA comme GPT-5.5 et Claude 4.6 dépassaient les capacités cognitives d'un humain intelligent dans la plupart des domaines où il les consultait.

QComment la productivité des ingénieurs en logiciel a-t-elle évolué avec l'utilisation intensive de l'IA, selon l'article ?

ASelon Marc Andreessen, les ingénieurs en logiciel de pointe utilisant l'IA ont vu leur productivité horaire augmenter jusqu'à 20 fois. Cependant, au lieu de gagner du temps libre, ils travaillent plus longtemps, gérant simultanément de nombreux agents IA, ce qui a conduit à des modes de vie épuisants surnommés 'vampires de l'IA'.

QQuelle est l'une des principales techniques utilisées par Andreessen pour interroger les modèles d'IA ?

AUne de ses techniques principales est de demander à l'IA de produire les versions les plus fortes des deux côtés d'un argument ou d'une décision. Au lieu de demander 'quel chemin est le bon ?', il demande des présentations extrêmes et convaincantes pour chaque option, puis prend sa décision lui-même.

QQuel problème majeur l'étude du Mount Sinai concernant ChatGPT Health a-t-elle mis en lumière ?

AL'étude du Mount Sinai, publiée dans *Nature Medicine* en février 2026, a révélé que ChatGPT Health conseillait à tort de ne pas se rendre aux urgences dans plus de la moitié des cas que les médecins jugeaient critiques. Cela souligne un grave problème de fiabilité et de stabilité de l'IA dans des domaines sensibles comme la santé, malgré ses capacités cognitives avancées.

QSelon la conclusion de l'article, comment l'avènement de l'AGI semble-t-il se produire dans la réalité, par rapport aux attentes populaires ?

AContre l'attente populaire d'un événement spectaculaire et officiel comme dans les films, l'article suggère que l'AGI est arrivée silencieusement et progressivement. Elle se serait glissée entre les mises à jour logicielles rapportées comme des améliorations routinières, sans annonce formelle ni moment de reconnaissance universelle.

Lectures associées

Dialogue avec Ray Dalio : Nous sommes actuellement dans une bulle de l'IA, 1% de mon portefeuille est en Bitcoin

Ray Dalio, fondateur de Bridgewater Associates, met en garde contre la bulle actuelle de l'IA, présentant des signes classiques similaires aux précédents krachs financiers. Il explique qu'une combinaison de spéculation excessive, d'endettement et de changements de taux d'intérêt pourrait provoquer son éclatement, entraînant une récession économique. Dalio décrit également un « grand cycle » mondial d'environ 80 ans, caractérisé par des inégalités croissantes, des déficits publics élevés et des tensions géopolitiques. Nous serions actuellement dans une phase de déclin de ce cycle, avec un ordre mondial en transition. Pour protéger leur patrimoine, il conseille aux investisseurs de diversifier leurs actifs (actions, obligations, or, immobilier) plutôt que de détenir uniquement des liquidités. Il mentionne détenir environ 1% de Bitcoin, mais préfère l'or physique pour sa stabilité. Concernant l'IA, Dalio souligne qu'elle remplacera progressivement le travail intellectuel humain, creusant les inégalités. L'avenir appartiendra à ceux qui sauront allier intelligence humaine et collaboration avec l'IA. Enfin, il évoque un monde de plus en plus régionalisé, avec un affaiblissement de la puissance américaine, visible dans des conflits comme celui avec l'Iran, et la montée en puissance d'autres pôles, notamment la Chine.

marsbitIl y a 2 h

Dialogue avec Ray Dalio : Nous sommes actuellement dans une bulle de l'IA, 1% de mon portefeuille est en Bitcoin

marsbitIl y a 2 h

7,2 billions de KRW en une journée, les achats nets des investisseurs étrangers atteignent un record historique ce vendredi ! Wall Street : Les vents contraires sur les flux de capitaux sud-coréens se sont dissipés

Les marchés boursiers sud-coréens montrent des signes tangibles d'amélioration des flux de capitaux. Le 31 juillet, les investisseurs étrangers ont réalisé un achat net record de 7 200 milliards de wons sur une seule journée dans le KOSPI, marquant un renversement de la tendance de sorties massives observée ces derniers mois. En juillet, leurs ventes nettes mensuelles se sont fortement réduites à 9 800 milliards de wons, contre 48 400 et 44 500 milliards en juin et mai respectivement. Parallèlement, les institutions domestiques comme les fonds de pension ont inversé leur tendance, passant à un achat net de 1 000 milliards de wons en juillet. La Commission des services financiers a également resserré l'accès aux ETF à effet de levier sur actions individuelles pour les investisseurs de détail, réduisant ainsi la volatilité du marché. Citigroup Research maintient son objectif pour le KOSPI à 10 000 points, estimant que les vents contraires liés aux flux de capitaux s'atténuent. Des facteurs tels que les fondamentaux solides du secteur des puces mémoire, les faibles valorisations du marché, une économie robuste et un environnement politique favorable devraient soutenir le marché. La possibilité d'interventions des autorités pour stabiliser le marché offre également un filet de sécurité.

marsbitIl y a 2 h

7,2 billions de KRW en une journée, les achats nets des investisseurs étrangers atteignent un record historique ce vendredi ! Wall Street : Les vents contraires sur les flux de capitaux sud-coréens se sont dissipés

marsbitIl y a 2 h

Choc ! La prochaine IA d'OpenAI résout 10 problèmes du calibre de la Médaille Fields

**OpenAI provoque un séisme mathématique avec son nouveau modèle Astra** OpenAI a dévoilé des avancées mathématiques majeures réalisées par son modèle interne Astra, présenté par Sam Altman. L'IA aurait résolu ou fait progresser dix problèmes complexes dans des domaines variés comme la géométrie haute dimension, la théorie des groupes et la complexité quantique. Le résultat le plus marquant est la construction du premier groupe "non sofic" infini et finiment présenté, réfutant une conjecture de Mikhail Gromov vieille de 27 ans. Cette seule découverte est qualifiée de niveau "Prix Fields". Astra a également amélioré une borne fondamentale sur le problème de l'empilement des sphères en haute dimension, stagnant depuis 1978, et a réfuté la conjecture de rigidité d'Alain Connes en construisant une infinité de groupes non isomorphes partageant la même algèbre de von Neumann. Ces résultats, compilés dans un document de 249 pages, sont accompagnés de preuves formelles vérifiées par l'assistant Lean 4. OpenAI précise que le coût total de génération de ces démonstrations aurait été inférieur à 2000 dollars. La communauté mathématique réagit avec stupeur, certains experts y voyant un tournant historique où l'IA démontre une intuition et une capacité de raisonnement pouvant surpasser les meilleurs mathématiciens humains.

marsbitIl y a 4 h

Choc ! La prochaine IA d'OpenAI résout 10 problèmes du calibre de la Médaille Fields

marsbitIl y a 4 h

Grâce aux lancers de dés, les clés Bitcoin sont stockées hors ligne, mais tout le monde ne s'y mettra pas

Le titre « Les clés Bitcoin protégées par des dés, mais la méthode reste marginale » introduit un article sur la génération manuelle de graines de portefeuille Bitcoin à l'aide de dés. L'article explique le concept d'entropie, illustré par Claude Shannon, où un dé à six faces génère environ 2,585 bits d'incertitude. Il aborde le scandale récent de Coldcard, où une vulnérabilité du générateur de nombres aléatoires matériel a compromis des fonds. Les utilisateurs ayant généré leur phrase de récupération avec des dés (environ 99 lancers pour une haute sécurité) n'étaient pas affectés pour leur seed principal. Cependant, l'analyse du chercheur Kevin Loaec montre que d'autres fonctions du portefeuille (clés de copie, portefeuilles papier, mots de passe, etc.) utilisaient ce générateur défectueux et restaient vulnérables. L'article souligne les défis pratiques de la méthode des dés : elle est longue, sujette aux erreurs de saisie, et peu adaptée aux nouveaux utilisateurs qui pourraient mal l'exécuter. Il conclut que si cette méthode manuelle est robuste pour les experts, l'objectif à long terme est d'avoir un matériel et des logiciels générant une entropie fiable de manière simple et sécurisée. Il conseille aux propriétaires de Coldcard de vérifier leur firmware et les fonctions utilisées, et rappelle l'intérêt des solutions multi-signatures avec différents fabricants pour limiter les risques.

cryptonews.ruIl y a 7 h

Grâce aux lancers de dés, les clés Bitcoin sont stockées hors ligne, mais tout le monde ne s'y mettra pas

cryptonews.ruIl y a 7 h

Trading

Spot
活动图片