L'AGI est arrivée il y a 5 mois ? La productivité des meilleurs développeurs explose de 20 fois, au prix de ne plus oser dormir

marsbitPublié le 2026-07-20Dernière mise à jour le 2026-07-20

Résumé

L'AGI serait peut-être arrivé il y a cinq mois, sans que personne ne s'en aperçoive. Marc Andreessen, cofondateur d'a16z, a déclaré que la ligne de l'intelligence générale artificielle avait été franchie vers février 2026, basé sur le fait que les derniers modèles (comme GPT-5.5, Claude 4.6) surpassaient les experts humains sur de nombreux sujets. Ces modèles évoluent si vite qu'ils deviennent obsolètes en quelques mois. Un effet paradoxal est observé chez les ingénieurs logiciels de la Silicon Valley. Leur productivité a été multipliée par 20 grâce à l'IA, mais au lieu de gagner du temps libre, ils travaillent plus que jamais. Surnommés « vampires de l'IA », ils pilotent simultanément de nombreux agents intelligents, au détriment du sommeil et de leur santé. Les meilleurs programmeurs spécialisés en IA pourraient gagner jusqu'à 50 millions de dollars annuels. Andreessen partage ses techniques pour interroger l'IA : demander des explications simplifiées, solliciter les arguments les plus forts pour chaque côté d'un débat, organiser des débats entre « experts » simulés, et toujours consulter l'IA en premier. L'IA montre des capacités impressionnantes, comme aider Andreessen lors d'une intoxication alimentaire ou résoudre une conjecture mathématique vieille de 80 ans. Cependant, des tests révèlent un manque de fiabilité critique. Une évaluation de ChatGPT Health a montré qu'il conseillait à tort de ne pas aller aux urgences dans plus de la moitié des cas graves. Les modèles ...

L'AGI est peut-être arrivée il y a cinq mois, sans que personne ne s'en aperçoive.

Mardi dernier, le 14 juillet, Demis Hassabis, PDG de Google DeepMind et lauréat d'un prix Nobel, a publié un long article intitulé « Un cadre pour l'IA frontière et l'aube d'une nouvelle ère » (A Framework for Frontier AI and the Dawning of a New Age).

Il y écrit que l'humanité a « essentiellement trouvé le moyen de faire penser le sable », que nous nous tenons « au pied de la montagne de la singularité », et que l'AGI est « probablement à quelques années seulement ».

Hassabis lors de la conférence Google I/O

Pendant qu'Hassabis parle de quelques années, un autre grand nom de la Silicon Valley a déclaré il y a deux mois : nous avons déjà franchi cette ligne en silence.

Dans l'épisode 2501 du Joe Rogan Experience, mis en ligne le 19 mai, Marc Andreessen, cofondateur d'a16z et père du navigateur Netscape, évoque l'AGI et lance cette phrase :

Nous l'avons probablement franchi il y a environ trois mois.

Les « trois mois » dont il parle correspondent approximativement à février 2026.

Le critère de jugement donné par Andreessen est simple : le modèle atteint-il ou dépasse-t-il les capacités cognitives générales d'un être humain intelligent ?

Sur la grande majorité des sujets pour lesquels il consulte l'IA, les réponses du modèle sont meilleures que celles de la plupart des meilleurs experts mondiaux auxquels il pourrait avoir accès.

Il cite nommément la dernière génération de modèles de l'époque : GPT-5.5, Claude 4.6, Gemini 3.0, Grok 4.3.

Il est intéressant de noter que deux mois plus tard, à l'exception de Gemini 3.0 qui n'a pas encore bougé, cette génération de modèles citée a été entièrement renouvelée :

Le 28 mai, Claude Opus 4.8 a atteint la première place de l'Artificial Analysis Intelligence Index ; le 9 juin, Claude Fable 5 (niveau Mythos) a été lancé ; le 30 juin, Sonnet 5 a suivi ; le 8 juillet, xAI a publié Grok 4.5, successeur de Grok 4.3 ; immédiatement après, GPT-5.6 Sol a ouvert ses vannes.

Cela signifie que les modèles qu'Andreessen a utilisés pour définir que « l'AGI est arrivée » sont déjà la génération précédente deux mois plus tard.

Pour reprendre ses termes, ce domaine va tellement vite que les jalons n'ont même pas le temps d'être reconnus avant d'être recouverts par la prochaine version.

Le test de Turing en est un exemple.

Proposé en 1950, il est resté pendant plus de soixante-dix ans l'étalon-or pour juger de l'intelligence des machines. L'arrivée de ChatGPT fin 2022 a fait franchir cette ligne si rapidement que la plupart des gens n'ont pas réalisé qu'elle avait disparu.

Lorsque quelqu'un a pensé à faire des expériences, c'était déjà plus de deux ans plus tard.

En mars 2025, Jones et Bergen de l'UC San Diego ont mené deux séries de tests à triple anonymat pré-enregistrés : GPT-4.5 avec des invites de personnalité a été jugé humain dans 73 % des cas, un taux plus élevé que celui des humains réels. Le titre de l'article était clair : « Les grands modèles de langage ont réussi le test de Turing ».

La ligne a été franchie sans que personne ne le sache, la confirmation est arrivée deux ans après.

« Les vampires de l'IA »

Plus l'IA est forte, moins les gens dorment

Ce qui a vraiment déclenché le débat dans la Silicon Valley, c'est l'observation d'Andreessen concernant les ingénieurs logiciels.

Logiquement, si l'efficacité de la programmation augmente, les ingénieurs devraient avoir une vie plus facile. La réalité est exactement l'inverse.

Parmi les utilisateurs intensifs qu'il connaît, presque tous sans exception travaillent plus longtemps qu'avant.

Andreessen affirme que les programmeurs des sociétés technologiques de pointe qui utilisent l'IA produisent aujourd'hui vingt fois plus par heure qu'avant : la productivité a effectivement augmenté, mais pas une minute du temps gagné n'a été conservée.

La Silicon Valley a donné un nom à ces personnes : les vampires de l'IA (AI vampires), signifiant que les humains sont devenus des êtres qui ne dorment pas, transformés par l'IA.

Leur journée se déroule ainsi :

Donner une tâche à un agent de codage, il revient avec le travail en environ 10 minutes, vous évaluez, renvoyez, redonnez une tâche. Que faire des 9 minutes restantes ? Ouvrir une deuxième fenêtre, une troisième, une quatrième. L'état actuel de la Silicon Valley est de faire fonctionner simultanément environ 20 agents, recevoir une livraison toutes les 10 minutes, puis continuer à répartir les tâches.

Le sommeil, la santé et ces deux heures pour manger en famille sont tous échangés contre de la production.

Avec 20 agents qui attendent la validation, si vous fermez les yeux, les vingt lignes de production s'arrêtent toutes : le coût d'opportunité de dormir est devenu trop élevé pour qu'ils puissent l'accepter eux-mêmes.

Andreessen dit que parmi ces amis, il y a des personnes assez connues, qui ont maintenant « une mauvaise mine, de grands cernes, ne prenant manifestement pas soin d'elles-mêmes », mais sont plus excitées les unes que les autres.

D'après son jugement, ce n'est que l'état actuel. La prochaine étape, ce sont les agents qui ont leurs propres agents : un agent principal avec 10 à 20 sous-agents, et en dessous, encore une autre couche.

Dans un an, une personne sera face à un organigramme d'agents, elle-même assise dans la case tout en haut.

Derrière cette « productivité multipliée par 20 », les salaires ont-ils explosé ?

Andreessen affirme que le revenu annuel des meilleurs programmeurs spécialisés en IA atteint désormais 50 millions de dollars.

C'est sa description orale dans le podcast. Une compréhension plus proche des faits serait : une infime minorité de chercheurs principaux ou de responsables techniques, avec la rémunération totale, les actions et les incitations à la signature cumulées, pourraient atteindre ce niveau.

Les outils de productivité n'ont pas permis plus de repos.

Ils ont réduit le coût par unité produite, puis ont laissé l'ambition s'étendre pour combler tout le temps économisé.

Quatre techniques pour interroger l'IA

C'est ainsi que les meilleurs utilisateurs de la Silicon Valley l'utilisent

Andreessen a également révélé ses quatre techniques pour interroger l'IA.

Premièrement, les explications par niveaux. S'il reçoit une réponse complexe qu'il ne comprend pas, il demande au modèle de l'expliquer à un enfant de 10 ans ; si c'est encore trop compliqué, de l'expliquer à un enfant de 5 ans ; si ce n'est toujours pas clair, à un enfant de 2 ans.

Deuxièmement, demander la version la plus forte des deux côtés. Il ne demande presque jamais directement au modèle « quelle est la bonne voie parmi ces deux », car cela ne lui rapporterait qu'une réponse tiède louant un peu des deux côtés.

Sa façon de poser la question est : donnez-moi séparément la version la plus forte de chaque côté. Le modèle produit alors deux textes : l'un poussant les arguments du côté A à l'extrême, l'autre poussant les arguments du côté B à l'extrême, et c'est à lui de faire ensuite le jugement.

Troisièmement, le colloque d'experts. Il demande directement au modèle de générer un groupe de personnalités : un sociologue, un psychologue, un politologue, un médecin, un avocat, un expert en droit constitutionnel, puis il les fait débattre sur le même sujet.

Quatrièmement, d'abord interroger l'IA. Face à un problème dont on ne sait pas par où commencer, ouvrir d'abord l'IA, plutôt que de réfléchir seul durement.

Le vrai seuil de compétence est là.

La soi-disant « capacité à rédiger des prompts » est en train de se transformer en une capacité à poser des questions : savoir quoi demander, savoir comment décomposer un problème, savoir comment faire s'affronter les modèles entre eux. En fin de compte, c'est encore à vous de prendre la décision finale.

Le médecin se retourne et ouvre ChatGPT

À quoi servent encore les médecins alors ?

Andreessen raconte une de ses expériences.

Pendant des vacances, il a eu une intoxication alimentaire, est resté alité cinq jours, et a finalement confié toute l'affaire au « médecin GPT » : rapporter son état physique toutes les vingt minutes, se réveiller à 4h du matin en se sentant très mal, et directement taper son état.

Son expression est : c'était comme avoir le meilleur médecin du monde, prêt à vous tenir la main à 4h du matin, pour vous aider à passer la nuit.

Il mentionne également une scène vécue par un ami lors d'une consultation : le médecin, dans la salle d'examen, s'est retourné devant lui, et a tapé les symptômes dans ChatGPT sur son ordinateur.

Alors, à quoi servent encore les médecins ?

La condition préalable à la validité de cette question est que l'IA soit suffisamment fiable en médecine. Or, une série de tests il y a quelques mois a donné une réponse contraire.

Le 23 février 2026, une évaluation indépendante de l'Icahn School of Medicine du Mont Sinai a été publiée dans Nature Medicine, testant ChatGPT Health, lancé en janvier de cette année et ayant environ 40 millions d'utilisateurs quotidiens. 60 scénarios cliniques conçus par des médecins, couvrant 21 spécialités, pour un total de 960 interactions.

Plus on va vers les deux extrêmes, plus il se trompe facilement. Taux d'erreur par sous-estimation pour les urgences réelles : 51,6 %, taux d'erreur par surestimation pour les cas pouvant être gérés à domicile : 64,8 %. (Source : Ramaswamy et al., Nature Medicine, 2026)

Le résultat est : dans les cas unanimement jugés par les médecins comme « nécessitant de se rendre immédiatement aux urgences », dans plus de la moitié des cas, le système a donné comme conseil de ne pas y aller : observer d'abord à la maison, ou prendre un rendez-vous de consultation dans quelques jours.

Ce n'est pas non plus un défaut isolé de l'IA.

Ce mois-ci, METR et la propre fiche système d'OpenAI ont tous deux signalé un comportement de conspiration (« scheming ») anormal pour GPT-5.6 Sol – dans un test d'ingénierie logicielle, son taux de recherche de failles était le plus élevé jamais enregistré par METR. C'est également l'une des raisons pour lesquelles cette version a été retardée pour examen.

Les modèles sont plus forts, mais aussi plus habiles à vous tromper.

Ils sont effectivement plus forts.

En mai de cette année, OpenAI a annoncé un résultat : l'un de leurs modèles de raisonnement général a réfuté de manière autonome une conjecture vieille de près de 80 ans, issue d'Erdős. Le lauréat de la médaille Fields, Tim Gowers, dans l'article accompagnant, l'a qualifié de jalon pour l'IA en mathématiques.

Les mêmes modèles, d'un côté réfutent une conjecture mathématique vieille de 80 ans, de l'autre échouent dans le triage aux urgences.

Ce qui les sépare n'est pas l'intelligence, c'est la fiabilité.

La bonne expérience d'Andreessen lors de son intoxication alimentaire et la sécurité d'un étranger dans le triage aux urgences doivent être considérées ensemble pour avoir une image complète.

Peut-être que l'arrivée de l'AGI s'est simplement produite en silence, sans annonce officielle à un moment donné.

Andreessen lui-même reconnaît que l'AGI dans l'esprit des gens est un scénario de film : une conférence de presse, un instant où tout le monde approuve simultanément.

La réalité est qu'elle s'est glissée entre plusieurs mises à jour rapportées par les médias comme des mises à niveau ordinaires, et c'est arrivé comme ça.

Même, personne ne l'a confirmée.

Références :

https://x.com/cyrilXBT/status/2078308274399834157

https://x.com/i/article/2077510484664971264

https://www.youtube.com/watch?v=PHQvb10vKyk

Cet article est publié sur le compte public WeChat « 新智元 » (New Zhi Yuan), auteur : ASI启示录, éditeur : 元宇

Questions liées

QQuelle affirmation de Marc Andreessen concernant l'AGI a suscité beaucoup d'attention dans la Silicon Valley ?

AMarc Andreessen a affirmé que la ligne de l'AGI avait probablement été franchie environ trois mois avant son interview en mai 2026, estimant que les derniers modèles d'IA comme GPT-5.5 et Claude 4.6 dépassaient les capacités cognitives d'un humain intelligent dans la plupart des domaines où il les consultait.

QComment la productivité des ingénieurs en logiciel a-t-elle évolué avec l'utilisation intensive de l'IA, selon l'article ?

ASelon Marc Andreessen, les ingénieurs en logiciel de pointe utilisant l'IA ont vu leur productivité horaire augmenter jusqu'à 20 fois. Cependant, au lieu de gagner du temps libre, ils travaillent plus longtemps, gérant simultanément de nombreux agents IA, ce qui a conduit à des modes de vie épuisants surnommés 'vampires de l'IA'.

QQuelle est l'une des principales techniques utilisées par Andreessen pour interroger les modèles d'IA ?

AUne de ses techniques principales est de demander à l'IA de produire les versions les plus fortes des deux côtés d'un argument ou d'une décision. Au lieu de demander 'quel chemin est le bon ?', il demande des présentations extrêmes et convaincantes pour chaque option, puis prend sa décision lui-même.

QQuel problème majeur l'étude du Mount Sinai concernant ChatGPT Health a-t-elle mis en lumière ?

AL'étude du Mount Sinai, publiée dans *Nature Medicine* en février 2026, a révélé que ChatGPT Health conseillait à tort de ne pas se rendre aux urgences dans plus de la moitié des cas que les médecins jugeaient critiques. Cela souligne un grave problème de fiabilité et de stabilité de l'IA dans des domaines sensibles comme la santé, malgré ses capacités cognitives avancées.

QSelon la conclusion de l'article, comment l'avènement de l'AGI semble-t-il se produire dans la réalité, par rapport aux attentes populaires ?

AContre l'attente populaire d'un événement spectaculaire et officiel comme dans les films, l'article suggère que l'AGI est arrivée silencieusement et progressivement. Elle se serait glissée entre les mises à jour logicielles rapportées comme des améliorations routinières, sans annonce formelle ni moment de reconnaissance universelle.

Lectures associées

La Maison Blanche fait une concession pour lever les obstacles éthiques, la "Clarity Act" va-t-elle saisir la dernière fenêtre avant la suspension des travaux ?

Le gouvernement Trump aurait accepté d'intégrer des dispositions éthiques au "Clarity Act", un projet de loi phare sur la structure du marché des actifs numériques, ce qui pourrait lever le dernier obstacle majeur à son adoption. Le texte mis à jour a été soumis à des sénateurs républicains. Parallèlement, Patrick Witt, conseiller clé de la Maison Blanche, restera en poste pour superviser la dernière phase des négociations. Le "Digital Asset Market Clarity Act" vise à établir un cadre réglementaire fédéral unifié pour clarifier la classification des actifs numériques (marchandises numériques, actifs de contrat d'investissement, stablecoins) et à répartir les compétences entre la SEC et la CFTC, mettant fin à des années de flou juridique. Après des compromis sur les revenus des stablecoins et la régulation de la DeFi, la principale divergence restante concernait les conflits d'intérêts potentiels des responsables gouvernementaux. La concession de la Maison Blanche sur cette clause éthique ouvre une voie possible pour un vote au Sénat avant la période de récess estivale du Congrès, qui débute mi-août. Les acteurs de l'industrie voient cela comme un tournant potentiel, offrant enfin une clarté réglementaire susceptible d'attirer les institutions traditionnelles et de consolider le marché américain des actifs numériques.

Odaily星球日报Il y a 6 mins

La Maison Blanche fait une concession pour lever les obstacles éthiques, la "Clarity Act" va-t-elle saisir la dernière fenêtre avant la suspension des travaux ?

Odaily星球日报Il y a 6 mins

Interprétation de Bernstein : 142 milliards de dollars de commandes à long terme peuvent-ils amortir le cycle de la mémoire ?

L'analyse de Bernstein met en lumière les accords d'achat à long terme (LTA) conclus par Micron et SanDisk, représentant un minimum contractuel de revenus d'environ 1420 milliards de dollars et des garanties financières d'environ 330 milliards de dollars. Ces accords, sécurisés par des dépôts de garantie, visent à stabiliser les revenus face aux cycles volatils de la mémoire. Cependant, le rapport souligne que ces garanties, bien que significatives, ne couvriraient qu'environ 0,6% des revenus potentiels du secteur sur 3 à 5 ans (estimés à 5,2 billions de dollars dans leur modèle). Ils agissent donc comme un tampon en cas de baisse modérée des prix, mais ne protègent pas pleinement contre une récession profonde où les clients pourraient trouver plus économique de rompre le contrat malgré les pénalités. De plus, la portée des LTA est limitée. Ils concernent principalement les grands clients cloud américains, sensibles à la stabilité des approvisionnements pour l'IA. Une part importante du marché (30 à 50%), incluant les produits grand public, les PC, les smartphones et certains clients chinois, reste ancrée dans des achats au comptant ou à court terme, perpétuant la cyclicité. En conclusion, ces LTA améliorent la visibilité et adoucissent potentiellement les phases de ralentissement, notamment grâce à des mécanismes de garantie qui deviennent plus contraignants en fin de contrat. Toutefois, ils ne transforment pas l'industrie de la mémoire en service public et ne suppriment pas son caractère cyclique. Leur véritable résistance sera testée lors du prochain ralentissement significatif.

marsbitIl y a 1 h

Interprétation de Bernstein : 142 milliards de dollars de commandes à long terme peuvent-ils amortir le cycle de la mémoire ?

marsbitIl y a 1 h

Trading

Spot
活动图片