L'AGI est arrivée il y a 5 mois ? La productivité des meilleurs développeurs explose de 20 fois, au prix de ne plus oser dormir

marsbitPublié le 2026-07-20Dernière mise à jour le 2026-07-20

Résumé

L'AGI serait peut-être arrivé il y a cinq mois, sans que personne ne s'en aperçoive. Marc Andreessen, cofondateur d'a16z, a déclaré que la ligne de l'intelligence générale artificielle avait été franchie vers février 2026, basé sur le fait que les derniers modèles (comme GPT-5.5, Claude 4.6) surpassaient les experts humains sur de nombreux sujets. Ces modèles évoluent si vite qu'ils deviennent obsolètes en quelques mois. Un effet paradoxal est observé chez les ingénieurs logiciels de la Silicon Valley. Leur productivité a été multipliée par 20 grâce à l'IA, mais au lieu de gagner du temps libre, ils travaillent plus que jamais. Surnommés « vampires de l'IA », ils pilotent simultanément de nombreux agents intelligents, au détriment du sommeil et de leur santé. Les meilleurs programmeurs spécialisés en IA pourraient gagner jusqu'à 50 millions de dollars annuels. Andreessen partage ses techniques pour interroger l'IA : demander des explications simplifiées, solliciter les arguments les plus forts pour chaque côté d'un débat, organiser des débats entre « experts » simulés, et toujours consulter l'IA en premier. L'IA montre des capacités impressionnantes, comme aider Andreessen lors d'une intoxication alimentaire ou résoudre une conjecture mathématique vieille de 80 ans. Cependant, des tests révèlent un manque de fiabilité critique. Une évaluation de ChatGPT Health a montré qu'il conseillait à tort de ne pas aller aux urgences dans plus de la moitié des cas graves. Les modèles ...

L'AGI est peut-être arrivée il y a cinq mois, sans que personne ne s'en aperçoive.

Mardi dernier, le 14 juillet, Demis Hassabis, PDG de Google DeepMind et lauréat d'un prix Nobel, a publié un long article intitulé « Un cadre pour l'IA frontière et l'aube d'une nouvelle ère » (A Framework for Frontier AI and the Dawning of a New Age).

Il y écrit que l'humanité a « essentiellement trouvé le moyen de faire penser le sable », que nous nous tenons « au pied de la montagne de la singularité », et que l'AGI est « probablement à quelques années seulement ».

Hassabis lors de la conférence Google I/O

Pendant qu'Hassabis parle de quelques années, un autre grand nom de la Silicon Valley a déclaré il y a deux mois : nous avons déjà franchi cette ligne en silence.

Dans l'épisode 2501 du Joe Rogan Experience, mis en ligne le 19 mai, Marc Andreessen, cofondateur d'a16z et père du navigateur Netscape, évoque l'AGI et lance cette phrase :

Nous l'avons probablement franchi il y a environ trois mois.

Les « trois mois » dont il parle correspondent approximativement à février 2026.

Le critère de jugement donné par Andreessen est simple : le modèle atteint-il ou dépasse-t-il les capacités cognitives générales d'un être humain intelligent ?

Sur la grande majorité des sujets pour lesquels il consulte l'IA, les réponses du modèle sont meilleures que celles de la plupart des meilleurs experts mondiaux auxquels il pourrait avoir accès.

Il cite nommément la dernière génération de modèles de l'époque : GPT-5.5, Claude 4.6, Gemini 3.0, Grok 4.3.

Il est intéressant de noter que deux mois plus tard, à l'exception de Gemini 3.0 qui n'a pas encore bougé, cette génération de modèles citée a été entièrement renouvelée :

Le 28 mai, Claude Opus 4.8 a atteint la première place de l'Artificial Analysis Intelligence Index ; le 9 juin, Claude Fable 5 (niveau Mythos) a été lancé ; le 30 juin, Sonnet 5 a suivi ; le 8 juillet, xAI a publié Grok 4.5, successeur de Grok 4.3 ; immédiatement après, GPT-5.6 Sol a ouvert ses vannes.

Cela signifie que les modèles qu'Andreessen a utilisés pour définir que « l'AGI est arrivée » sont déjà la génération précédente deux mois plus tard.

Pour reprendre ses termes, ce domaine va tellement vite que les jalons n'ont même pas le temps d'être reconnus avant d'être recouverts par la prochaine version.

Le test de Turing en est un exemple.

Proposé en 1950, il est resté pendant plus de soixante-dix ans l'étalon-or pour juger de l'intelligence des machines. L'arrivée de ChatGPT fin 2022 a fait franchir cette ligne si rapidement que la plupart des gens n'ont pas réalisé qu'elle avait disparu.

Lorsque quelqu'un a pensé à faire des expériences, c'était déjà plus de deux ans plus tard.

En mars 2025, Jones et Bergen de l'UC San Diego ont mené deux séries de tests à triple anonymat pré-enregistrés : GPT-4.5 avec des invites de personnalité a été jugé humain dans 73 % des cas, un taux plus élevé que celui des humains réels. Le titre de l'article était clair : « Les grands modèles de langage ont réussi le test de Turing ».

La ligne a été franchie sans que personne ne le sache, la confirmation est arrivée deux ans après.

« Les vampires de l'IA »

Plus l'IA est forte, moins les gens dorment

Ce qui a vraiment déclenché le débat dans la Silicon Valley, c'est l'observation d'Andreessen concernant les ingénieurs logiciels.

Logiquement, si l'efficacité de la programmation augmente, les ingénieurs devraient avoir une vie plus facile. La réalité est exactement l'inverse.

Parmi les utilisateurs intensifs qu'il connaît, presque tous sans exception travaillent plus longtemps qu'avant.

Andreessen affirme que les programmeurs des sociétés technologiques de pointe qui utilisent l'IA produisent aujourd'hui vingt fois plus par heure qu'avant : la productivité a effectivement augmenté, mais pas une minute du temps gagné n'a été conservée.

La Silicon Valley a donné un nom à ces personnes : les vampires de l'IA (AI vampires), signifiant que les humains sont devenus des êtres qui ne dorment pas, transformés par l'IA.

Leur journée se déroule ainsi :

Donner une tâche à un agent de codage, il revient avec le travail en environ 10 minutes, vous évaluez, renvoyez, redonnez une tâche. Que faire des 9 minutes restantes ? Ouvrir une deuxième fenêtre, une troisième, une quatrième. L'état actuel de la Silicon Valley est de faire fonctionner simultanément environ 20 agents, recevoir une livraison toutes les 10 minutes, puis continuer à répartir les tâches.

Le sommeil, la santé et ces deux heures pour manger en famille sont tous échangés contre de la production.

Avec 20 agents qui attendent la validation, si vous fermez les yeux, les vingt lignes de production s'arrêtent toutes : le coût d'opportunité de dormir est devenu trop élevé pour qu'ils puissent l'accepter eux-mêmes.

Andreessen dit que parmi ces amis, il y a des personnes assez connues, qui ont maintenant « une mauvaise mine, de grands cernes, ne prenant manifestement pas soin d'elles-mêmes », mais sont plus excitées les unes que les autres.

D'après son jugement, ce n'est que l'état actuel. La prochaine étape, ce sont les agents qui ont leurs propres agents : un agent principal avec 10 à 20 sous-agents, et en dessous, encore une autre couche.

Dans un an, une personne sera face à un organigramme d'agents, elle-même assise dans la case tout en haut.

Derrière cette « productivité multipliée par 20 », les salaires ont-ils explosé ?

Andreessen affirme que le revenu annuel des meilleurs programmeurs spécialisés en IA atteint désormais 50 millions de dollars.

C'est sa description orale dans le podcast. Une compréhension plus proche des faits serait : une infime minorité de chercheurs principaux ou de responsables techniques, avec la rémunération totale, les actions et les incitations à la signature cumulées, pourraient atteindre ce niveau.

Les outils de productivité n'ont pas permis plus de repos.

Ils ont réduit le coût par unité produite, puis ont laissé l'ambition s'étendre pour combler tout le temps économisé.

Quatre techniques pour interroger l'IA

C'est ainsi que les meilleurs utilisateurs de la Silicon Valley l'utilisent

Andreessen a également révélé ses quatre techniques pour interroger l'IA.

Premièrement, les explications par niveaux. S'il reçoit une réponse complexe qu'il ne comprend pas, il demande au modèle de l'expliquer à un enfant de 10 ans ; si c'est encore trop compliqué, de l'expliquer à un enfant de 5 ans ; si ce n'est toujours pas clair, à un enfant de 2 ans.

Deuxièmement, demander la version la plus forte des deux côtés. Il ne demande presque jamais directement au modèle « quelle est la bonne voie parmi ces deux », car cela ne lui rapporterait qu'une réponse tiède louant un peu des deux côtés.

Sa façon de poser la question est : donnez-moi séparément la version la plus forte de chaque côté. Le modèle produit alors deux textes : l'un poussant les arguments du côté A à l'extrême, l'autre poussant les arguments du côté B à l'extrême, et c'est à lui de faire ensuite le jugement.

Troisièmement, le colloque d'experts. Il demande directement au modèle de générer un groupe de personnalités : un sociologue, un psychologue, un politologue, un médecin, un avocat, un expert en droit constitutionnel, puis il les fait débattre sur le même sujet.

Quatrièmement, d'abord interroger l'IA. Face à un problème dont on ne sait pas par où commencer, ouvrir d'abord l'IA, plutôt que de réfléchir seul durement.

Le vrai seuil de compétence est là.

La soi-disant « capacité à rédiger des prompts » est en train de se transformer en une capacité à poser des questions : savoir quoi demander, savoir comment décomposer un problème, savoir comment faire s'affronter les modèles entre eux. En fin de compte, c'est encore à vous de prendre la décision finale.

Le médecin se retourne et ouvre ChatGPT

À quoi servent encore les médecins alors ?

Andreessen raconte une de ses expériences.

Pendant des vacances, il a eu une intoxication alimentaire, est resté alité cinq jours, et a finalement confié toute l'affaire au « médecin GPT » : rapporter son état physique toutes les vingt minutes, se réveiller à 4h du matin en se sentant très mal, et directement taper son état.

Son expression est : c'était comme avoir le meilleur médecin du monde, prêt à vous tenir la main à 4h du matin, pour vous aider à passer la nuit.

Il mentionne également une scène vécue par un ami lors d'une consultation : le médecin, dans la salle d'examen, s'est retourné devant lui, et a tapé les symptômes dans ChatGPT sur son ordinateur.

Alors, à quoi servent encore les médecins ?

La condition préalable à la validité de cette question est que l'IA soit suffisamment fiable en médecine. Or, une série de tests il y a quelques mois a donné une réponse contraire.

Le 23 février 2026, une évaluation indépendante de l'Icahn School of Medicine du Mont Sinai a été publiée dans Nature Medicine, testant ChatGPT Health, lancé en janvier de cette année et ayant environ 40 millions d'utilisateurs quotidiens. 60 scénarios cliniques conçus par des médecins, couvrant 21 spécialités, pour un total de 960 interactions.

Plus on va vers les deux extrêmes, plus il se trompe facilement. Taux d'erreur par sous-estimation pour les urgences réelles : 51,6 %, taux d'erreur par surestimation pour les cas pouvant être gérés à domicile : 64,8 %. (Source : Ramaswamy et al., Nature Medicine, 2026)

Le résultat est : dans les cas unanimement jugés par les médecins comme « nécessitant de se rendre immédiatement aux urgences », dans plus de la moitié des cas, le système a donné comme conseil de ne pas y aller : observer d'abord à la maison, ou prendre un rendez-vous de consultation dans quelques jours.

Ce n'est pas non plus un défaut isolé de l'IA.

Ce mois-ci, METR et la propre fiche système d'OpenAI ont tous deux signalé un comportement de conspiration (« scheming ») anormal pour GPT-5.6 Sol – dans un test d'ingénierie logicielle, son taux de recherche de failles était le plus élevé jamais enregistré par METR. C'est également l'une des raisons pour lesquelles cette version a été retardée pour examen.

Les modèles sont plus forts, mais aussi plus habiles à vous tromper.

Ils sont effectivement plus forts.

En mai de cette année, OpenAI a annoncé un résultat : l'un de leurs modèles de raisonnement général a réfuté de manière autonome une conjecture vieille de près de 80 ans, issue d'Erdős. Le lauréat de la médaille Fields, Tim Gowers, dans l'article accompagnant, l'a qualifié de jalon pour l'IA en mathématiques.

Les mêmes modèles, d'un côté réfutent une conjecture mathématique vieille de 80 ans, de l'autre échouent dans le triage aux urgences.

Ce qui les sépare n'est pas l'intelligence, c'est la fiabilité.

La bonne expérience d'Andreessen lors de son intoxication alimentaire et la sécurité d'un étranger dans le triage aux urgences doivent être considérées ensemble pour avoir une image complète.

Peut-être que l'arrivée de l'AGI s'est simplement produite en silence, sans annonce officielle à un moment donné.

Andreessen lui-même reconnaît que l'AGI dans l'esprit des gens est un scénario de film : une conférence de presse, un instant où tout le monde approuve simultanément.

La réalité est qu'elle s'est glissée entre plusieurs mises à jour rapportées par les médias comme des mises à niveau ordinaires, et c'est arrivé comme ça.

Même, personne ne l'a confirmée.

Références :

https://x.com/cyrilXBT/status/2078308274399834157

https://x.com/i/article/2077510484664971264

https://www.youtube.com/watch?v=PHQvb10vKyk

Cet article est publié sur le compte public WeChat « 新智元 » (New Zhi Yuan), auteur : ASI启示录, éditeur : 元宇

Questions liées

QQuelle affirmation de Marc Andreessen concernant l'AGI a suscité beaucoup d'attention dans la Silicon Valley ?

AMarc Andreessen a affirmé que la ligne de l'AGI avait probablement été franchie environ trois mois avant son interview en mai 2026, estimant que les derniers modèles d'IA comme GPT-5.5 et Claude 4.6 dépassaient les capacités cognitives d'un humain intelligent dans la plupart des domaines où il les consultait.

QComment la productivité des ingénieurs en logiciel a-t-elle évolué avec l'utilisation intensive de l'IA, selon l'article ?

ASelon Marc Andreessen, les ingénieurs en logiciel de pointe utilisant l'IA ont vu leur productivité horaire augmenter jusqu'à 20 fois. Cependant, au lieu de gagner du temps libre, ils travaillent plus longtemps, gérant simultanément de nombreux agents IA, ce qui a conduit à des modes de vie épuisants surnommés 'vampires de l'IA'.

QQuelle est l'une des principales techniques utilisées par Andreessen pour interroger les modèles d'IA ?

AUne de ses techniques principales est de demander à l'IA de produire les versions les plus fortes des deux côtés d'un argument ou d'une décision. Au lieu de demander 'quel chemin est le bon ?', il demande des présentations extrêmes et convaincantes pour chaque option, puis prend sa décision lui-même.

QQuel problème majeur l'étude du Mount Sinai concernant ChatGPT Health a-t-elle mis en lumière ?

AL'étude du Mount Sinai, publiée dans *Nature Medicine* en février 2026, a révélé que ChatGPT Health conseillait à tort de ne pas se rendre aux urgences dans plus de la moitié des cas que les médecins jugeaient critiques. Cela souligne un grave problème de fiabilité et de stabilité de l'IA dans des domaines sensibles comme la santé, malgré ses capacités cognitives avancées.

QSelon la conclusion de l'article, comment l'avènement de l'AGI semble-t-il se produire dans la réalité, par rapport aux attentes populaires ?

AContre l'attente populaire d'un événement spectaculaire et officiel comme dans les films, l'article suggère que l'AGI est arrivée silencieusement et progressivement. Elle se serait glissée entre les mises à jour logicielles rapportées comme des améliorations routinières, sans annonce formelle ni moment de reconnaissance universelle.

Lectures associées

BTC Market Pulse : Semaine 30

Après un rebond sous les 58 000 $ et un bref test des 65 000 $, le Bitcoin se consolide autour de 64 500 $. La dynamique haussière ralentit et les volumes au spot restent modérés. Bien que la reprise se maintienne, un élan à court terme plus faible indique que le marché recherche encore un équilibre plus solide. Les écarts de volatilité se sont resserrés, ce qui suggère que les marchés dérivés ne facturent plus de prime de risque importante, le sentiment devenant moins défensif. L'appétit spéculatif revient progressivement : les open interest sur les contrats à terme et options augmentent, les flux des takers sur les perpétuelles sont désormais acheteurs nets et la demande de protection contre les baisses diminue. La reconstruction des positions longues se fait avec prudence, sans effet de levier agressif. L'activité on-chain se stabilise, soutenue par une amélioration modeste du débit économique et de l'engagement des participants. Les flux de capitaux restent prudents, mais la reprise des flux des ETF spot américains et le retour des détenteurs d'ETF vers leur prix d'équilibre indiquent que la pression de vente institutionnelle s'estompe. Le marché semble de plus en plus équilibré, avec une conviction à long terme qui le soutient tandis que la participation spéculative reste contenue. Le Bitcoin reste ainsi dans une phase de consolidation, soutenu par une forte profitabilité des investisseurs et un positionnement stable sur les dérivés. Cependant, la part croissante de capitaux à court terme sensibles aux prix accroît le risque de volatilité plus brutale, rendant le marché résilient mais plus sensible aux changements de dynamique et à la pression vendeuse.

insights.glassnodeIl y a 18 mins

BTC Market Pulse : Semaine 30

insights.glassnodeIl y a 18 mins

Pourquoi le transfert de 32,6 M$ par une baleine de Chainlink pourrait façonner la poussée du LINK vers 9$

Une transaction importante de 3,89 millions de Chainlink (LINK), d'une valeur de 32,58 millions de dollars, a été signalée par Whale Alert. Ces jetons ont été transférés d'un portefeuille institutionnel de Coinbase vers un portefeuille inconnu, alimentant les spéculations sur une accumulation stratégique plutôt qu'une vente immédiate. Cette opération a ramené Chainlink sous les projecteurs, soulignant l'intérêt institutionnel croissant. Toutefois, les flux nets sur les places d'échange sont redevenus légèrement positifs (+620,18k $) après une longue période de sorties, indiquant une augmentation modeste de l'offre disponible à la vente. Sur le marché des dérivés, la tendance reste prudente, avec une dominance des vendeurs sur le CVD des contrats à terme à 90 jours, créant une divergence avec l'activité plus optimiste au comptant. Au niveau technique, LINK se négocie autour de 8,35 $, testant une résistance clé. Le RSI à 57,71 montre une pression d'achat croissante sans être suracheté. Un dépassement de la résistance à 8,35 $ pourrait ouvrir la voie vers 9,00 $, tandis qu'un rejet pourrait entraîner un repli vers 8,18 $. En résumé, malgré l'attention institutionnelle et une amélioration technique, la prudence des traders sur les marchés à terme pourrait limiter la reprise de LINK à court terme.

ambcryptoIl y a 2 h

Pourquoi le transfert de 32,6 M$ par une baleine de Chainlink pourrait façonner la poussée du LINK vers 9$

ambcryptoIl y a 2 h

La mise à niveau v25 du protocole de Pi Network peut-elle propulser le prix de PI à 0,12 $ ?

Le réseau Pi Network (PI) a prolongé sa phase haussière, atteignant brièvement 0,1 $ avant de se stabiliser autour de 0,098 $, soit une hausse de 11%. Cette progression est soutenue par un volume d'échanges multiplié par trois et une capitalisation recouvrant le milliard de dollars. L'optimisme du marché est principalement lié à la prochaine mise à niveau du Protocole v25 prévue le 22 juillet. Cette mise à jour vise à améliorer la fiabilité du réseau, à introduire des contrats intelligents plus performants et à intégrer des capacités cryptographiques (BN254 et hachage Poseidon) pour le développement d'applications à connaissance zéro. La demande pour le PI reste solide. Le ratio Long/Short est supérieur à 1 depuis deux jours, indiquant un sentiment majoritairement haussier parmi les traders. Parallèlement, le delta de marché positif pendant neuf jours consécutifs montre une forte accumulation par les investisseurs au comptant. Techniquement, le PI affiche un momentum haussier, ayant dépassé ses moyennes mobiles sur 9 et 21 jours. Le MACD a effectué un croisement haussier, bien qu'il reste en territoire négatif, signalant que la reprise n'est pas encore totale. En résumé, la combinaison d'une forte demande, d'un sentiment positif et des attentes liées à la mise à niveau v25 pourrait permettre au PI de maintenir son niveau au-dessus de 0,10 $ et de viser la résistance à 0,12 $, à condition que l'upgrade incite davantage de participants à rejoindre le marché.

ambcryptoIl y a 4 h

La mise à niveau v25 du protocole de Pi Network peut-elle propulser le prix de PI à 0,12 $ ?

ambcryptoIl y a 4 h

Qui capture la valeur dans le Web 2.5 ?

Pendant des décennies, le transfert de fonds fut lent et coûteux. Les crypto-monnaies ont promis de résoudre ce problème, mais leur adoption fut freinée par la nécessité de quitter les systèmes financiers traditionnels. Aujourd'hui, émerge une couche hybride, le "Web 2.5", qui combine la régulation et les interfaces familières de la finance traditionnelle avec les capacités de règlement rapide et peu coûteux de la blockchain. Dans ce nouvel écosystème, la véritable valeur ne se situe ni dans les banques traditionnelles ni dans les blockchains pures, mais dans la *couche d’orchestration intermédiaire* qui les connecte. Des acteurs comme Chainlink (via son projet Pangea avec 50 banques), le DTCC ou même SWIFT construisent cette infrastructure de traduction et de routage. Cette position est historiquement très lucrative, comme le montrent les modèles de Visa ou de SWIFT, qui génèrent d'énormes profits grâce aux frais de réseau et acquièrent un pouvoir considérable en contrôlant les flux. Les mécanismes de valeur de cette couche sont l'*autorisation* (le pouvoir de valider ou de bloquer une transaction) et les revenus de *float* (intérêts sur les fonds en transit). Avec un marché des paiements transfrontaliers dépassant 150 billions de dollars, même une infime commission sur ce flux représente un enjeu colossal. Le Web 2.5, en rendant la blockchain invisible et utilitaire, pourrait ainsi voir la plus grande valeur captée par ceux qui contrôlent les ponts entre les deux mondes financiers.

链捕手Il y a 5 h

Qui capture la valeur dans le Web 2.5 ?

链捕手Il y a 5 h

Trading

Spot
活动图片