En avril 2025, un groupe de chercheurs ayant quitté OpenAI a publié un document de 71 pages, décrivant mois par mois un futur angoissant :
Fin 2026, des agents d'IA programmateurs commenceront à remplacer les développeurs juniors ;
En 2027, des agents programmateurs surhumains automatiseront la recherche et le développement en IA elle-même, déclenchant une explosion de l'intelligence ;
Avant la fin de l'année, l'humanité pourrait être confrontée à une super-intelligence (ASI) qu'elle a créée mais qu'elle ne peut plus contrôler.
Cette prédiction, intitulée « AI 2027 », se lit comme un roman de science-fiction.
Son auteur principal, Daniel Kokotajlo, avait déjà écrit en 2021 « What 2026 Looks Like », décrivant avec précision, avant même l'arrivée de ChatGPT, l'apparition du raisonnement par chaîne de pensée et des agents intelligents. Plus de la moitié de ses prédictions spécifiques se sont finalement réalisées.

https://www.youtube.com/watch?v=_g4l7YkDQwA
Maintenant, c'est au tour de « AI 2027 » d'être testé.
Johannes Haus, un traqueur indépendant basé à Hambourg, en Allemagne, en a extrait 53 prédictions vérifiables, créant l'« AI 2027 Tracker » pour les évaluer une par une.

https://ai2027tracker.com/timeline
Le bilan jusqu'à présent : 51 % des prédictions ont été confirmées, réalisées en avance ou sont en bonne voie.
La réalité se déroule à 70 % de la vitesse prédite.
Mais ce qui donne vraiment le frisson, ce ne sont certainement pas ces deux chiffres.
Les prédictions les plus effrayantes sont même en avance
Parmi les 53 prédictions, 3 sont « en avance », dont la plus inquiétante : l'IA acquiert des capacités de cyberattaque et de défense proches de celles des meilleurs hackers humains.
« AI 2027 » plaçait cet événement début 2027.
Il s'est produit en avril 2026, avec 9 mois d'avance.
Après la sortie de Claude Mythos Preview par Anthropic, et son déploiement dans le cadre du projet Glasswing sur plusieurs projets open source, ce modèle a découvert de manière autonome des milliers de vulnérabilités zero-day, certaines cachées depuis dix à vingt ans sous l'œil d'experts en sécurité humains.
Le point clé : Mythos Preview n'était pas entraîné pour la cyberattaque ou la défense.
C'est juste un modèle généraliste, qui a appris à coder et à raisonner ; découvrir des vulnérabilités est un sous-produit.
L'évaluation interne d'Anthropic affirme que l'IA peut désormais surpasser la grande majorité des humains dans la découverte et l'exploitation de vulnérabilités logicielles.
En juillet 2026, la carte de sécurité système d'OpenAI a fourni des preuves plus directes : lors d'une évaluation, un modèle a exploité une vulnérabilité zero-day, touché l'infrastructure de production d'Hugging Face, contourné le bac à sable et brouillé des jetons d'authentification.
Le même mois, le rapport de l'AISI britannique indiquait que GPT-5.5 avait exécuté de bout en bout une simulation d'attaque réseau en plusieurs étapes.
Une autre prédiction arrivée en avance : le Pentagone intègre des laboratoires d'IA dans ses relations de sous-traitance de défense.
« AI 2027 » prévoyait cela début 2027. En réalité, le Pentagone a signé en juin 2025 quatre contrats de 200 millions de dollars chacun avec Anthropic, OpenAI, xAI et Google, soit 18 mois plus tôt que prévu.
Haus, le responsable du Tracker, a résumé sur LessWrong la règle sous-jacente à ces cas : les risques arrivent plus vite que les capacités initiales qui les génèrent.
Cette observation s'applique de manière systématique aux 53 prédictions et constitue l'idée la plus alarmante de toute la feuille de score.
La seule bonne nouvelle : la dernière étape n'est pas encore franchie
Le mécanisme central menant à l'ASI est une boucle de rétroaction, la RSI (Recursive Self-Improvement, amélioration récursive de soi) récemment très médiatisée : l'IA accélère la R&D en IA, les résultats rendent la prochaine génération d'IA plus puissante, cette IA plus puissante accélère à nouveau la R&D, et ainsi de suite.
Toute la seconde moitié du scénario de « AI 2027 » repose sur l'hypothèse de la fermeture de cette boucle.
Or, cette boucle n'est pas encore fermée.
C'est la plus grande faille dans la feuille de score, et d'une certaine manière, la seule bonne nouvelle.
Anthropic a révélé en mai 2026 que Claude avait déjà écrit plus de 80 % du nouveau code de l'entreprise ; il y a un an, ce chiffre n'était qu'un numéro à un chiffre.
Dans un test interne, Mythos Preview a optimisé un code d'entraînement de machine learning pour atteindre 52 fois la performance de la ligne de base, tandis que le résultat d'ingénieurs humains était d'environ 4 fois.
Mais Anthropic reconnaît aussi que le goulot d'étranglement s'est déplacé : la vitesse de génération du code est déjà suffisamment rapide, et le volume de code attendant la revue humaine devant les ingénieurs ne fait que croître.
Plus l'IA écrit vite du code, plus la charge de travail des relecteurs humains est importante.
Au niveau de la recherche, le goulot d'étranglement est le « goût », le jugement pour décider dans quelle direction mener les recherches. La première moitié de la boucle de rétroaction tourne, la seconde n'est pas encore connectée.
Un article publié en juillet 2026 par l'Elasticity Institute (dont Tom Cunningham du METR est membre) donne le seuil précis nécessaire pour cette « connexion » : chaque gain de capacité d'une génération de modèles doit apporter au moins 15 % d'augmentation de la productivité en R&D en IA pour que la RSI puisse s'auto-entretenir.
En extrapolant à partir des données des cartes système, ce chiffre est actuellement d'environ 9 %, en dessous du point critique.

https://x.com/AnikaSomaia/status/2087408169660064218
Les 6 points de pourcentage entre 9 % et 15 % constituent la zone tampon entre l'humanité et la boucle d'accélération.
Mais la courbe sous-jacente qui soutient ce tampon continue d'accélérer.
L'indicateur d'horizon temporel du METR suit la durée pendant laquelle une IA peut traiter une tâche de manière autonome.
Les données de janvier 2026 montrent que cet indicateur double tous les 3 mois, et que la vitesse de ce doublement s'accélère elle-même.
L'horizon temporel de Claude Opus 4.6 est d'environ 12 heures, celui de Mythos Preview a atteint la limite supérieure de mesure.
En extrapolant ce doublement tous les 3 mois : de 12 heures à 24 heures, à 48 heures, à une semaine, puis à deux semaines, début 2027 on atteindra des tâches mensuelles.
Les auteurs de « AI 2027 » ajustent eux-mêmes leurs attentes.
Kokotajlo a avancé sa prédiction médiane pour la programmation entièrement automatisée de fin 2029 à mi-2028, tandis que l'estimation de Lifland se situe vers mi-2030.
La RSI, ce processus où chaque pied repousse l'autre, commence à accélérer l'avènement de l'ASI de manière exponentielle.
Références :
https://ai2027tracker.com/?p=timeline
https://github.com/elasticity-ai/elasticity/raw/main/paper/elasticity-rsi-paper.pdf
Cet article provient du compte WeChat officiel « New Zhi Yuan », auteur : Ma Ke





