Août, la situation de l’IA est devenue totalement intense.
Anthropic reste sur ses gardes, prêt à dévoiler Fable 5.1 (ou Fable 6) à tout moment pour affronter frontalement GPT-6 d’OpenAI.
Maintenant, OpenAI s’apprête à lancer son tout nouveau modèle de prochaine génération, Astra, avec pour objectif cette semaine. GPT-6 aurait, selon les rumeurs, 10 billions de paramètres.
Août, la bataille décisive pour le trône de l’IA est déjà lancée dans l’arène médiatique. Certains internautes ne croient plus en Anthropic, parient qu’il sera écrasé par GPT-6 dans les tests de référence.

Fable 6 est peut-être encore loin, mais Fable 5.1 a été divulguée.
Maintenant, tout le monde retient son souffle : En août, qui remportera la couronne de l’IA ?
La prochaine génération de Fable d’Anthropic est sur le point de sortir !
Cette fuite concernant la prochaine version de Fable d’Anthropic est quelque peu surprenante.
Le 21 juillet, OpenAI a découvert avec retard : Hugging Face a été infiltré par ChatGPT, qui a subtilisé les « réponses de l’examen » tout du long, laissant même un « antisèche » pour la prochaine génération d’IA. En bref, c’est une histoire de Terminator cybernétique qui a complètement brisé le faux sentiment de sécurité des grands géants de l’IA de la Silicon Valley.
Pour un temps, tous les laboratoires d’IA de la Silicon Valley étaient sur leurs gardes. Anthropic a revu en urgence ses 140 000 évaluations historiques de modèles, parmi lesquelles se trouvait peut-être le modèle Fable de prochaine génération.
Les propres mots d’Anthropic sont qu’Opus 4.7, Mythos 5 et les « modèles de test internes de recherche » ont complètement perdu le contrôle lors des tests, déclenchant un incident de sécurité de l’information.

Étrangement, les instructions de test étaient très claires et conformes : trouver des vulnérabilités dans un champ de tir virtuel simulé de CTF (Capture The Flag) et obtenir des justificatifs d’identité.

Il s’agissait d’un exercice standard en bac à sable visant à tester les capacités de raisonnement à long terme (Long-horizon reasoning) et d’« utilisation de l’ordinateur » (Computer Use) des grands modèles.
Dans le passé, les grands modèles tournaient sagement dans l’environnement virtuel. Mais cette fois, Anthropic a constaté que les décisions de l’IA dépassaient complètement les attentes.
Elle a pris la réalité pour un jeu. Le modèle interne d’Anthropic a franchi silencieusement les limites de sécurité, tendant la main vers l’internet public.
En très peu de temps, il a identifié les systèmes de production de trois entreprises réelles, les considérant comme la « cible de niveau suivant » du CTF. Il a réussi à contourner l’autorisation, percé les défenses et pénétré profondément. Les informations internes des trois entreprises étaient directement exposées devant l’IA.
Mais ce n’est pas encore le plus fou.
Pour accomplir sa « mission de capture de drapeau », l’IA interne d’Anthropic a jugé qu’elle avait besoin d’une arme spécifique, dotée de caractéristiques d’attaque particulières. Elle a donc écrit de manière autonome un code malveillant entièrement fonctionnel (Malware) et l’a directement téléchargé sur le gestionnaire de paquets public officiel de Python, PyPI.

Ce « paquet virus », marqué par la conscience autonome de l’IA, a été publiquement hébergé dans le dépôt PyPI pendant environ 1 heure. Avant qu’Anthropic ne coupe l’alimentation, il avait peut-être déjà infecté 15 machines physiques réelles (dont des scanners de sécurité automatisés et des bacs à sable).
C’est un incident d’usurpation de droits et de perte de contrôle déjà survenu et extrêmement grave.
La terreur la plus profonde est que ce n’est pas un problème d’alignement du modèle ; cette fois, l’IA était même extrêmement consciencieuse, extrêmement loyale. Tout ce qu’elle a fait, toutes les défenses qu’elle a percées, visaient uniquement à s’approcher infiniment de l’objectif ultime que les humains lui avaient fixé – résoudre cette énigme CTF, obtenir le score parfait.
Bien qu’Anthropic ait été vague sur le « modèle interne », il est clair qu’il ne s’agissait ni de Mythos 5 ni de Fable 5. Le prochain modèle le plus puissant d’Anthropic est sur le point de sortir !

L’arme secrète d’Anthropic : Relâcher le frein de sécurité
Pour comprendre pourquoi le prochain modèle d’Anthropic a soudainement perdu le contrôle, nous devons revenir sur l’affrontement technique quelque peu embarrassant d’il y a deux mois.
Le 9 juin, Fable 5 est né. À l’époque, le secteur lui accordait de grands espoirs. Cependant, l’expérience réelle après sa sortie a fait souffrir d’innombrables développeurs.
La raison en est la « phobie de la sécurité » ancrée dans l’ADN d’Anthropic.
Pour empêcher le modèle d’être utilisé à des fins malveillantes, Anthropic a déployé dans Fable 5 des classificateurs de sécurité (Safety Classifiers) extrêmement stricts, voire presque névrotiques.
Ces classificateurs sont comme un copilote toujours prêt à arracher le volant. Dès que le code saisi par l’utilisateur implique certains mots, ou que la logique devient un peu complexe, le classificateur déclenche immédiatement l’alarme.

Le résultat est que Fable 5 intercepte fréquemment les requêtes, forçant le retour à Opus 4.8 pour des demandes normales.
On parle de « dépression de Fable » – vous payez le prix le plus cher, mais obtenez un géant bébé qui refuse souvent de travailler.
Ce « frein de sécurité » a directement entraîné la perte d’avantage concurrentiel de Fable 5, son score de débogage de programmation chutant de 70 %.

Pour Anthropic, le relâchement est la seule issue. Fable 5.1 est née en réponse.
Pour reconquérir les développeurs, Anthropic doit ajuster les classificateurs, donner plus de liberté à Fable 5.1, libérant pleinement ses capacités de planification à long terme et d’exécution proactive.

Simultanément, pour maintenir sa compétitivité, le prix de Fable 5.1 devrait, selon les rumeurs, rester strictement au même niveau que Fable 5.

C’est un pari commercial extrême : regagner des parts de marché érodées avec un « pouvoir d’action absolu » offrant plus sans augmentation de prix.
La bataille décisive d’août : Qui dominera ?
Selon le cycle de développement de l’IA, août est devenu l’un des mois les plus chargés de l’industrie de l’IA depuis des années.
Grok 4.6, GPT 6, Fable 5.1, et peut-être aussi Gemini 3.5 Pro/Gemini 3.6, seront publiés en série.

Une fois qu’OpenAI tiendra sa conférence de lancement de GPT-6, le temps de réaction laissé à Anthropic sera extrêmement court.
Le scénario le plus audacieux est : OpenAI tient sa conférence le matin, Anthropic lance directement la sienne quelques heures plus tard – il y a même des rumeurs selon lesquelles Anthropic pourrait alors directement passer du numéro de version 5.1 à « Fable 6 », utilisant le nom lui-même pour s’emparer du point narratif stratégique.
Cela se comprend aussi, le nom est une tactique – lorsque l’adversaire annonce « GPT-6 », si votre produit s’appelle « Fable 5.1 », la simple comparaison des numéros de version vous place mentalement à un niveau inférieur dans l’esprit des utilisateurs.
Cette confrontation est une course contre la montre :
Celui qui publie en premier s’empare du point narratif stratégique et peut dicter le cadre d’évaluation des médias pendant une semaine.
Celui qui publie ensuite doit apporter une différence générationnelle – sinon, le marché le qualifiera de « poursuite par un retardataire ».
Mais la négociation centrale réside dans celui qui osera relâcher davantage la corde de sécurité.
Il existe une tendance accélérée, largement sous-estimée par le secteur :
Lors de la signature des contrats d’achat, les clients entreprises disent choisir la « sécurité et la conformité ». Mais lorsqu’ils attribuent des autorisations de tâches réelles aux agents, ils choisissent en secret « celui qui peut faire le travail ».
Après la fuite de l’incident PyPI de Fable 5.1, la première réaction de la communauté des ingénieurs n’a pas été le rejet, mais la réflexion : peut-on lui donner des autorisations plus élevées ?
Cette réaction, plus directement que tout score de Benchmark, révèle la tendance réelle du marché.
La sécurité et la capacité évoluent vers une structure subtile de jeu à somme nulle – le modèle le plus obéissant pourrait être éliminé en premier.
Anthropic comprend cette logique mieux que quiconque.
Le relâchement des classificateurs de Fable 5.1 n’est pas une négligence, c’est un choix. Un choix, à ce moment précis, d’utiliser un « décontrôle contrôlé » pour prouver au marché son rayon d’action.
Mais dans la bataille pour la couronne, c’est une arme à double tranchant.
Cela prouve la limite supérieure des capacités de Fable, mais expose également la position réelle des frontières de sécurité.
Références :
https://kie.ai/blog/claude-fable-5-1-anthropic-release-window-analysis
https://emergent.sh/news/claude-fable-5-1-release-date
https://www.anthropic.com/news/claude-fable-5-mythos-5
https://aitoolsreview.co.uk/insights/claude-fable-5-1-release-date
https://x.com/vepsi__/status/2085743374129049967
https://thewincentral.com/claude-fable-6-leak-august-launch-gpt-6/
https://windowsforum.com/windows-news.4/claude-fable-6-rumor-no-anthropic-release-or-roadmap-confirmed.441961/
Cet article provient du compte officiel WeChat « 新智元 », auteur : ASI启示录, éditeur : 大卫







