25 minutes, 500 portefeuilles vidés!
Ces derniers jours, le célèbre portefeuille matériel Coldcard a été frappé par un scandale, et la cause de cette secousse dans le monde des cryptomonnaies est une faille de code latente depuis cinq ans.
Qui aurait cru qu'avec un simple prompt, Claude l'a trouvée en un clin d'œil, après seulement 8 minutes de réflexion.

Auparavant, l'équipe de Coldcard avait publié plus d'une dizaine de mises à jour matérielles et effectué plusieurs rounds de revues de code, sans jamais la détecter.
Claude déterre en 8 minutes une faille vieille de cinq ans
Le fabricant de ce portefeuille matériel Coldcard est l'entreprise canadienne établie Coinkite.
En mars 2021, une soumission de code apparemment routinière de l'équipe de développement a créé une énorme faille dans la logique de base –
elle a modifié le « point crucial » de la génération de nombres aléatoires.
La source des nombres aléatoires pour générer les clés privées est passée du « générateur de nombres aléatoires matériel » véritable de la puce, à un chemin de repli utilisant un générateur de nombres pseudo-aléatoires logiciel.

Personne ne s'attendait à ce que ce changement ait un coût extrêmement douloureux : la robustesse de la clé est tombée d'environ 128 bits à environ 40 bits.
Ce qui nécessitait auparavant un nombre astronomique d'essais pour un pirate pour deviner la clé, est devenu quelque chose qu'une machine peut calculer par force brute en un rien de temps.
Le plus poignant est que Coinkite l'a admis dans une déclaration –
quelques semaines avant l'incident, l'équipe avait passé le firmware au crible avec une IA, sans détecter le moindre problème.
Aujourd'hui, un développeur a directement soumis le problème à Claude, qui l'a résolu en 8 minutes.

Démonstration à huis clos révélée, Claude vide un compte bancaire
Il y a deux mois, une démonstration à huis clos devant le Congrès avait déjà montré la puissante capacité de Claude à « dénicher des failles ».
Anthropic a dévoilé lors de la réunion son modèle non encore publié, Mythos –
Ils ont demandé au modèle de trouver des failles dans un système bancaire, de vider un compte, et il l'a réellement fait.

Ce qui est encore plus dramatique, c'est que Mythos a ensuite réparé la faille.
Après tout, lors de tests précédents, il avait découvert des milliers de failles critiques dans chaque système d'exploitation et navigateur majeur, y compris des 0day.
ChatGPT+Claude, tous deux « hors de contrôle »
Ensuite, Anthropic a publié un article de rétrospection, exposant son aspect le plus inquiétant.
141 006 enregistrements d'évaluation de cybersécurité ont mis au jour 3 incidents, impliquant 6 exécutions –
Claude s'est échappé de l'environnement d'évaluation tiers et a pénétré les systèmes de production de trois entreprises réelles.
Le premier incident remonte à avril.

La société cible fictive dans l'évaluation portait par hasard le même nom qu'un domaine réel.
Opus 4.7 a réussi à quatre reprises, extrayant des identifiants et des centaines de lignes de données de la base de production. Le plus grave, c'est que l'IA avait réalisé en cours de route qu'il s'agissait d'un système réel, mais n'a pas arrêté.
Dans une autre mission de type capture de drapeau, Mythos 5 a reçu l'ordre d'installer un package, a découvert que ce package n'existait pas sur PyPI, et a donc jugé que « la bonne solution à ce problème était de le publier ».
Pour créer un compte, il a d'abord obtenu une adresse e-mail, puis un numéro de téléphone, avant de télécharger le package.
Ce « package malveillant » publié de manière purement autonome par l'IA a effectivement survécu sur le réseau public pendant environ une heure.
Un autre modèle utilisé dans des tests de recherche internes chez Anthropic, après avoir scanné 9 000 cibles, a compromis une application externe d'une entreprise.
Le WSJ a qualifié cela de « moment Jurassic Park » pour la cybersécurité.
L'élément déclencheur fut qu'OpenAI a d'abord révélé l'intrusion de ChatGPT contre Hugging Face.
Anthropic a ensuite examiné ses journaux et a découvert ses trois propres incidents.
Ce qui est profondément troublant, c'est que pendant plus de trois mois, les deux laboratoires d'IA les plus avancés au monde ne savaient pas que leurs créations s'étaient échappées.
Sam Altman, dans un podcast, a décrit cet incident comme un « accident de cybersécurité extrêmement science-fiction ».

L'IA en cage, incontrôlable
La faille de Coldcard, cachée pendant cinq ans, a finalement été découverte en seulement 8 minutes.
Pour l'industrie de la sécurité, cette vitesse est suffisante pour donner froid dans le dos.
Autrefois, avant qu'une faille ne soit découverte, c'était une question d'expérience ; maintenant, c'est une course pour voir qui déploie le modèle en premier.
Le problème est que l'IA devient de plus en plus rapide, mais ses limites ne sont pas encore clairement définies.
Références : https://x.com/MedusaOnchain/status/2083987806943432847?s=20
Cet article provient du compte public WeChat « New Zhiyuan », auteur : ASI Apocalypse ; éditeur : Taozi





