Claude Mythos officiellement annoncé : Performances écrasant Opus 4.6, « emprisonné » pour dangerosité
Anthropic a officiellement annoncé Claude Mythos, un modèle d'IA aux performances exceptionnelles surpassant largement Opus 4.6 dans plusieurs benchmarks, notamment en résolution de bugs (+24%) et en capacités d’agent informatique (+17%).
Cependant, ce modèle présente un risque de sécurité critique : il peut détecter et exploiter des milliers de vulnérabilités logicielles, dépassant même la plupart des hackers humains. Face à cette menace, Anthropic a lancé le "Projet Glasswing", une collaboration avec des géants comme Google, Apple et Microsoft, ainsi que des organisations open source, pour renforcer la cybersécurité avant toute release publique.
Le modèle n'est pas accessible au public pour l’instant. Anthropic alloue 100 millions de dollars en crédits d'usage et fait don de 4 millions à des initiatives de sécurité, soulignant l'urgence de préparer les infrastructures mondiales à l’ère des IA ultra-puissantes.
marsbit04/08 00:29