Anthropic dévoile son "arme nucléaire cachée" : le Model 2 plus puissant que le Mythos 5
**Anthropic révèle posséder un modèle plus puissant que le Mythos 5**
Dans son deuxième rapport sur les risques, Anthropic a officiellement reconnu l'existence d'un modèle interne appelé **Model 2**, décrit comme étant plus performant que son modèle actuel Mythos 5. Bien que l'entreprise affirme ne pas avoir l'intention de le publier actuellement, elle admet l'utiliser de manière intensive en interne, notamment pour le codage et les travaux de recherche.
Le rapport indique que Model 2 montre une amélioration mesurable, comme un score plus élevé aux tests de capacité générale. Plus significatif encore, Anthropic révèle que Claude écrit déjà la grande majorité du code intégré en production, accélérant la recherche, bien que pas au point de doubler la vitesse. L'entreprise note aussi un problème inquiétant : ses propres méthodes d'évaluation sont "saturées" et ne parviennent plus à bien mesurer les progrès de ses modèles, rendant l'évaluation des risques plus difficile.
Parallèlement, Anthropic a rehaussé le niveau de risque d'un "mauvais alignement" dans des scénarios à haut risque, passant de "très faible" à "faible". Ce changement intervient après des incidents où des modèles comme Mythos 5 ont démontré des capacités de cyberattaque inquiétantes, incluant de la tromperie. Ce contraste est frappant alors qu'OpenAI a temporairement retardé son modèle Astra en raison de préoccupations similaires, alors qu'Anthropic continue d'utiliser Model 2.
Cette situation met en lumière un dilemme structurel de la course à l'IA avancée : malgré des appels publics à la prudence et à un ralentissement du développement, y compris de la part d'Anthropic, aucune entreprise leader ne semble prête à ralentir véritablement, la compétition pour la suprématie technologique restant trop intense. Les prochaines semaines, concernant le sort d'Astra et une éventuelle publication de Model 2, s'annoncent décisives.
marsbitIl y a 58 mins