Le fossé de CUDA, 20 ans d'avance, effacé en un week-end, Claude fait tourner le nouveau GPU d'AMD en solo
En un week-end, Claude a réussi à faire fonctionner un modèle de pointe sur une nouvelle machine AMD MI355X, sans intervention manuelle du code. Cet exploit suggère que le fossé établi par CUDA de NVIDIA sur 20 ans pourrait être comblé.
AMD a fourni à Anthropic un serveur équipé du GPU MI355X. Plutôt que de lancer un long processus d'adaptation, les ingénieurs ont confié la tâche à l'agent IA Claude. À leur retour après le week-end, le système était opérationnel et optimisait ses performances de manière autonome. La PDG d'AMD, Lisa Su, a été surprise d'apprendre qu'une seule personne suffisait.
Cet événement a conduit à un partenariat concret : Anthropic déploiera jusqu'à 2 GW de GPU AMD Instinct dans son système Helios d'ici 2027. La clé de cette percée est ROCm.AI, une suite d'outils qu'AMD a conçue pour les agents IA comme Claude. Elle inclut AMD Skills, une base de connaissances sur ROCm, et permet aux agents d'installer des environnements, déployer des modèles et diagnostiquer des pannes. AMD modifie même la documentation de ses puces pour la rendre lisible par l'IA, via un format ISA spécifique.
L'outil Hyperloom illustre cette approche : il analyse les performances, identifie les goulets d'étranglement, teste des configurations et génère des noyaux personnalisés, améliorant par exemple la vitesse d'inférence d'un modèle de 38%. L'objectif est de former les modèles d'IA frontaliers à « programmer nativement pour AMD ».
L'écosystème CUDA, bâti sur des décennies d'expertise humaine accumulée, était jusqu'ici un avantage décisif. Désormais, les agents IA peuvent lire la documentation, utiliser les outils d'analyse et optimiser le code en parallèle et à grande échelle, compressant en tâches ce qui prenait des années. La course à l'écosystème entre dans une nouvelle ère où les agents IA deviennent les développeurs clés.
marsbitIl y a 24 mins