Fable 5 écrit à la main son premier « super noyau » CUDA, une accélération de 18,7 fois en seulement 2,5 heures
Dans le benchmark KernelBench-Mega, l'IA Fable 5 a écrit manuellement un noyau CUDA "super kernel" fusionné en un seul lancement, atteignant une accélération de 18,7x sur RTX PRO 6000 pour une tâche de décodage Kimi-Linear W4A16. Elle devance largement Claude Opus 4.8 (14,4x) et GPT-5.5 (4,34x). Fable 5 a réalisé cela en regroupant toutes les opérations (déquantification int4, convolution, attention, etc.) en un seul noyau avec 14 barrières, éliminant les coûts de lancement multiples. Le processus a pris 2,5 heures et environ 550 000 tokens. Jack Clark, cofondateur d'Anthropic, y voit le début d'une boucle d'auto-amélioration récursive (RSI), où les IA optimisent leurs propres systèmes, accélérant potentiellement les progrès futurs de manière autonome.
marsbit07/07 07:40