Google commence à vendre ses TPU, les géants cherchent à produire des "jetons à bas prix" avec des puces IA
Google commence désormais à vendre directement ses puces TPU (Tensor Processing Unit) et ses solutions matérielles de calcul IA aux centres de données tiers et aux clients. Ces puces, conçues spécifiquement pour les opérations mathématiques de tenseurs et de matrices, sont au cœur du fonctionnement des grands modèles d'IA. Auparavant, les TPU n'étaient accessibles que via la location dans les centres de données cloud de Google.
Cette stratégie permet à Google de proposer une alternative à l'écosystème NVIDIA (GPU, CUDA), non pas en se positionnant sur la puissance brute, mais sur l'efficacité et la réduction des coûts, notamment pour l'inférence des modèles. L'objectif est de produire des "tokens" à moindre coût, un facteur clé pour démocratiser l'utilisation de l'IA à grande échelle.
Google, à l'instar des grands fournisseurs de cloud comme Huawei Cloud et Alibaba Cloud, ne vend pas seulement du matériel. Il propose un écosystème complet intégrant puces, clusters, logiciels et services, transformant la puissance de calcul en une "productivité" directement utilisable. Cela reflète une évolution du marché : la compétition ne porte plus seulement sur la puissance des puces, mais sur la capacité à offrir une "meilleure puissance de calcul" – c'est-à-dire la solution la plus efficace et la plus économique pour des besoins variés.
Ainsi, le marché de l'infrastructure IA évolue d'une "guerre des puces" vers une "guerre des systèmes". Si NVIDIA conserve sa position dominante pour l'entraînement des modèles et son écosystème mature, la montée en puissance de ces alternatives centrées sur le coût et l'efficacité opérationnelle redessine le paysage concurrentiel.
marsbit06/24 10:25