# GPU Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "GPU", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

Sans Tencent, que reste-t-il à Enflame AI ?

La société chinoise de puces IA Tianshu Zhixin (燧原科技), surnommée l’un des « Quatre Dragons » du GPU domestique, a finalement obtenu l’approbation pour son introduction en bourse sur le marché STAR, après ses concurrents Moore Thread, Biren Technology et MetaX. Ce qui distingue particulièrement Tianshu Zhixin, c’est sa dépendance extrêmement élevée à l’égard de Tencent, son principal actionnaire et client. En 2025, 74,9 % de ses revenus, voire plus de 80 % selon une autre méthode de calcul, provenaient de Tencent. Cette concentration reflète une stratégie industrielle délibérée : plutôt que de se concentrer d’abord sur le récit et la valorisation, Tianshu Zhixin s’est ancrée dès le départ sur la livraison à un grand client. Ses revenus ont connu une croissance exponentielle, passant de 3 milliards de yuans en 2023 à 9,9 milliards en 2025, avec une projection de plus de 10,6 milliards pour le seul premier semestre 2026. Cette relation symbiotique dépasse la simple transaction. Face à une demande de calcul explosée pour ses modèles d’IA (comme Hunyuan) et à la nécessité d’une chaîne d’approvisionnement sécurisée, Tencent utilise des commandes massives et stables pour permettre à Tianshu Zhixin d’atteindre une échelle de production, d’itérer ses processus et de rattraper son retard technologique. En retour, Tianshu Zhixin devient la base de calcul de l’écosystème Tencent, une substitution qui serait aujourd’hui coûteuse et complexe en raison de l’intégration logicielle et matérielle. Le secteur des puces IA chinoises évolue vers une stratification : NVIDIA en tant que norme mondiale, Huawei Ascend en tant qu’acteur étatique, et les sociétés commerciales comme Tianshu Zhixin qui survivent par les commandes du marché. Tianshu Zhixin semble se positionner comme le fournisseur attitré de Tencent, à l’instar des puces maison des géants du cloud mondiaux. Son introduction en bourse, soutenue par des capitaux publics et industriels, marque un tournant pour l’industrie : la phase du financement par promesses cède la place à une ère impitoyable axée sur les commandes, la capacité de livraison et la profondeur de l’intégration dans la chaîne d’approvisionnement des super-clients. L’histoire montre que la course technologique ne se gagne pas seulement en concevant une puce performante, mais en trouvant un client prêt à l’acheter continuellement. C’est peut-être là le seul long-termisme qui compte.

marsbit06/15 23:21

Sans Tencent, que reste-t-il à Enflame AI ?

marsbit06/15 23:21

Anthropic met en garde contre l’IA récursive, la nouvelle société de Tian Yuan Dong vient de franchir la « première étape »

Il y a quelques jours, Anthropic a publié un article intitulé "When AI Builds Itself", déclenchant des discussions sur l'« amélioration récursive de soi » – des systèmes d'IA conçus pour développer de manière autonome leurs versions successives. Simultanément, Recursive Superintelligence, une startup cofondée par Tianyuandong (ex-Meta FAIR), a émergé de son mode furtif et a présenté ses premiers résultats techniques : un système d'automatisation de la recherche en IA. Intitulé "First Steps Toward Automated AI Research", ce système vise à automatiser la boucle classique de la recherche (idée, code, expérience, analyse). Il a été évalué sur trois références, établissant de nouveaux records. Sur NanoChat Autoresearch, il a amélioré la perte de validation d'un petit modèle de langage. Sur NanoGPT Speedrun, il a réduit le temps d'entraînement nécessaire pour atteindre une perte cible (de 79,7 à 77,5 secondes). Enfin, sur SOL-ExecBench (optimisation de noyaux GPU), il a augmenté le score global de 0,699 à 0,754, se rapprochant de la limite théorique du matériel. Fondée fin 2025/début 2026, Recursive a levé 650 millions de dollars avec une valorisation de 4,65 milliards. Son objectif est d'accélérer les progrès de l'IA en permettant à l'IA d'améliorer récursivement ses propres capacités de recherche. Cette avancée illustre l'émergence d'un nouveau paradigme de recherche, tandis qu'Anthropic met en garde contre les risques potentiels de cette trajectoire et appelle à une coordination mondiale. Recursive reconnaît qu'il ne s'agit que d'un premier pas, les défis comme la prévention de la triche aux indicateurs restant majeurs pour une application à des problèmes scientifiques ouverts.

marsbit06/12 04:17

Anthropic met en garde contre l’IA récursive, la nouvelle société de Tian Yuan Dong vient de franchir la « première étape »

marsbit06/12 04:17

Lorsque l'inférence devient une ressource rare, qui en capture la valeur ?

L'article souligne le basculement de l'économie de l'IA, où la ressource critique n'est plus l'entraînement des modèles mais l'inférence (exécution). Cette dernière, consommatrice de calcul de façon récurrente et croissante avec l'essor des agents IA, devient le principal goulot d'étranglement et le moteur de valeur. Plusieurs signaux forts l'attestent : la réorganisation des résultats financiers de Nvidia autour des « tokens de service », l'introduction en bourse très attendue de Cerebras (spécialisé dans les puces d'inférence rapide), et les difficultés de capacité rencontrées par Anthropic pour son modèle Claude. Face à cette rareté, la question centrale est de savoir qui capturera la valeur dans la pile technologique. L'article analyse deux approches : Venice, une application qui vend de l'inférence avec une garantie de confidentialité mais reste dépendante du coût de la puissance de calcul sous-jacente ; et surtout Hyperbolic. Cette entreprise adopte une stratégie différente : sans posséder de GPU, elle agit comme une couche d'agrégation et de routage intelligent, connectant les offres fragmentées de nombreux fournisseurs de cloud pour offrir aux développeurs la puissance disponible au meilleur prix. En situation de surcapacité potentielle des GPU, ce modèle « sans actifs » qui optimise l'allocation de la ressource rare (l'inférence) pourrait s'avérer plus résilient et profitable que celui des simples détenteurs de matériel. L'enjeu n'est plus de posséder le plus de silicium, mais d'en être le meilleur orchestrateur.

链捕手06/08 15:47

Lorsque l'inférence devient une ressource rare, qui en capture la valeur ?

链捕手06/08 15:47

Le CPU, retour discret au centre de la scène du calcul IA

Ces trois dernières années, l'histoire du calcul IA a été presque entièrement centrée sur les GPU, les CPU étant relégués au rôle de soutien. Cependant, à partir de 2026, ce récit évolue. Alors que l'IA passe de l'entraînement massif de modèles au déploiement à grande échelle d'agents et d'inférences, la coordination, la concurrence et la circulation des données deviennent des goulots d'étranglement critiques. Ces tâches d'orchestration, où les GPU sont moins performants, remettent le CPU au centre en tant que « plan de contrôle » de l'infrastructure IA. Intel illustre cette tendance avec son processeur Xeon 6+, lancé en juin 2026. Fabriqué en procédé 18A, il mise sur une densité extrême avec jusqu'à 288 cœurs éco-efficaces (E-cores), optimisés pour le traitement simultané de milliers de tâches légères typiques des charges de travail des agents IA et de l'inférence. Cette approche « haute densité, haut débit » contraste avec la quête traditionnelle de performances mono-cœur. Cependant, la trajectoire d'Intel n'est pas assurée. Le récit du « retour du CPU » est confronté à plusieurs défis : les solutions intégrées CPU-GPU de NVIDIA, la montée des CPU ARM à haute densité développés en interne par les grands clouds (AWS Graviton, Google Axion, etc.), et la nécessité pour le procédé 18A de rivaliser avec les technologies N2 de TSMC et 2 nm de Samsung. En résumé, le CPU retrouve une place essentielle dans l'écosystème du calcul IA, non pas en rivalisant avec le GPU sur le pic de performance, mais en adressant les nouveaux besoins systémiques d'orchestration. La bataille pour savoir quelle architecture (x86 d'Intel/AMD, ARM des clouds ou solutions intégrées de NVIDIA) dominera cette nouvelle ère reste toutefois ouverte.

marsbit06/03 10:46

Le CPU, retour discret au centre de la scène du calcul IA

marsbit06/03 10:46

Prévision du cours d'AMD pour 2026-2030 : Wall Street signale un objectif majeur de 657 dollars !

Le titre de l'article évoque une prévision du cours de l'action AMD, avec un objectif significatif de 657 dollars signalé par Wall Street pour la période 2026-2030. Le texte explique que l'action AMD a connu une hausse spectaculaire de plus de 130% depuis début 2026, se négociant autour de 510 dollars. Cette performance est portée par une transformation structurelle de l'entreprise, où le segment Data Center est désormais au cœur des activités. Au premier trimestre 2026, les revenus du Data Center ont atteint 5,8 milliards de dollars, représentant pour la première fois plus de la moitié du chiffre d'affaires total de 10,3 milliards de dollars. La PDG, le Dr Lisa Su, a révisé à la hausse ses prévisions pour le marché total adressable (TAM) des CPU serveurs, l'estimant désormais à plus de 120 milliards de dollars d'ici 2030. Concernant les prévisions de cours, le consensus des analystes pour les 12 prochains mois est un objectif moyen de 472,17 dollars, avec une notation "Achat Fort". L'objectif le plus élevé sur Wall Street est de 665 dollars (Barclays). Des modèles à plus long terme prévoient un cours moyen d'environ 657 dollars d'ici 2030, avec une fourchette potentielle de 493 à 822 dollars, en s'appuyant sur la croissance du marché des serveurs et l'exécution de la feuille de route IA d'AMD, notamment les GPU Instinct MI450. Les arguments en faveur d'AMD incluent la dynamique solide du Data Center, les partenariats avec OpenAI et Meta, et une trésorerie importante. Les principaux risques identifiés sont une valorisation élevée (PER > 169) et la future concurrence de Nvidia sur le marché des CPU serveurs. En résumé, AMD a opéré une transition réussie vers le marché du Data Center et de l'IA, justifiant des prévisions de cours optimistes à long terme, mais l'investissement comporte des risques significatifs liés à la valorisation et à la concurrence.

marsbit06/02 13:17

Prévision du cours d'AMD pour 2026-2030 : Wall Street signale un objectif majeur de 657 dollars !

marsbit06/02 13:17

Que raconte le nouvel acte de la "usine à Agents" de Jensen Huang ?

Lors du COMPUTEX 2026, Jensen Huang, fondateur et PDG de NVIDIA, a présenté une nouvelle vision stratégique centrée sur l'ère des agents d'IA. Contrairement aux annonces précédentes axées sur les puces et les systèmes de calcul, cette présentation a mis l'accent sur l'infrastructure complète nécessaire pour exécuter et gérer des agents IA à grande échelle. Le point central est la plateforme Vera Rubin, désormais en production, conçue spécifiquement pour les charges de travail des agents. Elle promet une efficacité de traitement dix fois supérieure à celle de la génération précédente pour les tâches d'agents autonomes. Le processeur Vera, successeur de Grace, est présenté comme le premier CPU conçu pour l'IA et les agents. NVIDIA a également introduit DSX, une suite d'outils pour la conception, la simulation et l'exploitation d'"usines d'IA", ainsi qu'une station de travail DGX Station for Windows pour déployer des agents localement dans un environnement sécurisé. Du côté des logiciels, NVIDIA a annoncé le modèle Nemotron 3 Ultra (550 milliards de paramètres) pour les agents d'entreprise et Cosmos 3, un modèle de fondation pour la compréhension du monde physique. Le partenariat avec Unitree a donné naissance à H2 Plus, un robot humanoïde de référence basé sur la plateforme Isaac GR00T, visant à accélérer le développement de l'IA physique. Les annonces couvrent également la sécurité des données avec BlueField-4 STX, une collaboration mutuelle avec TSMC, et le SoC RTX Spark pour les PC AI. En résumé, NVIDIA construit un écosystème complet, des puces et du matériel aux modèles et outils de déploiement, pour positionner chaque couche de la pile technologique des agents IA comme un marché adressable par l'entreprise.

marsbit06/01 12:09

Que raconte le nouvel acte de la "usine à Agents" de Jensen Huang ?

marsbit06/01 12:09

AI PC arrive, défie localement un grand modèle de 120B ! Nvidia redéfinit le socle de l’« ordinateur personnel IA » avec le RTX Spark

Ces deux dernières années, les fabricants de PC ont largement mis en avant la puissance des NPU (processeurs neuronaux) pour les "AI PC", mais leurs performances restaient modestes (environ 45 à 50 TOPS). Lors du GTC 2026, NVIDIA a présenté la puce RTX Spark, qui repousse radicalement cette limite avec une puissance annoncée de 1 pétaflop (1000 TOPS) pour l'IA. Cette SoC intègre un GPU Blackwell et un CPU Arm Grace conçu avec MediaTek, et surtout, elle adopte une architecture de mémoire unifiée allant jusqu'à 128 GB, partagée entre le CPU et le GPU. L'objectif principal est de permettre l'exécution locale de grands modèles de langage (LLM) de 120 milliards de paramètres, avec des fenêtres de contexte pouvant atteindre un million de tokens, ce qui redéfinit les capacités de l'IA de bord. NVIDIA a également annoncé des collaborations majeures avec Microsoft pour renforcer la sécurité Windows et intégrer le bac à sable OpenShell, ainsi qu'avec Adobe qui adapte en profondeur des logiciels comme Photoshop pour tirer parti de cette nouvelle architecture. Plusieurs grands fabricants d'ordinateurs (ASUS, Dell, HP, Lenovo, Microsoft Surface, MSI) prévoient de commercialiser des PC portables fins et des mini-desktops équipés du RTX Spark dès l'automne. Cette initiative marque un changement potentiel dans l'industrie du PC, faisant passer l'accent du processeur x86 traditionnel à une plateforme SoC centrée sur le GPU. Cependant, des questions pratiques concernant la dissipation thermique, l'autonomie, les performances réelles et la stratégie de tarification des OEM restent en suspens et détermineront le succès final de cette nouvelle norme matérielle.

marsbit06/01 06:45

AI PC arrive, défie localement un grand modèle de 120B ! Nvidia redéfinit le socle de l’« ordinateur personnel IA » avec le RTX Spark

marsbit06/01 06:45

活动图片