AMD achète Taalas : l'IA matérielle se passe de la mémoire HBM en pénurie

cryptonews.ruОпубликовано 2026-08-09Обновлено 2026-08-09

Введение

AMD acquiert Taalas : une solution matérielle pour l'IA qui se passe de mémoire HBM rare AMD a accepté d'acheter la startup torontoise Taalas, dont la technologie résout un problème majeur de l'inférence des réseaux neuronaux : la nécessité de transférer constamment les poids du modèle de la mémoire vers le processeur pour générer chaque token. Les puces de Taalas éliminent cette opération en intégrant physiquement les poids du modèle dans les transistors. Ce transfert de données limite actuellement la vitesse d'inférence et a fait de la mémoire à haut débit (HBM) un produit très rare dans l'industrie des semi-conducteurs. Fondée en 2023, Taalas a développé des circuits intégrés spécifiques à un modèle (model-specific integrated circuits). Son premier prototype, fabriqué en 6 nm par TSMC, exécute le modèle Llama 3.1 8B de Meta à une vitesse de 16 960 tokens par seconde, revendiquée comme étant bien supérieure aux solutions concurrentes. L'architecture comporte une zone où les poids sont figés dans une mémoire ROM masquée et une SRAM classique pour les caches. Cependant, cette approche présente un compromis majeur : chaque puce est dédiée à un seul modèle de manière permanente. Le changer nécessite une reconfiguration partielle de la puce, un processus prenant environ deux mois. Cette inflexibilité explique pourquoi cet achat ne bouleverse pas la rivalité entre AMD et Nvidia sur le front de l'inférence, ce dernier ayant acquis Groq pour intégrer une accélération spécialisée...

AMD a accepté d'acquérir la startup torontoise Taalas, qui résout le principal problème de l'inférence des réseaux neuronaux : la nécessité de transférer constamment les poids du modèle de la mémoire vers le processeur pour générer chaque jeton. Les puces Taalas se passent de cette opération : les poids du modèle sont littéralement soudés dans les transistors. C'est précisément ce transfert de données qui limite la vitesse de l'inférence moderne et a transformé la mémoire à haut débit (HBM) en produit le plus rare de l'industrie des semi-conducteurs.

La transaction sera perçue comme une nouvelle manche dans la rivalité entre AMD et Nvidia dans le domaine de l'inférence, mais elle ne change pas grand-chose sur ce front. Ce qui est bien plus intéressant, c'est ce que cet achat révèle de l'état du marché de la mémoire — l'affaire la plus surchauffée des semi-conducteurs actuellement.

Ce qu'a créé Taalas

Taalas a été fondée en 2023 par Ljubisa Bajic, créateur précédemment de la société de puces Tenstorrent, et son épouse Lejla Bajic, vétérane des équipes d'ingénierie d'ATI et d'AMD, qui a pris le poste de directrice des opérations. La société a levé 219 millions de dollars auprès de Fidelity, Quiet Capital et de l'investisseur en semi-conducteurs Pierre Lamond — fonds qui ont servi au développement de ce qu'on appelle des circuits intégrés dédiés à un modèle spécifique.

La première puce de test, fabriquée selon le procédé technologique 6 nm de TSMC, servait le modèle Llama 3.1 8B de Meta à une vitesse de 16 960 jetons par seconde. Selon l'entreprise, c'est 48 fois plus rapide que les cartes graphiques Nvidia et 8,5 fois plus rapide que les accélérateurs Cerebras au moment de la comparaison. La puce de deuxième génération, conçue pour des modèles à 20 milliards de paramètres, devrait sortir cette année.

L'architecture se divise en deux zones : une région où les poids du modèle sont câblés sous forme de mémoire ROM masquée, et une SRAM classique pour les caches et les adaptateurs de réglage fin, qui peuvent encore changer. « C'est en partie ce câblage rigide qui nous donne la vitesse », expliquait Bajic au média The Next Platform en février.

AMD prévoit d'intégrer les puces Taalas dans ses baies Helios selon un schéma partagé : les accélérateurs Instinct traiteront l'invite (prompt), tandis que le silicium Taalas générera les jetons, le tout sous la gestion de la pile logicielle ROCm. L'entreprise a souligné qu'il s'agissait bien d'une absorption, et non d'un recrutement d'équipe — la finalisation de l'opération est attendue au quatrième trimestre. Le vice-président principal d'AMD pour l'IA, Vamsi Boppana, a qualifié cet achat d'extension de plateforme.

Le compromis que fait Taalas

Le soudage des poids dans le silicium a un coût évident : chaque puce sert exactement un modèle — pour toujours. Changer de modèle nécessite un recalcul partiel de la topologie, et même avec le cycle raccourci de Taalas, où seules deux couches métalliques sont modifiées sur une plaque quasi finie, cela prend environ deux mois sur les capacités de TSMC. Les modèles phares sont mis à jour plus rapidement. Le pari n'est rentable que là où un modèle est stable, largement utilisé et suffisamment précieux pour être figé.

Ce même compromis explique pourquoi la transaction ne modifie pas la donne sur le marché de l'inférence. Nvidia a payé 20 milliards de dollars pour Groq en décembre — la plus grande acquisition de son histoire — pour intégrer un matériel spécialisé dans la génération de jetons précisément dans la plateforme autour de laquelle toute l'industrie s'est déjà construite. La bataille pour l'inférence se joue au niveau des écosystèmes et des logiciels installés, et une puce liée à un seul modèle ne participe ni à l'un ni à l'autre. Ce que l'approche de Taalas prouve réellement est une thèse plus étroite, mais plus intéressante : la limitation de mémoire, dont souffre l'inférence, est une solution d'ingénierie, et non une donnée physique, et on peut la contourner.

La question de la mémoire

Le marché intègre actuellement dans les prix l'hypothèse que cette pénurie de mémoire est permanente. Les prix de la DRAM classique ont augmenté de près de 90 % au premier trimestre. La mémoire à haut débit (HBM) est pratiquement vendue pour toute l'année 2026, et le volume du marché HBM cette année est estimé à 54,6 milliards de dollars. SK hynix, qui contrôle plus de la moitié des approvisionnements en HBM, a dépassé une capitalisation de 1 000 milliards de dollars et a annoncé la construction de nouvelles usines pour 38,1 milliards de dollars. Pour l'investisseur ordinaire, tout le pari sur la mémoire repose sur une seule hypothèse : la demande en IA maintiendra la mémoire en pénurie pendant encore des années.

Cette hypothèse est déjà attaquée de plusieurs côtés à la fois. Taalas supprime complètement la mémoire pour les poids du processus de service des modèles, et les ingénieurs de Nvidia compressent et quantifient les modèles précisément pour réduire le volume de mémoire touché par un modèle déployé.

Les fabricants de mémoire eux-mêmes travaillent dans la même direction. La technologie zHBM de Samsung, présentée à la conférence FMS la semaine dernière, empile la mémoire directement sur l'accélérateur, multipliant le débit effectif. SK hynix et Sandisk viennent de publier le premier standard de mémoire flash haute vitesse, visant à remplacer par du NAND bon marché le travail effectué aujourd'hui par la HBM. Pratiquement chaque grand acteur du secteur finance sa propre méthode pour réduire le besoin de cette ressource même que le marché considère comme définitivement rare.

AMD a acheté la preuve que l'inférence peut fonctionner sans faire appel au composant dont la pénurie définit tout le cycle de demande actuel en IA — et vendra cette preuve à l'intérieur de baies où les GPU et la HBM restent toujours présents. Les investisseurs qui considèrent les prix actuels de la mémoire comme une caractéristique permanente de tout le cycle de construction de l'infrastructure IA parient contre un mouvement d'ingénierie massif et croissant, visant le résultat inverse.

La mémoire a toujours été un secteur cyclique. Ceux qui paient pour elle aux prix d'aujourd'hui viennent juste de financer une raison de plus pour que cela reste le cas.

L'avis de l'IA

Du point de vue de l'analyse automatique des données, le précédent clé pour les puces Taalas ne se trouve pas dans le monde de l'IA, mais dans l'industrie de la crypto. Les circuits intégrés spécialisés pour le minage de bitcoin résolvent un problème similaire — câbler l'algorithme dans le silicium pour la vitesse — et obtiennent le même effet secondaire : une inflexibilité totale. Hash Telegraph a déjà décrit comment la spécialisation matérielle, poussée à l'extrême, engendre un risque d'obsolescence morale lors d'un changement d'algorithme de base ou de l'apparition d'un nouveau paradigme informatique.

Les aspects techniques que l'article ne détaille pas concernent l'économie de l'immobilisation : pendant qu'une puce Taalas sert un modèle, les laboratoires concurrents sortent de nouvelles versions tous les quelques mois, et le cycle de reprogrammation de la topologie prend environ deux mois sur les capacités de TSMC. L'histoire des ASIC montre que la spécialisation n'est rentable que sur un algorithme stable — la question est de savoir si l'architecture des grands modèles linguistiques sera suffisamment stable pour ce pari.

Трендовые криптовалюты

Связанные с этим вопросы

QQuelle est l'innovation principale de la startup Taalas, acquise par AMD, concernant les puces pour l'inférence IA ?

ATaalas a développé des puces spécialisées où les poids des modèles d'IA sont physiquement gravés dans les transistors sous forme de mémoire ROM masquée. Cela élimine le besoin de transférer constamment ces poids depuis une mémoire externe (comme la HBM) vers le processeur pour générer chaque jeton, augmentant ainsi considérablement la vitesse d'inférence.

QQuel compromis majeur implique la technologie des puces Taalas, et quelles en sont les conséquences ?

ALe compromis majeur est la perte totale de flexibilité : chaque puce est conçue pour exécuter un modèle spécifique de manière permanente. Changer de modèle nécessite une recalcul partiel de la topologie et une nouvelle fabrication, un processus qui prend environ deux mois. Cette approche n'est économiquement viable que pour des modèles stables, largement utilisés et à haute valeur.

QPourquoi l'acquisition de Taalas par AMD est-elle significative par rapport au marché de la mémoire (HBM/DRAM) dans l'industrie des semi-conducteurs ?

ACette acquisition est significative car elle démontre qu'il est possible de contourner la pénurie de mémoire à large bande passante (HBM), un goulet d'étranglement majeur et une ressource très chère pour l'inférence IA. Elle remet en question l'hypothèse du marché selon laquelle cette pénurie est une constante durable, en proposant une solution matérielle qui supprime le besoin de mémoire HBM pour les poids des modèles.

QComment AMD prévoit-elle d'intégrer la technologie Taalas dans ses offres existantes ?

AAMD prévoit d'intégrer les puces Taalas dans ses serveurs Helios selon une architecture divisée : ses accélérateurs Instinct (GPU) traiteront l'invite (prompt), tandis que les puces Taalas se chargeront de la génération des jetons (tokens). L'ensemble sera géré par la pile logicielle ROCm d'AMD.

QQuelle comparaison l'article établit-il entre les puces Taalas pour l'IA et une autre technologie dans le domaine des cryptomonnaies, et quel est l'argument sous-jacent ?

AL'article compare les puces Taalas aux circuits intégrés spécifiques à une application (ASIC) utilisés pour le minage de Bitcoin. Les deux technologies sacrifient la flexibilité en gravant un algorithme spécifique dans le silicium pour obtenir des performances maximales. L'argument sous-jacent est que cette spécialisation extrême comporte un risque important d'obsolescence en cas de changement d'algorithme ou de paradigme de calcul, ce qui interroge la pérennité de l'approche si les architectures des grands modèles linguistiques évoluent rapidement.

Похожее

Тест спроса: биткоин-киты заработали рекордные $1,2 млрд, а владельцы Ethereum вернулись к прибыльности

За три дня после восстановления стоимости биткоина новые крупные держатели (киты) зафиксировали рекордную прибыль более чем в $1,2 млрд, что стало крупнейшим событием такого рода в истории наблюдений. Пик пришелся на 20 августа — $614 млн. Фиксация прибыли началась после того, как биткоин поднялся выше реализованной цены краткосрочных китов (около $68 900). По мнению аналитиков CryptoQuant, это важный тест для спроса: если актив удержится выше себестоимости китов, а объемы продаж нормализуются, это покажет способность нового спроса поглощать предложение. Что касается Ethereum, то крупные держатели этого актива также вернулись в зону нереализованной прибыли, однако ее уровень пока невысок и, по мнению аналитика Darkfost, не создает существенного давления на курс. С июня Ethereum вырос более чем на 65%, что улучшило настроения инвесторов после периода значительных убытков.

cryptonews.ru7 мин. назад

Тест спроса: биткоин-киты заработали рекордные $1,2 млрд, а владельцы Ethereum вернулись к прибыльности

cryptonews.ru7 мин. назад

Команда Kinetiq анонсировала L2-сеть Elysium для Hyperliquid

24 августа протокол ликвидного стейкинга Kinetiq анонсировал запуск L2-сети Elysium для экосистемы Hyperliquid. Новая сеть призвана устранить ограничения HyperEVM, такие как низкая пропускная способность и высокие комиссии, значительно увеличив скорость обработки транзакций. Elysium упростит запуск спотовых рынков, токенов и DeFi-приложений, предоставив разработчикам более глубокий доступ к данным ордербука HyperCore. Для оплаты газа в сети будет использоваться токен $HYPE. Elysium также предложит упрощенный процесс листинга новых активов, объединяя этапы предоставления ликвидности через AMM, выхода на спотовый рынок и запуска фьючерсов. Модель распределения доходов сети предусматривает направление 50% комиссий секвенсора на выкуп и сжигание токена $KNTQ, 25% — разработчикам приложений и 25% — в казначейство Kinetiq. Точная дата запуска Elysium пока не названа, он запланирован на «ближайшее время».

cryptonews.ru8 мин. назад

Команда Kinetiq анонсировала L2-сеть Elysium для Hyperliquid

cryptonews.ru8 мин. назад

Hyperliquid Policy Center призвала регуляторов в США создать фреймворк для бессрочных фьючерсов

Некоммерческая организация Hyperliquid Policy Center призвала регулирующие органы США (SEC и CFTC) создать четкие правила для бессрочных фьючерсов. Центр предлагает классифицировать такие контракты, особенно на акции, как стандартные фьючерсы под совместным надзором, а не как свопы на ценные бумаги (SBS). В качестве аргументов называются стандартизация, публичность цен и возможность офсетного закрытия позиций без перехода права собственности на базовый актив. Hyperliquid Policy Center рекомендует SEC и CFTC выпустить совместное руководство, унифицировать подход к регулированию разных активов (криптовалют, товаров, акций) и модернизировать нормативную базу. Инициатива встречает сопротивление со стороны традиционных бирж, таких как CME Group и ICE, которые требуют более жесткого регулирования подобных площадок и уже подавали иск из-за классификации бессрочных фьючерсов.

cryptonews.ru10 мин. назад

Hyperliquid Policy Center призвала регуляторов в США создать фреймворк для бессрочных фьючерсов

cryptonews.ru10 мин. назад

Индия планирует выпустить первые токенизированные облигации с использованием оптовой CBDC — Reuters

Индия планирует в сентябре запустить пилотный проект по выпуску первых токенизированных корпорационных облигаций с расчетами в оптовой цифровой валюте центрального банка (CBDC) на блокчейне. Государственная энергетическая финансовая компания REC Limited выпустит такие облигации на сумму менее 5 млрд рупий (около $57 млн). На начальном этапе доступ к проекту будет предоставлен ограниченному кругу инвесторов, возможно, в рамках финансово-технологического мероприятия в Мумбаи. Для покупки облигаций инвесторы будут использовать цифровой рупий RBI. Участие потребует двух цифровых счетов: банковского кошелька для CBDC и нового электронного кошелька для ценных бумаг DEMAT 2.0, разрабатываемого местными депозитариями с использованием технологии распределенного реестра для учета прав собственности. Над инициативой совместно работают Резервный банк Индии (RBI) и Совет по ценным бумагам и биржам (SEBI). Облигации будут иметь первоначальный трехмесячный период блокировки, а к декабрю биржи планируют создать для них вторичный рынок.

cryptonews.ru10 мин. назад

Индия планирует выпустить первые токенизированные облигации с использованием оптовой CBDC — Reuters

cryptonews.ru10 мин. назад

Shipyard сворачивает работу над IPFS после прекращения финансирования Protocol Labs

Компания Shipyard, сопровождающая систему межпланетных файловых систем (IPFS), прекратит инженерную деятельность, техническое обслуживание и эксплуатацию инфраструктуры 30 сентября после того, как Protocol Labs отказалась продлевать финансирование. Потеря финансирования оставит без выделенных сопровождающих такие проекты, как Kubo, Helia, Boxo, Rainbow, IPFS Desktop и IPFS Companion. Коллектив прекратит эксплуатацию общедоступной инфраструктуры, включая ipfs.io и dweb.link. Будущее этих доменов и инфраструктуры, принадлежащих Protocol Labs, будет определено этой организацией. Сама IPFS не закрывается, но уход Shipyard лишает многие популярные реализации и сервисы выделенного управления, если их не возьмут под контроль другие сопровождающие. В Protocol Labs заявили, что развитие децентрализованной публичной инфраструктуры продолжится, а управление IPFS перейдет к «более легкому» формату через гранты фонда IPFS Foundation отдельным сопровождающим. Shipyard была создана в 2024 году как независимый коллектив давних разработчиков IPFS, ранее работавших в Protocol Labs.

cointelegraph28 мин. назад

Shipyard сворачивает работу над IPFS после прекращения финансирования Protocol Labs

cointelegraph28 мин. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

2.0k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片