Google начинает продавать TPU: крупные компании стремятся производить «дешёвые токены» с помощью AI-чипов

marsbitОпубликовано 2026-06-24Обновлено 2026-06-24

Введение

Google начала продавать свои собственные чипы TPU, предназначенные для обработки вычислений искусственного интеллекта. Раньше эти чипы были доступны только через облачные сервисы компании, но теперь их можно приобрести напрямую для собственных центров обработки данных. TPU оптимизированы для матричных операций, лежащих в основе современных больших языковых моделей, что позволяет повысить эффективность и снизить стоимость вычислений. Этот шаг Google представляет собой вызов доминированию Nvidia на рынке AI-чипов. Хотя Nvidia обладает сильной экосистемой (CUDA), Google предлагает готовые комплексные решения, ориентированные на эффективность и снижение стоимости обработки, особенно на этапе инференса (вывода моделей). Автор статьи сравнивает это с переходом от «премиального топлива» к более доступному, что критически важно для массового внедрения ИИ, где стоимость «токенов» становится ключевым фактором. Тенденция показывает, что вычисления ИИ становятся базовым ресурсом, подобным электричеству. В этой новой реальности побеждает не обязательно тот, у кого самые мощные чипы, а тот, кто может предложить наиболее оптимальную по цене и эффективности систему. Аналогичную стратегию развивают и крупные облачные провайдеры, такие как Huawei Cloud и Alibaba Cloud, создавая собственные полные экосистемы на базе своих чипов. Конкуренция на рынке ИИ-инфраструктуры смещается от «битвы чипов» к «битве систем».

Недавно Google объявил о начале прямых продаж сторонним центрам обработки данных и клиентам своих собственных чипов TPU, а также сопутствующего оборудования для AI-вычислений. Будучи «секретным оружием» Google в области AI, TPU раньше можно было арендовать только через облачные центры данных, и в индустрии долгое время считалось, что Google не будет продавать эти чипы, пока в июне этого года не пришла эта хорошая новость.

Тогда возникает вопрос: что такое «TPU»? Полное название — «Tensor Processing Unit (тензорный процессор)». В отличие от CPU и GPU, он представляет собой чип, специально разработанный для «матричных и тензорных математических операций» в AI-вычислениях, способный с чрезвычайно высокой эффективностью обрабатывать соответствующие вычисления.

Звучит как вспомогательный чип? Однако это не так, потому что современные технологии больших AI-моделей по своей сути представляют собой сложные математические операции над огромными объёмами данных (в основном, матричное умножение). Поэтому Google сделал следующее: объединил тысячи TPU в суперкомпьютерные кластеры, а затем, используя CPU-хосты для распределения задач (разделения задач, преобразования данных), создал центры AI-вычислений с чрезвычайно высокой эффективностью.

Источник: Google

Именно поэтому Gemini может с более низкой стоимостью подписки и более высокими лимитами использования агрессивно отвоёвывать пользовательскую базу у таких компаний, как OpenAI. Даже если рассматривать только цену токена, Gemini является одним из представителей зарубежных AI-продуктов с относительно низкой ценой на флагманские модели, при этом цена на основные модели близка к ценам китайских производителей, таких как DeepSeek.

Более того, TPU также лучше справляются с обработкой огромного количества вычислительных запросов от обычных пользователей, что можно считать «профильным» для будущей AI-экосистемы, поэтому сторонние компании давно присматривались к этим чипам. После анонса планов продаж Google также объявил о соглашении на 50 миллиардов долларов о совместном строительстве крупного центра обработки данных с известной частной инвестиционной компанией Blackstone, предварительная мощность которого составит 500 мегаватт.

LeiTech (ID: leitech) предполагает, что после этого сообщения к Google наверняка обратится множество компаний с запросами о ценах или сотрудничестве, особенно тех, кто хочет построить собственные центры обработки данных. В этот момент кто-то может подумать, что Amazon должно волноваться, ведь это явный перехват бизнеса облачных услуг. На самом деле, нет, сейчас больше всего головной боли, вероятно, достанется Nvidia.

Google нанёс Nvidia удар «под дых»?

Сначала LeiTech хочет задать вопрос: почему Nvidia стала одной из самых важных компаний в эпоху AI? Если ваш ответ — просто «GPU обладает высокой вычислительной мощностью», то вы правы лишь наполовину.

Настоящая сила Nvidia заключается в том, что она уже давно не просто продаёт GPU. CUDA, NVLink, DGX, сеть InfiniBand, библиотеки AI-программного обеспечения, экосистема разработчиков, партнёры по серверам, адаптация для облачных провайдеров — всё это вместе составляет «защитный ров» Nvidia.

Поэтому, когда вы покупаете вычислительную карту Nvidia и запускаете её, вы покупаете не просто карту, а целую, уже проверенную индустрией AI-экосистему. Для большинства компаний экосистема CUDA от Nvidia позволяет им не «изобретать велосипед», экономя много усилий и средств.

Вот почему многие AI-компании, зная, что GPU от Nvidia очень дорогие, всё равно вынуждены их использовать. Потому что в период взрывного роста AI «стоимость» можно игнорировать, единственным критерием является возможность опередить конкурента или быстрее догнать его. Но по мере того, как большие модели AI входят в фазу распространения, всем нужно уже не только «скорость»; перед лицом огромной пользовательской базы эффективность и соотношение цены и качества становятся новыми приоритетами.

Google, очевидно, также увидел это, поэтому они сделали ставку на TPU и упаковали его в комплексное решение. Чипы в этом решении предназначены не для того, чтобы превзойти Nvidia по производительности вычислений, а для того, чтобы упаковать многолетний опыт Google в области чипов, центров обработки данных, сетей, хранения, планирования и обучения моделей в облачные услуги, которые предприятия могут напрямую приобретать.

Это и есть то, что Google действительно «перенял» у Nvidia — он учится не продавать чипы, а продавать системы и экосистемы, превращая ряд аппаратных средств в «производительные силы», которые клиенты могут использовать. Это имеет немалую привлекательность для тех предприятий, которые хотят держать центр обработки данных в своих руках.

Тогда, Nvidia должно запаниковать? Не обязательно, но головная боль точно будет, ведь хотя флагманские вычислительные карты приносят прибыль, компании не могут вечно находиться в состоянии «покупать столько, сколько есть», а постепенно будут обращать внимание на другие, более экономичные чипы. В этот момент решение Google с TPU неизбежно окажет давление на эту часть рынка Nvidia.

Однако для всей AI-индустрии Nvidia по-прежнему остаётся наиболее признанным универсальным стандартом на рынке AI-вычислений, и положение экосистемы CUDA не так легко поколебать одним-двумя поколениями чипов. Особенно на этапе обучения больших моделей многие команды уже накопили огромный опыт работы с системой Nvidia, и резкий переход на другую платформу сопряжён с немалым риском.

Например, DeepSeek недавно анонсировал, что его новая модель может быть обучена на чипах Huawei Ascend, и это стало возможным только после глубокого сотрудничества Huawei и DeepSeek и нескольких итераций версий.

Источник: Ascend

Но с точки зрения Google, на самом деле не нужно заменять Nvidia во всех сценариях, достаточно привлечь часть корпоративных клиентов и доказать, что их эффективность выше, чем у других вычислительных экосистем, и тогда они уже смогут отрезать себе кусок пирога на рынке AI-инфраструктуры.

Особенно на этапе логического вывода (inference) серверы с TPU от Google явно имеют преимущество. Все знают, что токены, когда их начинают реально использовать, расходуются не медленнее, чем открытый шлюз для воды. Сначала Uber сжёг годовой бюджет за четыре месяца, таинственная компания потратила 500 миллионов долларов на токены за месяц, затем даже щедрая Microsoft ограничила права сотрудников, приказав им использовать свои собственные вычислительные мощности.

Можно сказать, что по мере того, как AI всё чаще используется в различных областях, наверняка будет появляться больше примеров, доказывающих, что стоимость токенов является ключевым фактором будущей конкуренции в AI. Потому что у кого стоимость токенов ниже, тот сможет внедрить AI в большее количество бизнес-направлений, чтобы захватывать пользователей и рынки.

Вычислительные мощности становятся базовым ресурсом, у облачных провайдеров появляются возможности

LeiTech считает, что аналогия одного пользователя в сети очень удачна: обучение модели похоже на покупку автомобиля, а услуги логического вывода — на ежедневно сжигаемый бензин. Даже богатые семьи не могут постоянно заправлять все машины 98-м бензином; вычислительные мощности, предоставляемые Google, похожи на 92-й: хотя мощности немного не хватает, машина всё равно едет, работа делается, и при этом дешевле.

Недавно LeiTech уже писал статью, в которой упоминалось, что сейчас в индустрии есть консенсус: AI-вычислительные мощности становятся всё больше похожи на базовые ресурсы, такие как электричество, вода, широкополосный интернет.

И для пользователей им не нужно знать, как производятся «вычислительные мощности», но они будут заботиться о цене на них, как о счетах за коммунальные услуги. Этот «пользователь» может быть как частным лицом, так и предприятием, городом или даже страной.

Поэтому на будущем AI-рынке Nvidia по-прежнему будет очень важна, потому что без высокопроизводительных чипов ни о чём не может быть и речи. Но когда потребность в вычислительных мощностях станет долгосрочным, стабильным и масштабируемым базовым ресурсом, право голоса, наоборот, постепенно перейдёт к провайдерам облачных услуг.

Вот почему облачные провайдеры, такие как Google, Microsoft, Amazon, Alibaba Cloud, Huawei Cloud, больше не удовлетворяются ролью просто «перепродавцов» GPU-вычислений от Nvidia, а все занимаются построением собственных вычислительных экосистем. Это, конечно, не означает, что они не будут продолжать закупать GPU Nvidia, потому что рынок нуждается, клиенты нуждаются, и это также может принести хороший доход.

Источник: LeiTech

Но в то же время их истинный фокус развития обязательно сместится на свои собственные экосистемы, и это то, чего Nvidia должна больше всего опасаться. Ведь нынешняя рыночная капитализация Nvidia во многом рассчитывается исходя из её положения как «базовой основы AI». Как только Nvidia потеряет контроль над рынком не топовых вычислительных карт, она может постепенно вернуться к положению пятилетней давности на рынке игровых видеокарт: хотя и лидер, но не незаменимая.

На самом деле, если мы вернём взгляд на Китай, подобные изменения уже появились. Раньше, когда мы говорили о китайских AI-вычислительных картах, фокус часто был на сравнении производительности вычислений, обсуждении, насколько производительность одной карты отстаёт от топовых вычислительных карт.

Этот вопрос, безусловно, важен, но если смотреть только на производительность самого чипа, упускается другой ключевой момент: китайские облачные провайдеры также превращают чипы, кластеры, облачные платформы, сервисы моделей и отраслевые решения в целостную AI-производственную систему, и это является самой основной конкурентоспособностью китайского AI.

Это говорит не LeiTech, а сами ключевые облачные провайдеры, такие как Huawei Cloud, Alibaba Cloud. Например, облачные услуги Huawei Ascend. Хотя чипы Ascend по-прежнему часто оказываются в центре внимания, сегодня Huawei уже предоставляет вокруг вычислений Ascend облачные инструментальные цепочки, суперузловые кластеры, миграцию моделей, оптимизацию обучения и логического вывода, а также возможности внедрения в отрасли.

Источник: Weibo

Более того, Huawei также продвигает эту вычислительную экосистему для большего числа китайских AI-компаний. Помимо упомянутого ранее DeepSeek, есть также ведущие производители больших AI-моделей, такие как Baidu, iFlytek, Zhipu, MiniMax. Можно сказать, что Huawei постепенно построила свою собственную вычислительную экосистему, и теперь ей остаётся привлечь больше партнёров на борт, а затем с более низкой ценой токенов завоёвывать рынок.

Alibaba Cloud делает то же самое. В мае этого года они выпустили AI-чип для обучения и вывода Zhenwu M890, а до этого Zhenwu 810E уже давно массово развёрнут на интеллектуальной вычислительной платформе Lingjun от Alibaba Cloud. На саммите Alibaba Cloud в этом году компания прямо объявила, что совокупный объём поставок AI-чипов серии Zhenwu от Pingtouge достиг 560 000 штук, а годовой доход перешагнул отметку в 10 миллиардов юаней.

Можно сказать, что в обучении у Nvidia китайские облачные провайдеры не только идут быстрее, но и начали раньше.

Самые мощные вычисления? Нет, миру нужны «оптимальные вычисления»

Конечно, Nvidia не потеряет своё ключевое положение в эпоху AI только из-за того, что Google начал продавать TPU.

По крайней мере, в течение длительного времени GPU, CUDA и экосистема разработчиков по-прежнему останутся стандартом, который нельзя обойти во всей AI-индустрии. Особенно в сценариях обучения больших моделей, высокопроизводительных вычислений и разработки универсального AI, Nvidia остаётся наиболее зрелым и признанным индустрией выбором на данный момент.

Но проблема в том, что рынок AI-вычислений вступает в следующую фазу.

Раньше все боролись за то, «чей чип мощнее», а теперь предприятия по-настоящему начинают заботиться о том, «кто может сделать вычисления дешевле». В этот момент преимущества облачных провайдеров, таких как Google, Huawei Cloud, Alibaba Cloud, начинают проявляться: у них есть огромное количество частных и корпоративных клиентов, данные, приложения и сценарии, и они также лучше умеют упаковывать различное аппаратное обеспечение в систему производительности, которую можно использовать напрямую.

Другими словами, в эпоху AI действительно дефицитны уже не только сами чипы, а системная способность превращать чипы в производительные силы.

Когда вычисления становятся всё больше похожи на базовые ресурсы, такие как вода, электричество, широкополосный интернет, победившая компания не обязательно будет тем производителем, у которого самая высокая производительность одной карты, а тем, кто сможет с более низкой стоимостью и более высокой эффективностью постоянно поставлять AI-вычисления клиентам.

Поэтому, с точки зрения LeiTech, начало продаж TPU от Google — это сигнал, напоминающий всей отрасли: конкуренция в AI-инфраструктуре — это уже не только битва чипов, но и битва систем.

Эта статья взята из официального аккаунта WeChat «LeiTech», автор: LeiTech

Связанные с этим вопросы

QЧто такое TPU и чем он отличается от CPU и GPU?

ATPU (Tensor Processing Unit, Тензорный процессор) — это специализированный процессор, разработанный Google для выполнения матричных и тензорных математических операций, которые лежат в основе вычислений для ИИ-моделей. В отличие от CPU (центральных процессоров) и GPU (графических процессоров), TPU оптимизирован для максимальной эффективности именно в задачах ИИ.

QПочему Google начал продавать свои TPU третьим сторонам?

AGoogle начал продавать TPU напрямую клиентам и центрам обработки данных, чтобы предоставить предприятиям возможность создавать собственные высокоэффективные и экономичные вычислительные мощности для ИИ. Это позволяет клиентам снижать стоимость генерации токенов (token) и повышать конкурентоспособность своих ИИ-сервисов.

QКак решение Google повлияет на позиции Nvidia на рынке ИИ-чипов?

AРешение Google представляет серьёзную конкуренцию для Nvidia, особенно на рынке более бюджетных решений для инференса (выполнения моделей). Хотя экосистема CUDA от Nvidia остаётся отраслевым стандартом для обучения моделей, TPU Google предлагают альтернативу с акцентом на эффективность и снижение стоимости, что может перетянуть часть клиентов, для которых цена и эффективность стали приоритетом.

QКакие китайские компании развивают аналогичные стратегии в области ИИ-чипов?

AКитайские технологические гиганты, такие как Huawei и Alibaba Cloud, также активно развивают собственные экосистемы ИИ-чипов. Huawei продвигает чипы Ascend и облачные сервисы на их основе, сотрудничая с компаниями вроде DeepSeek. Alibaba Cloud через свою дочернюю компанию T-Head выпустила серию чипов Zhenwu, которые уже используются в её облачных платформах, стремясь создать целостные и конкурентоспособные ИИ-решения.

QКак, согласно статье, изменилась природа конкуренции на рынке ИИ-вычислений?

AКонкуренция сместилась с простой гонки за максимальную производительность отдельного чипа («самая мощная вычисления») к системной конкуренции за создание наиболее эффективных и экономичных комплексных решений («оптимальные вычисления»). Побеждать будут те, кто сможет, подобно поставщикам коммунальных услуг, предлагать ИИ-вычисления как надёжный, масштабируемый и дешёвый базовый ресурс.

Похожее

На самом деле, основной сценарий оплаты стабильными монетами не в трансграничных платежах

Анализ данных Allium показывает, что основная часть трансфера стейблкоинов (62.6% от $15.2 млрд опознанных транзакций) происходит внутри стран, а не как кросс-бордерные переводы. Лидером по объему операций является Азиатско-Тихоокеанский регион (АТР) с 41% от общего отправленного объема. Внутрирегиональные потоки также преобладают: 73% всех идентифицированных средств остаются в регионе отправителя. Крупнейшие внутренние рынки — Турция, Южная Корея, Мексика, Индонезия и США. Пользователи активно используют стейблкоины для внутренних расчетов, платежей и сбережений в долларах США. В кросс-бордерных потоках (27.8% от $5.68 млрд) также доминирует АТР, где формируются значительные двусторонние коридоры (например, Тайвань-Индонезия, Индонезия-Южная Корея). Индонезия, Сингапур и Южная Корея являются чистыми реципиентами капитала. **Ключевой вывод:** для организаций, оценивающих спрос на платежные решения со стейблкоинами, наибольший потенциал в настоящее время представляют услуги по внутренним расчетам внутри стран, а также развитие платежных коридоров внутри АТР.

marsbit31 мин. назад

На самом деле, основной сценарий оплаты стабильными монетами не в трансграничных платежах

marsbit31 мин. назад

2 триллиона долларов: обратный отсчёт до крупнейшего IPO в истории ИИ

Менее чем через два месяца, в октябре, на Уолл-стрит ожидают историческое IPO компании Anthropic с потенциальной оценкой в $2 трлн, что станет крупнейшим в истории ИИ. Всего за пять лет компания, основанная бывшими ключевыми сотрудниками OpenAI, может достичь этой отметки, в то время как Apple на это потребовалось 40 лет. Выручка Anthropic демонстрирует взрывной рост: с $90 млрд (годовой темп) в конце 2025 года до $470 млрд в мае 2026-го. Во втором квартале 2026 года выручка составила $115 млрд, что в 14 раз больше, чем годом ранее. Согласно внутренним прогнозам, к 2028 году выручка может достичь $1,9-2 трлн. Именно на этих ожиданиях будущих доходов инвесторы и банки строят свою оценку. Основу доходов (70-80%) составляют плата за API и корпоративные контракты, взимаемая за использование токенов. Ключевым драйвером роста стала платформа для разработчиков Claude Code, чья доля в доходах компании приближается к 20%. По некоторым данным, Anthropic уже занимает около 40% корпоративных расходов на большие языковые модели, обгоняя OpenAI. Однако на фоне подготовки к IPO в компании нарастает внутренний конфликт. Сообщается о глубоком расколе между руководством, придерживающимся философии «спасения человечества» через безопасный ИИ, и рядовыми сотрудниками, недовольными такой культурой. Многие оказались в ловушке: с одной стороны, ценные опционы перед IPO, с другой — неприятие корпоративной среды. Anthropic оказалась в парадоксальной ситуации: для создания «безопасного» ИИ требуются огромные вычислительные мощности, финансируемые инвесторами, которые, в свою очередь, требуют агрессивного роста и высокой отдачи. Компании предстоит балансировать между этими требованиями, давлением регуляторов, высокими затратами и внутренними противоречиями. Успех или провал ее грандиозного IPO, запланированного на октябрь, определит ее место в финальной гонке за искусственный сверхинтеллект (ASI).

marsbit1 ч. назад

2 триллиона долларов: обратный отсчёт до крупнейшего IPO в истории ИИ

marsbit1 ч. назад

Эффективное ИИ, сокращающее затраты, делает венчурные инвестиции всё более дорогостоящими

Авторы: Zen, PANews Несмотря на то, что инструменты искусственного интеллекта снижают затраты на создание и первоначальное развитие стартапов (уменьшая размеры команд и начальный капитал), рынок венчурных инвестиций в ИИ становится дороже. Наблюдается поляризация: в то время как многие проекты требуют меньше средств, топовые компании ИИ, основанные выходцами из OpenAI, Google DeepMind и т.д., привлекают многомиллиардное финансирование на самых ранних этапах, ещё до создания продукта. Это приводит к резкому росту оценок на seed-стадии. В результате венчурным фондам (ВК) для приобретения и сохранения значительной доли в перспективных компаниях требуется гораздо больше капитала. Инвестиции концентрируются вокруг небольшого числа лидеров, создавая петлю обратной связи: конкуренция за лучшие проекты взвинчивает цены, что, в свою очередь, требует от фондов большего размера и способности участвовать в последующих раундах. Такие гиганты, как Accel, a16z, активно наращивают фонды для ранних и поздних стадий, чтобы успеть за "суперциклом" ИИ. Ключевой парадокс: ИИ снижает стоимость запуска бизнеса, но значительно увеличивает стоимость инвестиций в него для венчурных капиталистов. Риск заключается в том, что сегодняшние сверхвысокие оценки закладывают будущий рост, который сможет оправдать лишь несколько компаний, ставших глобальными платформами.

marsbit2 ч. назад

Эффективное ИИ, сокращающее затраты, делает венчурные инвестиции всё более дорогостоящими

marsbit2 ч. назад

Резкий поворот после восьми лет вложений: почему Ethereum внезапно отказался от Poseidon?

Эфириум отказывается от хэш-функции Poseidon после восьми лет разработки и миллионов долларов вложений. Как сообщил исследователь Джастин Дрейк, в основном уровне L1 будут использоваться традиционные функции, такие как SHA2 или BLAKE2. Это ключевая корректировка постквантовой криптографической дорожной карты. Poseidon, представленный в 2019 году, был оптимизирован для эффективной работы в SNARK-схемах, но имеет ограничения для постквантовой безопасности. Прорыв в дизайне SNARK, использующий бинарные поля ("binary field"), теперь позволяет традиционным хэш-функциям в доказательствах нулевого разглашения достигать производительности, сравнимой с Poseidon, что устраняет ключевое преимущество последнего. Другим важным фактором является ускорение графика перехода на постквантовую криптографию. Угроза квантовых компьютеров, способных взломать текущую асимметричную криптографию, становится более реальной. Ethereum делает ставку на схемы на основе хэшей, считающиеся более устойчивыми. План включает развертывание производственной leanVM в 2027 году и внедрение на консенсусном, исполнительном и уровнях доступности данных в 2028 году. Отказ от Poseidon в пользу SHA2/BLAKE2s обусловлен их более долгой историей криптоанализа и зрелостью. В то время как другие блокчейны, такие как Solana, выбирают стандартизированную постквантовую подпись Falcon, Ethereum фокусируется на создании зрелых и проверенных криптографических примитивов для будущего.

marsbit3 ч. назад

Резкий поворот после восьми лет вложений: почему Ethereum внезапно отказался от Poseidon?

marsbit3 ч. назад

Pax Silica против WAICO: США хотят запретить Европе использовать китайский искусственный интеллект

США готовы потребовать от европейских и других партнеров отказаться от китайских проектов в сфере искусственного интеллекта под угрозой исключения из американской инициативы Pax Silica, сообщает Reuters со ссылкой на проект документа Госдепа. Страны-участницы альянса, включая многих европейцев, должны выбрать одну сторону: либо Pax Silica, либо конкурирующую структуру, подразумевая китайскую Всемирную организацию сотрудничества в области ИИ (WAICO). Этот ультиматум ставит государства, особенно европейские, перед сложным выбором между интеграцией в западную технологическую экосистему и сотрудничеством с альтернативными форматами, что может ограничить их возможности для диверсификации. Формирование двух противостоящих блоков — Pax Silica под руководством США и WAICO во главе с Китаем — ведет к фрагментации глобального технологического пространства. Это вынуждает страны и компании выбирать сторону, что приведет к росту издержек, снижению эффективности и созданию несовместимых стандартов. Решение партнеров определит конфигурацию мировой цифровой экономики на десятилетия вперед, смещая приоритеты с экономической эффективности на технологический суверенитет.

cryptonews.ru7 ч. назад

Pax Silica против WAICO: США хотят запретить Европе использовать китайский искусственный интеллект

cryptonews.ru7 ч. назад

Торговля

Спот
活动图片