Весь мир завидует бизнесу NVIDIA.
Согласно отчету NVIDIA за четвертый квартал 2026 финансового года (по состоянию на конец января 2026 года), ее валовая прибыль по GAAP достигла 75,2% — это просто печатный станок. Такая способность «печатать деньги» в основном обусловлена доминирующим положением на рынке AI-чипов и мощной ценовой властью.
Почти все большие модели работают на вычислительных чипах NVIDIA, поддерживая ее рыночную капитализацию почти в 5 триллионов долларов.
Но именно поэтому почти все крупные AI-компании явно или тайно пытаются вырваться из клетки NVIDIA, не желая отдавать ей свою судьбу. Недавно выпущенный DeepSeek V4, судя по техническому отчету, вероятно, все еще использовал чипы NVIDIA для обучения, но адаптирован для логического вывода (inference) на чипах Ascend от Huawei, при этом было заявлено, что после выхода Ascend 950 во второй половине года цена за токен для Pro-версии значительно снизится. Кроме того, помимо Huawei Ascend, китайские производители чипов, такие как Tianshu Zhixin и Cambricon, также заявили о поддержке новой модели DeepSeek V4.
В США, родном бастионе NVIDIA, Google самостоятельно разработал вычислительные чипы TPU (Tensor Processing Unit). По состоянию на апрель 2026 года TPU уже достиг восьмого поколения, сформировав полную линейку продуктов для обучения и логического вывода. Meta в марте этого года также раскрыла дорожную карту разработки собственных AI-чипов, планируя развернуть к концу 2027 года четыре новых чипа серии MTIA для удовлетворения вычислительных потребностей внутреннего AI-бизнеса, одновременно поддерживая масштабное сотрудничество по закупкам с NVIDIA и AMD, создавая систему двойного снабжения вычислительными мощностями: «собственная разработка + закупки».
Да, пока ни одна AI-компания не может обойтись без NVIDIA в краткосрочной перспективе, но Хуан Жэньсюнь уже чувствует угрозу. В недавнем подкасте Хуан Жэньсюнь заявил, что закон Мура подходит к концу, то есть эпоха ежегодного удвоения производительности чипов прошла, и сегодня преимущество самых передовых чипов не будет вечным защитным рвом, а лишь временным относительным преимуществом. Как только технологический процесс приблизится к физическому пределу,难度 догоняющих反而 снизится.
Хуан Жэньсюнь отметил, что ограничение экспорта вычислительных чипов в Китай действительно замедлит развитие AI в Китае в краткосрочной перспективе, но в долгосрочной перспективе это только заставит Китай сформировать собственную экосистему. Он не стал углубляться в то, что в настоящее время только китайские AI-компании активно занимаются открытыми исходными кодами (open-source), и их модели используются многими компаниями и стартапами. Если все больше open-source моделей будут работать на китайских вычислительных чипах, то даже если она останется первой на рынку, NVIDIA больше не будет единственной.
Фактически, даже без угрозы со стороны китайских open-source моделей и вычислительных чипов, рыночная конкуренция стремится к формированию дуопольной структуры на рынке вычислительных чипов, а не к доминированию одной NVIDIA.
Что интересно, среди них OpenAI, которая крайне зависит от NVIDIA,反而是 наиболее активно «втыкающая нож в спину».
01
17 апреля по местному времени американский производитель AI-чипов Cerebras официально подал заявку на IPO в SEC США, aiming привлечь 3 миллиарда долларов при оценке в 35 миллиардов долларов.
После отзыва заявки на IPO в октябре 2025 года, этот претендент на звание challenger NVIDIA, чей козырь — «чипы на уровне пластины (wafer-scale)», всего за полгода вновь ринулся к IPO и успешно поднял оценку компании с 8,1 миллиарда долларов до 35 миллиардов.
Ключевой точкой роста оценки стало соглашение о сотрудничестве с OpenAI на сумму более 20 миллиардов долларов.
Согласно соглашению, OpenAI обязалась использовать кластеры серверов на чипах Cerebras в течение следующих трех лет, а Cerebras развернет для первой 750 мегаватт вычислительной мощности, планируется завершить полное развертывание к 2028 году. Кроме того, OpenAI также предоставит Cerebras около 1 миллиарда долларов для помощи в разработке центров обработки данных и получит опционы на акции (warrants) на примерно 10%.
Очевидно, OpenAI уже не просто клиент, а кредитор и, возможно, будущий крупный акционер. Выбор времени для повторного запуска IPO, вероятно, является совместным решением двух компаний.
В тот же день, когда Cerebras подала документы на IPO, три ключевых топ-менеджера OpenAI, включая руководителя Sora Билла Пиблса, объявили об уходе.与此同时, считавшийся вехой американской AI-инфраструктуры план «Stargate» стоимостью 500 миллиардов долларов также находится в состоянии хаоса, с медленным прогрессом в вопросах внутренней координации и финансирования.
По данным раскрытой информации, выручка OpenAI в 2025 году составила 13,1 миллиарда долларов, а убытки достигли 8 миллиардов долларов,预计 в этом году убытки взлетят до 25 миллиардов. Под давлением огромных убытков OpenAI даже пришлось пойти на болезненные меры, закрыв популярный продукт для генерации видео Sora.
По некоторым оценкам, ежедневная стоимость вычислений для Sora составляла около 15 миллионов долларов, а стоимость 10-секундного высококачественного видео — около 33 долларов. За время работы Sora общий доход от платы пользователей составил лишь 2,1 миллиона долларов.
В такое неспокойное время Олтман прекрасно понимал, что чрезмерная зависимость от NVIDIA станет самым большим уязвимым местом OpenAI.
Ранее OpenAI последовательно объявляла о сотрудничестве с Broadcom по разработке定制чипов, об использовании нового чипа AMD MI450,频频向外界传递明确信号 — больше не хочет работать на NVIDIA. Именно в этом контексте Cerebras стала ключевым объектом ставки в стратегии OpenAI по «де-найвисизации».
Хотя知名度 Cerebras невелика, она обладает уникальностью среди производителей чипов.
Почти все гиганты проектирования чипов следуют пути «резки пластин, создания маленьких чипов»,而 Cerebras обратила внимание на «стену памяти» (memory wall), с которой сталкиваются данные при перемещении между чипами, поэтому она выбрала более агрессивный путь single-chip технологии.
Ключевой продукт Cerebras — это wafer-scale engine WSE-3, созданный на цельной 300-мм пластине. Поскольку вычисления, хранение и соединение полностью находятся внутри одного чипа, задержка передачи данных снижается на 90% по сравнению с кластерами GPU, что особенно подходит для логического вывода (inference) больших моделей с низкой задержкой.
В сценариях inference архитектура wafer-scale может снизить стоимость за токен на 80%.
Глава подразделения вычислительной инфраструктуры OpenAI заявил, что Cerebras добавила в платформу эксклюзивное решение для inference с низкой задержкой, которое не только позволяет пользователям получать более быстрый отклик, но и закладывает основу для расширения технологий AI в реальном времени на более широкую пользовательскую базу.
Что еще важнее, путь Cerebras, не зависящий от HBM, может打破 почти монопольную структуру отрасли чипов, сложившуюся у NVIDIA, и сделать поставки вычислительных мощностей более диверсифицированными.
Все это как нельзя лучше попадает в самое больное место OpenAI, и сотрудничество между ними естественным образом сложилось.
Помимо OpenAI, Cerebras в марте также достигла соглашения с AWS, CS-3 будут развернуты в дата-центрах Amazon, войдя в инфраструктурную систему mainstream hyperscale cloud-платформ.
02
«Самое захватывающее в этой быстро развивающейся отрасли то, что алгоритмы будут становиться все быстрее, точнее и эффективнее — именно поэтому я не хочу погружаться в те традиционные отрасли, которые остаются неизменными девять лет подряд.»
То, что Cerebras дошла до своей нынешней позиции, неразрывно связано с ее основателем Эндрю Фельдманом.
В отличие от типичных основателей chip-компаний, являющихся инженерами, Фельдман окончил Стэнфордский университет со степенями бакалавра экономики, политологии и MBA. С самого начала карьеры он постоянно накапливал опыт в области продуктов и маркетинга, этот профессиональный путь дал ему天然嗅觉 к тому, какие бизнес-модели будут работать.
С накоплением опыта Фельдман也逐渐 превратился из наемного работника в серийного предпринимателя.
А все серийные предприниматели имеют极其明显的特性 — хотят побеждать, любой ценой. Эти люди не просто «азартны», а считают «победу» такой же необходимой, как дыхание. Они обычно делают ставки в «no man's land» отраслевого консенсуса, идут ва-банк в направлениях, которые большинство считает «ненужными» или «невозможными». Другими словами, у них большая «азартная жилка».
В 2007 году Фельдман основал серверную компанию SeaMicro.
«Сегодня большие процессоры используются так, как если бы мы летали на космическом шаттле в продуктовый магазин. На самом деле, мне нужно просто поехать на Prius».
SeaMicro отказалась от традиционного подхода серверов «набрать побольше компонентов», удалив все компоненты, кроме CPU, памяти и одной собственной ASIC, предоставляя «больше ядер» профессиональным интернет-компаниям с нагрузками, требующими «горизонтального масштабирования». В 2012 году компания была приобретена AMD за 355 миллионов долларов.
Хотя бизнес микросерверов в составе AMD постепенно заглох, этот опыт позволил Фельдману完成 накопление богатства и еще больше укрепил его методологию предпринимательства: на узлах смены поколений использовать «анти-мейнстримовый» hardware design для входа в нишевые рынки, еще не охваченные гигантами.
Согласно отраслевым нормам, выход годных чипов (yield) падает с увеличением площади. Когда все chip-компании шли по пути NVIDIA, Фельдман принял очень «дилетантское» решение — делать цельные чипы размером с тарелку.
В 2015 году Фельдман и его технический партнер Гэри Лаутербах共同 основали Cerebras и привлекли нескольких старых сотрудников, работавших в SeaMicro. Cerebras молчала целых четыре года,直到 августа 2019 года выпустила первое поколение WSE-1.
В этот период незаметной разработки Фельдман ставил на две вещи: во-первых, что технология wafer-level packaging台积电 будет постепенно成熟еть, и во-вторых, что масштабы AI-моделей станут настолько большими, что memory wall GPU станет фатальным узким местом.
Судя по текущему развитию, он выиграл обе ставки.
С 2019 по 2024 год Cerebras выпускала новое поколение каждые два года, технологический процесс перескакивал с 16 нм на 7 нм, а затем на 5 нм, количество транзисторов выросло с 1,2 триллиона до 4 триллионов. В то же время Фельдман начал主动出击寻找大客户. В 2023 году он полетел в Абу-Даби и заполучил G42.
Cerebras и G42 совместно обучили самую передовую языковую модель в арабском языке, совместно создали сеть из девяти соединенных суперкомпьютеров Condor Galaxy. Тесное сотрудничество с этой ближневосточной компанией также вызвало проверку Cerebras Комитетом по иностранным инвестициям в США (CFIUS) на предмет национальной безопасности, но Фельдману все равно — проверка говорит о его собственной силе.
«Если вы работаете всего 38 часов в неделю и还想 бросить вызов такой 800-фунтовой горилле, как NVIDIA? Ни за что. Вам нужна каждая минута вашего清醒ного времени.»
Фельдмана как-то спросили в интервью о его взглядах на «баланс между работой и личной жизнью», на что он дал颇为 радикальный отрицательный ответ. Он毫不掩饰 свое желание бросить вызов NVIDIA.
Ориентируясь на стократный рост NVIDIA за десять лет, Фельдман питает颇为 оптимистичные ожидания относительно перспектив Cerebras: в течение следующих 3-5 лет разработать методы лечения для миллионов пациентов; обеспечить вычислительные мощности для inference для еще не появившихся приложений; чтобы люди использовали технологии компании незаметно для себя.
03
Стремление Cerebras к IPO сталкивается с непрекращающимися спорами: оптимисты надеются стать свидетелями рождения второй NVIDIA, а пессимисты сомневаются в стабильности ее результатов.
Согласно раскрытой официальной финансовой информации, выручка Cerebras выросла с 24,6 миллиона долларов в 2022 году до 510 миллионов долларов в 2025 году, совокупный годовой темп роста (CAGR) за четыре года составил 175%. Особенно выделяется то, что в 2025 году чистая прибыль по GAAP составила 238 миллионов долларов, что позволило успешно扭转 убыток в 482 миллионов долларов в 2024 году.
Но при仔细分析 становится ясно, что прибыль по GAAP стала возможной благодаря учетному операционному доходу (non-cash accounting gain) в размере 363 миллионов долларов, который фактически является бухгалтерской операцией по удалению обязательств, связанных с G42, из баланса из-за проверки национальной безопасности США. Если исключить эту разовую статью, то скорректированный (non-GAAP) чистый убыток компании фактически составил 75,7 миллиона долларов.
Другими словами, «выход на прибыль» Cerebras — это бухгалтерская игра.
В 2023 и 2024 годах G42 обеспечила 83% и 87% общей выручки Cerebras соответственно. В условиях усиления геополитических конфликтов риск зависимости от единственного клиента с Ближнего Востока очевиден. Ведь первоначальная заявка Cerebras на IPO была отозвана именно из-за проверки национальной безопасности.
Согласно проспекту, обязательства компании на оставшуюся сумму в 24,6 миллиарда долларов почти полностью зависят от соглашения с OpenAI на 20 миллиардов долларов. Иными словами,预期 доходы Cerebras почти полностью построены на远期承诺 OpenAI, а не на диверсифицированной大规模 клиентской базе.
Сможет ли этот заказ-«допинг» быть выполнен, зависит от самой судьбы OpenAI. Когда стабильность самого крупного клиента сама находится под пристальным вниманием рынка, сколько из этого «пустого чека» будет реализовано,恐怕, даже сам Фельдман не может ручаться.
Сравнение с NVIDIA更能 показать недостатки Cerebras.
До бума AI-индустрии NVIDIA уже建立了 диверсифицированную клиентскую базу в таких областях, как игры, профессиональная визуализация, центры обработки данных и др., ни один отдельный клиент не составлял более 10% ее выручки. За более чем двадцать лет эволюции NVIDIA глубоко связала себя с миллионами разработчиков, каждая итерация продукта происходила из потребностей внутреннего расширения экосистемы, путь планирования продуктов был очень清晰. Экосистема Cerebras находится на очень ранней стадии, все еще представляет собой точечный прорыв в сценариях inference, и до truly платформенной компании ей еще далеко.
Даже без неожиданного появления ChatGPT, NVIDIA была стабильной компанией с надежной выручкой и солидной прибылью. А без заказа OpenAI на 20 миллиардов долларов у Cerebras,恐怕, даже не было бы возможности стремиться к IPO.
В декабре 2025 года NVIDIA заключила специальное соглашение о сотрудничестве с конкурентом Cerebras, Groq, на сумму около 20 миллиардов долларов наличными, получив постоянное неэксклюзивное право на использование архитектуры inference LPU Groq, полного стека технологий проектирования чипов.
Выход Хуана Жэньсюня на арену означает, что ценность специализированной архитектуры inference с низкой задержкой Cerebras得到了认可业界巨头, но также резко повышает competitive давление, с которым сталкивается Cerebras.
Реалистично speaking, привлечение Cerebras OpenAI предназначено не для замены, а для создания «рыбки-гриль» (鲶鱼), увеличения переговорной силы и диверсификации рисков цепочки поставок.
По некоторым данным, системы NVIDIA на базе чипов Groq будут выпущены во второй половине 2026 года. Если Олтман развернется и снова договорится с Хуаном Жэньсюнем, Cerebras может легко стать разменной монетой.
На триллионном треке AI-чипов диверсифицированная конкуренция, несомненно, полезна для долгосрочного развития отраслевой экосистемы. Но на资本市场 никогда не недостает историй обогащения и медийного ажиотажа, сможет ли Cerebras真正реализовать технологическую и коммерческую ценность, еще предстоит пройти多重考验.
Красивое звание «претендент NVIDIA» также, возможно, станет мимолетным пузырем.
Но, как раскрывает «Парадокс Джевонса», технологический прогресс повышает эффективность использования ресурсов, снижает удельную стоимость производства, а поскольку люди могут позволить себе использовать больше, это反而 приводит к тому, что общее потребление ресурсов не снижается, а увеличивается. По мере того, как AI будет все больше проникать во все аспекты жизни людей, в обозримом будущем спрос на вычислительные мощности будет продолжать быстро расти.
Этот сверхкрупный рынок стоимостью в сотни миллиардов или даже тысячи миллиардов долларов касается не только экономики, но и геополитической безопасности, и никто не хочет отдавать ключи от своей судьбы в руки одной NVIDIA.
Но очевидно, что даже из чувства собственного достоинства Хуан Жэньсюнь не отдаст ключи легко.
Данная статья из WeChat Official Account «最话FunTalk» (ID: iFuntalker), автор: Хэ Ижань, редактор: Лю Юйсян








