Преодолевая «стену памяти»: Революция на уровне пластины и маршруты вычислений в эпоху AI-инференса

marsbitОпубликовано 2026-06-05Обновлено 2026-06-05

Введение

В 2026 году мир ИИ достиг поворотного момента: крупнейшие облачные провайдеры впервые стали тратить на вывод моделей больше, чем на их обучение. Ключевой проблемой эпохи обучения была производительность вычислений, но в эпоху вывода главным узким местом стала «стена памяти» — задержки и энергозатраты на перемещение данных между памятью и процессором. Традиционные GPU, как у NVIDIA, упираются в ограничения пропускной способности памяти. Компания Cerebras Systems предлагает радикально другой подход — чип на целой кремниевой пластине (Wafer-Scale Engine, WSE-3). Эта архитектура размещает 44 ГБ сверхбыстрой SRAM-памяти прямо на кристалле, обеспечивая пропускную способность в тысячи раз выше, чем у HBM в GPU, что кардинально ускоряет генерацию токенов в больших языковых моделях (LLM). Ключевое преимущество Cerebras — минимальная задержка при выводе, особенно для первого токена и длинных контекстов. Однако у этого пути есть серьезные компромиссы: сложности с теплоотводом, ограниченная экосистема ПО, низкая внешняя пропускная способность и физические ограничения на дальнейшее увеличение объема SRAM с уменьшением техпроцесса. Крупные технологические компании (Google, AWS, Microsoft) в ответ развивают три направления: специализированные AI-чипы (ASIC), продвинутые стандартные технологии упаковки (как SoW от TSMC), которые могут нивелировать преимущество Cerebras, и оптические интерконнекты для преодоления «стены памяти». Cerebras сейчас сталкивается с вызовом масштабирования: круп...

2026 год стал знаковым переломным моментом в развитии глобального искусственного интеллекта — капитальные затраты на инференс у сверхмасштабных облачных провайдеров впервые в истории превысили капитальные затраты на обучение. Отраслевой фокус сместился с «создания больших моделей» на «использование больших моделей», а структура спроса на вычислительные ресурсы претерпела фундаментальный переворот.

В эпоху обучения ключевым противоречием вычислительной мощности была «двойная точность с плавающей запятой и масштаб кластера»; с наступлением эры инференса центральным противоречием стали «пропускная способность памяти и задержки связи».

Узким местом инференса больших моделей перестали быть только вычисления — веса модели, промежуточные активации и KV Cache нуждаются в частом обмене между внешней DRAM (например, HBM) и GPU. Чем больше модель, тем выше энергопотребление и задержки при перемещении данных, которые в конечном итоге значительно превышают энергопотребление самих вычислений, формируя тем самым «стену памяти».

GPU NVIDIA, построившие крепкую крепость на основе CUDA и NVLink, все же не могут избежать простоев GPU, вызванных узкими местами в пропускной способности.

Китайская компания, работающая с большими моделями, Zhipu, провела простой эксперимент: в кластере инференса на 512 GPU, оставив GPU, модель и код неизменными, просто повысив лимит пропускной способности сети с 200 ГБ/с до 400 ГБ/с, пропускная способность инференса сразу выросла на 10%, а задержка выдачи первого токена снизилась на 19% — принцип прост: стоит лишь расширить дорогу, и машины смогут ехать быстрее.

Однако архитектуры, отличные от GPU, представленные такими компаниями, как Cerebras, похоже, пробивают брешь в этой «стене памяти».

Сравнение размеров чипа Cerebras WSE-3 и GPU NVIDIA B200

Сущность Cerebras: вычислительная машина на основе SRAM с памятью рядом с ядром

Cerebras Systems была основана в Кремниевой долине Эндрю Фельдманом и другими, а первые члены команды основателей все были из компании SeaMicro, занимавшейся низкопотребляющими микросерверами, которая позже была приобретена AMD, после чего:

2015: команда основателей определила направление «вычислений на уровне пластины»;

2016: завершена регистрация, привлечен раунд финансирования A, начат скрытый этап разработки;

2019: выпущен первый продукт — чип WSE-1 и система CS-1, на основе технологии TSMC 16 нм;

2021: выпущено второе поколение продуктов на основе технологии TSMC 7 нм;

2024: выпущено третье поколение продуктов (WSE-3 / CS-3) на основе технологии TSMC 5 нм; чип и система полностью произведены в США, являясь подлинными чиповыми системами чисто американского производства.

Конфигурация системы CS-3, содержащей один чип WSE-3

Архитектурная философия процессора на уровне пластины (Wafer-Scale Engine, WSE) от Cerebras проста, прямолинейна и бьет точно в болевую точку: обменом на предельное увеличение физического пространства достигается предельное сокращение задержек при перемещении данных.

Обычные чипы режут пластину на множество маленьких кристаллов, как, например, делает NVIDIA со своими GPU. Cerebras поступает наоборот: не резать, а сделать из почти целой пластины один гигантский чип, называемый Wafer-Scale Engine (WSE).

Традиционные чипы формируются путем разрезания целой 300-миллиметровой пластины на сотни маленьких кристаллов; Cerebras же выбирает сохранить целую пластину, используя ее непосредственно как цельный чип. Новейший WSE-3 содержит 4 триллиона транзисторов, 900 тысяч AI-ядер, каждое из которых оснащено 48 КБ локальной SRAM, что обеспечивает общий объем внутрикристальной SRAM в 44 ГБ, предоставляя пропускную способность внутрикристальной памяти 21 ПБ/с и пропускную способность коммутационной сети 214 Пбит/с, что в тысячи раз превышает пропускную способность традиционной HBM.

Пропускная способность памяти Cerebras WSE в 2625 раз выше, чем у упакованного чипа NVIDIA B200, что ломает барьер пропускной способности памяти в сценариях инференса больших моделей.

В архитектуре Cerebras веса модели никогда не хранятся в SRAM на кристалле, а находятся во внешней памяти MemoryX и передаются слой за слоем на большой чип. Реализация заключается в раздельном хранении весов нейронной сети и вычислительных блоков.

Все веса модели хранятся внешне в модуле расширения памяти MemoryX, и веса, необходимые для вычисления каждого слоя сети, передаются в систему CS-3 по требованию, слой за слоем. Веса хранятся в DRAM и флэш-памяти MEMORY X и передаются в систему CS-3 на полной скорости пропускной способности. Эти веса не сохраняются в системе CS-3, даже временно не кэшируются; CS-3 полагается на базовый механизм потоковой передачи данных в ядре для выполнения вычислений.

Благодаря архитектуре на уровне пластины, Cerebras демонстрирует непреодолимые барьеры, подобные удару с более высокого измерения, в инференсе LLM, ограниченном пропускной способностью памяти. При генерации токена за токеном веса потоково передаются слой за слоем с внешнего MemoryX в CS-3; скорость обработки токенов для разных моделей в 1.5 - 5 раз выше, чем у NVIDIA B200.

Сравнение скорости обработки токенов GPU NVIDIA DGX B200 и чипа Cerebras CS-3 на разных больших моделях

Ключевое преимущество заключается в следующем: 44 ГБ внутрикристальной SRAM CS-3 обеспечивают сверхвысокую пропускную способность в 21 ПБ/с (в 2625 раз больше, чем у B200) и внутреннюю коммутацию в 214 Пбит/с, что позволяет потоковой передаче весов избавиться от ограничений интерфейса HBM. Поэтому особенно заметно превосходство в TTFT (Time To First Token, время от отправки запроса до возврата первым токеном моделью), при длинном контексте и рабочих нагрузках агентов.

Хотя веса хранятся внешне в MemoryX и загружаются слой за слоем по требованию без кэширования на кристалле, CS-3, полагаясь на базовый механизм потоков данных в ядрах, выполняет вычисления с полной точностью FP16 без потерь в SRAM; благодаря линейному масштабированию производительности, он также демонстрирует впечатляющую общую пропускную способность при конкурентном инференсе для нескольких пользователей.

Кроме пропускной способности, есть и преимущество в энергопотреблении. В недавнем выступлении председателя правления компании Zhongji InnoLight Лю Шэна также упоминалось, что требования клиентов к оптическим модулям составляют 1 пДж/бит, в то время как сейчас это 10 пДж/бит. В чипе Cerebras энергопотребление коммутации составляет всего 0.15 пДж/бит, тогда как энергопотребление коммутации текущих GPU составляет 10 пДж/бит.

Сравнение пропускной способности и энергопотребления архитектур коммутации Cerebras и GPU

Таким образом, если архитектура крупночиповых решений на уровне пластины от Cerebras станет мейнстримом для инференса или даже обучения AI, это, возможно, окажет значительное сдерживающее и структурно изменяющее влияние на объемы поставок традиционных оптических модулей и CPO (со-упакованной оптики). Основная логика заключается в следующем: высокий спрос на оптические модули и CPO по своей сути направлен на решение проблемы узких мест в пропускной способности «межчиповой» и «межузловой» коммутации в GPU-кластерах; архитектура же Cerebras как раз решает проблему путем «устранения распределенной коммутации».

Контр-интуиция: «истинные» и «ложные» недостатки крупночиповых решений на уровне пластины

В основе чипа всегда лежит принцип Trade Off (искусство компромиссов). Cerebras, добиваясь предельной пропускной способности внутрикристальной SRAM, также сталкивается с некоторыми проблемами.

Низкий выход годных?

Наоборот, размер одного AI-ядра уменьшен до 0.05 кв. мм (1% от размера одного вычислительного ядра H100), поэтому выход годных, наоборот, выше. Благодаря внутрикристальной маршрутизации можно отключать и обходить дефектные ядра, что повышает устойчивость к дефектам в 100 раз по сравнению с традиционными многоядерными процессорами. Фактически на чипе 1 миллион AI-ядер, но с учетом выхода годных, публично заявляется о 900 тысячах AI-ядер.

Специализируется только на инференсе, а не на обучении?

В течение нескольких лет после основания Cerebras обучение было основной темой, поэтому компания всегда много работала вокруг обучения. Просто после взрывного роста спроса на инференс все увидели, что ее преимущества в инференсе более очевидны.

На самом деле, упрощенные распределенные вычисления также приносят ряд преимуществ: снижение сложности кода и уменьшение накладных расходов на связь.

Для обучения модели с 175 миллиардами параметров на 4000 GPU обычно требуется около 20 тысяч строк кода для распределенного обучения.

Cerebras добилась эквивалентного обучения на 565 строках кода — вся модель может разместиться на пластине, и не требуется обработка сложностей распараллеливания данных.

Масштабирование SRAM закончилось, ключевые преимущества достигли физического потолка.

Продукт третьего поколения, основанный на 5 нм TSMC, имеет объем SRAM всего на 10% больше, чем продукт второго поколения на основе 7 нм TSMC; после 5 нм площадь ячейки SRAM практически не уменьшается с прогрессом технологического процесса.

Это означает, что Cerebras больше не сможет, как раньше, значимо увеличивать свое ключевое преимущество (объем SRAM) за счет перехода на более совершенные технологические процессы TSMC (например, с 5 нм на 3 нм).

Из-за ограничений по размеру пластины, возможностям охлаждения и производственной себестоимости ресурсы хранения, такие как внутрикристальная SRAM, не могут линейно масштабироваться синхронно с вычислительными ядрами, и соотношение ресурсов сталкивается с узким местом. Это практически блокирует ее путь эволюции.

Технические характеристики трех поколений продуктов Cerebras

Тройное испытание: охлаждение, технология и экосистема.

Концентрированное тепловыделение на всей пластине приводит к высокой плотности теплового потока, что требует использования специальных дата-центров и систем жидкостного охлаждения. Кроме того, универсальность экосистемы означает, что клиенты должны адаптироваться к ее кастомизированному программному стеку; совместимость с существующими универсальными фреймворками программирования, такими как CUDA, слабая, а затраты на портирование и адаптацию ПО высоки.

Низкая внешняя пропускная способность, ведущая к «изолированности» масштабирования.

Из-за ограничений физического проектирования на уровне пластины количество I/O-контактов, которые можно вывести на краях WSE, крайне ограничено, что приводит к I/O-пропускной способности всего в 150 ГБ/с. По сравнению с двунаправленной пропускной способностью NVLink от NVIDIA, достигающей 1.8 ТБ/с, это похоже на улитку. Это означает, что WSE чрезвычайно сложно масштабировать вовне с высокой скоростью. Хотя межсистемное соединение SwarmX от Cerebras работает неплохо, перед лицом очень больших моделей, требующих высокоскоростного межчипового взаимодействия, крайне низкая внешняя пропускная способность становится структурным физическим ограничением.

Борьба направлений: собственные разработки крупных компаний, сколько осталось времени у Cerebras?

У крупных компаний есть не один способ решения проблемы «инференсу нужна более высокая пропускная способность + меньшая задержка», они ведут наступление по трем параллельным направлениям, осаждая технологические преимущества стартапов.

1. Собственные ASIC-чипы

Google TPU v8 уже разделился на две версии: training-specific и inference-specific; AWS Trainium 4 в пути; Microsoft Maia уже используется внутри Azure, построен на основе технологии TSMC 3 нм, имеет нативные тензорные ядра FP8/FP4, переработанную систему памяти, оснащен 216 ГБ HBM3e, 272 МБ внутрикристальной SRAM; даже Anthropic начала оценку собственного inference chip.

Вероятность развития по этому пути очень высока, что напрямую приведет к сжатию TAM (общего доступного рынка) «закупок инференса у сторонних производителей» к 2028 году на 10% до 25%.

2. Технологическая универсализация пути стандартной упаковки (Packaging)

Это прямое сдерживание Cerebras с более высокой позиции.

SoW (System-on-Wafer) от TSMC уже широко доступна клиентам, CoWoS 9.5x interposer также будет запущена в 2027 году.

То, что делают эти два продукта — объединение нескольких кристаллов на уровне пластины — по сути является технологической универсализацией и демократизацией физической технологии Cerebras.

Vera Rubin от NVIDIA войдет в эту экосистему во второй половине 2026 года.

Хотя собственное cross-reticle stitching от Cerebras является эксклюзивным, максимальный срок его эксклюзивности составляет всего 2-3 года. После 2027-2028 годов его технологический барьер будет размыт передовыми решениями TSMC в области упаковки.

3. Прорыв в области оптической коммутации/оптических вычислений

Пределы коммутации электронных чипов и стены памяти достигнуты; высокая пропускная способность, низкая задержка и нулевые перекрестные помехи фотоники являются окончательным решением.

Оптические направления, представленные такими компаниями, как Lumentum, набирают силу. Самое большое преимущество wafer-scale — это вычисления на кристалле, но модели неизбежно будут становиться все больше, и высокоскоростная коммутация за пределами wafer scale — это насущная необходимость.

По мере созревания CPO (со-упакованной оптики) и оптических соединений (Optical Interconnects), весьма вероятно, что в будущем мы увидим прямое внедрение оптического ввода-вывода в пластину WSE, ломающее оковы электрической коммутации; NVIDIA также может путем приобретения компаний, обладающих определенными архитектурными преимуществами (например, LPU, таких как Groq), в сочетании с оптической коммутацией разработать системы на уровне пластины, совместимые с существующим ПО сверхузлов NV.

Забег на краю пропасти: бизнес и поставки Cerebras

В настоящее время Cerebras сталкивается с забегом на краю пропасти, подстегиваемым огромными объемами заказов.

Сделки с ведущими крупными клиентами, такими как OpenAI, вынудили Cerebras трансформироваться из чиповой компании в нового типа облачного провайдера. Она больше не просто продает оборудование, ей необходимо в короткие сроки закрепить и построить огромные объемы энергетических мощностей и инфраструктуры для дата-центров.

Согласно требованиям контрактов, Cerebras должна поставлять мощность дата-центров в размере 250 МВт ежегодно в период с 2026 по 2028 год. Однако требования систем на уровне пластины к машинным залам чрезвычайно высоки, их нельзя просто впихнуть в традиционные IDC с воздушным охлаждением. В настоящее время прогресс Cerebras в подготовке мощностей дата-центров уже заметно отстает от требований контрактов.

От выпуска инженерных образцов до строительства заводов, от согласования энергоснабжения до развертывания систем охлаждения — это трясина капиталоемких и долгосрочных проектов.

Эпилог: Налево или направо?

Возвращаясь к первоначальному тезису, когда переломная точка в вычислительных мощностях для инференса уже наступила, ядро архитектуры вычислений всегда заключается в компромиссе.

Нет абсолютно правильного или ошибочного пути, есть лишь относительно оптимальное решение для самой важной рабочей нагрузки. А нагрузки уже меняются.

Cerebras идет налево, выбирая предельную физическую оптимизацию, обменивая целую пластину и огромный объем SRAM на предельно низкую задержку для одной задачи, что непобедимо в сценариях, крайне чувствительных к задержке первого токена.

NVIDIA идет направо, выбирая сохранение универсальности, используя HBM + NVLink + огромную пропускную способность кластера, чтобы справиться с тысячами изменений в нагрузках, оставаясь неизменной перед лицом перемен.

Бушующие ветра перемен, неясный путь вперед. Именно эта двойная неопределенность — технологическая и коммерческая — и рождает возможность для подрывных изменений. В потоке вычислительных мощностей, ведущих к AGI, еще рано делать окончательные выводы — потому что именно неопределенность создает возможности.

Эта статья взята с официального аккаунта WeChat «Исследовательский институт чесночных гранул», автор: ПиЛи Юся (Pili Youxia)

Трендовые криптовалюты

Связанные с этим вопросы

QКаковы ключевые изменения в структуре спроса на вычислительные мощности в эпоху AI, начиная с 2026 года?

AС 2026 года капитальные затраты гипермасштабных облачных провайдеров на AI-инференс впервые в истории превысили затраты на обучение. Индустриальный фокус сместился с "создания больших моделей" на "использование больших моделей", что привело к фундаментальному перевороту в структуре спроса на вычислительные мощности.

QВ чем заключается архитектурная философия Wafer-Scale Engine (WSE) от Cerebras, и как она решает проблему "стены памяти"?

AФилософия архитектуры WSE от Cerebras заключается в максимальном использовании физического пространства для радикального снижения задержек перемещения данных. Вместо разрезания пластины на множество мелких чипов, компания использует почти всю цельную пластину как один гигантский чип. Это позволяет разместить огромный объем сверхбыстрой SRAM-памяти на кристалле, обеспечивая полосу пропускания в тысячи раз выше, чем у традиционной HBM, и тем самым преодолевая узкое место "стены памяти" в AI-инференсе.

QКаковы три основные проблемы (или "слабости"), с которыми сталкивается архитектура Cerebras WSE?

AАрхитектура Cerebras WSE сталкивается с тремя основными проблемами: 1) Физический предел масштабирования SRAM, который практически перестает уменьшаться после 5нм техпроцесса, ограничивая рост ключевого преимущества. 2) Проблемы с охлаждением, специализированной экосистемой ПО и необходимостью адаптации под заказные системы. 3) Низкая полоса пропускания за пределами чипа (I/O), что затрудняет высокоскоростное масштабирование и создание кластеров, делая его "изолированным" решением.

QКакие три пути исследуют крупные технологические компании для решения проблемы высокой пропускной способности и низкой задержки в инференсе, угрожая позициям Cerebras?

AКрупные компании исследуют три параллельных пути: 1) Разработка собственных специализированных ASIC-чипов для инференса (например, Google TPU v8, Microsoft Maia). 2) Использование стандартных решений в области продвинутой упаковки, таких как SoW (System-on-Wafer) и CoWoS от TSMC, которые делают технологию склеивания кристаллов на уровне пластины общедоступной. 3) Прорыв в области оптических соединений и оптических вычислений, которые предлагают сверхвысокую пропускную способность и низкую задержку для преодоления ограничений электронных межсоединений.

QКак изменилась бизнес-модель Cerebras под давлением крупных заказов, и с какими вызовами она столкнулась?

AПод давлением крупных заказов от таких компаний, как OpenAI, Cerebras трансформировалась из производителя чипов в поставщика облачных услуг. Теперь компания обязана в сжатые сроки обеспечить и построить огромные объемы мощностей центров обработки данных. Согласно контрактам, ей необходимо ежегодно с 2026 по 2028 год вводить в эксплуатацию центры мощностью 250 МВт. Основная проблема заключается в том, что системы Cerebras требуют специализированных ЦОД с жидкостным охлаждением, и развертывание такой тяжелой инфраструктуры с длительным циклом строительства отстает от графика, требуемого контрактами.

Похожее

Свадебное дело Чхве Тхэвона закрыто: раскрывая скрытые линии наследования за триллионной империей SK Hynix

Дело о разводе главы SK Group Чхве Тхэвона завершилось, раскрывая сложные сценарии наследования в конгломерате, стоящем за SK Hynix, чья капитализация превысила 1000 трлн вон. В отличие от традиционных сценариев наследования в чеблях, где ключевую роль играют первенец, доли, брачные связи и отцовское признание, трое детей Чхве Тхэвона от бывшей жены Но Соён — дочь Чхве Юнджон (1989 г.р.), дочь Чхве Минджон (1991 г.р.) и сын Чхве Ингын (1995 г.р.) — следуют разными путями. Чхве Юнджон, названная СМИ «наиболее очевидным кандидатом», занимает руководящую должность в SK Inc. и работает над стратегией развития в области биотехнологий и точной медицины, сочетая научную подготовку с бизнес-опытом. Её брак с основателем ИИ-стартапа символизирует новый тип элитных союзов. Чхве Минджон, добровольно служившая в ВМС Республики Корея и работавшая в сфере международной политики в SK Hynix в США, сейчас является основателем ИИ-стартапа в сфере здравоохранения. Её брак с бывшим офицером морской пехоты США подчёркивает связь с геополитическим контекстом, в котором теперь существует полупроводниковый гигант. Чхве Ингын, единственный сын и, казалось бы, естественный наследник по старой логике, сохраняет молчание. Имея образование в области физики, он покинул SK E&S, чтобы присоединиться к McKinsey, что рассматривается как стандартная внешняя стажировка, но без явных сигналов о наследовании. Громкое судебное разбирательство по разводу родителей, связанное с разделом активов на триллионы вон, стало фоном для их путей. По мере того как SK Hynix становится глобальным геополитическим активом в эпоху ИИ, наследование в SK перестаёт быть семейным делом, превращаясь в публичный экзамен на легитимность в новой, сложной реальности. Наследникам предстоит найти свои собственные ответы на вызовы эпохи.

marsbit2 дня назад 09:08

Свадебное дело Чхве Тхэвона закрыто: раскрывая скрытые линии наследования за триллионной империей SK Hynix

marsbit2 дня назад 09:08

Банки выступают против компромисса по доходности стейблкоинов – Найдёт ли закон CLARITY 60 голосов?

Американский Банковский институт политики выступил против нового проекта закона CLARITY Act, указав на пробелы в регулировании доходности стейблкоинов и мерах по борьбе с незаконными финансами. Банковский сектор добивается полного запрета любых форм вознаграждений по стейблкоинам и лоббирует сенаторов, что снижает поддержку со стороны республиканцев. Из-за смерти сенатора Грэма и болезни Макконнелла у республиканцев стало 51 голос. Если сенаторы Кёртис и Корнин откажут в поддержке, эта цифра упадет до 49, а для принятия закона потребуется 60 голосов. Необходимость заручиться поддержкой 11 демократов осложняется тем, что некоторые про-крипто демократы также выступают против законопроекта. Сроки ограничены: до августовских каникул Сената осталось две недели. Лидер большинства Джон Тюн сомневается в успехе до перерыва. Советник Белого дома по криптовалютам Патрик Уитт призывает провести голосование, утверждая, что новые этические нормы устраняют возражения демократов. Вероятность принятия закона в 2026 году, по рыночным оценкам, упала до 32%.

ambcrypto2 дня назад 09:03

Банки выступают против компромисса по доходности стейблкоинов – Найдёт ли закон CLARITY 60 голосов?

ambcrypto2 дня назад 09:03

За 2 месяца оценка выросла с 8,8 до 68 млрд юаней! Крупнейший AI-хаб OpenRouter может быть куплен

Stripe ведет переговоры о приобретении стартапа OpenRouter, агрегатора API крупных языковых моделей, за сумму около 100 миллиардов долларов. Это представляет собой семикратный рост по сравнению с оценкой OpenRouter в 13 миллиардов долларов двумя месяцами ранее. OpenRouter выступает в качестве «маршрутизатора» или агрегатора для более чем 400 AI-моделей (таких как GPT, Claude и множество открытых), позволяя разработчикам через единый API выбирать наиболее подходящую модель для каждой задачи на основе стоимости, скорости и сложности. Это помогает приложениям снижать расходы, автоматически направляя простые запросы к более дешевым моделям. Компания, основанная соучредителем OpenSea Алексом Аталлой, демонстрирует быстрый рост: ее ежегодный доход достиг 50 миллионов долларов, увеличившись в пять раз за полгода. Для Stripe, крупнейшего процессора онлайн-платежей, это вторая крупная сделка в сфере AI-инфраструктуры после приобретения платформы биллинга Metronome в 2025 году. Стратегия Stripe заключается в создании комплексного предложения для AI-экономики: OpenRouter будет «выбирать модель», Metronome — «подсчитывать потребление», а существующие платежные сервисы Stripe — «обрабатывать оплату». Таким образом, Stripe стремится контролировать ключевой уровень инфраструктуры, который определяет распределение трафика между моделями и формирует счета для конечных предприятий. Сделка подчеркивает растущую важность промежуточного слоя, который управляет стоимостью и выбором моделей для миллионов пользователей AI-приложений.

链捕手2 дня назад 09:00

За 2 месяца оценка выросла с 8,8 до 68 млрд юаней! Крупнейший AI-хаб OpenRouter может быть куплен

链捕手2 дня назад 09:00

От OpenSea до OpenRouter: Алекс Аталлах повторяет сценарий «ухода на пике»?

Автор: Нэнси, PANews Алекс Аталла, соучредитель NFT-платформы OpenSea, покинул компанию на пике пузыря NFT четыре года назад. Сейчас он снова оказывается в центре внимания на волне бума ИИ, готовясь продать созданную им агрегирующую платформу AI-моделей OpenRouter по высокой цене. По данным The Wall Street Journal от 23 июля, платежный гигант Stripe ведет переговоры о приобретении OpenRouter, при этом потенциальная оценка сделки может приблизиться к 100 миллиардам долларов. Если сделка состоится, это станет еще одним успехом Аталлы в создании компании на уровне ста миллиардов долларов после OpenSea. Ранее в этом месяце появились сообщения о том, что OpenRouter получил предложения о покупке от нескольких крупных технологических компаний. Потенциальная сделка со Stripe рассматривается как важный шаг для инфраструктурного гиганта в сфере платежей по расширению своего присутствия в области инфраструктуры ИИ. По данным информированных источников, если сделка будет заключена, оценка OpenRouter может приблизиться к 100 миллиардам долларов, что значительно превышает его предыдущие оценки при финансировании. Всего за три года компания добилась быстрого роста благодаря буму больших моделей. Это не первая компания Аталлы стоимостью в сто миллиардов. Ранее он был соучредителем OpenSea, ведущей мировой платформы для торговли NFT, пиковая оценка которой превысила 130 миллиардов долларов. Его уход с OpenSea до серьезного спада на рынке NFT рассматривался как знаковый сигнал. OpenRouter стала крупнейшим хабом в эпоху ИИ, подключившись к более чем 400 AI-моделям, имея около 10 миллионов пользователей и обрабатывая более 200 триллионов токенов в месяц. Однако, несмотря на быстрый рост, это бизнес с большими объемами, но ограниченной рентабельностью. Его основная бизнес-модель заключается в взимании комиссии за платформу (около 5-5,5%) при вызове разработчиками AI-моделей. Конкуренция на рынке агрегации AI-моделей также обостряется. Высокая оценка OpenRouter, возможно, больше отражает его будущий потенциал, чем текущую прибыльность. Для потенциальных покупателей наиболее ценным активом могут быть не текущие доходы, а накопленные реальные данные об использовании ИИ, которые трудно быстро воспроизвести. От NFT к ИИ Алекс Аталла дважды поймал волну технологического бума. Если продажа OpenRouter состоится с оценкой в 100 миллиардов долларов, это может означать либо переоценку стоимости инфраструктуры ИИ, либо сигнал о новом пике цикла. Ответ на этот вопрос даст только время.

链捕手2 дня назад 08:44

От OpenSea до OpenRouter: Алекс Аталлах повторяет сценарий «ухода на пике»?

链捕手2 дня назад 08:44

Приближается ли Биткойн к очередной зоне накопления? ЭТОТ сигнал говорит «да»

Аналитики отмечают, что Bitcoin (BTC) переживает один из самых длительных медвежьих периодов, охватывающий три квартала и два календарных года, при этом его динамика отклонилась от рынка акций. Однако сохраняется корреляция с акциями Apple (AAPL). График соотношения BTC/AAPL с 2017 года движется в восходящем канале, где его нижняя граница традиционно сигнализирует о зоне недооценки (накопления) для Bitcoin, а верхняя — о перекупленности. В настоящее время соотношение приближается к линии поддержки, что, по историческим данным, может предшествовать новой фазе роста BTC. При этом в 2025 году нарушилась многолетняя корреляция годовой доходности Bitcoin с индексами S&P 500 и Nasdaq 100, что объясняется его более резкой реакцией на макроэкономические потрясения. В качестве подтверждающего сигнала для разворота рассматриваются поступления стейблкоинов на криптобиржи, которые указывают на готовность капитала к реинвестированию. За последние семь дней чистый приток составил $1,42 млрд, что значительно меньше оттока в $10 млрд за предыдущие 30 дней и пока недостаточно для уверенного старта ралли. Таким образом, соотношение BTC/AAPL указывает на возможное приближение к зоне накопления, но для подтверждения тренда необходимы более значительные притоки стейблкоинов.

ambcrypto2 дня назад 08:24

Приближается ли Биткойн к очередной зоне накопления? ЭТОТ сигнал говорит «да»

ambcrypto2 дня назад 08:24

Торговля

Спот

Популярные статьи

Как купить ERA

Добро пожаловать на HTX.com! Мы сделали приобретение Caldera (ERA) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки Caldera (ERA).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение Caldera (ERA)После приобретения вами Caldera (ERA) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля Caldera (ERA)С легкостью торгуйте Caldera (ERA) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

847 просмотров всегоОпубликовано 2025.07.17Обновлено 2026.06.02

Как купить ERA

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на ERA (ERA) представлены ниже.

活动图片