Сильные урезания в Rubin Ultra: Nvidia тоже не справляется с ростом цен на память?

Odaily星球日报Опубликовано 2026-08-03Обновлено 2026-08-03

Введение

Прошлые выходные стали поводом для бурных обсуждений в индустрии ИИ после публикации отчета аналитической компании SemiAnalysis. Согласно данным отчета, NVIDIA значительно изменила спецификации своего флагманского чипа Rubin Ultra, ключевой модели, анонсированной на GTC 2026. Вместо ожидавшегося увеличения вычислительной мощности и объема памяти, компания, судя по всему, пошла по пути оптимизации затрат. Основные изменения в спецификациях Rubin Ultra по сравнению с более ранними ожиданиями и базовой моделью Rubin: * **Теоретическая пиковая производительность (35 PFLOPs) осталась на уровне обычного Rubin.** * **Объем памяти HBM серьезно сокращен** — до 192 ГБ (8-Hi), что даже меньше, чем 288 ГБ (12-Hi) у Rubin. * **Пропускная способность памяти увеличена незначительно** (всего на 1 ТБ/с). * **Энергопотребление осталось высоким**, а максимальное даже возросло. * **Главным улучшением стал масштаб межсоединений (Scale-up)**: поддержка объединения до 576 GPU в единый логический узел через NVLink (против 72 GPU у Rubin). Аналитики SemiAnalysis связывают такое решение с резким ростом цен на высокоскоростную память HBM, которая является ключевым и самым дорогим компонентом современных ИИ-ускорителей. Стоимость HBM3 с 2025 года выросла в несколько раз. Первоначальный дизайн Rubin Ultra приводил к тому, что стоимость памяти в системе приближалась к 40% от общей стоимости материалов (BOM). После пересмотра спецификаций эта доля упала до 28%, что позволило снизить общую расче...

Оригинал | Odaily Planet Daily(@OdailyChina)

Автор | Azuma(@azuma_eth)

Минувшие выходные ознаменовались оживлёнными дискуссиями в индустрии ИИ, вызванными отчётом известного аналитического агентства SemiAnalysis.

Основная суть отчёта заключается в следующем: после того как SemiAnalysis в конце июня сообщила о сокращении оригинальной 4-кристальной (4-die) архитектуры Rubin Ultra от Nvidia, аналитики вновь раскрыли, что Nvidia предоставила ключевым клиентам предварительный обзор Rubin Ultra, и его характеристики оказались ещё ниже, чем ожидалось ранее.

Скриншот с информацией о Rubin Ultra из отчёта SemiAnalysis:

  • Rubin Ultra сохранит тот же теоретический пик производительности, что и Rubin — 35 PFLOPs;
  • Сильно урезан объём видеопамяти: спецификации снижены до 192 ГБ с 8-слойным стеком (8-Hi), что даже меньше, чем у Rubin с 12-слойным стеком (12-Hi) 288 ГБ;
  • Пропускная способность памяти практически не изменилась, увеличившись лишь на 1 ТБ/с, что в реальных вычислениях с высокой пропускной способностью несущественно;
  • Энергопотребление на уровне чипа даже немного возросло: минимальная мощность осталась такой же, как у Rubin (1800 Вт), а максимальная стала выше (2600 Вт);
  • Единственным значительным улучшением является «масштаб сетевого взаимодействия» (Scale-up world size), увеличенный с 72 GPU до 576 GPU. Это означает, что NVIDIA перенесла главную точку продаж на возможности кластерной сети: через сеть NVLink она может объединить до 576 чипов Rubin Ultra в один гигантский «суперлогический GPU» (обычная версия поддерживает подключение максимум 72 карт).

Как топовая флагманская версия Rubin, анонсированная Nvidia на GTC 2026, Rubin Ultra изначально позиционировалась как решение, предназначенное для экстремально масштабных задач обучения и вывода ИИ-моделей, за счёт интеграции большего количества кристаллов и памяти с высокой пропускной способностью. Однако, судя по последним раскрытым SemiAnalysis деталям спецификаций, Nvidia явно скорректировала подход к проектированию Rubin Ultra.

HBM слишком быстро дорожает: Nvidia начинает пересчитывать затраты

За последние два года одним из ключевых компонентов для расширения индустрии ИИ, несомненно, стала память HBM.

Взрывной спрос на ускорители ИИ, такие как Nvidia H100, H200, Blackwell, превратил память с высокой пропускной способностью из относительно нишевого продукта в самый дефицитный элемент всей ИИ-инфраструктуры. SK Hynix, Samsung, Micron, постоянно обновляя рекорды доходов, наращивают инвестиции в HBM, а дисбаланс спроса и предложения продолжает подталкивать цены на HBM вверх.

Для производителей ИИ-чипов важность HBM очевидна — GPU отвечают за вычисления, HBM обеспечивает высокоскоростную передачу данных; вместе они определяют эффективность обучения и вывода ИИ-моделей. Однако проблема в том, что сегодня HBM стала настолько дорогой, что начала влиять на общую экономическую эффективность ИИ-систем. Например, цена на HBM3 в минимальной точке во втором квартале 2025 года составляла всего 180-220 долларов за модуль, в первом квартале этого года (контрактная) выросла до 600-700 долларов, а во втором квартале (спотовая) достигла 700-850 долларов.

Согласно расчётам SemiAnalysis, по мере роста цен на HBM чистая стоимость материалов (BOM) для одной стойки с Rubin Ultra выросла примерно с 6,6 до 8 миллионов долларов, тогда как после корректировки конструкции спецификаций она может снизиться примерно до 6,4 миллиона долларов.

Для Nvidia такая огромная разница в стоимости означает очень практический вопрос: если продолжить увеличивать объём HBM в соответствии с исходным проектом, приведёт ли это к соответствующему росту производительности? Существует ли другое, более оптимальное решение?

SemiAnalysis в своём отчёте отвечает на этот вопрос: корректировка Rubin Ultra по сути является пересмотром компанией Nvidia структуры затрат на ИИ-системы при ограниченных ресурсах, то есть снижение относительно дорогой конфигурации HBM (доля в стоимости снизилась с почти 40% до 28%) и перенаправление ресурсов на более ценную возможность расширения сетевого взаимодействия (доля в стоимости выросла с 4% до 12%).

Как упоминалось ранее, основное направление модернизации Rubin Ultra теперь сместилось в сторону «возможностей расширения на системном уровне». Архитектура NVL576, поддерживаемая Rubin Ultra, позволяет через NVLink соединить до 576 GPU в единый домен вычислений, что призвано компенсировать корректировки спецификаций отдельного чипа за счёт масштабирования системы.

Акции производителей памяти падают: рынок опасается пика спроса

Возможно, из-за этого сообщения, сегодня утром после открытия южнокорейского рынка акции сектора памяти массово пошли вниз. На 11:45 по пекинскому времени лидеры по производству HBM, SK Hynix и Samsung, упали примерно на 8%, индекс KOSPI также снизился примерно на 5%.

Рынок начал опасаться: если информация SemiAnalysis об изменении спецификаций Rubin Ultra подтвердится (Nvidia публично пока не подтвердила эту информацию), означает ли это, что Nvidia как ключевой покупатель в ИИ-инфраструктуре снижает спрос на HBM?

За последние два года, на фоне быстрого роста спроса на расширение ИИ, HBM стала самым дефицитным компонентом ИИ-инфраструктуры. Nvidia, AMD и другие производители чипов продолжали увеличивать конфигурации HBM в своих ИИ-ускорителях, что подстегнуло резкий рост доходов производителей памяти, таких как SK Hynix, Samsung, Micron, и постоянно укрепляло их позиции в цепочке создания стоимости.

Выбор Nvidia может означать, что производители ИИ-чипов рассматривают возможность снижения зависимости отдельных чипов от памяти HBM большой ёмкости за счёт оптимизации аппаратного дизайна. Если этот путь окажется осуществимым, пространство для дальнейшего повышения цен производителями HBM, скорее всего, будет ограничено.

Строительство ИИ-инфраструктуры рано или поздно покинет эпоху «безумного наращивания аппаратных мощностей и бездумного роста цен». И сейчас даже Nvidia, восседающая на железном троне вычислительных мощностей, начала считать деньги.

Связанные с этим вопросы

QКакие ключевые изменения в спецификациях Rubin Ultra сообщил SemiAnalysis?

AПо данным отчёта SemiAnalysis, спецификации Rubin Ultra подверглись значительному снижению: производительность осталась на уровне 35 PFLOPs (как у обычного Rubin), объём памяти уменьшился до 192 GB (8-Hi) вместо ожидаемых 288 GB, пропускная способность памяти выросла лишь на 1 TB/s, энергопотребление чипа даже увеличилось (до 2600 Вт). Единственным существенным улучшением стало увеличение поддержки масштабирования через NVLink — до 576 GPU.

QКакая основная причина, по мнению автора, привела к сокращению конфигурации Rubin Ultra?

AОсновная причина — резкий рост цен на память HBM. Стоимость модуля HBM3 выросла с примерно 200 долларов в середине 2025 года до 700-850 долларов к середине 2026 года. Это сделало изначальный дизайн Rubin Ultra экономически нецелесообразным, и NVIDIA оптимизировала структуру затрат, сократив долю дорогой памяти.

QКак изменилась реакция фондового рынка на сообщение о сокращении конфигурации Rubin Ultra?

AНа новости о возможном снижении спроса на HBM со стороны NVIDIA акции ключевых производителей памяти на корейской бирже резко упали. SK Hynix и Samsung потеряли около 8% стоимости, а индекс KOSPI снизился примерно на 5%. Рынок выразил опасения, что эпоха безудержного роста спроса и цен на HBM может подойти к концу.

QВ чём теперь заключается главное конкурентное преимущество Rubin Ultra после изменения дизайна?

AПосле корректировки дизайна главным преимуществом Rubin Ultra стала не производительность отдельного чипа, а возможность масштабирования на системном уровне. Архитектура NVL576 позволяет объединять до 576 GPU в единый домен вычислений через NVLink, создавая «суперлогический GPU», что компенсирует снижение характеристик отдельных чипов.

QЧто означает перераспределение затрат в структуре себестоимости Rubin Ultra, согласно отчёту?

AСогласно анализу SemiAnalysis, NVIDIA перераспределила затраты в структуре себестоимости (BOM) Rubin Ultra: доля дорогостоящей памяти HBM сократилась с почти 40% до примерно 28%, а ресурсы были перенаправлены на развитие сетевых интерконнектов (NVLink), доля которых выросла с 4% до 12%. Это отражает стратегический сдвиг в оптимизации системы для крупномасштабных кластеров.

Похожее

Атака на Coldcard обостряется: Четвертая волна превысила $90 миллионов в кражах биткоинов

Инцидент с аппаратным кошельком Coldcard перерос в одну из самых масштабных атак в истории Bitcoin. Из-за уязвимости в прошивке устройств Coldcard Mk3 (версии v4.0.1–v5.0.3) сгенерированные сид-фразы имели пониженную энтропию, что делало их предсказуемыми. В результате было похищено около 90 миллионов долларов (более 1367 BTC) с более чем 4500 кошельков. Четвёртая волна атак всё ещё активна: за 2,5 часа в блоках 960,778–960,792 злоумышленники провели 218 транзакций, переместив около 388,92 BTC на новые адреса. Активность по выводу средств в 45 раз превысила обычный уровень. Компания Coinkite, производитель Coldcard, уничтожила все оставшиеся уязвимые устройства и приостановила поставки. Выпущено исправление прошивки, но оно защищает только вновь созданные сид-фразы. Владельцам уязвимых устройств необходимо немедленно сгенерировать новый кошелёк и перевести все средства. Продукты Satscard, Opendime и Tapsigner не затронуты. Этот инцидент подрывает доверие к безопасности аппаратных кошельков, считавшихся одним из самых надёжных решений для холодного хранения Bitcoin.

TheNewsCrypto4 мин. назад

Атака на Coldcard обостряется: Четвертая волна превысила $90 миллионов в кражах биткоинов

TheNewsCrypto4 мин. назад

Китайские высокотехнологичные отрасли массово пересекают "видимую черту"

В последнее время китайские технологические отрасли, такие как искусственный интеллект, робототехника и инновационные фармацевтические препараты, выходят на глобальный рынок и привлекают внимание международных СМИ. Это явление показывает, что накопленные за долгое время промышленные возможности Китая пересекают "видимую черту" — точку, где внутренние достижения становятся заметными и влиятельными на мировой арене. Исторически экспорт Китая эволюционировал от "старой тройки" (одежда, мебель, бытовая техника) к "новой тройке" (электромобили, литиевые батареи, фотоэлектрическая продукция), а теперь к "новейшей тройке". Отрасли, преодолевающие эту черту, обычно демонстрируют значительные масштабы, конкурентные преимущества, ускоренный рост и способность развивать целые цепочки поставок. Ключевым фактором этого ускоренного прогресса является переход от просто "полной" промышленной системы к "плотной", где различные отрасли тесно взаимосвязаны, обмениваются технологиями, талантами и инфраструктурой. Это создает основу для быстрого появления новых инновационных секторов. Например, возможности, накопленные в производстве электромобилей, переносятся в робототехнику, а развитие искусственного интеллекта опирается на достижения в области чипов и вычислительных систем. Этот сдвиг означает, что конкурентное преимущество Китая больше не сводится только к производству, а распространяется на создание целых систем знаний, стандартов и экосистем. Такие системы, основанные на открытости и сотрудничестве (например, через открытые исходные коды и API), позволяют создавать более широкие и устойчивые технологические платформы. Преодоление "видимой черты" — это начало рыночной проверки. Последовательный выход новых отраслей Китая на мировую арену свидетельствует о формировании у страны способности постоянно генерировать новые инновационные промышленные направления.

marsbit28 мин. назад

Китайские высокотехнологичные отрасли массово пересекают "видимую черту"

marsbit28 мин. назад

Forbes: 7 миллионов биткоинов подвержены риску квантовых вычислений — нужно ли BTC менять «замок»?

Форбс: 7 миллионов биткойнов под угрозой квантовых вычислений – нужна ли BTC новая «защита»? Квантовые компьютеры потенциально могут взломать криптографию, защищающую биткойны на миллиарды долларов. По оценкам Galaxy Digital и Glassnode, около 7 млн BTC (примерно 30% предложения) находятся в адресах с публичными ключами, уже раскрытыми в блокчейне. Риск реален, но текущие квантовые машины ещё не способны осуществить взлом. Исследования Google показывают, что необходимые для этого мощности (менее 1 млн кубитов) могут появиться в обозримом будущем. В ответ сообщество ищет решения. Предлагаются два основных подхода BIP: BIP-360 (новый тип квантоустойчивых адресов) и более спорный BIP-361 (поэтапное «замораживание» неизрасходованных монет старого типа, включая возможные монеты Сатоши). На этом фоне появляются стартапы, такие как American Fortress, которые заявляют о решении, не требующем миграции адресов, но их заявления пока не подкреплены публичными исследованиями или аудитом. Компания также продвигает слой приватности с выборочной идентификацией для соответствия регуляторным требованиям. Гонка за защиту биткойна от квантовой угрозы идёт полным ходом, но ни одно решение пока не стало общепринятым стандартом. Вопрос стоит не только о технологическом обновлении, но и о будущей устойчивости сети в долгосрочной перспективе.

marsbit34 мин. назад

Forbes: 7 миллионов биткоинов подвержены риску квантовых вычислений — нужно ли BTC менять «замок»?

marsbit34 мин. назад

10 млрд долларов на выкуп не смогли остановить падение HYPE: ключевые участники и Multicoin тайно продают монеты?

Согласно анализу данных, с декабря 2025 года по конец июля 2026 года, примерно 4.93 миллиона токенов HYPE (0.493% от общего предложения) были распределены между членами команды. Из них 1.19 миллиона были проданы на открытом рынке на сумму около 32.5 миллионов долларов США, а 3.14 миллиона переведены на внебиржевые (OTC) площадки. За тот же период Assistance Fund проекта выкупил примерно 9.8 миллионов токенов HYPE, потратив около 364 миллионов долларов, что более чем в два раза превышает объем продаж командой. Совокупный объем выкупа фонда превысил 1.02 миллиарда долларов. Несмотря на эти масштабные выкупы, цена HYPE упала примерно на 30% с исторического максимума в 76 долларов в середине июня 2026 года до примерно 52.4 доллара. Это снижение связано не только с ограниченными продажами команды, но и с другими факторами, включая уменьшение объема торгов на протоколе, что замедляет выкуп, а также с действиями крупных инвесторов. Такие фонды, как Multicoin Capital и a16z, выводили значительные объемы токенов из стейкинга и фиксировали прибыль. Кроме того, с начала июля 2026 года биржевые ETF на HYPE столкнулись с устойчивым оттоком средств после периода значительного притока в мае-июне.

marsbit52 мин. назад

10 млрд долларов на выкуп не смогли остановить падение HYPE: ключевые участники и Multicoin тайно продают монеты?

marsbit52 мин. назад

WEEX API Fast Connect: Сделайте каждого нового пользователя активным трейдером менее чем за 10 секунд

WEEX представляет API Fast Connect — систему авторизации OAuth в один клик, которая позволяет пользователям подключить свой аккаунт WEEX к партнерским платформам без необходимости ручного создания или управления API-ключами. Решение разработано специально для партнеров программы WEEX Broker и заменяет технически сложный процесс подключения на мгновенную авторизацию, что ускоряет конверсию и повышает долгосрочную удержанность пользователей. Ключевые преимущества: - **Беспрепятственная конверсия:** Пользователи переходят от регистрации к реальной торговле менее чем за 10 секунд. - **Автогенерация ключей:** API-ключи создаются автоматически на стороне сервера, исключая ошибки ручного ввода. - **Повышенная безопасность:** Ключи передаются по зашифрованному каналу и никогда не отображаются пользователю. - **Снижение оттока:** Упрощённый процесс подключения уменьшает количество пользователей, теряемых на этапе настройки API. Как это работает: 1. Пользователь нажимает «Войти через WEEX» на партнерской платформе. 2. Происходит перенаправление на официальную страницу авторизации WEEX. 3. Пользователь подтверждает разрешения (по умолчанию доступно чтение и торговля). 4. Система автоматически генерирует и привязывает API-ключ к платформе через защищённое соединение. Решение предназначено для AI-сигнальных платформ, копи-трейдинга, торговых ботов и других сервисов, где ручная настройка API создаёт барьер для пользователей. API Fast Connect является частью экосистемы WEEX Broker, которая также включает институциональную ликвидность, комиссионные программы до 70% и полный доступ к API. WEEX — глобальная криптобиржа с более чем 6,2 млн пользователей, предлагающая свыше 1200 спотовых пар и фьючерсы с плечом до 400x.

TheNewsCrypto59 мин. назад

WEEX API Fast Connect: Сделайте каждого нового пользователя активным трейдером менее чем за 10 секунд

TheNewsCrypto59 мин. назад

Торговля

Спот
活动图片