Обработка & перевод: DeepwaveTechFlow

Спикер: Хуан Жэньсюн, генеральный директор NVIDIA
Источник подкаста: Бонни Блокчейн Bonnie Blockchain
Оригинальный заголовок: 7 ключевых моментов выступления Хуан Жэньсюна на GTC Taipei 2026, краткий обзор последних планов Nvidia! 【Бонни Блокчейн】
Дата выпуска: 2 июня 2026 г.
Ключевые выводы
В своем выступлении на GTC Taipei в 2026 году Хуан Жэньсюн сосредоточил следующую стратегическую фазу NVIDIA на одном ключевом утверждении: ИИ перешел от генерации контента к эпохе работающих агентов, где токен — это уже не просто технический показатель, а единица производства дохода, прибыли и ВВП. Вокруг этого изменения NVIDIA представляет Vera Rubin, Vera CPU, набор инструментов для корпоративных агентов, ПК нового поколения в сотрудничестве с Microsoft, а также Cosmos 3, Alpamayo 2 и Isaac GR00T для физического ИИ. Хуан Жэньсюн подчеркивает, что вычислительная парадигма следующего десятилетия будет формироваться моделью, фреймворком агента, инструментами/навыками и средой выполнения, и она будет распространяться из облака, корпоративных систем и локальных ПК на роботов, фабрики, спутники и периферийные устройства. Для тайваньских цепочек поставок это означает, что ИИ-фабрики, энергоэффективность, скорость доставки инфраструктуры и способность к полному стековому взаимодействию станут ключом к следующему витку промышленного роста.
Краткий обзор ключевых идей
Наступление эры ИИ-агентов
- "Полезный ИИ уже здесь, ИИ теперь — генератор прибыли и генератор ВВП. За ним стоит не просто большая языковая модель, а совершенно новая вычислительная парадигма: агент."
- "Агент состоит из большой языковой модели и фреймворка агента, который, подобно операционной системе, соединяет память, инструменты, рассуждения, планирование и действие."
- "Прорыв в агентных системах стал возможен благодаря тому, что большие языковые модели уже способны мыслить, рассуждать, планировать и использовать инструменты, а также благодаря появлению фреймворков агентов, которые могут управлять памятью, координировать процессы и планировать использование инструментов."
- "Каждая компания станет компанией-агентом, внутри каждой компании будут работать агенты, и каждой компании понадобится своя операционная система для агентов."
Токен, ИИ-фабрики и экономика инфраструктуры
- "Токен теперь — это прибыльная единица дохода. ИИ-компании, желающие производить больше токенов, будут строить больше ИИ-фабрик, и именно поэтому спрос на вычисления на Тайване так резко вырос."
- "Вычисления — это доход, вычисления — это прибыль. Отсутствие дохода и прибыли — это убыток."
- "Если ИИ-фабрика имеет только 1 гигаватт электроэнергии, это ее предел; в этих условиях пропускная способность на ватт — это и есть доход, потому что каждый токен имеет ценность."
- "Выбор неверной архитектуры только потому, что чип дешевле, не превратится в реальную выгоду. Вам нужно обеспечить доход на ватт. Чем больше вы покупаете, тем больше зарабатываете."
Vera Rubin и трансформация инфраструктуры NVIDIA
- "Vera Rubin — это не один чип и не просто GPU, а целостная система, созданная с нуля."
- "NVIDIA раньше была компанией по производству GPU, затем стала системной компанией, а сейчас превращается в инфраструктурную компанию, помогающую клиентам строить ИИ-фабрики."
- "Vera Rubin — самый амбициозный инженерный проект в истории NVIDIA. Все 40 000 инженеров компании участвовали в нем, и тайваньская цепочка поставок также внесла вклад в создание этой системы."
- "Grace Blackwell создан для обработки ИИ, особенно для вывода (inference); Vera Rubin создан для работы агентов."
Vera CPU и вычислительные потребности агентов
- "Все предыдущие CPU создавались для людей. Этот CPU создан для агентов."
- "У агентов нет терпения. Они живут в мире, где время измеряется не секундами, а наносекундами. Когда агент использует инструмент, он хочет мгновенного отклика; когда обращается к базе данных — немедленного результата."
- "Vera CPU — это CPU, созданный для агентов. В нем делается упор на производительность одного потока, количество инструкций за такт, пропускную способность на ядро и общую пропускную способность системы."
- "Этот рынок обязательно будет больше предыдущего, потому что количество агентов значительно превысит количество людей, и у агентов совершенно нет терпения. Это NVIDIA Vera CPU."
Следующее поколение персональных компьютеров
- "Будущая парадигма вычислений с агентами будет работать в ИИ-облаке, внутри корпоративных сетей, а также на вашем ПК."
- "Новая операционная система будет представлять собой традиционную ОС плюс большую языковую модель; во многом большая языковая модель — это современная версия DirectX, интеллектуальное расширение компьютера."
- "Приложения будут заменены средой выполнения агентов; современное приложение станет агентом."
- "NVIDIA и Microsoft заново изобретают ПК и выводят на рынок новое поколение машин на Windows для настольных ПК, ноутбуков и рабочих станций."
Физический ИИ, автономное вождение и роботы
- "Языковые модели обучаются на данных с человеческой точки зрения, но роботам нужно понимать мир с собственной перспективы робота. Самая большая проблема физического ИИ — данные."
- "Cosmos 3 — это передовая фундаментальная модель для физического ИИ, которая может понимать, рассуждать, генерировать, симулировать в замкнутом цикле и даже сама становиться стратегией."
- "С появлением ИИ сами вычисления тоже станут данными; можно использовать Cosmos 3 для обучения большего количества ИИ-моделей и дорабатывать ее как свою собственную проприетарную модель."
- "Будь то облачный агент, ПК-агент, система автономного вождения или гуманоидный робот, за всем этим стоит одна и та же вычислительная парадигма: модель, фреймворк, инструменты/навыки и среда выполнения."
Тайваньские закуски, отмеченные Хуан Жэньсюном, становятся частью цепочки поставок ИИ
Хуан Жэньсюн:
Масштаб, до которого выросла тайваньская экосистема, действительно невероятен. Когда большинство людей говорят об экосистеме, они в первую очередь думают о нашем программном стеке, об экосистеме разработчиков поверх вычислительных систем NVIDIA. Но экосистема NVIDIA этим не ограничивается; она простирается вверх до тайваньской цепочки поставок, где все начинается; и вниз — до дата-центров и конечных пользователей.
Сегодня мы почти коснемся каждого звена этой экосистемы. Здесь так много людей, которым стоит сказать спасибо. Я люблю эту экосистему, здесь очень много компаний и много моих любимых партнеров. Тайвань обладает невероятно богатой экосистемой, это лучшая в мире экосистема цепочек поставок.
Наступает эра ИИ-агентов
Хуан Жэньсюн:
Два года назад, когда я был здесь, я начал рассказывать о том, как ИИ переходит от генеративного к следующей волне — агентному ИИ. Сегодня мы можем сказать, что агентный ИИ уже здесь, полезный ИИ уже здесь.
С точки зрения индустрии это означает, что спрос на токены становится чрезвычайно высоким. Потому что если ИИ действительно может выполнять работу, люди захотят производить больше таких возможностей. Теперь токен — это прибыльная единица, единица, генерирующая доход. Раз это приносит деньги, ИИ-компании захотят создавать больше токенов, генерировать больше токенов, строить больше ИИ-фабрик, и именно поэтому спрос на вычисления на Тайване так резко вырос.
Именно поэтому вы все так заняты и ваши компании так хорошо работают. На самом деле, это, кажется, отражается и на ценах акций некоторых из ваших компаний. Вычислительная парадигма изменилась, все изменилось.
Первый ключевой момент: полезный ИИ уже здесь, ИИ теперь — генератор прибыли и генератор ВВП. За ним стоит совершенно новая вычислительная парадигма. Это не просто большая языковая модель, а агент. Почти все, о чем мы сегодня будем говорить, будет основано на этом.
Позвольте мне потратить немного времени, чтобы объяснить, о чем я. Здесь находится агент, агентное приложение. Раньше здесь было бы приложение, код, операционная система, то есть код приложения, работающий поверх ОС. Сегодня это агент, состоящий из одной или нескольких больших языковых моделей, помещенных в фреймворк агента. Этот фреймворк помогает ему координировать работу, позволяя действительно выполнять продуктивные задачи.
Когда входные данные попадают в систему, агент должен понимать, наблюдать, рассуждать, действовать и использовать инструменты. Инструментами могут быть электронная таблица, веб-браузер, механизм обработки данных или механизм базы данных. Каждый поток информации, будь то обработка контекста, понимание происходящего, рассуждение о следующих шагах или формирование исполняемого плана, требует координации с помощью какого-либо программного обеспечения.
Таким образом, сущность агента — это такая система. Он обрабатывает кратковременную память, рабочую память, а также долговременную память, как человек. Система управления памятью становится чрезвычайно важной. Вся система называется агентом. Большая языковая модель отвечает за мышление, фреймворк агента соединяет все вместе, подобно операционной системе.
Это новая вычислительная парадигма и причина, по которой агенты могут выполнять удивительные задачи. Это серьезный прорыв: большие языковые модели уже могут хорошо мыслить, рассуждать, планировать, использовать инструменты; в то же время у нас появились фреймворки агентов, способные управлять памятью, координировать процессы и вызывать инструменты. Поэтому теперь мы можем делать многое из того, что было невозможно раньше.
Что такое токен для ИИ-фабрики?
Хуан Жэньсюн:
Токен, DSX, GPU, CPU, Vera... Мы создали систему следующего поколения Vera Rubin. Vera Rubin — это не один чип и не просто GPU. Она начинается с GPU, но далеко выходит за его рамки. Вся сквозная система — это и есть Vera Rubin.
Она включает GPU, Vera Rubin NVLink 72, и управляется Vera CPU, о котором я расскажу позже. Она также включает революционную систему хранения Vera, CX9, наш программный стек DOCA и встроенный защищенный процессор. Все данные в системе, будь то данные в состоянии покоя, в процессе передачи или использования, шифруются. Вся система безопасна, потому что ИИ-модели чрезвычайно ценны. Вот почему вся система следует принципам конфиденциальных вычислений (confidential computing).
Любая из этих систем сама по себе могла бы стать полноценной революцией. Vera Rubin — самый амбициозный инженерный проект в истории NVIDIA. Все 40 000 инженеров компании участвовали в работе над Vera Rubin, не говоря уже о том, что вы, присутствующие здесь, также участвовали в создании всей системы. Vera Rubin — это действительно чудо, это не просто чип, а система, состоящая из множества компонентов.
И это еще не все. Давным-давно NVIDIA была компанией по производству GPU; за эти годы мы постепенно эволюционировали в системную компанию. То, что вы видите сейчас, — это самая сложная система, которую мы когда-либо проектировали с нуля. Но в конечном счете наши клиенты и партнеры хотят не покупать компьютеры, а строить ИИ-фабрики.
Вот почему NVIDIA снова начинает трансформацию. Как вы можете видеть, многие наши технологии расширились до масштаба полной инфраструктуры. Наши партнеры также работают в инфраструктурном масштабе: электростанции, системы охлаждения, поставщики электросетей, а также многие промышленные предприятия теперь стали частью нашей экосистемы. В конечном счете, мы должны построить полный технологический стек, как когда-то строили GPU, Grace Blackwell, NVLink 72; теперь мы строим полный стек систем, чтобы клиенты могли создавать превосходную ИИ-инфраструктуру.
Сделать это хорошо, помочь клиентам построить и развернуть ИИ-фабрики, стало чрезвычайно важным. Причина проста: вычисления — это доход, вычисления — это прибыль. Отсутствие дохода и прибыли — это убыток.
Вам нужно понять одну вещь: когда ИИ-инфраструктура запускается, она может быть запущена быстро или очень долго; ее пропускная способность может быть высокой или низкой; гибкость и надежность могут быть хорошими или плохими; эффективный срок службы может быть долгим или коротким. Поскольку это инвестиции в размере 50, 60 или даже 100 миллиардов долларов, эта кривая чрезвычайно важна.
Вот почему NVIDIA — хороший партнер. У нас есть возможности для полной интеграции; мы не просто сделали презентацию, а действительно создали всю инфраструктуру, соединили все и сами построили ее в большом масштабе, чтобы обеспечить хорошую работу системы. Поэтому наше время до первого токена, время первого вывода, время запуска обучения — все это происходит быстрее.
Во-вторых, наша пропускная способность на ватт, количество токенов на ватт — мирового класса. Причина в том, что мы интегрируем все, проектируем все с нуля, симулируем всю систему и применяем экстремальное совместное проектирование (co-design). Как показано на только что продемонстрированном стоечном шкафу Vera Rubin, все спроектировано для достижения удивительной пропускной способности.
Если ваш дата-центр, ваша фабрика имеют 1 гигаватт электроэнергии, больше не будет, это вся доступная вам генерирующая мощность. При 1 гигаватте пропускная способность на ватт — это и есть доход, потому что каждый токен генерирует прибыль, каждый токен — это доход.
Таково будущее. Вычисления — это доход, производительность на ватт — ваш доход. Выбор неверной архитектуры только потому, что чип дешевле, не превратится в реальную выгоду. Вам нужно обеспечить доход на ватт. Чем больше вы покупаете, тем больше зарабатываете.
Стоя перед вами, я могу сказать: Vera Rubin находится в полном производстве. Масштаб цепочки поставок, который мы создали для Vera Rubin, вдвое больше, чем для Grace Blackwell. Раньше на сборку одного стоечного шкафа Grace Blackwell уходило два часа, теперь — всего пять минут. Так что не только производственные мощности выше, но и пропускная способность производства намного выше, и все это нам нужно для удовлетворения спроса.
Эта экосистема необыкновенна. Для поддержки Grace Blackwell и подготовки к наращиванию производства Vera Rubin уже введены в строй миллионы квадратных футов производственных мощностей. Я хочу поблагодарить вас. Vera Rubin находится в полном производстве. Спасибо всем.
Введение в систему Vera Rubin
Хуан Жэньсюн:
Vera Rubin создан не только для ИИ. Vera Rubin создан не только для работы ИИ, он создан для работы агентов. Это агентная система. Представьте себе сложность. И именно поэтому агент — это последний прорыв в компьютерных науках. Потребовалось так много лет, чтобы его потенциал наконец реализовался и он стал полезным. Компьютер, способный его запускать, также должен быть самым передовым в мире.
Это и есть Vera Rubin. Давайте посмотрим. Принесите Vera Rubin.
Это Vera Rubin, Vera Rubin NVLink 72. Это часть системы следующего поколения, о которой я расскажу больше на следующей GTC; сегодня у нас еще много тем. Это стоечный шкаф с Vera CPU, 256 CPU, все с жидкостным охлаждением. Я расскажу о Vera позже. Это система обработки и хранения Vera BlueField, а также система безопасности. И, конечно, наша сеть Mellanox, первая в мире CPO (копакетная оптика). Это Vera Rubin, удивительное сочетание технологий.
Когда мы создавали Hopper, это было для предварительного обучения (pre-training). Предварительное обучение было тогда самым важным приложением, самой важной нагрузкой, с которой мы сталкивались. Позже, когда создавали Grace Blackwell, все говорили: "Дженсен, NVIDIA отлично справляется с предварительным обучением, вывод (inference) — это просто". Помните? Многие тогда говорили: "Вывод прост, мы тоже можем это делать".
Но вы знаете, вывод — это деньги. Модели очень сложны, и одновременно добиться высокой скорости отклика, быстрого взаимодействия и высокой пропускной способности очень трудно. Вот почему мы создали NVLink 72.
Сегодня стоимость токена у NVIDIA — самая низкая в мире. Не на 10% ниже, а в разы, даже на порядок. Все благодаря экстремальному совместному проектированию, потому что мы понимаем вычислительную модель и парадигму вывода и создали NVLink 72.
С Vera Rubin все вышло за рамки вывода. Теперь это вывод в агентной системе. Это Vera Rubin. Никаких кабелей, никаких шлангов, никаких вентиляторов. Когда я показывал его вам в прошлый раз, повсюду были кабели.
VERA CPU: CPU для ИИ-агентов
Хуан Жэньсюн:
Vera CPU — это CPU, созданный для эпохи ИИ. До сих пор все CPU создавались для людей. Мы были пользователями, арендаторами. Люди используют CPU, живя в мире, где время измеряется секундами. Мы арендуем CPU в облаке, и чем больше ядер у CPU, тем больше ресурсов можно сдавать в аренду. Сценарии использования и экономика старых CPU совершенно не похожи на сценарии для агентов.
У агентов нет терпения. Они живут в мире, где время измеряется не секундами, а наносекундами. Когда агент использует инструмент, он хочет мгновенного отклика; когда обращается к базе данных — немедленного результата. Каждое мгновение ожидания агента препятствует переходу к следующему шагу, и еще к следующему, и еще. Поэтому мы должны сделать CPU максимально низколатентным, максимально интерактивным.
Вот почему мы создали Vera CPU для эпохи ИИ. В нашей системе у него три назначения. Первое, конечно, — мышление в Vera Rubin. В стоечном шкафу Vera Rubin уже есть два CPU. Как вы знаете, мы производим и продаем миллионы Vera Rubin и уже продали миллионы Grace Blackwell. NVIDIA уже является одним из крупнейших производителей CPU в мире.
Два CPU в стоечном шкафу Vera Rubin, один из которых координирует и управляет GPU, управляет KV-кешем и обрабатывает все программное обеспечение, работающее в шкафу. У нас также есть Grace BlueField для безопасности и изоляции. Вычислительная часть Vera используется для фреймворка агента, отвечая за координацию ИИ-моделей, использование инструментов и доступ к базам данных.
Здесь сервер данных — это Vera BlueField, самая быстрая в мире система хранения и хранения данных. Она имеет решающее значение, потому что агенты обращаются к памяти с огромной скоростью. Серверы хранения и CPU теперь находятся на критическом пути самой дорогой части дата-центра.
То, что это самая дорогая часть, имеет вескую причину. Ядро экономики ИИ-фабрики — токен, и именно здесь токен создается. Поэтому, конечно, вы хотите производить и генерировать как можно больше токенов. Экономическая ценность сосредоточена здесь, и CPU и система хранения ни в коем случае не должны быть узким местом.
Таким образом, Vera CPU оказывает большое давление на архитектуру CPU, и именно поэтому мы создали совершенно новую архитектуру с нуля. Это CPU, которого мир никогда не видел, мы называем его Vera. Это CPU, созданный для агентов. Все предыдущие CPU создавались для людей. Этот CPU создан для агентов.
Во-первых, количество инструкций за такт (IPC) у Vera должно быть исключительно высоким, потому что нам нужно сократить задержку, сократить время обработки. Нам нужна производительность одного потока, а не просто пропускная способность. Производительность одного потока должна быть мирового уровня, лучшей в мире. Поэтому IPC у Vera чрезвычайно высок, это мировой рекорд: 10 инструкций за такт на выборку, декодирование и выполнение.
Во-вторых, пропускная способность, необходимая CPU для ввода и вывода данных, должна быть мирового уровня. Это включает как пропускную способность на ядро, так и общую пропускную способность. Как я говорил ранее, агентные системы по своей сути являются несвязанными (decoupled) и распределенными. Когда вычисления разделены и распределены, сеть становится проблемой. Поэтому мы должны перемещать данные между ядрами CPU, между CPU и памятью, между CPU и GPU как можно быстрее.
Пропускная способность как внутри системы, так и между ядрами CPU должна быть мирового уровня, потому что ядра CPU общаются друг с другом с очень высокой пропускной способностью. Они сдаются в аренду не по одному ядру, а все вместе работают совместно. Поперечная пропускная способность (cross-sectional bandwidth) Vera просто поразительна. Это первая система, поддерживающая PCI Express Gen 6, а также первая с LPDDR5, с пропускной способностью от 1,2 до 2 ТБ/с, что в 2-3 раза выше, чем у самых производительных CPU.
Это CPU, созданный для агентов. Этот рынок обязательно будет больше предыдущего, потому что количество агентов значительно превысит количество людей, и у агентов совершенно нет терпения. Это NVIDIA Vera CPU.
Важнейшая вычислительная парадигма следующего десятилетия
Хуан Жэньсюн:
Это действительно самый важный слайд. Ключевой вывод здесь: это парадигма приложений и вычислений на следующее десятилетие. Агент, фреймворк агента и большая языковая модель, координируемая фреймворком, — это будет работать в каждой компании. Каждая компания станет компанией-агентом, внутри каждой компании будут работать агенты, каждая компания обнаружит, что агентам нужна своя операционная система.
Каждая компания спрашивает нас: как безопасно запускать агентов? Как строить агентов для своей рабочей нагрузки? Поэтому у нас есть NVIDIA Enterprise AI Agent Toolkit. Вы фактически видели, как я публично строил его шаг за шагом.
Почти все, что делает NVIDIA, как вы знаете, если посмотреть мои выступления на GTC 5 или 10 лет назад, вы увидите, что я годами говорил о сегодняшних вещах, потому что мы все это время готовились к этому моменту.
Чтобы корпорациям создавать агентов как услугу или агентов для операций, им нужно четыре вещи. Во-первых, модель. Конечно, чем умнее, дешевле и быстрее большая языковая модель, тем лучше. Во-вторых, нужен фреймворк для координации всей системы. В-третьих, этим моделям нужны инструменты, и эти инструменты обладают навыками. Я только что показывал библиотеки CUDA-X, в будущем они станут мощными инструментами для агентов. В-четвертых, нужна среда выполнения (runtime), операционная система, которая все связывает.
Это и есть NVIDIA Agent Toolkit. Он включает модели, которые можно модифицировать, — мировые открытые модели от NVIDIA. Я хочу показать еще кое-что. Вы можете запускать агентов откуда угодно, можете запускать мощных агентов, таких как Claude Code, или мощных агентов, таких как Codex. Вы можете поместить их в фреймворк под названием Open Shell для высокобезопасного запуска внутри компании.
Эта оболочка (Shell) будет защищать агента, обеспечивая его постоянное соответствие политикам безопасности. Конфиденциальность защищена, права и привилегии четко распределены, идентичность защищена. Поэтому Open Shell внедряется по всему миру. NVIDIA Open Shell имеет открытый исходный код, вы увидите, как многие компании его принимают, включая Red Hat, Canonical и Microsoft. Он будет принят повсеместно.
Это важная среда выполнения, и она полностью оптимизирована для повсеместно доступной платформы NVIDIA AI. Вы можете запускать Open Shell в любом облаке, локально или даже на устройстве. Теперь у вас есть инструменты и библиотеки, которые могут использовать агенты, модели, которые можно модифицировать или использовать напрямую, и фреймворки агентов. Эти фреймворки агентов теперь могут работать локально или где угодно.
Один из моих любимых сценариев использования агентов — дизайнеры микросхем. Это одна из самых важных работ в NVIDIA. Поэтому, конечно, мы сотрудничаем с Cadence, чтобы построить супер-агента для проектирования микросхем. Он координируется Codex или Claude Code, принимает на вход RTL, архитектурные схемы, принципиальные схемы или спецификации и помогает исправить то, что нужно исправить. Вместе мы создали несколько супер-агентов и оптимизировали Nemotron для среды выполнения NVIDIA.
NVIDIA стремится создавать открытые модели для мира, чтобы вы, мы все могли создавать своих агентов. Сегодня мы анонсируем Nemotron 3 Ultra, нашу следующую открытую модель, и она очень умная. Модели Nemotron дают вам не только модель, но и все данные, которые мы использовали для ее обучения.
Потому что у нас есть мощный альянс партнеров, как вы можете видеть из списка здесь. Мы совместно работаем, вносим свой вклад в данные. Благодаря этим замечательным партнерским отношениям все — от моделей и скриптов обучения до данных — будет полностью открыто для вас. Это лучшая форма политики открытых моделей, лучшая в мире система открытых моделей. Цель проста: вы можете взять все, продолжить наращивать, сделать лучше и превратить в свою собственную модель.
Nemotron 3 Ultra в 5 раз быстрее, на 30% дешевле и полностью открыт. Мы очень в этом уверены. Это Nemotron 3, и мы также разрабатываем Nemotron 4. Именно этот полный набор инструментов, состоящий из моделей, фреймворков, инструментов/навыков и среды выполнения, позволяет каждой компании в мире создавать своих собственных агентов, как Cadence создала супер-агента.
Новое поколение персональных компьютеров от NVIDIA
Хуан Жэньсюн:
Microsoft и NVIDIA заново изобретут ПК. Это станет новым ПК. Завтра вечером, наверное, здесь завтра вечером, я буду с Сатьей, и мы поговорим подробнее о работе, которую мы совместно вели последние три года. Microsoft и NVIDIA потратили столько времени, полностью переосмыслив, как работает ПК, именно чтобы подготовиться к этому моменту.
Как я уже говорил, эта парадигма вычислений с агентами будет работать в ИИ-облаке, будет работать внутри корпоративных сетей, а также будет работать на вашем ПК. Что произойдет, когда у ПК появится автономный агент? Он будет помогать вам, понимать вас. Вы можете разговаривать с ним, он может вас видеть. Вы можете заставить его читать файлы, помогать в исследованиях. Он может делать еще больше, я покажу позже.
Новая операционная система, конечно же, старая ОС плюс большая языковая модель. Во многом большая языковая модель — это современная версия DirectX. У нее есть ввод и вывод, она понимает промпты, понимает компьютерное зрение, может генерировать видео, может генерировать звук. Это современное интеллектуальное расширение ПК и компьютера.
Поверх этого, как я уже говорил, приложения будут заменены средой выполнения агентов, и современное приложение — это агент.
Дамы и господа, ноутбук NVIDIA RTX Spark. Спасибо. У меня слишком много вещей в карманах. Хорошо, это самый удивительный чип в мире. Это N1X, созданный в сотрудничестве с MediaTek. Кажется, я только что видел Рика. Это N1X, красивый чип. Честно говоря, это чип, на создание которого потребовалось 33 года.
Причина в том, что здесь может работать 100% программного стека NVIDIA. Вы хотите заниматься цифровой биологией — нет проблем; хотите обрабатывать данные о землетрясениях — нет проблем; хотите заниматься астрофизикой — нет проблем. Все, что связано с CUDA, вся физика, вся биология, вся геномика, весь ИИ — нет проблем. Вся компьютерная графика — тоже нет проблем.
Каждое приложение, которое когда-либо создавала NVIDIA, и каждое приложение, которое когда-либо работало на Windows, было тщательно оптимизировано Microsoft и NVIDIA, чтобы этот компьютер действительно мог запускать все, что когда-либо создавалось в мире. Более того, теперь он может запускать агентов. Это невероятный компьютер, и я им очень горжусь.
На этом компьютере может быть локальная модель Nemotron 3 Ultra или супер-модель Nemotron 3; он также может подключаться к Claude Code, Codex или другим моделям в облаке; может подключаться к моделям в сети. Он будет работать и делать удивительные вещи. RTX Spark — это переизобретение ноутбука, но на самом деле Microsoft и NVIDIA переизобретают весь ПК.
Сегодня мы анонсируем совершенно новую продуктовую линейку: три революционные машины на Windows для настольных ПК, ноутбуков и рабочих станций. Они на 100% совместимы с Windows, на 100% поддерживают CUDA, на 100% оснащены тензорными ядрами NVIDIA AI. Все, что вы видите работающим на различных платформах NVIDIA по всему миру, будет работать и здесь.
У нас есть дорожная карта для этого. Это совершенно новое семейство продуктов. Для каждого поколения архитектуры у нас будут настольные ПК, ноутбуки, рабочие станции; следующее поколение также будет иметь настольные ПК, ноутбуки, рабочие станции. Я очень рад и горд тем, что 100% индустрии ПК по всему миру присоединились к нам, чтобы вместе заново изобрести ПК. Это новая продуктовая линейка и новое начало.
Cosmos 3: фундаментальная модель для физического ИИ
Хуан Жэньсюн:
В случае языковых моделей данные для обучения в интернете, на английском и других языках, представляют точку зрения человека. Их пишем мы и читаем мы. Однако, если создавать данные для ИИ-роботов, они должны исходить из восприятия и перспективы робота. Подавляющее большинство видеоданных в мире — это вид от третьего лица, а не от первого.
Поэтому для агентных систем, робототехнических систем и физического ИИ данные — самая сложная проблема. Вы уже видели, как мы продвигались по этой лестнице вверх. Мы начали с телеоперации (teleoperation), по сути, демонстрации человеком. Это не отличается от прорыва в обучении с подкреплением, основанного на человеческой обратной связи. Затем мы использовали симуляцию, здесь вступает в игру Omniverse. Это аналогично проверяемым вознаграждениям в обучении с подкреплением.
Мы используем эти системы для инициализации (bootstrap) ИИ-моделей, инициализации моделей физического ИИ. В конечном итоге мы смогли обучаться с перспективы от третьего лица и проецировать это обратно на перспективу от первого лица. Благодаря этому процессу инициализации мы в итоге получили фундаментальную модель мира, способную понимать физический мир с любой желаемой перспективы. От третьего лица, от первого лица, извне внутрь, изнутри наружу — все возможно. Это действительно серьезный прорыв.
Сегодня мы анонсируем Cosmos 3. Cosmos 3 — это передний край физического ИИ. Мы находимся на переднем крае в языковых моделях, многие также занимаются языковыми моделями. Но в физическом ИИ мы, безусловно, сильнейшие в мире. Я невероятно горжусь командой за достижение этого.
Это ваша фундаментальная модель для любой работы. Неважно, хотите ли вы создавать роботов, фабричных роботов или роботов, работающих на фабриках, если речь идет о физическом мире, теперь у вас есть партнер: Cosmos 3. Он может понимать и рассуждать, может генерировать, может симулировать в замкнутом цикле и даже может сам становиться стратегией. Он лидирует в мировых рейтингах по различным категориям. Я очень горжусь Cosmos. Сегодня мы анонсируем Cosmos 3.
Раньше было: данные + вычисления = ИИ. Теперь у нас есть ИИ, и вычисления также станут данными. Поэтому используйте Cosmos 3, чтобы обучать множество ИИ-моделей. Cosmos — это очень мощная система открытых моделей, полностью аналогичная Nemotron. Мы открываем модели, открываем данные, даже открываем методы обучения, чтобы вы могли дорабатывать ее для себя и превращать Cosmos в свою проприетарную модель.
Alpamayo 2: вывод для автономного вождения
Хуан Жэньсюн:
Сегодня мы анонсируем Alpamayo 2, открытую модель для автономных автомобилей. Мы сотрудничаем с автомобильными компаниями по всему миру. Если посмотреть на бренды, которые уже присоединились к NVIDIA Hyperion и создают автомобили на его основе, они представляют около 80% мирового автопрома. То есть эти производители охватывают примерно 80% автомобилей в мире.
В будущем будет много систем NVIDIA Hyperion, способных запускать Alpamayo, а также любые другие стеки технологий автономного вождения. Мы также подключаемся к службам мобильности (mobility services). Около 97% мировых служб мобильности сейчас подключаются к нам. Поэтому, развернув Alpamayo на среде выполнения Hyperion и операционной системе Halos, мы сможем подключаться к этим службам по всему миру.
Isaac GR00T: гуманоидные роботы
Хуан Жэньсюн:
NVIDIA Isaac GR00T — это наш технологический стек для гуманоидных роботов, включающий модели, генерацию данных, симуляцию, среду выполнения и операционную систему. Он представляет платформу GR00T, то есть платформу Isaac GR00T.
Как вы можете видеть, каждая наша система следует одной и той же схеме: будь то облачная агентная система, агентная система на ПК, робототехническая система для автономных автомобилей или робототехническая система для гуманоидных роботов — все это одна и та же схема.
Конечно, в каждом случае мы полностью строим все с нуля. Мы делаем вертикальную интеграцию, полную интеграцию, применяем совместное проектирование и экстремальное совместное проектирование, а затем открываем это, позволяя каждому использовать любую часть по своему усмотрению. Что бы вы ни хотели использовать, мы даже поможем вам это модифицировать.
Но пока не хватает одной вещи: робототехническим системам нужна референсная платформа. Эти системы слишком сложны, в них много двигателей и сенсоров, они очень хрупкие. Однако нам нужен способ поставки таких референсных платформ. Как мы делали для ПК, DGX, облака и автономных автомобилей, теперь мы сделаем это и для роботов.
Сегодня мы анонсируем NVIDIA Isaac GR00T, полностью интегрированную референсную платформу для гуманоидных роботов. У нее по 25 степеней свободы на каждой руке, 31 степень свободы у корпуса робота, высота 6 футов (около 183 см), вес 150 фунтов (около 68 кг). Прямо как я, только первая цифра меньше моей, вторая больше, в остальном похоже.
Эта платформа работает на новом Thor, а также на нашем полном программном стеке, стеке генерации данных, стеке симуляции данных и среде выполнения. Все интегрировано в одну робототехническую платформу для использования всеми. Мы создаем ее для высшего образования и университетских исследователей, потому что им слишком сложно строить такую платформу самостоятельно.
Итоговый обзор
Хуан Жэньсюн:
За последние шесть месяцев компьютерная индустрия была полностью изменена. Причина изменений в том, что агенты наконец реализованы и, соединившись с новейшими передовыми моделями, позволили ИИ теперь действительно выполнять полезную работу.
Эта вычислительная парадигма будет повторяться снова и снова: агент состоит из модели и фреймворка, использует инструменты со навыками и работает поверх определенной среды выполнения. Среда выполнения зависит от того, находится ли она в облаке, локальной корпоративной среде, на ПК или в роботе. Но вычислительная парадигма полностью одинакова.
Вы будете использовать разные фреймворки в соответствии со своими предпочтениями, также будете использовать разные модели в соответствии со своими предпочтениями. Вы будете улучшать их для своих собственных, проприетарных целей. Вы будете создавать супер-агентов, сдавать их в аренду другим, помогая им выполнять работу. Эта агентная платформа, эта агентная парадигма — именно то, что поддерживает набор инструментов NVIDIA Enterprise AI. Для вас это отличный способ участвовать в ИИ; для нас это огромная возможность для роста.
Vera Rubin находится в полном производстве. Grace Blackwell создан для обработки ИИ, особенно для вывода; Vera Rubin создан для работы агентов. Он находится в полном производстве. Это далеко не просто GPU, а целая несвязанная, распределенная система обработки агентов.
NVIDIA действительно стала инфраструктурной компанией. Не просто компанией по производству GPU, не просто системной компанией, а инфраструктурной компанией. Наша цель — помочь вам получить максимальный доход, максимальную прибыль и сделать это как можно быстрее.
В мире агентов этот новый способ вычислений означает, что CPU также должен строиться для агентов, а не для людей. CPU, созданный для агентов, имеет свои особые потребности. Наш NVIDIA Vera — это революция. Я рад видеть, как растут объемы производства и заказы на него; это станет самым быстрым и успешным запуском продукта в истории NVIDIA.
NVIDIA и Microsoft создали совершенно новую продуктовую линейку ПК. Это новое начало. Конечно, та же самая агентная парадигма обработки, агентная вычислительная парадигма, которую я описывал, будет работать и на различных устройствах. Я упомянул ПК, но в будущем она появится в роботах, спутниках, базовых станциях, фабриках, облаке, локальных системах, периферийных устройствах. Эта агентная ИИ-система и агентная вычислительная парадигма будут бесконечно реплицироваться в различных компьютерах. Наше понимание персонального компьютера, вероятно, изменится.








