Не зацикливайтесь на GPU: процессор становится «новым узким местом» эпохи ИИ

marsbitОпубликовано 2026-04-13Обновлено 2026-04-13

Введение

За последние годы в индустрии ИИ доминировала идея, что вычислительная мощность определяет пределы возможного, а GPU — её ядро. Однако к 2026 году ситуация изменилась: производительность систем всё больше зависит от возможностей выполнения и планирования задач. GPU по-прежнему важны, но ключевым элементом, определяющим, «заработает ли ИИ», становится CPU. Заключение многолетнего соглашения между Google и Intel о развёртывании процессоров Xeon в дата-центрах для ИИ подтверждает этот сдвиг. Гендиректор Intel Пат Гелсингер подчеркнул, что ИИ работает на всей системе, где CPU и IPU критичны для производительности, эффективности и гибкости. Внезапный дефицит CPU, вызванный ростом цен на 30% в 4 квартале 2025 года и увеличением сроков поставок, усугубляется «вторичным эффектом»: производители полупроводников, такие как TSMC, отдают приоритет более прибыльным заказам на GPU, сокращая выпуск CPU. Основная причина — изменение роли CPU в эпоху ИИ-агентов. Если в чат-ботах CPU лишь управлял данными, а GPU выполнял вычисления, то теперь CPU должен координировать сложные многоэтапные задачи, вызовы API, работу с базами данных и интеграцию результатов. Исследование показало, что на обработку инструментов CPU приходится 50–90,6% задержки. Расширение контекстного окна до 1 млн токенов также увеличивает нагрузку на CPU, который теперь управляет кэшем данных, не помещающимся в память GPU. Крупные игроки реагируют по-разному: Intel делает ставку на Xeon и партнёрства, AMD наращивает долю на...

В годы бурного развития ИИ отраслью практически управляла одна логика: вычислительная мощность определяет потолок возможностей, а GPU — это ядро вычислительной мощности.

Однако к 2026 году эта логика начала меняться: вывод моделей больше не является единственным узким местом, производительность системы все больше зависит от возможностей выполнения и планирования. GPU по-прежнему важен, но ключ к тому, «заработает ли ИИ», постепенно смещается в сторону долгое время игнорируемого CPU.

9 апреля по местному времени США Google и Intel заключили многолетнее соглашение о масштабном развертывании «процессоров Intel Xeon» в глобальных дата-центрах ИИ именно для решения этой проблемы. Генеральный директор Intel Чен Лиу прямо заявил, что ИИ работает на всей системе, и именно CPU и IPU являются ключом к производительности, эффективности и гибкости. Другими словами, CPU, который последние два года считался «второстепенным игроком», теперь «душит» расширение возможностей ИИ.

Генеральный директор Intel Чен Лиу в социальных сетях заявил: Intel углубляет сотрудничество с Google, распространяя его с традиционных CPU на инфраструктуру ИИ (такую как IPU), чтобы совместно продвигать возможности ИИ и облачных вычислений.

CPU больше не является просто пассивным вспомогательным компонентом, а становится одной из ключевых переменных в инфраструктуре ИИ.

01

«Тихий» кризис поставок

Пока все следили за сроками поставок GPU, напряженность на рынке CPU уже достигла пика.

Согласно последним отчетам нескольких ИТ-дистрибьюторов, в четвертом квартале 2025 года средняя цена серверных CPU выросла примерно на 30%. Такой рост на относительно зрелом рынке CPU является весьма редким.

Глава подразделения центров обработки данных AMD Форрест Норрод (Forrest Norrod) сообщил, что за последние три квартала спрос на CPU рос быстрее, чем можно было представить. В настоящее время цикл поставок AMD увеличился с первоначальных восьми недель до более чем десяти недель, а некоторые модели сталкиваются с задержками до шести месяцев.

Этот дефицит в основном вызван «вторичным эффектом», приводящим к вытеснению ресурсов. По словам некоторых представителей отрасли, из-за крайней загруженности 3-нм производственной линии TSMC, мощности пластин, первоначально выделенные для CPU, постоянно вытесняются более прибыльными заказами на GPU. Это привело к крайне ироничной ситуации: лаборатории ИИ получили достаточно GPU, но обнаружили, что на рынке невозможно купить достаточно мощных CPU, чтобы «запустить» эти видеокарты.

В этой волне скупки CPU поучаствовал и Илон Маск (Elon Musk).

Генеральный директор Intel Чен Лиу подтвердил на платформе социальных сетей, что Маск поручил Intel разработать и произвести定制ные чипы для своего проекта «Terafab» в Техасе. Этот масштабный проект旨在 создать единую вычислительную базу для xAI, SpaceX и Tesla.

Доверие Маска к Intel во многом объясняется тем, что Intel пытается внедриться на каждый уровень — от наземных центров обработки данных до орбитальных вычислений в космосе.

Для Intel это, несомненно, долгожданная поддержка. Некоторые отраслевые аналитики预测, что доля доходов AMD на рынке серверных CPU превысит долю Intel в 2026 году, но глубокая инерция и производственные возможности Intel в экосистеме x86 по-прежнему являются козырем, который крупные клиенты, подобные Маску, не могут игнорировать.

Такое глубокое межотраслевое взаимодействие превращает конкуренцию на рынке CPU из простого соревнования параметров в игру экосистем и стабильности цепочек поставок.

02

Почему CPU стал «слабым звеном»?

Внезапное превращение CPU в узкое место связано с fundamentalным изменением характера работы, которую ему приходится выполнять в эпоху агентов.

В традиционной модели чат-ботов CPU в основном отвечает за планирование и обработку данных, а GPU承担核心推理计算. Поскольку вычислительно-емкие этапы сосредоточены на стороне GPU, общая задержка обычно определяется GPU, и CPU редко становится узким местом производительности.

Но рабочая нагрузка агентов совершенно иная. Агенту необходимо выполнять многошаговые рассуждения, вызывать API, читать и записывать базы данных, orcheстрировать сложные бизнес-процессы и интегрировать промежуточные результаты в окончательный вывод. Такие задачи, как поиск, вызов API, выполнение кода, файловый ввод-вывод и orchestration результатов, в основном ложатся на CPU и主机系统. GPU отвечает за генерацию токенов (т.е. «мышление»), а CPU负责 преобразование результатов «мышления» в конкретные действия.

В статье «Взгляд на агентный ИИ с процессоро-центричной точки зрения» (A CPU-Centric Perspective on Agentic AI), опубликованной учеными Технологического института Джорджии в ноябре 2025 года, был проведен количественный анализ распределения задержек в рабочей нагрузке агентов. Исследование показало, что время, затрачиваемое на обработку инструментов на стороне CPU, составляет от 50% до 90,6% общей задержки. В некоторых сценариях GPU был готов обработать следующую партию задач, а CPU все еще ждал возврата от вызова инструмента.

Другим ключевым фактором является быстрое расширение контекстного окна. В 2024 году большинство主流 моделей поддерживали 128–200 тыс. токенов. К 2025 году такие модели, как Gemini 2.5 Pro, GPT-4.1, Llama 4 Maverick, начали поддерживать 1 млн+ токенов. Кэш KV (Key-Value Cache, используемый для ускорения процесса вывода моделей Transformers) растет линейно с количеством токенов, составляя около 200 ГБ при 1 млн токенов, что значительно превышает объем памяти одной видеокарты H100 (80 ГБ).

Одним из решений этой проблемы является частичная выгрузка кэша KV в оперативную память CPU. Это означает, что CPU должен управлять не только orchestration и вызовами инструментов, но и помогать обрабатывать данные, которые не помещаются в видеопамять. Таким образом, объем оперативной памяти CPU, пропускная способность памяти и скорость соединения между CPU и GPU становятся ключевыми для производительности системы.

Следовательно, CPU, подходящий для эпохи агентов,更需要 низкую задержку, согласованную способность доступа к памяти и более сильные возможности системного уровня, а не простое наращивание ядер.

03

Что делают производители? Кто-то захватывает территории, кто-то меняет设计

Столкнувшись с этим внезапным всплеском спроса на CPU, крупные производители выбрали совершенно разные стратегии.

Intel — традиционный лидер на рынке серверных CPU. По данным Mercury Research, в четвертом квартале 2025 года доля Intel на рынке серверных CPU仍然 составляла 60%, AMD — 24,3%, NVIDIA — 6,2%. Но все эти годы Intel一直在追赶新技术, и этот всплеск спроса на CPU является как возможностью, так и испытанием для них.

Текущая стратегия Intel — идти двумя путями. С одной стороны, продолжать продавать процессоры Xeon, тесно связываясь с крупномасштабными клиентами, такими как Google; с другой стороны, сотрудничать с SambaNova, предлагая комбинированные решения на основе процессоров Xeon и их собственных акселераторов RDU, с主打卖点 «возможность запуска推理 агентов без GPU». Дорожные карты Xeon 6 Granite Rapids и технологии 18A станут ключевым испытанием способности Intel переломить ситуацию.

AMD является одним из крупнейших бенефициаров этого всплеска спроса на CPU. В четвертом квартале 2025 года выручка центра обработки данных AMD составила 5,4 млрд долларов, увеличившись на 39% год к году. Пятое поколение EPYC Turin占了 более половины доходов от серверных CPU, развертывание облачных инстансов на EPYC выросло более чем на 50% год к году. Доля доходов AMD от серверных CPU впервые превысила 40%.

Генеральный директор AMD Лиза Су (Lisa Su)直接 связала причину роста с развитием «агентов» — рабочая нагрузка агентов «вернула» задачи к традиционным задачам CPU.

В феврале 2026 года AMD также объявила о потенциальной сделке с Meta стоимостью более 100 млрд долларов на поставку GPU MI450 и CPU Venice EPYC.

Однако у AMD все еще есть возможности для улучшения на системном уровне协同, не хватает зрелых возможностей高速 соединения CPU-GPU, подобных NVLink C2C. По мере того, как системы агентов предъявляют все более высокие требования к эффективности взаимодействия и协同 данных, важность этого аспекта также постепенно возрастает.

Подход NVIDIA к проектированию CPU полностью отличается от подходов Intel и AMD.

Процессор NVIDIA Grace имеет всего 72 ядра, в то время как AMD EPYC и Intel Xeon обычно имеют 128. Глава подразделения инфраструктуры ИИ NVIDIA Дион Харрис (Dion Harris) объяснил: «Если вы — крупномасштабный企业, вы хотите максимизировать количество ядер на каждый CPU, что基本上 снизит стоимость, то есть стоимость в долларах за ядро. Так что это бизнес-модель.»

Другими словами, в системе вычислений ИИ роль CPU больше не является основной для универсальных вычислений, а представляет собой «центр планирования», обслуживающий GPU. Если CPU не успевает, дорогостоящие GPU вынуждены ждать, и общая эффективность反而 падает.

Поэтому при проектировании NVIDIA优先 обеспечивает高效协同 между CPU и GPU. Например, с помощью соединения NVLink C2C пропускная способность между CPU и GPU увеличивается до примерно 1,8 ТБ/с, что значительно выше традиционного PCIe, CPU может напрямую обращаться к памяти GPU, что значительно упрощает управление кэшем KV.

В настоящее время NVIDIA уже продает процессор Vera как独立ный продукт. CoreWeave стал первым клиентом. Сделка с Meta еще более масштабна: это第一次大规模「чистого развертывания Grace», то есть大规模独立ного развертывания CPU без配对 GPU.

Главный аналитик Creative Strategies Бен Баджарин (Ben Bajarin) отметил, что в условиях высокой интенсивности системного взаимодействия вычислительная мощность CPU должна соответствовать скорости итерации акселераторов. Если в канале передачи данных возникает даже однопроцентная задержка, экономическая эффективность всего кластера ИИ значительно снижается. Это стремление к максимальной системной эффективности заставляет всех крупных производителей重新评估 показатели производительности CPU.

Вице-президент и главный аналитик Constellation Research Хольгер Мюллер (Holger Mueller) заявил, что по мере перехода рабочих нагрузок ИИ на агентно-ориентированную архитектуру роль CPU становится все более центральной. Он отметил: «В мире агентов агентам необходимо вызывать API и различные бизнес-приложения, эти задачи最适合 для выполнения на CPU.»

Он также добавил: «В настоящее время нет единого мнения о том, что更适合 для处理 задач вывода — GPU или CPU. GPU имеют преимущество в обучении моделей, а定制ные ASIC, такие как TPU, также имеют свою специализацию. Но одно ясно: Google необходимо采用 гибридную процессорную архитектуру. Поэтому выбор Google в пользу сотрудничества с Intel является обоснованным».

04

Заключение: В эпоху агентов天平 вычислительной мощности качнулась обратно

В последних отраслевых наблюдениях следует обратить внимание на одни данные. В рамках соглашения о сотрудничестве между Amazon AWS и OpenAI на сумму 38 млрд долларов в官方ном заявлении также четко упоминается масштаб расширения в «десятки миллионов CPU».

В последние годы внимание отрасли обычно было приковано к «сотням тысяч GPU». Однако то, что передовые лаборатории, такие как OpenAI,主动 рассматривают масштаб CPU как важную переменную планирования, посылает четкий сигнал: расширение рабочей нагрузки агентов должно основываться на огромной инфраструктуре CPU.

Bank of America预测, что к 2030 году мировой рынок CPU может удвоиться с текущих 27 млрд долларов до 60 млрд долларов.几乎 вся эта доля будет обусловлена ИИ.

Мы являемся свидетелями начала расширения全新的 инфраструктуры: крупные производители больше не просто наращивают GPU, а同步 расширяют целый уровень «инфраструктуры планирования CPU», специально предназначенной для поддержки работы агентов ИИ.

Объединение усилий Intel и Google, а также крупные инвестиции Маска в定制ные чипы доказывают один факт: точка превосходства в гонке ИИ смещается. Когда вычислительная мощность перестает быть дефицитом, победит в этой игре на триллионы долларов тот, кто最先 решит проблему системного «узкого места».

*Приглашенный编译 Цзинь Лу также внес вклад в эту статью.

Эта статья来自微信公众号「Tencent Technology», автор: Ли Хайлунь, редактор: Сюй Цинъян

Трендовые криптовалюты

Связанные с этим вопросы

QПочему CPU становится новым узким местом в эпоху ИИ, согласно статье?

ACPU становится узким местом, потому что в эпоху агентного ИИ нагрузка сместилась: CPU теперь отвечает за выполнение многошаговых рассуждений, вызовы API, работу с базами данных и оркестрацию сложных рабочих процессов, что занимает 50-90,6% общей задержки, в то время как GPU в основном генерирует токены.

QКакое соглашение заключили Google и Intel, и как оно связано с проблемой CPU?

AGoogle и Intel заключили многолетнее соглашение о крупномасштабном развертывании процессоров Intel Xeon в дата-центрах Google для ИИ, чтобы решить проблему нехватки производительности CPU, которая стала ограничивать масштабирование ИИ-систем.

QКак расширение контекстного окна моделей ИИ влияет на нагрузку CPU?

AРасширение контекстного окна до 1 млн+ токенов увеличивает объем KV-кэша примерно до 200 ГБ, что превышает объем памяти отдельных GPU (например, H100). Это вынуждает перемещать часть KV-кэша в память CPU, увеличивая нагрузку на CPU, его память и пропускную способность соединения с GPU.

QКаковы стратегии основных производителей (Intel, AMD, NVIDIA) в ответ на возросшую важность CPU для ИИ?

AIntel: углубляет сотрудничество с крупными клиентами (Google) и предлагает гибридные решения (Xeon + RDU-ускоритель). AMD: извлекает выгоду от роста спроса, его EPYC Turin доминирует в продажах, но не хватает высокоскоростного соединения CPU-GPU. NVIDIA: разрабатывает специализированные CPU (Grace) с упором на эффективное взаимодействие с GPU через NVLink C2C, рассматривая CPU как "центральный планировщик" для GPU.

QКакой прогноз относительно рынка CPU в контексте развития ИИ представлен в статье?

AАналитики из Bank of America прогнозируют, что к 2030 году мировой рынок CPU вырастет с текущих 27 миллиардов долларов до 60 миллиардов долларов, и этот рост почти полностью будет driven by спросом со стороны технологий искусственного интеллекта.

Похожее

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

Источник: интервью Рэя Далио, основателя Bridgewater Associates, для подкаста "The Diary Of A CEO". Далио, предсказавший кризис 2008 года, обсуждает "большой цикл" — концепцию, охватывающую долговые проблемы, растущее неравенство и геополитические сдвиги. Он указывает, что текущий ажиотаж вокруг ИИ демонстрирует классические признаки пузыря, который может лопнуть из-за высокой долговой нагрузки, роста процентных ставок и чрезмерной эмиссии акций, что способно привести к рецессии. Для защиты личного капитала в неопределенные времена Далио советует диверсификацию: вместо хранения наличных инвестировать в акции, золото, облигации. Сам он держит около 1% портфеля в биткоине, считая его "твердыми деньгами", но предпочитает физическое золото из-за его статуса резервного актива и независимости от технологических рисков. Говоря о влиянии ИИ, Далио отмечает, что технология заменяет не только физический труд, но и элементы мышления, что увеличит разрыв между капиталом и трудом. Ключевыми останутся человеческие качества — эмоции и интуиция, а успеха добьются те, кто научится работать в партнерстве с ИИ. На геополитической арене, по его мнению, мир движется к регионализации с центрами в виде США и Китая. Вовлечение США в конфликты, подобные иранскому, обнажает снижение их абсолютного влияния. Внутренние вызовы, такие как дебаты о налогах на богатство, риск капитального бегства и низкая производительность, также ставят под вопрос стабильность традиционных держав в текущей фазе цикла.

marsbit50 мин. назад

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

marsbit50 мин. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

Капиталы возвращаются на южнокорейский рынок акций. 31 июля иностранные инвесторы осуществили чистые покупки акций KOSPI на рекордные 7,2 трлн вон за один день, что стало самым высоким показателем в истории. По данным Citigroup, эта цифра знаменует собой кардинальный разворот после месяцев масштабного оттока средств нерезидентов. В июле чистые продажи иностранными инвесторами значительно сократились до 9,8 трлн вон по сравнению с 48,4 трлн и 44,5 трлн вон в июне и мае соответственно. Одновременно внутренние пенсионные и инвестиционные фонды в июле вернулись к чистым покупкам на 1,0 трлн вон. Дополнительным фактором снижения волатильности стали новые правила Комиссии по финансовым услугам (FSC), ужесточившие с 31 июля доступ розничных инвесторов к ETF с плечом на отдельные акции. После введения норм торговый оборот таких инструментов упал примерно вдвое. Citigroup сохраняет целевую точку для KOSPI на уровне 10000 пунктов, отмечая ослабление давления со стороны движения капиталов. Аналитики видят поддержку рынку в устойчивости фундаментальных показателей сектора чипов памяти, низких оценках KOSPI, сильной экономике и благоприятной политике властей, включая возможные меры по поддержке ликвидности.

marsbit50 мин. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

marsbit50 мин. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

В статье рассматривается вопрос о том, как остаться незаменимым в эпоху искусственного интеллекта. Автор утверждает, что вместо страха перед ИИ следует сосредоточиться на развитии качеств, которые машины не смогут заменить. Он критикует «зарплатное рабство» — зависимость от работы, не приносящей удовлетворения, и предлагает путь к финансовой независимости через создание собственного дела. Ключ к успеху — развитие пяти элементов: самостоятельности (агентности), вкуса, умения убеждать, упорства и способности к итерациям. Главное — не просто создавать что-либо (сегодня это может каждый), а создавать что-то ценное, востребованное и уметь это продвигать. Автор считает, что наиболее важным навыком будущего является создание контента (медиа), а не просто написание кода, поскольку ценность контента субъективна и требует уникального человеческого вкуса и суждения. ИИ может помочь в производстве, но не заменит оригинальность мысли и связь с аудиторией. В качестве практического шага предлагается упражнение: за 15 минут ответить на вопросы, чтобы обнаружить свои уникальные знания, опыт и точку зрения, которые станут основой для личного бренда и дела жизни. Первый шаг — немедленно опубликовать свою основную идею, чтобы получить обратную связь от реального мира и начать процесс роста. Цель — стать «непригодным для найма», построив жизнь вокруг собственного творчества и экспертизы.

marsbit2 ч. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

marsbit2 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

Статья посвящена практике генерации сид-фраз для биткоин-кошельков с помощью бросков кубиков в свете уязвимости, обнаруженной в аппаратных кошельках Coldcard. Подчеркивается, что физический бросок кубика (дающий около 2.6 бит энтропии за бросок) создает высококачественную случайность, поскольку предсказать результат практически невозможно из-за множества переменных. Для создания стандартной сид-фразы из 12 слов (128 бит энтропии) требуется около 50 бросков, а для повышенной безопасности рекомендуется 99 и более. В связи с инцидентом Coldcard, когда неисправный генератор случайных чисел в прошивке (2021-2026 гг.) мог создавать предсказуемые ключи, выяснилось, что сид-фразы, сгенерированные вручную через кубики, были защищены от этой уязвимости. Однако исследование показало, что другие функции устройства (создание бумажных кошельков, ключей для мультиподписи, паролей и т.д.) по-прежнему использовали скомпрометированный генератор, подвергая риску владельцев даже с безопасной основной сид-фразой. Автор отмечает, что, хотя метод с кубиками криптографически надежен, он непрактичен для массового использования из-за трудоемкости, высокой вероятности ошибок при вводе и необходимости строгой дисциплины для сохранения секретности процесса. Делается вывод, что будущее безопасности лежит в создании надежных аппаратных генераторов случайных чисел и понятных интерфейсов, а ручные методы остаются нишевым инструментом для опытных пользователей. Владельцам Coldcard рекомендуется обновить прошивку и проверить/заменить все ключи, сгенерированные уязвимыми функциями.

cryptonews.ru6 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

cryptonews.ru6 ч. назад

Торговля

Спот

Популярные статьи

Как купить ERA

Добро пожаловать на HTX.com! Мы сделали приобретение Caldera (ERA) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки Caldera (ERA).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение Caldera (ERA)После приобретения вами Caldera (ERA) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля Caldera (ERA)С легкостью торгуйте Caldera (ERA) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

871 просмотров всегоОпубликовано 2025.07.17Обновлено 2026.06.02

Как купить ERA

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на ERA (ERA) представлены ниже.

活动图片