
За последние пять месяцев доход Alibaba Cloud от MaaS вырос в 15 раз, что является лишь одним из аспектов перестройки компании. На саммите Alibaba Cloud объявила о завершении полного стека обновлений "чип-облако-модель-вывод" до уровня Agent, одновременно представив новый официальный сайт AI-продуктов "Qianwen Cloud", супернодный сервер на базе собственного AI-чипа Zhenwu M890 и последнюю флагманскую модель Qwen3.7-Max.
По словам старшего вице-президента Alibaba Cloud Лю Вэйгуана: "Мы строим крупнейшую в Китае фабрику ИИ". Метафора фабрики подразумевает полную производственную логику: чипы — сырье, облако — цех, модели — станки, платформа вывода — конвейер, а конечный товар — токены.
Суть этой перестройки заключается в преобразовании всей системы, построенной за последние 17 лет вокруг концепции "человек использует облако", в новую систему "Agent потребляет токены".
Зачем сейчас разыгрывать карту чипов
Раньше Alibaba Cloud редко акцентировала внимание на чипах в публичных выступлениях. На этом саммите была не только представлена новая обучающе-инференсная AI-микросхема Zhenwu M890, но и впервые обнародована дорожная карта чипов на следующие два года с поэтапным выпуском продуктов двух поколений: Zhenwu V900 и Zhenwu J900.
Zhenwu M890 оснащён 144 ГБ видеопамяти, пропускная способность межчипового соединения составляет 800 ГБ/с, производительность в 3 раза выше, чем у предыдущего поколения Zhenwu 810E. В сочетании с собственным чипом межсоединения ICN Switch, 128 AI-чипов могут быть объединены в одну машину с задержкой P2P менее 150 наносекунд.
Но помимо параметров, более важной информацией является масштаб: совокупные поставки серии Zhenwu составили 560 000 чипов, которые уже используются более чем 400 клиентами из 20+ отраслей, включая телекоммуникации, FAW, Pufa Bank и других.

Лю Вэйгуан неоднократно проводил аналогии с Google: глубокая интеграция TPU от Google и Gemini позволила Google достичь оптимального соотношения цены и производительности в собственной экосистеме. Alibaba Cloud, конечно, хочет пойти по тому же пути. Он свел логику конкуренции к одной фразе: "Если в будущем борьба будет вестись за то, сколько высококачественных токенов сможет выдать каждый чип по сравнению с конкурентами, то наша победа обеспечена".
В дополнение к этому, CPU Yitian, интеллектуальная сетевая карта Panmai, основной контроллер хранения Zhenyue — карта чипов T-Head расширилась от отдельных точек до полного охвата вычислительных мощностей, сети и хранения данных. Когда спрос на инференс растёт экспоненциально, только держа чипы в своих руках, можно контролировать предельные издержки каждого токена.
Логика проста. Компании, занимающиеся моделями, могут соревноваться в параметрах, но облачные провайдеры в конечном итоге соревнуются в том, чьи токены дешевле, стабильнее и быстрее. Чипы — это отправная точка в этой битве за стоимость.
Само облако тоже нужно переписать
Чипы решают проблему "способности работать", но потребности Agent от облака далеко не ограничиваются вычислительной мощностью.
Логика взаимодействия традиционных облачных продуктов создана для людей: открыть консоль, посмотреть меню, настроить параметры, нажать кнопки. Для Agent всё это совершенно непригодно. Agent не смотрит веб-страницы и не нажимает кнопки, ему нужны структурированные описания возможностей, стандартизированные протоколы вызовов и предсказуемые ответы.
CTO Alibaba Cloud Ли Фэйфэй проиллюстрировал проблему на контрасте: рабочая нагрузка традиционного облака стабильна, экземпляр ECS может работать месяцы или даже годы; но рабочая нагрузка Agent характеризуется "нерегулярной эластичностью, коротким жизненным циклом, мгновенным всплеском и уходом". После выполнения задачи Agent'ом песочница уничтожается, следующий запрос может поступить через миллисекунды или через несколько часов.
Для этого Alibaba Cloud сделала три вещи.
Во-первых, преобразование облачных продуктов в Skill, MCP и CLI. Проще говоря, это инкапсуляция каждого облачного продукта в стандартизированный интерфейс, который Agent может вызывать напрямую, как функцию.
Во-вторых, создание специальной среды выполнения для Agent — облегчённые песочницы, взаимодействие нескольких Agent'ов, память между задачами, пути передачи данных.
В-третьих, перестройка логики оркестрации с "оркестрации ресурсов" на "оркестрацию задач", потому что традиционные методы управления ресурсами не выдержат одновременного параллельного выполнения массы Agent'ов.
Лю Вэйгуан отметил, что после развёртывания некоторых AI-приложений они автоматически подключают облачные ресурсы — виртуальные машины, экземпляры баз данных, среды песочницы — без какого-либо вмешательства человека. Объём ресурсов, автоматически подключаемых одним клиентом за день, эквивалентен двухнедельной ручной работе в прошлом.
"Это уже равносильно тому, что Agent сам использует облако". Лю Вэйгуан привёл внутренний расчёт соотношения: потребление токенов можно пропорционально конвертировать в использование GPU, а рост каждого GPU примерно ведёт к такому же росту CPU. То есть рост дохода от токенов не подрывает доход от традиционного облака, а стимулирует его, при условии, что облачная платформа способна справиться с рабочей нагрузкой Agent.
Таким образом, Alibaba Cloud не просто добавляет слой AI-возможностей к старой системе, а полностью переписывает всё: от способа взаимодействия и логики оркестрации до моделей тарификации и форм продуктов.
Модели не для чата
Третий уровень полной перестройки стека — модели. Qwen3.7-Max заняла первое место среди отечественных моделей в общем глобальном слепом рейтинге Arena, опередив Kimi-K2.6, DeepSeek-v4-pro, GLM-5.1. Ключевым моментом этого релиза стало переопределение Alibaba направления развития возможностей моделей.
Ответственный за большую модель Alibaba Tongyi, Чжоу Цзинжэнь, заявил: "Раньше мы стремились к тому, чтобы модель 'хорошо говорила', теперь мы требуем, чтобы модель 'могла делать'".

Судя по практике Alibaba Cloud с чипами, на чипе Zhenwu M890, с которым модель никогда не встречалась во время обучения, Qwen3.7-Max, опираясь только на описание задачи, с нуля автономно работала 35 часов, самостоятельно завершив написание и оптимизацию производственного AI-вычислительного ядра. В итоге производительность улучшилась в 10 раз по сравнению с официальной версией. Весь процесс прошёл без вмешательства человека и промежуточных указаний.
Это демонстрирует ключевую способность моделей в сценариях Agent: длительное автономное выполнение, принятие задачи, самостоятельная декомпозиция, планирование, написание кода, отладка, непрерывная работа в течение 35 часов.
Для поддержки такого уровня потребностей в инференсе платформа Bailian также получила соответствующие обновления: объединённое планирование для повышения утилизации GPU, кэширование контекста для устранения повторных вычислений, эластичное планирование пропускной способности для обработки пиков параллелизма.
В плане экосистемы Bailian остаётся открытой для интеграции. Помимо матрицы моделей Qianwen, на платформу добавлены сторонние модели, такие как Zhipu GLM-5.1, MiniMax M2.7, Moonshot AI Kimi K2.6 и другие.
Лю Вэйгуан упомянул: "Клиенты на практике используют не одну модель, а комбинацию нескольких. Мы предоставляем комбинации, клиенты на платформе находят наиболее подходящее для себя сочетание". На саммите выступили руководители шести ведущих отечественных модельных компаний, создав атмосферу, напоминающую "альянс отечественного ИИ".
За последние три месяца флагманская модель Qianwen последовательно итеративно обновлялась до версий 3.5, 3.6 и 3.7. Сам этот темп выпуска передаёт сигнал: соревнование в возможностях моделей далеко не закончено, и Alibaba намерена создать долгосрочное преимущество за счёт вертикальной интеграции собственных чипов и собственных моделей.
Настоящая ставка этой перестройки
Оглядываясь назад, базовая логика этой полной перестройки стека Alibaba Cloud проста и ясна. Когда рост доходов от ИИ значительно опережает традиционный облачный бизнес, когда токены могут заменить ECS в качестве крупнейшей продуктовой линейки, когда Agent'ы начинают автоматически подключать облачные ресурсы без необходимости входа человека в консоль управления, вся техническая система, созданная для людей, достигает точки, когда её необходимо изменить.
Но сложность реализации — это другое дело. Сам Лю Вэйгуан признаёт, что трансформация "легко сказать, но трудно сделать". Раньше команда продаж общалась с ИТ-отделами клиентов, теперь для работы с MaaS нужно говорить с бизнес-подразделениями и даже с CEO.
"Ваши способности к диалогу, ваш опыт — это требования совершенно другого уровня". Alibaba Cloud уже назначила专职ных продавцов MaaS для крупных клиентов, которые работают отдельно от традиционных продавцов IaaS, с независимыми оценками и задачами.
Ключевые показатели эффективности также меняются. Учитывается не только объём вызовов, но и "высококачественные токены" — токены, решающие реальные проблемы, а не токены для пустой болтовни. Три основных показателя: ежедневный рост числа платящих клиентов, количество ключевых бизнес-систем, интегрированных с моделями, эффективность автономного завершения задач Agent'ами.
Эти корректировки на организационном и механистическом уровнях часто лучше, чем технические анонсы, показывают реальные оценки компании. Alibaba Cloud намерена перестроить структуру доходов, отношения с клиентами и систему продаж. Лю Вэйгуан заявил: "Раньше, когда мы занимались облаком, ИТ-бюджет клиента можно было рассчитать: сколько серверов на местах, примерно сколько стоит перенос в облако — можно было увидеть задачу. Но с MaaS ответ на эту задачу неизвестен, и после входа в неё результат может превзойти ожидания".
Задача не видна, ответ не определён, но Alibaba Cloud всё же решила разобрать и переписать всю систему, потому что единственное, что известно наверняка, — это то, что ИИ представляет возможность, в десять или даже в сто раз большую, чем всё предыдущее.
Это, вероятно, самая важная информация этого саммита: не то, сколько вычислительной мощности добавляет тот или иной чип, или какое место занимает та или иная модель, а то, что крупнейший китайский облачный провайдер с агрессивной позицией, близкой к стартапу, делает ставку на будущее, в наступление которого он верит. (Автор статьи | Чжан Шуай, редактор | Ян Линь)





