Почему Zhipu AI вырос почти на 30% за один день?
**Чжипу ворвался на рынок: почему акции компании взлетели почти на 30% за один день?**
Компания "Чжипу" (Zhipu AI), известная как "первая акция глобальной большой модели", показала резкий рост акций — на 26% за день. Причина — технический прорыв: запуск API высокоскоростной версии модели GLM-5.1, генерирующей текст со скоростью **400 токенов в секунду** (около 200 иероглифов).
**Почему скорость стала ключевым фактором?**
До сих пор конкуренция на рынке ИИ шла по двум направлениям: размер модели (больше параметров) и цена. Однако с переходом от чат-ботов к автономным агентам (Agent) задержка в ответах стала критически важной. Задачи агента требуют десятки или сотни циклов обращения к модели, и каждый сэкономленный миллисекунд суммируется, существенно влияя на общую производительность. Скорость превращается из технического показателя в фактор, определяющий интеллектуальный потолок системы.
**Сложность достижения такой скорости**
Текущие лидеры рынка — OpenAI GPT-4o, Anthropic Claude — работают на скоростях 80-150 токенов/с. Показатель "Чжипу" в 400 токенов/с опережает средний уровень отрасли в 3-5 раз. Это достижение стало возможным благодаря одновременным инновациям на трех уровнях:
1. **TileRT (движок логического вывода):** Компилирует всю модель в единый, непрерывно работающий "двигатель", минимизируя простои GPU и накладные расходы на запуск операций.
2. **Гетерогенный параллелизм:** Оптимизирует распределение вычислений между несколькими графическими процессорами (GPU), адаптируя стратегию под разные типы операций (например, разреженный поиск и плотные вычисления), чтобы избежать потерь на синхронизацию.
3. **ZCube (сетевая архитектура):** Заменяет стандартную древовидную сетевую топологию на плоскую и полностью связанную. Это сокращает количество "прыжков" при передаче данных между GPU с 3 до 2 и, что самое главное, проектирует сеть таким образом, что между любыми двумя GPU существует только один оптимальный путь. Это устраняет саму возможность сетевых заторов.
**Практические и рыночные последствия**
Для "Чжипу" это означает:
* Увеличение пропускной способности кластера на **15%** (больше пользователей при том же оборудовании).
* Снижение задержек при пиковой нагрузке на **40.6%** (более стабильная работа).
* Сокращение затрат на сетевое оборудование примерно на **треть**.
В долгосрочной перспективе эти инновации подрывают монополию комплексных решений NVIDIA (GPU + NVLink + InfiniBand), открывая возможности для производителей альтернативных чипов (например, Huawei Ascend) и меняя структуру спроса на сетевые компоненты (выгоду получат производители высокоплотных коммутаторов и высокоскоростных оптических модулей). Прорыв "Чжипу" демонстрирует, как оптимизация инфраструктуры *вокруг* GPU может кардинально повысить эффективность и снизить стоимость вычислений ИИ.
marsbit05/23 01:24