Ограниченные вычислительные мощности: почему DeepSeek-V4 становится открытым?
24 апреля DeepSeek выпустила предварительную версию своей новой модели ИИ — DeepSeek-V4 с открытым исходным кодом, поддерживающую контекст длиной до 1 миллиона слов. Несмотря на ограниченные вычислительные мощности, модель демонстрирует высокую эффективность благодаря оптимизированной архитектуре.
Версия Pro с 1.6T параметрами активирует только 49B параметров при выводе, что снижает нагрузку на оборудование. Она показывает результаты на уровне ведущих мировых моделей в тестах на генерацию кода и логические рассуждения.
Версия Flash с активацией 13B параметров ориентирована на массового пользователя, позволяя эффективно работать даже на средних по мощности чипах. Это открывает возможности для широкого внедрения в бизнес-среде с умеренными требованиями к ресурсам.
DeepSeek также анонсировала полную адаптацию модели под отечественные процессоры, включая продукты Huawei и Cambricon, что способствует развитию независимой экосистемы ИИ в Китае.
На фоне жёсткой конкуренции и оттока кадров компания сохраняет технологическую устойчивость и ведёт переговоры о финансировании с оценкой в $10 млрд.
Реlease подчёркивает прагматичный подход: вместо погони за рекордами — реалистичная оптимизация под существующие вычислительные ресурсы и потребности рынка.
marsbit04/26 00:29