DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

marsbitОпубликовано 2026-04-24Обновлено 2026-04-24

Введение

DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4 в двух версиях: Pro и Flash. Версия обладает 49 млрд активируемых параметров и поддерживает контекст длиной до 1 млн токенов, что ставит её в один ряд с ведущими закрытыми моделями, такими как Gemini и Claude. Flash-версия предлагает более экономичное решение с 13 млрд параметров. Модель демонстрирует улучшенные способности в задачах агентского кодирования, работе со знаниями и логических рассуждениях. Особое внимание уделено оптимизации под различные фреймворки и поддержке длинного контекста благодаря новой механике внимания DSA. Компания также анонсировала будущую поддержку вычислений на чипах Huawei. Модель уже доступна через API и в открытом доступе на платформах Hugging Face и ModelScope.

Только что появился DeepSeek-V4!

Превью-версия официально запущена и одновременно открыта для всех.

Всего две версии:

DeepSeek-V4-Pro: сопоставима с топовыми закрытыми моделями, 1,6T, 49B активаций, длина контекста 1M;

DeepSeek-V4-Flash: более компактная и быстрая экономичная версия, 284B, 13B активаций, длина контекста 1M.

Официальное заявление: В возможностях агента, знаниях о мире и производительности логических выводов достигнуто лидерство как в Китае, так и в области открытого исходного кода.

И кроме того:

На данный момент DeepSeek-V4 уже стал моделью для агентского кодирования, используемой сотрудниками компании. По данным оценок, опыт использования превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6. Однако все еще существует некоторый разрыв с режимом размышлений Opus 4.6.

Сейчас модель уже доступна на официальном сайте и в приложении, сервис API также обновлен одновременно.

Что касается волнующих всех отечественных вычислительных мощностей, ключевой момент: во втором полугодии будет поддержка вычислений на Huawei.

Топовая конфигурация и выбор по соотношению цена-качество: две версии запускаются вместе

В этом выпуске V4 сразу представили две версии.

V4-Pro, производительность на уровне топовых закрытых моделей.

Официально указаны три критерия:

Значительно улучшены возможности агента: в оценке Agentic Coding V4-Pro достигла лучшего уровня среди текущих открытых моделей и также показала отличные результаты в других оценках, связанных с агентом. Во внутреннем тестировании, в режиме Agent Coding, опыт использования V4 превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6, но все еще есть разрыв с режимом размышлений Opus 4.6.

Богатые знания о мире: В оценке знаний о мире DeepSeek-V4-Pro значительно опережает другие открытые модели, лишь немного уступая топовой закрытой модели Gemini-Pro-3.1.

Мировая топовая производительность логических выводов: в оценках по математике, STEM, соревновательному коду DeepSeek-V4-Pro превзошла все текущие открытые модели, представленные в открытых оценках, достигнув выдающихся результатов на уровне мировых топовых закрытых моделей.

V4-Flash, более компактная и быстрая экономичная версия. Возможности логического вывода близки к Pro, запас знаний о мире немного слабее, но параметры и активации меньше, API дешевле.

В задачах агента DeepSeek-V4-Flash на простых задачах наравне с DeepSeek-V4-Pro, но на задачах высокой сложности все еще есть разрыв.

В тесте на мойку автомобиля V4 также быстро прошел.

А в классическом биологическом сценарии «Отчаявшийся отец» DeepSeek-V4 не сразу уловил ключевой момент о дальтонизме (согласно законам генетики, если женщина страдает дальтонизмом, ее биологический отец обязательно тоже болен).

Контекст в миллион токенов становится стандартом

Стоит отметить, что с сегодняшнего дня контекст в 1M токенов является стандартом для всех официальных сервисов DeepSeek.

Год назад контекст в 1M был козырем исключительно Gemini; все другие закрытые модели предлагали либо 128K, либо 200K; в открытом сегменте почти никто не мог позволить себе работать с таким объемом.

DeepSeek просто переместил миллионный контекст из «премиальной функции» в разряд «коммунальных услуг».

И открыл исходный код. Как они этого добились, в релизе прямо дается ответ —

V4 представила совершенно новый механизм внимания, сжимающий на уровне токенов, используемый вместе с разреженным вниманием DSA. По сравнению с традиционными методами, потребность в вычислениях и видеопамяти значительно снижена.

DSA — не новое слово. Полгода назад, в том обновлении V3.2-Exp, его впервые внедрили, тогда внешнее внимание было невысоким, потому что бенчмарки были почти такие же, как у V3.1-Terminus, выглядело как промежуточная версия без особых новшеств.

Теперь, оглядываясь назад, видно, что это был фундамент V4.

Специальная оптимизация возможностей агента

В части агента V4 была адаптирована и оптимизирована для таких продуктов, как Claude Code, OpenClaw, OpenCode, CodeBuddy, улучшены задачи по коду и генерации документов.

В релизе также приложен пример внутренней страницы PPT, сгенерированной V4-Pro в одном из агентских фреймворков.

Цены на API

На стороне API, V4-Pro и V4-Flash запущены одновременно, поддерживаются два интерфейса: OpenAI ChatCompletions и Anthropic.

base_url не меняется, для вызова достаточно изменить параметр model на deepseek-v4-pro или deepseek-v4-flash.

Максимальный контекст обеих версий — 1M, обе одновременно поддерживают режим без размышлений и режим размышлений. В режиме размышлений можно регулировать интенсивность параметром reasoning_effort, два уровня: high и max. Официально рекомендуется для сложных сценариев с агентом сразу использовать max.

Здесь есть ключевой момент — во втором полугодии будет поддержка вычислений на Huawei.

Кроме того, старые названия моделей будут сняты с публикации.

deepseek-chat и deepseek-reasoner будут отключены через три месяца (24 июля 2026 года), на текущем этапе эти имена соответствуют режиму без размышлений и режиму размышлений V4-Flash соответственно.

Для индивидуальных разработчиков impact невелик, нужно изменить один параметр model. Компаниям, подключившим production-среды, в эти три месяца нужно заняться миграцией.

И еще кое-что

В конце релиза DeepSeek процитировали одну фразу.

«Не соблазняться славой, не бояться клеветы, идти своим путем, быть upright и correct себя.»

Это из «О двенадцати философах» Сюнь-цзы. Буквально означает: не соблазняться похвалой, не пугаться клеветы, идти вперед по своему пути, исправлять себя.

В сегодняшнем контексте это довольно интересно.

За последние полгода слухи о том, когда выйдет V4, не запаздывает ли он, не обогнали ли его уже другие, не справились ли с ним дистилляцией данных Claude, несколько раз ходили по китайскому и англоязычному AI-сообществу. В начале года даже кто-то уверенно заявлял, что V4 выйдет до Нового года по лунному календарю, но в итоге дождались только конца апреля.

Они ни разу не ответили.

А потом в одну из пятниц во второй половине дня выпустили V4, одновременно открыли исходный код, запустили на официальном сайте и в приложении, обновили API, попутно написав в релизе факт, что внутренние сотрудники уже перестали использовать Claude.

Никакой roadmap, никаких трансляций, никаких интервью.

Фраза «идти своим путем» звучит как лозунг. Но если посмотреть на путь за последние полгода: тот «малопримечательный» Exp-релиз V3.2, тот механизм разреженного внимания DSA, который полгода готовил почву для V4, путь превращения контекста в 1M из козыря в стандарт.

DeepSeek уже это сделал.

Ссылки на открытые модели DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Технический отчет DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Эта статья из WeChat Official Account «量子位» (QbitAI), автор: 量子位

Связанные с этим вопросы

QКакие две версии DeepSeek-V4 были представлены и каковы их ключевые характеристики?

AБыли представлены две версии: DeepSeek-V4-Pro и DeepSeek-V4-Flash. Pro-версия имеет 1,6T параметров, 49B активаций и длину контекста 1M, она ориентирована на высочайшую производительность. Flash-версия более компактна и быстра, с 284B параметрами, 13B активаций и той же длиной контекста 1M, предлагая экономически эффективное решение.

QКакие ключевые улучшения в производительности заявляет DeepSeek для модели V4-Pro?

ADeepSeek заявляет о трех ключевых улучшениях для V4-Pro: значительно улучшенные агентские способности (особенно в кодировании), превосходные мировые знания (немного уступая только Gemini-Pro-3.1) и высочайшая производительность в рассуждениях (математика, STEM, соревновательное программирование), что ставит модель на один уровень с ведущими закрытыми моделями.

QКакое важное технологическое достижение позволяет DeepSeek-V4 иметь стандартную длину контекста в 1 миллион токенов?

AДлина контекста в 1M токенов стала стандартом благодаря новой механизм внимания, который сжимает информацию на уровне токенов в сочетании с разреженным вниманием DSA (Dilated Sliding Attention). Этот подход значительно снижает вычислительные потребности и требования к памяти по сравнению с традиционными методами.

QКаковы планы DeepSeek относительно поддержки аппаратного обеспечения и что specifically упоминается в статье?

AВ статье specifically упоминается, что во второй половине года DeepSeek планирует добавить поддержку вычислений на чипах Huawei. Это подчеркивает ориентацию на развитие отечественных (китайских) вычислительных мощностей.

QКак изменится API сервис DeepSeek и что произойдет со старыми названиями моделей?

AAPI сервис обновлен для поддержки новых моделей V4-Pro и V4-Flash через те же конечные точки, используя параметры модели `deepseek-v4-pro` или `deepseek-v4-flash`. Старые имена моделей `deepseek-chat` и `deepseek-reasoner` будут отключены через три месяца (24 июля 2026 года), и в течение этого периода они будут перенаправлены на соответствующие режимы V4-Flash.

Похожее

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

В еженедельном обзоре рассматривается волатильность на рынках, вызванная распродажей в секторе ИИ и проблемами крупного хедж-фонда «Situational Awareness», что привело к значительным падениям на азиатских фондовых рынках. Акцентируется внимание на макроэкономических факторах, включая политику ФРС и интервенции Банка Японии. В криптосфере обсуждаются закрытие бирж BitMart и банкротство Storj Labs, трудности компаний вроде Coinbase, а также действия MicroStrategy по наращиванию резервов. Поднимаются темы инсайдерской торговли на Hyperliquid и отключения малопопулярных активов в Aave. Отдельно выделяется энтузиазм венчурных инвесторов вокруг Bittensor ($TAO). Завершается обзор серьёзным предупреждением об уязвимости аппаратных кошельков Coldcard, призывая пользователей к немедленным действиям и повышенной бдительности при самохранении активов.

cryptonews.ru13 мин. назад

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

cryptonews.ru13 мин. назад

Coinkite подвергся критике за хранение электронных писем клиентов после взлома Coldcard на сумму 88 млн долларов

Coinkite столкнулась с критикой из-за хранения электронных адресов клиентов после взлома, связанного с аппаратными кошельками Coldcard, в результате которого было похищено более 1000 BTC (свыше 88 млн долларов). Инцидент произошел из-за ошибки в генерации случайных сид-фраз. Чтобы предупредить пострадавших, компания отправила письма на адреса, связанные с покупками с 2019 года, что вызвало вопросы о хранении таких данных. Coinkite сослалась на свою политику, согласно которой электронные адреса сохраняются для возможности входа и проверки удаления остальной информации, но не указала сроки их хранения. Соучредитель компании Родольфо Новак подчеркнул, что Coinkite не хранит данные клиентов и предлагает анонимные покупки с удалением информации через 90 дней. Тем не менее, ущерб от взлома продолжает расти, достигнув к субботе 1 367 BTC.

cryptonews.ru13 мин. назад

Coinkite подвергся критике за хранение электронных писем клиентов после взлома Coldcard на сумму 88 млн долларов

cryptonews.ru13 мин. назад

Обвал курса BTC вызвал распродажу альткоинов, в то время как ADA пошла вразрез с общей тенденцией

После значительного роста в конце июля биткоин завершил месяц с небольшим повышением на 4.5%, не сумев компенсировать годовые потери около 30%. Резкое падение 31 июля до $62 236 вызвало снижение его рыночной капитализации до $1.26 трлн. Слабость биткоина была обусловлена решением ФРС оставить ставки без изменений, политической неопределённостью вокруг закона CLARITY в США и эскалацией конфликтов на Ближнем Востоке. Падение BTC привело к распродаже на рынке альткоинов. Большинство крупных альткоинов, включая Ethereum, XRP и Solana, потеряли за неделю 2-3%. Наиболее значительно упали HYPE (-12%) и RAIN. Однако Cardano (ADA) и Binance Coin (BNB) выросли на 15.3% и 2.4% соответственно, демонстрируя положительную динамику вопреки общей тенденции. Uniswap, PUMP и BEAT также показали рост. Общая капитализация рынка альткоинов снизилась до $964 млрд, а совокупная капитализация крипторынка упала с $2.33 трлн до $2.22 трлн. Несмотря на надежды индустрии на принятие закона CLARITY, текущие риски, включая проблемы безопасности (взломы Coldcard) и геополитическую напряжённость, продолжают оказывать давление на рынок, ставя под сомнение оптимистичные прогнозы на конец года.

cryptonews.ru16 мин. назад

Обвал курса BTC вызвал распродажу альткоинов, в то время как ADA пошла вразрез с общей тенденцией

cryptonews.ru16 мин. назад

Фразы-семена: 12 слов, которые стоят между вами и потерей всего

Семенная фраза (12 или 24 слова из списка BIP39) — это не логин и пароль, а математическое представление самого криптокошелька. Тот, кто владеет ею, полностью и безвозвратно контролирует все средства. В январе злоумышленники похитили активы на сотни миллионов долларов, не взламывая код, а с помощью социальной инженерии, убедив жертву ввести фразу в поддельное поле. Хотя перебор всех комбинаций полной 12-словой фразы практически невозможен (на это ушли бы миллиарды лет), утечка даже нескольких слов катастрофически снижает безопасность. Например, знание 7 из 12 слов делает взлом возможным менее чем за год. Контрольная сумма во фразе служит не для защиты, а для проверки на опечатки при восстановлении. Однако главная причина потерь — не кражи, а утрата доступа самими владельцами. По оценкам, до 23% всех биткоинов могут быть навсегда утеряны из-за забытых или уничтоженных семенных фраз. Таким образом, эта фраза — единственное и абсолютное доказательство владения, не имеющее механизма восстановления. Её утрата означает безвозвратную потерю активов.

cryptonews.ru16 мин. назад

Фразы-семена: 12 слов, которые стоят между вами и потерей всего

cryptonews.ru16 мин. назад

Внимание: на этой неделе произойдёт масштабное разблокирование токенов в 10 альткоинах! Вот список по дням и часам

В последнюю неделю рынок криптовалют испытал спад из-за хакерской атаки на аппаратный кошелек ColdCard и влияния геополитических событий. Однако на текущей неделе ожидается масштабное разблокирование токенов в 10 альткоинах, что может оказать значительное влияние на их рынки. Все время указано по UTC+3. Основные события разблокировки: * **4 августа, 03:00:** Lagrange (LGN) – разблокируется токенов на $1,38 млн (15.04% от рыночной стоимости). * **5 августа, 03:00:** Proof (PROOF) – разблокируется на $39,11 млн (119.59%), Power Protocol (POWER) – на $1,62 млн (8.93%), Verona (VERONA) – на $1,37 млн (12.61%). * **5 августа, 11:00:** Ethereum (ENA) – разблокируется на $15,28 млн (1.80%). * **6 августа, 03:00:** Goldfinger (GF) – на $11,52 млн (5.05%). * **7 августа, 03:00:** Infinity (INF) – на $2,31 млн (20.30%). * **8 августа, 03:00:** Stable (STBL) – на $28,75 млн (3.55%). * **9 августа, 03:00:** Name (NAME) – на $48,47 млн (74.54%), Move (MOVE) – на $1,22 млн (3.90%). Особое внимание стоит обратить на проекты Proof и Name, где объем разблокировки существенно превышает текущую рыночную капитализацию. Это не является инвестиционной рекомендацией.

cryptonews.ru1 ч. назад

Внимание: на этой неделе произойдёт масштабное разблокирование токенов в 10 альткоинах! Вот список по дням и часам

cryptonews.ru1 ч. назад

Торговля

Спот
活动图片