Только что появился DeepSeek-V4!
Превью-версия официально запущена и одновременно открыта для всех.
Всего две версии:
DeepSeek-V4-Pro: сопоставима с топовыми закрытыми моделями, 1,6T, 49B активаций, длина контекста 1M;
DeepSeek-V4-Flash: более компактная и быстрая экономичная версия, 284B, 13B активаций, длина контекста 1M.

Официальное заявление: В возможностях агента, знаниях о мире и производительности логических выводов достигнуто лидерство как в Китае, так и в области открытого исходного кода.
И кроме того:
На данный момент DeepSeek-V4 уже стал моделью для агентского кодирования, используемой сотрудниками компании. По данным оценок, опыт использования превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6. Однако все еще существует некоторый разрыв с режимом размышлений Opus 4.6.

Сейчас модель уже доступна на официальном сайте и в приложении, сервис API также обновлен одновременно.
Что касается волнующих всех отечественных вычислительных мощностей, ключевой момент: во втором полугодии будет поддержка вычислений на Huawei.

Топовая конфигурация и выбор по соотношению цена-качество: две версии запускаются вместе
В этом выпуске V4 сразу представили две версии.
V4-Pro, производительность на уровне топовых закрытых моделей.
Официально указаны три критерия:
Значительно улучшены возможности агента: в оценке Agentic Coding V4-Pro достигла лучшего уровня среди текущих открытых моделей и также показала отличные результаты в других оценках, связанных с агентом. Во внутреннем тестировании, в режиме Agent Coding, опыт использования V4 превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6, но все еще есть разрыв с режимом размышлений Opus 4.6.
Богатые знания о мире: В оценке знаний о мире DeepSeek-V4-Pro значительно опережает другие открытые модели, лишь немного уступая топовой закрытой модели Gemini-Pro-3.1.
Мировая топовая производительность логических выводов: в оценках по математике, STEM, соревновательному коду DeepSeek-V4-Pro превзошла все текущие открытые модели, представленные в открытых оценках, достигнув выдающихся результатов на уровне мировых топовых закрытых моделей.

V4-Flash, более компактная и быстрая экономичная версия. Возможности логического вывода близки к Pro, запас знаний о мире немного слабее, но параметры и активации меньше, API дешевле.
В задачах агента DeepSeek-V4-Flash на простых задачах наравне с DeepSeek-V4-Pro, но на задачах высокой сложности все еще есть разрыв.
В тесте на мойку автомобиля V4 также быстро прошел.

А в классическом биологическом сценарии «Отчаявшийся отец» DeepSeek-V4 не сразу уловил ключевой момент о дальтонизме (согласно законам генетики, если женщина страдает дальтонизмом, ее биологический отец обязательно тоже болен).

Контекст в миллион токенов становится стандартом
Стоит отметить, что с сегодняшнего дня контекст в 1M токенов является стандартом для всех официальных сервисов DeepSeek.
Год назад контекст в 1M был козырем исключительно Gemini; все другие закрытые модели предлагали либо 128K, либо 200K; в открытом сегменте почти никто не мог позволить себе работать с таким объемом.
DeepSeek просто переместил миллионный контекст из «премиальной функции» в разряд «коммунальных услуг».
И открыл исходный код. Как они этого добились, в релизе прямо дается ответ —
V4 представила совершенно новый механизм внимания, сжимающий на уровне токенов, используемый вместе с разреженным вниманием DSA. По сравнению с традиционными методами, потребность в вычислениях и видеопамяти значительно снижена.

DSA — не новое слово. Полгода назад, в том обновлении V3.2-Exp, его впервые внедрили, тогда внешнее внимание было невысоким, потому что бенчмарки были почти такие же, как у V3.1-Terminus, выглядело как промежуточная версия без особых новшеств.
Теперь, оглядываясь назад, видно, что это был фундамент V4.
Специальная оптимизация возможностей агента
В части агента V4 была адаптирована и оптимизирована для таких продуктов, как Claude Code, OpenClaw, OpenCode, CodeBuddy, улучшены задачи по коду и генерации документов.
В релизе также приложен пример внутренней страницы PPT, сгенерированной V4-Pro в одном из агентских фреймворков.

Цены на API
На стороне API, V4-Pro и V4-Flash запущены одновременно, поддерживаются два интерфейса: OpenAI ChatCompletions и Anthropic.
base_url не меняется, для вызова достаточно изменить параметр model на deepseek-v4-pro или deepseek-v4-flash.
Максимальный контекст обеих версий — 1M, обе одновременно поддерживают режим без размышлений и режим размышлений. В режиме размышлений можно регулировать интенсивность параметром reasoning_effort, два уровня: high и max. Официально рекомендуется для сложных сценариев с агентом сразу использовать max.

Здесь есть ключевой момент — во втором полугодии будет поддержка вычислений на Huawei.
Кроме того, старые названия моделей будут сняты с публикации.
deepseek-chat и deepseek-reasoner будут отключены через три месяца (24 июля 2026 года), на текущем этапе эти имена соответствуют режиму без размышлений и режиму размышлений V4-Flash соответственно.
Для индивидуальных разработчиков impact невелик, нужно изменить один параметр model. Компаниям, подключившим production-среды, в эти три месяца нужно заняться миграцией.
И еще кое-что
В конце релиза DeepSeek процитировали одну фразу.
«Не соблазняться славой, не бояться клеветы, идти своим путем, быть upright и correct себя.»
Это из «О двенадцати философах» Сюнь-цзы. Буквально означает: не соблазняться похвалой, не пугаться клеветы, идти вперед по своему пути, исправлять себя.
В сегодняшнем контексте это довольно интересно.
За последние полгода слухи о том, когда выйдет V4, не запаздывает ли он, не обогнали ли его уже другие, не справились ли с ним дистилляцией данных Claude, несколько раз ходили по китайскому и англоязычному AI-сообществу. В начале года даже кто-то уверенно заявлял, что V4 выйдет до Нового года по лунному календарю, но в итоге дождались только конца апреля.
Они ни разу не ответили.
А потом в одну из пятниц во второй половине дня выпустили V4, одновременно открыли исходный код, запустили на официальном сайте и в приложении, обновили API, попутно написав в релизе факт, что внутренние сотрудники уже перестали использовать Claude.
Никакой roadmap, никаких трансляций, никаких интервью.
Фраза «идти своим путем» звучит как лозунг. Но если посмотреть на путь за последние полгода: тот «малопримечательный» Exp-релиз V3.2, тот механизм разреженного внимания DSA, который полгода готовил почву для V4, путь превращения контекста в 1M из козыря в стандарт.
DeepSeek уже это сделал.
Ссылки на открытые модели DeepSeek-V4:
[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4
[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4
Технический отчет DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf
Эта статья из WeChat Official Account «量子位» (QbitAI), автор: 量子位





