DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

marsbitОпубликовано 2026-04-24Обновлено 2026-04-24

Введение

DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4 в двух версиях: Pro и Flash. Версия обладает 49 млрд активируемых параметров и поддерживает контекст длиной до 1 млн токенов, что ставит её в один ряд с ведущими закрытыми моделями, такими как Gemini и Claude. Flash-версия предлагает более экономичное решение с 13 млрд параметров. Модель демонстрирует улучшенные способности в задачах агентского кодирования, работе со знаниями и логических рассуждениях. Особое внимание уделено оптимизации под различные фреймворки и поддержке длинного контекста благодаря новой механике внимания DSA. Компания также анонсировала будущую поддержку вычислений на чипах Huawei. Модель уже доступна через API и в открытом доступе на платформах Hugging Face и ModelScope.

Только что появился DeepSeek-V4!

Превью-версия официально запущена и одновременно открыта для всех.

Всего две версии:

DeepSeek-V4-Pro: сопоставима с топовыми закрытыми моделями, 1,6T, 49B активаций, длина контекста 1M;

DeepSeek-V4-Flash: более компактная и быстрая экономичная версия, 284B, 13B активаций, длина контекста 1M.

Официальное заявление: В возможностях агента, знаниях о мире и производительности логических выводов достигнуто лидерство как в Китае, так и в области открытого исходного кода.

И кроме того:

На данный момент DeepSeek-V4 уже стал моделью для агентского кодирования, используемой сотрудниками компании. По данным оценок, опыт использования превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6. Однако все еще существует некоторый разрыв с режимом размышлений Opus 4.6.

Сейчас модель уже доступна на официальном сайте и в приложении, сервис API также обновлен одновременно.

Что касается волнующих всех отечественных вычислительных мощностей, ключевой момент: во втором полугодии будет поддержка вычислений на Huawei.

Топовая конфигурация и выбор по соотношению цена-качество: две версии запускаются вместе

В этом выпуске V4 сразу представили две версии.

V4-Pro, производительность на уровне топовых закрытых моделей.

Официально указаны три критерия:

Значительно улучшены возможности агента: в оценке Agentic Coding V4-Pro достигла лучшего уровня среди текущих открытых моделей и также показала отличные результаты в других оценках, связанных с агентом. Во внутреннем тестировании, в режиме Agent Coding, опыт использования V4 превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6, но все еще есть разрыв с режимом размышлений Opus 4.6.

Богатые знания о мире: В оценке знаний о мире DeepSeek-V4-Pro значительно опережает другие открытые модели, лишь немного уступая топовой закрытой модели Gemini-Pro-3.1.

Мировая топовая производительность логических выводов: в оценках по математике, STEM, соревновательному коду DeepSeek-V4-Pro превзошла все текущие открытые модели, представленные в открытых оценках, достигнув выдающихся результатов на уровне мировых топовых закрытых моделей.

V4-Flash, более компактная и быстрая экономичная версия. Возможности логического вывода близки к Pro, запас знаний о мире немного слабее, но параметры и активации меньше, API дешевле.

В задачах агента DeepSeek-V4-Flash на простых задачах наравне с DeepSeek-V4-Pro, но на задачах высокой сложности все еще есть разрыв.

В тесте на мойку автомобиля V4 также быстро прошел.

А в классическом биологическом сценарии «Отчаявшийся отец» DeepSeek-V4 не сразу уловил ключевой момент о дальтонизме (согласно законам генетики, если женщина страдает дальтонизмом, ее биологический отец обязательно тоже болен).

Контекст в миллион токенов становится стандартом

Стоит отметить, что с сегодняшнего дня контекст в 1M токенов является стандартом для всех официальных сервисов DeepSeek.

Год назад контекст в 1M был козырем исключительно Gemini; все другие закрытые модели предлагали либо 128K, либо 200K; в открытом сегменте почти никто не мог позволить себе работать с таким объемом.

DeepSeek просто переместил миллионный контекст из «премиальной функции» в разряд «коммунальных услуг».

И открыл исходный код. Как они этого добились, в релизе прямо дается ответ —

V4 представила совершенно новый механизм внимания, сжимающий на уровне токенов, используемый вместе с разреженным вниманием DSA. По сравнению с традиционными методами, потребность в вычислениях и видеопамяти значительно снижена.

DSA — не новое слово. Полгода назад, в том обновлении V3.2-Exp, его впервые внедрили, тогда внешнее внимание было невысоким, потому что бенчмарки были почти такие же, как у V3.1-Terminus, выглядело как промежуточная версия без особых новшеств.

Теперь, оглядываясь назад, видно, что это был фундамент V4.

Специальная оптимизация возможностей агента

В части агента V4 была адаптирована и оптимизирована для таких продуктов, как Claude Code, OpenClaw, OpenCode, CodeBuddy, улучшены задачи по коду и генерации документов.

В релизе также приложен пример внутренней страницы PPT, сгенерированной V4-Pro в одном из агентских фреймворков.

Цены на API

На стороне API, V4-Pro и V4-Flash запущены одновременно, поддерживаются два интерфейса: OpenAI ChatCompletions и Anthropic.

base_url не меняется, для вызова достаточно изменить параметр model на deepseek-v4-pro или deepseek-v4-flash.

Максимальный контекст обеих версий — 1M, обе одновременно поддерживают режим без размышлений и режим размышлений. В режиме размышлений можно регулировать интенсивность параметром reasoning_effort, два уровня: high и max. Официально рекомендуется для сложных сценариев с агентом сразу использовать max.

Здесь есть ключевой момент — во втором полугодии будет поддержка вычислений на Huawei.

Кроме того, старые названия моделей будут сняты с публикации.

deepseek-chat и deepseek-reasoner будут отключены через три месяца (24 июля 2026 года), на текущем этапе эти имена соответствуют режиму без размышлений и режиму размышлений V4-Flash соответственно.

Для индивидуальных разработчиков impact невелик, нужно изменить один параметр model. Компаниям, подключившим production-среды, в эти три месяца нужно заняться миграцией.

И еще кое-что

В конце релиза DeepSeek процитировали одну фразу.

«Не соблазняться славой, не бояться клеветы, идти своим путем, быть upright и correct себя.»

Это из «О двенадцати философах» Сюнь-цзы. Буквально означает: не соблазняться похвалой, не пугаться клеветы, идти вперед по своему пути, исправлять себя.

В сегодняшнем контексте это довольно интересно.

За последние полгода слухи о том, когда выйдет V4, не запаздывает ли он, не обогнали ли его уже другие, не справились ли с ним дистилляцией данных Claude, несколько раз ходили по китайскому и англоязычному AI-сообществу. В начале года даже кто-то уверенно заявлял, что V4 выйдет до Нового года по лунному календарю, но в итоге дождались только конца апреля.

Они ни разу не ответили.

А потом в одну из пятниц во второй половине дня выпустили V4, одновременно открыли исходный код, запустили на официальном сайте и в приложении, обновили API, попутно написав в релизе факт, что внутренние сотрудники уже перестали использовать Claude.

Никакой roadmap, никаких трансляций, никаких интервью.

Фраза «идти своим путем» звучит как лозунг. Но если посмотреть на путь за последние полгода: тот «малопримечательный» Exp-релиз V3.2, тот механизм разреженного внимания DSA, который полгода готовил почву для V4, путь превращения контекста в 1M из козыря в стандарт.

DeepSeek уже это сделал.

Ссылки на открытые модели DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Технический отчет DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Эта статья из WeChat Official Account «量子位» (QbitAI), автор: 量子位

Связанные с этим вопросы

QКакие две версии DeepSeek-V4 были представлены и каковы их ключевые характеристики?

AБыли представлены две версии: DeepSeek-V4-Pro и DeepSeek-V4-Flash. Pro-версия имеет 1,6T параметров, 49B активаций и длину контекста 1M, она ориентирована на высочайшую производительность. Flash-версия более компактна и быстра, с 284B параметрами, 13B активаций и той же длиной контекста 1M, предлагая экономически эффективное решение.

QКакие ключевые улучшения в производительности заявляет DeepSeek для модели V4-Pro?

ADeepSeek заявляет о трех ключевых улучшениях для V4-Pro: значительно улучшенные агентские способности (особенно в кодировании), превосходные мировые знания (немного уступая только Gemini-Pro-3.1) и высочайшая производительность в рассуждениях (математика, STEM, соревновательное программирование), что ставит модель на один уровень с ведущими закрытыми моделями.

QКакое важное технологическое достижение позволяет DeepSeek-V4 иметь стандартную длину контекста в 1 миллион токенов?

AДлина контекста в 1M токенов стала стандартом благодаря новой механизм внимания, который сжимает информацию на уровне токенов в сочетании с разреженным вниманием DSA (Dilated Sliding Attention). Этот подход значительно снижает вычислительные потребности и требования к памяти по сравнению с традиционными методами.

QКаковы планы DeepSeek относительно поддержки аппаратного обеспечения и что specifically упоминается в статье?

AВ статье specifically упоминается, что во второй половине года DeepSeek планирует добавить поддержку вычислений на чипах Huawei. Это подчеркивает ориентацию на развитие отечественных (китайских) вычислительных мощностей.

QКак изменится API сервис DeepSeek и что произойдет со старыми названиями моделей?

AAPI сервис обновлен для поддержки новых моделей V4-Pro и V4-Flash через те же конечные точки, используя параметры модели `deepseek-v4-pro` или `deepseek-v4-flash`. Старые имена моделей `deepseek-chat` и `deepseek-reasoner` будут отключены через три месяца (24 июля 2026 года), и в течение этого периода они будут перенаправлены на соответствующие режимы V4-Flash.

Похожее

Банк Кореи рассказал о результатах тестирования токенизированных депозитов

Банк Кореи сообщил об успешных результатах пилотного тестирования системы токенизированных депозитов. В проекте приняли участие 28 центральных банков и международные финансовые организации, а также крупнейшие южнокорейские коммерческие банки, включая KB Kookmin Bank, NH NongHyup Bank, Shinhan Bank, Woori Bank и Hana Bank. В ходе испытаний было совершено 30 транзакций в 17 различных сценариях, включая корпоративные и межбанковские переводы в шести валютах (корейская вона, доллар США, евро и другие). Общая сумма операций составила около 800 000 швейцарских франков. Полный процесс расчетов, от платежного поручения до финального расчета, занимал в среднем одну минуту 20 секунд, при этом сама стадия окончательного расчета — около 80 секунд. Платформа работала стабильно, обеспечивая быстрые и прозрачные расчеты даже в условиях частичной интеграции с действующей банковской инфраструктурой. Кроме того, были успешно проведены тестовый внутренний перевод на 20 млн вон между банками NH NongHyup и Shinhan через платформу Project Agora, а также кросс-граничные платежи между южнокорейским KB Kookmin Bank и японским MUFG Bank с использованием депозитных токенов. Эти токены представляют собой цифровые сертификаты, выпускаемые банками в рамках пилота, и не являются прямой эмиссией центрального банка. Банк Кореи планирует продолжать тестирование платежей с депозитными токенами. Напомним, что в прошлом году власти страны объявили о намерении ужесточить регулирование стейблкоинов, номинированных в воне, для выпуска которых потребуется разрешение ЦБ и Комиссии по финансовым услугам (FSC).

cryptonews.ru10 мин. назад

Банк Кореи рассказал о результатах тестирования токенизированных депозитов

cryptonews.ru10 мин. назад

Глава крупного майнера оценил доходность от ИИ в десять раз выше майнинга

Глава канадской майнинговой компании HIVE Digital Technologies Фрэнк Холмс заявил об ускоренном развитии направления вычислений для искусственного интеллекта (ИИ). Он отметил, что доходность от ИИ-вычислений значительно превышает традиционный майнинг: один GPU Nvidia H100 приносит около $2 в час, что примерно в десять раз больше, чем прибыль от ASIC-майнеров ($0,12–0,14 в час). В связи с этим доля ИИ в выручке HIVE, по его прогнозам, вырастет с 10% до более 50% уже в текущем году. Многие крупные майнеры, включая Riot Platforms, Cipher Digital, MARA и TeraWulf, минимизируют убытки, переходя или совмещая добычу криптовалют с поддержкой ИИ-вычислений. Например, MARA Holdings недавно инвестировала $600 млн в площадку для дата-центров, ориентированных на обе задачи. При этом модель традиционного майнинга становится всё менее рентабельной. По оценкам, себестоимость добычи одного биткоина к лету 2026 года составит около $78 тыс., что выше текущей рыночной цены. Глава MARA ранее предупреждал, что без роста цены биткоина минимум на 50% в год майнинг станет убыточным, что уже вынуждает некоторых операторов отключать оборудование при росте сложности сети.

cryptonews.ru12 мин. назад

Глава крупного майнера оценил доходность от ИИ в десять раз выше майнинга

cryptonews.ru12 мин. назад

В НКЦБФР раскрыли подробности подготовки законопроекта о криптовалютах

Глава НКЦБФР Алексей Семенюк сообщил, что работа над законопроектом о регулировании рынка виртуальных активов в Украине завершена примерно на 90%. Окончательную версию текста планируется подготовить в августе, однако это касается завершения разработки, а не принятия парламентом. На данный момент стороны согласовали ключевые положения: НКЦБФР определен как основной регулятор рынка с четким распределением полномочий с Национальным банком, утверждена классификация активов по стандартам MiCA, а также правила лицензирования поставщиков услуг и пруденциальные требования к ним. Отдельно согласован специальный режим работы рынка на время военного положения. Остаются нерешенными два основных блока: вопросы налогообложения операций с криптовалютами (ставки, база, льготы) и определение юридического статуса виртуальных активов в уголовном и исполнительном производстве. Консультации по этим пунктам, а также по переходному периоду, продолжаются. Законопроект был принят в первом чтении в сентябре 2025 года. Ожидается, что после подготовки в августе и принятия, закон может вступить в силу с 1 января 2027 года.

cryptonews.ru12 мин. назад

В НКЦБФР раскрыли подробности подготовки законопроекта о криптовалютах

cryptonews.ru12 мин. назад

Как укрепление японской иены может отразиться на биткоине?

Японская иена продемонстрировала самый значительный дневной рост против доллара США после разворота пары USD/JPY с недавнего максимума около 164,00. Это подчеркивает потенциальное влияние изменений курса иены на глобальные финансовые условия, включая рынок криптовалют, в частности, биткоин. На дневном графике пара USD/JPY упала ниже уровня 160,00 после многомесячного восходящего тренда, хотя к закрытию восстановилась до 160,59. Укрепление иены на целых 3% (с пиков около 164 до минимума 158,34) и высокие объемы операций напоминают о возможных интервенциях властей. Внимание рынка приковано к сигналам Банка Японии относительно будущей монетарной политики. Такое укрепление иены может оказать краткосрочное негативное влияние на биткоин. Инвесторы могут закрывать позиции в кэрри-трейде, которые финансировались за счет дешевых заимствований в йене, что создает давление на продажи. В день публикации статьи цена биткоина уже снизилась на 2.5% до $62,500. Однако в более долгосрочной перспективе, если укрепление иены приведет к снижению доходности японских гособлигаций и улучшит глобальную ликвидность, финансовые условия могут стать более благоприятными для рисковых активов, включая криптовалюты.

cryptonews.ru14 мин. назад

Как укрепление японской иены может отразиться на биткоине?

cryptonews.ru14 мин. назад

После 30%-го роста до $2000 Ethereum подал сигнал к снижению цены

Криптоаналитик Али Мартинес отмечает, что индикатор TD Sequential сформировал сигнал на продажу Ethereum, когда цена достигла зоны $1980. Впоследствии курс ETH опустился ниже уровня поддержки в $1897,27, и следующей вероятной целью снижения является уровень $1857,75. Несмотря на 30%-й рост до $2000, Ethereum демонстрирует слабую динамику в 2026 году, находясь в числе худших крупных криптоактивов с падением на 36,59% с начала года. Долгосрочные показатели также негативны: за 12 месяцев цена упала почти вдвое, а за 5 лет — на 23,32%. Для сравнения, Bitcoin с начала года снизился на 27%, но с середины 2021 года вырос на 53%. Ключевым событием, способным повлиять на рынок, станет голосование по Закону CLARITY 3 августа, которое может обеспечить регуляторную определённость. Ожидание этого события уже поддержало рост многих криптовалют, а некоторые аналитики прогнозируют, что в случае принятия закона цена BTC может превысить $600 000 в течение двух лет.

cryptonews.ru15 мин. назад

После 30%-го роста до $2000 Ethereum подал сигнал к снижению цены

cryptonews.ru15 мин. назад

Торговля

Спот
活动图片