DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

marsbitОпубликовано 2026-04-24Обновлено 2026-04-24

Введение

DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4 в двух версиях: Pro и Flash. Версия обладает 49 млрд активируемых параметров и поддерживает контекст длиной до 1 млн токенов, что ставит её в один ряд с ведущими закрытыми моделями, такими как Gemini и Claude. Flash-версия предлагает более экономичное решение с 13 млрд параметров. Модель демонстрирует улучшенные способности в задачах агентского кодирования, работе со знаниями и логических рассуждениях. Особое внимание уделено оптимизации под различные фреймворки и поддержке длинного контекста благодаря новой механике внимания DSA. Компания также анонсировала будущую поддержку вычислений на чипах Huawei. Модель уже доступна через API и в открытом доступе на платформах Hugging Face и ModelScope.

Только что появился DeepSeek-V4!

Превью-версия официально запущена и одновременно открыта для всех.

Всего две версии:

DeepSeek-V4-Pro: сопоставима с топовыми закрытыми моделями, 1,6T, 49B активаций, длина контекста 1M;

DeepSeek-V4-Flash: более компактная и быстрая экономичная версия, 284B, 13B активаций, длина контекста 1M.

Официальное заявление: В возможностях агента, знаниях о мире и производительности логических выводов достигнуто лидерство как в Китае, так и в области открытого исходного кода.

И кроме того:

На данный момент DeepSeek-V4 уже стал моделью для агентского кодирования, используемой сотрудниками компании. По данным оценок, опыт использования превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6. Однако все еще существует некоторый разрыв с режимом размышлений Opus 4.6.

Сейчас модель уже доступна на официальном сайте и в приложении, сервис API также обновлен одновременно.

Что касается волнующих всех отечественных вычислительных мощностей, ключевой момент: во втором полугодии будет поддержка вычислений на Huawei.

Топовая конфигурация и выбор по соотношению цена-качество: две версии запускаются вместе

В этом выпуске V4 сразу представили две версии.

V4-Pro, производительность на уровне топовых закрытых моделей.

Официально указаны три критерия:

Значительно улучшены возможности агента: в оценке Agentic Coding V4-Pro достигла лучшего уровня среди текущих открытых моделей и также показала отличные результаты в других оценках, связанных с агентом. Во внутреннем тестировании, в режиме Agent Coding, опыт использования V4 превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6, но все еще есть разрыв с режимом размышлений Opus 4.6.

Богатые знания о мире: В оценке знаний о мире DeepSeek-V4-Pro значительно опережает другие открытые модели, лишь немного уступая топовой закрытой модели Gemini-Pro-3.1.

Мировая топовая производительность логических выводов: в оценках по математике, STEM, соревновательному коду DeepSeek-V4-Pro превзошла все текущие открытые модели, представленные в открытых оценках, достигнув выдающихся результатов на уровне мировых топовых закрытых моделей.

V4-Flash, более компактная и быстрая экономичная версия. Возможности логического вывода близки к Pro, запас знаний о мире немного слабее, но параметры и активации меньше, API дешевле.

В задачах агента DeepSeek-V4-Flash на простых задачах наравне с DeepSeek-V4-Pro, но на задачах высокой сложности все еще есть разрыв.

В тесте на мойку автомобиля V4 также быстро прошел.

А в классическом биологическом сценарии «Отчаявшийся отец» DeepSeek-V4 не сразу уловил ключевой момент о дальтонизме (согласно законам генетики, если женщина страдает дальтонизмом, ее биологический отец обязательно тоже болен).

Контекст в миллион токенов становится стандартом

Стоит отметить, что с сегодняшнего дня контекст в 1M токенов является стандартом для всех официальных сервисов DeepSeek.

Год назад контекст в 1M был козырем исключительно Gemini; все другие закрытые модели предлагали либо 128K, либо 200K; в открытом сегменте почти никто не мог позволить себе работать с таким объемом.

DeepSeek просто переместил миллионный контекст из «премиальной функции» в разряд «коммунальных услуг».

И открыл исходный код. Как они этого добились, в релизе прямо дается ответ —

V4 представила совершенно новый механизм внимания, сжимающий на уровне токенов, используемый вместе с разреженным вниманием DSA. По сравнению с традиционными методами, потребность в вычислениях и видеопамяти значительно снижена.

DSA — не новое слово. Полгода назад, в том обновлении V3.2-Exp, его впервые внедрили, тогда внешнее внимание было невысоким, потому что бенчмарки были почти такие же, как у V3.1-Terminus, выглядело как промежуточная версия без особых новшеств.

Теперь, оглядываясь назад, видно, что это был фундамент V4.

Специальная оптимизация возможностей агента

В части агента V4 была адаптирована и оптимизирована для таких продуктов, как Claude Code, OpenClaw, OpenCode, CodeBuddy, улучшены задачи по коду и генерации документов.

В релизе также приложен пример внутренней страницы PPT, сгенерированной V4-Pro в одном из агентских фреймворков.

Цены на API

На стороне API, V4-Pro и V4-Flash запущены одновременно, поддерживаются два интерфейса: OpenAI ChatCompletions и Anthropic.

base_url не меняется, для вызова достаточно изменить параметр model на deepseek-v4-pro или deepseek-v4-flash.

Максимальный контекст обеих версий — 1M, обе одновременно поддерживают режим без размышлений и режим размышлений. В режиме размышлений можно регулировать интенсивность параметром reasoning_effort, два уровня: high и max. Официально рекомендуется для сложных сценариев с агентом сразу использовать max.

Здесь есть ключевой момент — во втором полугодии будет поддержка вычислений на Huawei.

Кроме того, старые названия моделей будут сняты с публикации.

deepseek-chat и deepseek-reasoner будут отключены через три месяца (24 июля 2026 года), на текущем этапе эти имена соответствуют режиму без размышлений и режиму размышлений V4-Flash соответственно.

Для индивидуальных разработчиков impact невелик, нужно изменить один параметр model. Компаниям, подключившим production-среды, в эти три месяца нужно заняться миграцией.

И еще кое-что

В конце релиза DeepSeek процитировали одну фразу.

«Не соблазняться славой, не бояться клеветы, идти своим путем, быть upright и correct себя.»

Это из «О двенадцати философах» Сюнь-цзы. Буквально означает: не соблазняться похвалой, не пугаться клеветы, идти вперед по своему пути, исправлять себя.

В сегодняшнем контексте это довольно интересно.

За последние полгода слухи о том, когда выйдет V4, не запаздывает ли он, не обогнали ли его уже другие, не справились ли с ним дистилляцией данных Claude, несколько раз ходили по китайскому и англоязычному AI-сообществу. В начале года даже кто-то уверенно заявлял, что V4 выйдет до Нового года по лунному календарю, но в итоге дождались только конца апреля.

Они ни разу не ответили.

А потом в одну из пятниц во второй половине дня выпустили V4, одновременно открыли исходный код, запустили на официальном сайте и в приложении, обновили API, попутно написав в релизе факт, что внутренние сотрудники уже перестали использовать Claude.

Никакой roadmap, никаких трансляций, никаких интервью.

Фраза «идти своим путем» звучит как лозунг. Но если посмотреть на путь за последние полгода: тот «малопримечательный» Exp-релиз V3.2, тот механизм разреженного внимания DSA, который полгода готовил почву для V4, путь превращения контекста в 1M из козыря в стандарт.

DeepSeek уже это сделал.

Ссылки на открытые модели DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Технический отчет DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Эта статья из WeChat Official Account «量子位» (QbitAI), автор: 量子位

Связанные с этим вопросы

QКакие две версии DeepSeek-V4 были представлены и каковы их ключевые характеристики?

AБыли представлены две версии: DeepSeek-V4-Pro и DeepSeek-V4-Flash. Pro-версия имеет 1,6T параметров, 49B активаций и длину контекста 1M, она ориентирована на высочайшую производительность. Flash-версия более компактна и быстра, с 284B параметрами, 13B активаций и той же длиной контекста 1M, предлагая экономически эффективное решение.

QКакие ключевые улучшения в производительности заявляет DeepSeek для модели V4-Pro?

ADeepSeek заявляет о трех ключевых улучшениях для V4-Pro: значительно улучшенные агентские способности (особенно в кодировании), превосходные мировые знания (немного уступая только Gemini-Pro-3.1) и высочайшая производительность в рассуждениях (математика, STEM, соревновательное программирование), что ставит модель на один уровень с ведущими закрытыми моделями.

QКакое важное технологическое достижение позволяет DeepSeek-V4 иметь стандартную длину контекста в 1 миллион токенов?

AДлина контекста в 1M токенов стала стандартом благодаря новой механизм внимания, который сжимает информацию на уровне токенов в сочетании с разреженным вниманием DSA (Dilated Sliding Attention). Этот подход значительно снижает вычислительные потребности и требования к памяти по сравнению с традиционными методами.

QКаковы планы DeepSeek относительно поддержки аппаратного обеспечения и что specifically упоминается в статье?

AВ статье specifically упоминается, что во второй половине года DeepSeek планирует добавить поддержку вычислений на чипах Huawei. Это подчеркивает ориентацию на развитие отечественных (китайских) вычислительных мощностей.

QКак изменится API сервис DeepSeek и что произойдет со старыми названиями моделей?

AAPI сервис обновлен для поддержки новых моделей V4-Pro и V4-Flash через те же конечные точки, используя параметры модели `deepseek-v4-pro` или `deepseek-v4-flash`. Старые имена моделей `deepseek-chat` и `deepseek-reasoner` будут отключены через три месяца (24 июля 2026 года), и в течение этого периода они будут перенаправлены на соответствующие режимы V4-Flash.

Похожее

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

Исследование Банка Италии показало, что стейблкоины (на примере USDC) не демонстрируют устойчивых системных преимуществ в стоимости и скорости международных денежных переводов по сравнению с традиционными сервисами. Анализ транзакций на 200 USDC в 10 платежных коридорах (Италия — Бразилия, Аргентина, Япония, ОАЭ, ЮАР и др.) выявил, что финальная стоимость переводов варьировалась от 0,3% до почти 9%. Сроки исполнения колебались от менее 20 минут в коридорах с инфраструктурой мгновенных платежей до 1-2 рабочих дней в ее отсутствие. Ключевые издержки и задержки связаны не с комиссиями блокчейна, а с процессами конвертации в фиатные валюты и работой локальных платежных систем. Хотя в большинстве изучных направлений стоимость переводов со стейблкоинами была ниже среднемирового показателя в 6,65%, по сравнению с сервисом Wise преимущество наблюдалось только в трех из семи сопоставимых случаев. Авторы отмечают, что преимущества стейблкоинов могли бы быть более заметны, если бы их можно было напрямую тратить без конвертации. Также подчеркивается, что запретительное регулирование не устраняет спрос на стейблкоины, а излишне жесткие правила лишь усложняют их использование для розничных клиентов. В контексте исследования упоминается значительное снижение общей капитализации рынка стейблкоинов в июле.

cryptonews.ru48 мин. назад

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

cryptonews.ru48 мин. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

Исполнительный председатель MicroStrategy Майкл Сэйлор 2 августа опубликовал сообщение «Bitcoin Drive engaged», что вызвало спекуляции о новой покупке биткойнов компанией. Его отчет показал, что резерв MicroStrategy составляет 843 775 BTC стоимостью около $53,25 млрд, со средней себестоимостью $75 653 и нереализованным убытком в $10,58 млрд. Ранее аналогичный сигнал предшествовал объявлению о пополнении долларового резерва. В то же время, реестр компании отразил две недавние продажи на общую сумму 3 588 BTC, сократив запасы. Эти продажи, согласно документам SEC, были проведены для финансирования выплат по привилегированным акциям. Неделей ранее компания не покупала биткойны, увеличив свой долларовый резерв примерно до $3,75 млрд. Финансовые риски остаются высокими после отчетности об операционном убытке в $8,33 млрд за второй квартал 2026 года. Ожидается, что обновление данных в понедельник покажет, означает ли сообщение Сэйлора возврат к накоплению биткойнов, поскольку компания балансирует между своими крупными запасами криптовалюты и растущими денежными обязательствами.

cryptonews.ru50 мин. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

cryptonews.ru50 мин. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

Несмотря на медленное снижение в начале августа, на графике биткоина формируется перевёрнутая разворотная модель «голова и плечи». Цена $BTC колеблется около $63,200, формируя правое плечо, что является основным поводом для краткосрочного оптимизма. Ключевой вопрос — хватит ли покупателям сил для рывка к уровню $67,200 для подтверждения разворота. В то же время в паре ETH/BTC уже пробито разворотное дно. Ethereum демонстрирует относительную силу, закрепился в восходящем тренде и движется к цели 0,0312, а против доллара тестирует уровень $1875, открывая путь к $2163. Эта ротация капитала в пользу ETH лишает биткоин объёма, необходимого для быстрого роста. Таким образом, ситуация для биткоина остаётся напряжённой: либо он в ближайшие дни последует примеру Ethereum и осуществит быстрый рост выше $67,200, либо, если атака на «шею» паттерна не состоится, медведи возьмут контроль и отправят цену к уровням поддержки $60,000 и $58,000.

cryptonews.ru50 мин. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

cryptonews.ru50 мин. назад

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

В еженедельном обзоре рассматривается волатильность на рынках, вызванная распродажей в секторе ИИ и проблемами крупного хедж-фонда «Situational Awareness», что привело к значительным падениям на азиатских фондовых рынках. Акцентируется внимание на макроэкономических факторах, включая политику ФРС и интервенции Банка Японии. В криптосфере обсуждаются закрытие бирж BitMart и банкротство Storj Labs, трудности компаний вроде Coinbase, а также действия MicroStrategy по наращиванию резервов. Поднимаются темы инсайдерской торговли на Hyperliquid и отключения малопопулярных активов в Aave. Отдельно выделяется энтузиазм венчурных инвесторов вокруг Bittensor ($TAO). Завершается обзор серьёзным предупреждением об уязвимости аппаратных кошельков Coldcard, призывая пользователей к немедленным действиям и повышенной бдительности при самохранении активов.

cryptonews.ru1 ч. назад

Акции компаний, занимающихся искусственным интеллектом, торгуются как «мемокоины», в то время как биткоин практически не меняет цены — обзор недели

cryptonews.ru1 ч. назад

Coinkite подвергся критике за хранение электронных писем клиентов после взлома Coldcard на сумму 88 млн долларов

Coinkite столкнулась с критикой из-за хранения электронных адресов клиентов после взлома, связанного с аппаратными кошельками Coldcard, в результате которого было похищено более 1000 BTC (свыше 88 млн долларов). Инцидент произошел из-за ошибки в генерации случайных сид-фраз. Чтобы предупредить пострадавших, компания отправила письма на адреса, связанные с покупками с 2019 года, что вызвало вопросы о хранении таких данных. Coinkite сослалась на свою политику, согласно которой электронные адреса сохраняются для возможности входа и проверки удаления остальной информации, но не указала сроки их хранения. Соучредитель компании Родольфо Новак подчеркнул, что Coinkite не хранит данные клиентов и предлагает анонимные покупки с удалением информации через 90 дней. Тем не менее, ущерб от взлома продолжает расти, достигнув к субботе 1 367 BTC.

cryptonews.ru1 ч. назад

Coinkite подвергся критике за хранение электронных писем клиентов после взлома Coldcard на сумму 88 млн долларов

cryptonews.ru1 ч. назад

Торговля

Спот
活动图片