DeepSeek V4 наконец-то выпущен: прорыв в монополии закрытых моделей и официальное партнерство с чипами Huawei

marsbitОпубликовано 2026-04-24Обновлено 2026-04-24

Введение

DeepSeek представила новую модель искусственного интеллекта DeepSeek-V4 в двух версиях: Pro и Flash. Версия обладает 49 млрд активируемых параметров и поддерживает контекст длиной до 1 млн токенов, что ставит её в один ряд с ведущими закрытыми моделями, такими как Gemini и Claude. Flash-версия предлагает более экономичное решение с 13 млрд параметров. Модель демонстрирует улучшенные способности в задачах агентского кодирования, работе со знаниями и логических рассуждениях. Особое внимание уделено оптимизации под различные фреймворки и поддержке длинного контекста благодаря новой механике внимания DSA. Компания также анонсировала будущую поддержку вычислений на чипах Huawei. Модель уже доступна через API и в открытом доступе на платформах Hugging Face и ModelScope.

Только что появился DeepSeek-V4!

Превью-версия официально запущена и одновременно открыта для всех.

Всего две версии:

DeepSeek-V4-Pro: сопоставима с топовыми закрытыми моделями, 1,6T, 49B активаций, длина контекста 1M;

DeepSeek-V4-Flash: более компактная и быстрая экономичная версия, 284B, 13B активаций, длина контекста 1M.

Официальное заявление: В возможностях агента, знаниях о мире и производительности логических выводов достигнуто лидерство как в Китае, так и в области открытого исходного кода.

И кроме того:

На данный момент DeepSeek-V4 уже стал моделью для агентского кодирования, используемой сотрудниками компании. По данным оценок, опыт использования превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6. Однако все еще существует некоторый разрыв с режимом размышлений Opus 4.6.

Сейчас модель уже доступна на официальном сайте и в приложении, сервис API также обновлен одновременно.

Что касается волнующих всех отечественных вычислительных мощностей, ключевой момент: во втором полугодии будет поддержка вычислений на Huawei.

Топовая конфигурация и выбор по соотношению цена-качество: две версии запускаются вместе

В этом выпуске V4 сразу представили две версии.

V4-Pro, производительность на уровне топовых закрытых моделей.

Официально указаны три критерия:

Значительно улучшены возможности агента: в оценке Agentic Coding V4-Pro достигла лучшего уровня среди текущих открытых моделей и также показала отличные результаты в других оценках, связанных с агентом. Во внутреннем тестировании, в режиме Agent Coding, опыт использования V4 превосходит Sonnet 4.5, качество результатов близко к режиму без размышлений Opus 4.6, но все еще есть разрыв с режимом размышлений Opus 4.6.

Богатые знания о мире: В оценке знаний о мире DeepSeek-V4-Pro значительно опережает другие открытые модели, лишь немного уступая топовой закрытой модели Gemini-Pro-3.1.

Мировая топовая производительность логических выводов: в оценках по математике, STEM, соревновательному коду DeepSeek-V4-Pro превзошла все текущие открытые модели, представленные в открытых оценках, достигнув выдающихся результатов на уровне мировых топовых закрытых моделей.

V4-Flash, более компактная и быстрая экономичная версия. Возможности логического вывода близки к Pro, запас знаний о мире немного слабее, но параметры и активации меньше, API дешевле.

В задачах агента DeepSeek-V4-Flash на простых задачах наравне с DeepSeek-V4-Pro, но на задачах высокой сложности все еще есть разрыв.

В тесте на мойку автомобиля V4 также быстро прошел.

А в классическом биологическом сценарии «Отчаявшийся отец» DeepSeek-V4 не сразу уловил ключевой момент о дальтонизме (согласно законам генетики, если женщина страдает дальтонизмом, ее биологический отец обязательно тоже болен).

Контекст в миллион токенов становится стандартом

Стоит отметить, что с сегодняшнего дня контекст в 1M токенов является стандартом для всех официальных сервисов DeepSeek.

Год назад контекст в 1M был козырем исключительно Gemini; все другие закрытые модели предлагали либо 128K, либо 200K; в открытом сегменте почти никто не мог позволить себе работать с таким объемом.

DeepSeek просто переместил миллионный контекст из «премиальной функции» в разряд «коммунальных услуг».

И открыл исходный код. Как они этого добились, в релизе прямо дается ответ —

V4 представила совершенно новый механизм внимания, сжимающий на уровне токенов, используемый вместе с разреженным вниманием DSA. По сравнению с традиционными методами, потребность в вычислениях и видеопамяти значительно снижена.

DSA — не новое слово. Полгода назад, в том обновлении V3.2-Exp, его впервые внедрили, тогда внешнее внимание было невысоким, потому что бенчмарки были почти такие же, как у V3.1-Terminus, выглядело как промежуточная версия без особых новшеств.

Теперь, оглядываясь назад, видно, что это был фундамент V4.

Специальная оптимизация возможностей агента

В части агента V4 была адаптирована и оптимизирована для таких продуктов, как Claude Code, OpenClaw, OpenCode, CodeBuddy, улучшены задачи по коду и генерации документов.

В релизе также приложен пример внутренней страницы PPT, сгенерированной V4-Pro в одном из агентских фреймворков.

Цены на API

На стороне API, V4-Pro и V4-Flash запущены одновременно, поддерживаются два интерфейса: OpenAI ChatCompletions и Anthropic.

base_url не меняется, для вызова достаточно изменить параметр model на deepseek-v4-pro или deepseek-v4-flash.

Максимальный контекст обеих версий — 1M, обе одновременно поддерживают режим без размышлений и режим размышлений. В режиме размышлений можно регулировать интенсивность параметром reasoning_effort, два уровня: high и max. Официально рекомендуется для сложных сценариев с агентом сразу использовать max.

Здесь есть ключевой момент — во втором полугодии будет поддержка вычислений на Huawei.

Кроме того, старые названия моделей будут сняты с публикации.

deepseek-chat и deepseek-reasoner будут отключены через три месяца (24 июля 2026 года), на текущем этапе эти имена соответствуют режиму без размышлений и режиму размышлений V4-Flash соответственно.

Для индивидуальных разработчиков impact невелик, нужно изменить один параметр model. Компаниям, подключившим production-среды, в эти три месяца нужно заняться миграцией.

И еще кое-что

В конце релиза DeepSeek процитировали одну фразу.

«Не соблазняться славой, не бояться клеветы, идти своим путем, быть upright и correct себя.»

Это из «О двенадцати философах» Сюнь-цзы. Буквально означает: не соблазняться похвалой, не пугаться клеветы, идти вперед по своему пути, исправлять себя.

В сегодняшнем контексте это довольно интересно.

За последние полгода слухи о том, когда выйдет V4, не запаздывает ли он, не обогнали ли его уже другие, не справились ли с ним дистилляцией данных Claude, несколько раз ходили по китайскому и англоязычному AI-сообществу. В начале года даже кто-то уверенно заявлял, что V4 выйдет до Нового года по лунному календарю, но в итоге дождались только конца апреля.

Они ни разу не ответили.

А потом в одну из пятниц во второй половине дня выпустили V4, одновременно открыли исходный код, запустили на официальном сайте и в приложении, обновили API, попутно написав в релизе факт, что внутренние сотрудники уже перестали использовать Claude.

Никакой roadmap, никаких трансляций, никаких интервью.

Фраза «идти своим путем» звучит как лозунг. Но если посмотреть на путь за последние полгода: тот «малопримечательный» Exp-релиз V3.2, тот механизм разреженного внимания DSA, который полгода готовил почву для V4, путь превращения контекста в 1M из козыря в стандарт.

DeepSeek уже это сделал.

Ссылки на открытые модели DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Технический отчет DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Эта статья из WeChat Official Account «量子位» (QbitAI), автор: 量子位

Связанные с этим вопросы

QКакие две версии DeepSeek-V4 были представлены и каковы их ключевые характеристики?

AБыли представлены две версии: DeepSeek-V4-Pro и DeepSeek-V4-Flash. Pro-версия имеет 1,6T параметров, 49B активаций и длину контекста 1M, она ориентирована на высочайшую производительность. Flash-версия более компактна и быстра, с 284B параметрами, 13B активаций и той же длиной контекста 1M, предлагая экономически эффективное решение.

QКакие ключевые улучшения в производительности заявляет DeepSeek для модели V4-Pro?

ADeepSeek заявляет о трех ключевых улучшениях для V4-Pro: значительно улучшенные агентские способности (особенно в кодировании), превосходные мировые знания (немного уступая только Gemini-Pro-3.1) и высочайшая производительность в рассуждениях (математика, STEM, соревновательное программирование), что ставит модель на один уровень с ведущими закрытыми моделями.

QКакое важное технологическое достижение позволяет DeepSeek-V4 иметь стандартную длину контекста в 1 миллион токенов?

AДлина контекста в 1M токенов стала стандартом благодаря новой механизм внимания, который сжимает информацию на уровне токенов в сочетании с разреженным вниманием DSA (Dilated Sliding Attention). Этот подход значительно снижает вычислительные потребности и требования к памяти по сравнению с традиционными методами.

QКаковы планы DeepSeek относительно поддержки аппаратного обеспечения и что specifically упоминается в статье?

AВ статье specifically упоминается, что во второй половине года DeepSeek планирует добавить поддержку вычислений на чипах Huawei. Это подчеркивает ориентацию на развитие отечественных (китайских) вычислительных мощностей.

QКак изменится API сервис DeepSeek и что произойдет со старыми названиями моделей?

AAPI сервис обновлен для поддержки новых моделей V4-Pro и V4-Flash через те же конечные точки, используя параметры модели `deepseek-v4-pro` или `deepseek-v4-flash`. Старые имена моделей `deepseek-chat` и `deepseek-reasoner` будут отключены через три месяца (24 июля 2026 года), и в течение этого периода они будут перенаправлены на соответствующие режимы V4-Flash.

Похожее

Почти половина россиян готова пользоваться цифровыми рублями — ТАСС

Почти половина граждан России (45%) выразила готовность использовать цифровой рубль, согласно исследованию, опубликованному ТАСС. 36% респондентов готовы начать пользоваться им позднее, когда эта форма расчетов станет более распространенной, а 18% не рассматривают такой возможности. Наибольший интерес проявляет молодежь: среди опрошенных в возрасте 18–24 лет пользоваться цифровой валютой центробанка (CBDC) готовы 62%. В группе 25–44 года таких 45%, а среди лиц старше 45 лет — 31%. 70% участников опроса заявили, что имеют представление о цифровом рубле: 32% хорошо понимают его принцип работы и назначение, а 38% знакомы лишь в общих чертах. 30% практически ничего о нем не знают. Основным источником информации о новых финансовых инструментах для аудитории стали СМИ (32%). 28% узнают о них через банки и финансовые сервисы, 18% — от родственников и знакомых, по 11% — из соцсетей и других источников. Опрос провели «Выберу.ру» и «Еврокредит.ру» среди 2976 человек. Ранее Банк России анонсировал стимулы для увеличения числа операций с цифровыми рублями, включая вознаграждение банкам за выплаты зарплат в цифровой валюте с 2027 года. Крупные банки обязаны обеспечить такую возможность всем клиентам уже с 1 сентября этого года.

cryptonews.ru2 мин. назад

Почти половина россиян готова пользоваться цифровыми рублями — ТАСС

cryptonews.ru2 мин. назад

CryptoQuant: «Данные блокчейна предупреждают: еще слишком рано говорить о настоящем дне биткоина! Вот почему…»

Несмотря на недавнюю волатильность цен на биткоин, данные блокчейна от CryptoQuant указывают, что рынок ещё не достиг фазы полномасштабной капитуляции. Глава исследований Хулио Морено отмечает отсутствие чётких сигналов к массовой продаже и подчёркивает, что текущие реализованные убытки держателей (около 136 000 BTC) значительно ниже уровней, наблюдавшихся на дне прошлых циклов (1,3–3,7 млн BTC). Это оставляет открытыми два сценария. Первый: текущий цикл может войти в историю как самый мягкий по масштабам принудительных продаж. Второй: рынок, не достигнув истинного дна, может столкнуться с дальнейшим давлением со стороны продавцов и более глубоким падением. Аналитик делает вывод, что волн распродаж, характерных для капитуляции, пока не было, и считать текущие ценовые уровни окончательным дном цикла ещё преждевременно.

cryptonews.ru2 мин. назад

CryptoQuant: «Данные блокчейна предупреждают: еще слишком рано говорить о настоящем дне биткоина! Вот почему…»

cryptonews.ru2 мин. назад

Прогноз цены Solana на август 2026 года: смогут ли $19 млн от Morgan Stanley и 330 000 корейских торговцев преодолеть треугольник SOL?

Солана (SOL) торгуется около $73,6, находясь на вершине симметричного треугольника на графике, сформированного между максимумом мая и минимумом июня. Ключевые уровни сопротивления расположены у $74,79 (уровень Фибоначчи 0.382) и кластера $75–$76 (скользящие средние), а поддержка — у $69,25 и июньского минимума $60,29. В августе возможен пробой треугольника в любом направлении. На цену в августе повлияют два новых фактора: спотовый ETF от Morgan Stanley (MSOL), который привлёк $19 млн за второй день торгов, и меморандум с южнокорейской платёжной сетью KSNET о потенциальной интеграции Solana Pay для 330 000 торговцев. Оптимистичный сценарий предполагает пробой вверх к уровню $79,27, подкреплённый устойчивым притоком в ETF и прогрессом в регуляторных вопросах. Пессимистичный сценарий видит пробой вниз к $69,25, если институциональный ажиотаж спадет, а макроэкономические риски усилятся. Исторически август показывал как значительный рост, так и стагнацию для SOL.

cryptonews.ru11 мин. назад

Прогноз цены Solana на август 2026 года: смогут ли $19 млн от Morgan Stanley и 330 000 корейских торговцев преодолеть треугольник SOL?

cryptonews.ru11 мин. назад

NEAR внедрила оплату ИИ через стейкинг

Платформа NEAR AI представила инновационный способ оплаты вычислительных ресурсов для искусственного интеллекта через стейкинг токенов NEAR. Вместо традиционной ежемесячной подписки пользователи могут заблокировать определенное количество токенов, получая ежемесячные вычислительные кредиты, объем которых зависит от суммы стейкинга. При этом сами токены не расходуются, остаются в собственности пользователя и могут быть возвращены на кошелек после выхода из стейкинга. Количество застейканных токенов можно гибко регулировать в зависимости от потребностей в использовании ИИ-сервисов. Механизм поддерживает 43 модели, включая решения от Anthropic, OpenAI и Google, и предназначен для конфиденциальной обработки запросов и работы автономных ИИ-агентов. Данное решение стало первым практическим применением концепции «AI money», которая предполагает прямую связь между использованием ИИ-сервисов и базовым криптоактивом сети.

cryptonews.ru12 мин. назад

NEAR внедрила оплату ИИ через стейкинг

cryptonews.ru12 мин. назад

Фонд Ашенбреннера лишился большей части портфеля акций

30 июля хедж-фонд Situational Awareness бывшего исследователя OpenAI Леопольда Ашенбреннера экстренно продал большую часть портфеля публичных акций на сумму более $10 млрд покупателю Citadel Кена Гриффина. Сделка была подготовлена менее чем за сутки. Фонд столкнулся с маржин-коллами от прайм-брокеров после одновременного падения ключевых позиций, особенно в секторе ИИ-инфраструктуры, и неудачных ставок на понижение. После рекордной доходности в 439% за первое полугодие убытки к концу июля достигли примерно 67%. В пакет, проданный Citadel, вошли преимущественно позиции, купленные с использованием заемных средств. Основные непубличные активы, включая долю в Anthropic, остались у фонда, хотя ее продажа также рассматривалась. После новости о распродаже акции биткоин-майнеров из портфеля фонда, такие как IREN, Bitdeer и Riot Platforms, в день сделки выросли на 18-30%. Окончательный объем сделки и точный состав проданных активов не раскрываются.

cryptonews.ru19 мин. назад

Фонд Ашенбреннера лишился большей части портфеля акций

cryptonews.ru19 мин. назад

Торговля

Спот
活动图片