DeepSeek V4 выходит в релизной версии, проявляются новые возможности, начинается битва за звание короля стоимости

marsbitОпубликовано 2026-07-31Обновлено 2026-07-31

Введение

31 июля DeepSeek официально выпустила публичную бета-версию API DeepSeek-V4-Flash. Несмотря на то, что V4-Flash (284 млрд параметров, 13 млрд активных) значительно меньше по размеру, чем V4-Pro (1,6 трлн параметров, 49 млрд активных), его производительность в тестах Agent, таких как Terminal Bench 2.1 (82,7 балла), приблизилась или даже превзошла уровень предварительной версии V4-Pro трехмесячной давности. Компания подчеркивает, что это улучшение достигнуто исключительно за счет дополнительного посттренинга модели без изменения ее архитектуры, что демонстрирует важность методов обучения и качества данных по сравнению с простым увеличением масштаба модели. Это обновление четко ориентировано на растущий рынок AI-агентов, где ключевыми являются скорость, стоимость и эффективность. DeepSeek позиционирует V4-Flash как высокопроизводительную и экономичную базовую модель для разработчиков. Стратегически, поддержка формата Responses API (аналогичного OpenAI) и оптимизация для задач в духе Codex облегчают миграцию разработчиков и бросают вызов существующим экосистемам. Выпуск следует за рекордным раундом финансирования DeepSeek в размере свыше 50 млрд юаней и повышением оценки. Этот шаг демонстрирует стремление компании конкурировать в эпоху Agent, делая ставку на эффективность и оптимальное соотношение цены и качества, что может изменить правила конкуренции в индустрии больших языковых моделей.

31 июля, после полудня, Phoenix Net Technology обнаружила на официальном сайте DeepSeek, что API релизной версии DeepSeek-V4-Flash запущена в открытое бета-тестирование. В отличие от прежней логики разделения на "Pro — мощный, Flash — слабый", это обновление сигнализирует о важном моменте: результаты релизной версии Flash в нескольких бенчмарках Agent уже приближаются к уровню, а в некоторых случаях даже превосходят уровень превью-версии V4-Pro трехмесячной давности.

Согласно официальному логу обновлений, релизная версия V4-Flash набрала 82,7 балла на Terminal Bench 2.1, 54,2 балла на NL2Repo, 76,7 баллов на Cybergym и 70,3 балла на Toolathlon verified. В то время как превью-версия V4-Pro набрала 67,9 балла на Terminal Bench 2.0.

Следует пояснить, что Terminal Bench 2.0 и 2.1 — это не один и тот же набор тестов, поэтому прямое сравнение не совсем корректно. Однако тот факт, что облегченная версия с всего 13 миллиардами активных параметров показывает такие результаты в тестах на способности Agent, уже говорит о том, что потенциал оптимизации на этапе дообучения может давать больший эффект, чем простое увеличение количества параметров.

Кроме того, DeepSeek также особо отметила, что в настоящее время открытое бета-тестирование доступно только через API, а в приложении и веб-версии испытать последние возможности пока нельзя. Релизная версия DeepSeek-V4-Pro выйдет как можно скорее.

"Было проведено лишь дообучение"

Официальные представители DeepSeek в логе обновлений заявили: "Архитектура модели, размеры и количество параметров DeepSeek-V4-Flash-0731 остались такими же, как у DeepSeek-V4-Flash-preview, было проведено лишь дообучение".

Согласно официальному техническому отчету DeepSeek, V4-Flash имеет в общей сложности 284 миллиарда параметров, из них активных — 13 миллиардов; V4-Pro — 1,6 триллиона общих параметров, из них активных — 49 миллиардов. Они отличаются на порядок по масштабу модели. Если Flash с помощью дообучения может поднять способности Agent до уровня, близкого к Pro, это означает, что для определенных задач размер модели не является решающим фактором — значимость методов обучения и качества данных растет.

Официальные источники также особо отметили, что для задач Code Agent в открытых бенчмарках тестирование проводилось с использованием фреймворка DeepSeek Harness в минималистичном режиме, максимальный уровень (max), topp=0.95, temperature=1.0. Эта деталь намекает на то, что DeepSeek, возможно, провела целевую оптимизацию и на уровне фреймворка Agent, а не только в самой модели.

Это также первый случай, когда собственный Harness от DeepSeek появляется под официальным названием. Ранее Лян Вэньфэн сравнивал путь к AGI с подъемом по лестнице: языковая модель — это первая ступень, в прошлом году решалась проблема CoT (цепочки мыслей), нынешняя ступень — это Agent, а следующая задача, которую необходимо решить после Agent, — это непрерывное обучение, позволяющее модели накапливать опыт, как человек, а не работать только при полной подаче контекста каждый раз. Дальше — уже "сингулярность" самоитерации и воплощенный интеллект. "Сейчас у ИИ не хватает не вкуса и интуиции, а способности к непрерывному обучению", — сказал он. "Инвесторы смотрят на Agent, а мы думаем о том, как решить проблему обучения".

Непрерывное обучение звучит как задача на уровне модели, но его инженерная реализация лежит именно в Harness. Команда DeepSeek по разработке Agent Harness была сформирована в марте этого года. Во главе ее стоит Цуй Тяньи, родившийся в 90-х, выпускник факультета компьютерных наук Чжэцзянского университета, обладатель шести золотых медалей ACM Asian Regional Contest. Ранее девять лет он работал в ведущей количественной компании Jane Street, в марте этого года присоединился к DeepSeek, после чего в мае активно начал набирать команду.

По имеющейся информации, планируется, что Harness от DeepSeek будет представлен одновременно с выходом релизной версии V4. Кроме того, в конце лога DeepSeek сообщает: "Релизная версия DeepSeek-V4-Pro выйдет в ближайшее время".

Прямое столкновение на уровне экосистемы

Если конкуренция больших моделей в 2023 году была "борьбой за универсальные возможности", в 2024 году — "борьбой за длинный контекст", то ключевым словом 2026 года, без сомнения, является Agent.

Способности Agent — то есть способность модели самостоятельно планировать, использовать инструменты и выполнять сложные задачи — становятся новой мерой оценки силы больших моделей. От Terminal Bench (терминальные операции), NL2Repo (генерация репозиториев кода) до Cybergym (задачи кибербезопасности), SWE-bench (инженерия программного обеспечения) — серия тестов Agent переопределяет, что такое хорошая модель.

В глобальном масштабе первый эшелон по способностям Agent по-прежнему удерживают закрытые гиганты. Согласно данным сторонних платформ оценки, таких как benchlm.ai, GPT-5.6 Sol и серия Claude Opus лидируют в большинстве тестов Agent. Среди китайских производителей GLM, Qwen и другие также быстро нагоняют.

Существенное повышение DeepSeek способностей Agent у Flash имеет четкую стратегическую цель: войти на огромный рынок приложений Agent с помощью экономичной облегченной модели.

В конце концов, сценарии Agent гораздо более чувствительны к скорости вывода и стоимости, чем чистые диалоговые сценарии. Задача Agent, требующая многократного использования инструментов и многошаговых рассуждений, при выполнении на флагманской модели может стоить в несколько раз или даже в десятки раз дороже, чем на Flash. Если Flash сможет достичь уровня способностей Agent, который "достаточен и даже удобен", ее преимущество в стоимости станет чрезвычайно мощным.

Два внутренних набора тестов, опубликованных официально, также имеют четкую цель. DSBench-FullStack (внутренний набор тестов для full-stack разработки) набрал 68,7 балла, DSBench-Hard (внутренний набор сложных тестов для Coding Agent) — 59,6 балла. Это косвенно подтверждает позиционирование DeepSeek — превратить Flash в предпочтительную основу для разработчиков и приложений Agent.

Тихая война экосистем также разгорается: релизная версия V4-Flash изначально поддерживает формат Responses API и специально адаптирована для Codex.

Responses API — это новый формат API, активно продвигаемый OpenAI. По сравнению с традиционными Chat Completions, он больше подходит для сценариев Agent — поддерживает более гибкое использование инструментов, более сложное многошаговое взаимодействие и более точный контроль вывода.

Нативная поддержка этого формата DeepSeek означает, что разработчики смогут с меньшими затратами переносить приложения Agent, разработанные на основе экосистемы OpenAI, на DeepSeek. Это будет прямое столкновение двух компаний на уровне экосистемы.

Адаптация под Codex нацелена на вертикальную сцену генерации кода и разработки программного обеспечения. Codex — это модель OpenAI, ориентированная на код. Целевая адаптация DeepSeek означает прямой вызов OpenAI на ее традиционной сильной территории.

Рассматривая эти действия вместе, становится ясно, что амбиции DeepSeek не ограничиваются созданием "дешевой альтернативы", а заключаются в создании собственной ниши в эпоху Agent.

После финансирования в 50 миллиардов: временное окно в условиях высокой оценки

Это обновление вышло менее чем через два месяца после завершения DeepSeek первого раунда внешнего финансирования.

Около месяца назад DeepSeek завершила первый внешний раунд финансирования за почти три года своего существования на общую сумму более 50 миллиардов юаней, установив рекорд в китайской индустрии ИИ по объему финансирования в одном раунде. Оценка после инвестиций составила около 52 миллиардов долларов США (примерно 350 миллиардов юаней). В число инвесторов вошли такие промышленные гиганты, как Tencent, CATL, JD.com, а также несколько государственных промышленных фондов.

В середине июля DeepSeek намерена продвигать новый раунд частного финансирования с оценкой перед инвестициями около 71 миллиарда долларов США (примерно 480 миллиардов юаней), что примерно на 37% выше оценки в 52 миллиарда долларов после первого раунда финансирования. От 52 до 71 миллиарда прошло менее шести недель.

За высокой оценкой стоит признание рынком технических возможностей DeepSeek, а также ставка на ее коммерческие перспективы. Однако высокая оценка также означает высокие ожидания и высокое давление.

Согласно сообщениям нескольких СМИ, основатель DeepSeek Лян Вэньфэн лично внес около 20 миллиардов юаней в первом раунде финансирования, сохранив твердый контроль над компанией через специальную структуру. Этот основатель, вышедший из Quantitative фонда幻方, ранее почти три года настаивал на финансировании из собственных средств. Теперь переход от "без финансирования, без IPO" к активному привлечению капитала сам по себе является сильным сигналом — DeepSeek ускоряет движение к коммерциализации и IPO.

Выход релизной версии Flash, возможно, можно рассматривать как демонстрацию технологий DeepSeek при поддержке капитала. Но настоящее испытание еще впереди: выйдет ли релизная версия Pro в срок? Приведет ли повышение способностей Agent к реальному росту доходов? Как DeepSeek сможет использовать свой подход с высокой стоимостью в условиях давления таких гигантов, как OpenAI и Anthropic?

Занавес войны Agent только начал подниматься. Своим значительным прогрессом в облегченной модели DeepSeek задает отрасли новый вопрос — когда преимущества дообучения будут полностью раскрыты, когда рост эффективности начнет компенсировать разницу в параметрах, логика конкуренции больших моделей, возможно, должна быть переписана заново.

Эта статья из официального аккаунта WeChat "凤凰网科技", автор: Phoenix Net Technology

Трендовые криптовалюты

Связанные с этим вопросы

QЧто представляет собой DeepSeek V4-Flash-0731 и чем он отличается от предпросмотра?

ADeepSeek V4-Flash-0731 — это официальная версия легкой модели, выпущенная 31 июля. Её архитектура и размер (284 млрд общих параметров, 13 млрд активных) идентичны предварительной версии (V4-Flash-preview). Единственное изменение — повторное посттренировочное обучение, которое значительно улучшило её способности в агентских задачах, приблизив их к уровню более мощной модели V4-Pro (предпросмотр).

QКакие результаты показал V4-Flash в тестах на агентские способности?

AСогласно официальному журналу обновлений, V4-Flash набрал 82.7 балла в Terminal Bench 2.1, 54.2 балла в NL2Repo, 76.7 баллов в Cybergym и 70.3 балла в Toolathlon verified. Хотя прямое сравнение с результатом V4-Pro (67.9 балла в Terminal Bench 2.0) не совсем корректно из-за разных версий тестов, эти показатели демонстрируют, что легкая модель с 13 млрд активных параметров достигла уровня, близкого к более крупной Pro-версии в агентских задачах.

QКакую стратегическую цель преследует DeepSeek, улучшая агентские способности легкой модели V4-Flash?

AСтратегическая цель DeepSeek — занять позицию в быстрорастущем рынке агентских приложений, предложив модель с высокой производительностью и оптимальным соотношением цены и качества (cost-performance). Поскольку агентские задачи требуют многократного вызова инструментов и многоэтапных рассуждений, стоимость использования мощных моделей может быть непомерно высокой. V4-Flash, обладая достаточными агентскими способностями, становится привлекательным и экономичным фундаментом для разработчиков, бросая вызов закрытым гигантам, таким как OpenAI.

QКакие ключевые технологические моменты упомянуты для объяснения прогресса V4-Flash?

AВ статье выделены два ключевых момента. Во-первых, прогресс достигнут за счет посттренировочного обучения (post-training), что подчеркивает важность методов обучения и качества данных, а не только масштабирования параметров. Во-вторых, тестирование проводилось с использованием собственного фреймворка DeepSeek Harness в минималистичном режиме (Harness 极简模式), что указывает на возможные оптимизации на уровне фреймворка, а не только самой модели.

QКак новое финансирование и высокая оценка компании связаны с этим релизом?

AРелиз V4-Flash происходит менее чем через два месяца после первого внешнего финансирования DeepSeek в размере 50 млрд юаней (оценка ~350 млрд юаней). Высокая оценка отражает признание рынком технологического потенциала и ожидания коммерческого успеха. Этот релиз можно рассматривать как демонстрацию технического прогресса в условиях повышенного давления для быстрой коммерциализации и подготовки к IPO. Успех V4-Flash как доступной и мощной модели имеет решающее значение для подтверждения бизнес-модели компании в условиях конкуренции с такими гигантами, как OpenAI и Anthropic.

Похожее

Внимание, пользователи биткоина! Сегодняшний взлом может быть масштабнее, чем вы думали. Вот что нужно делать

Компания Coinkite, производитель аппаратных биткоин-кошельков Coldcard, обнаружила критическую уязвимость в процессе генерации сид-фраз на устройствах Coldcard Mk3 с прошивкой версий 4.0.1–5.0.3. Все биткоин-адреса, созданные из этих сид-фраз, потенциально скомпрометированы. Компания настоятельно рекомендует пользователям немедленно перевести средства на новый, безопасный кошелёк, создав новую сид-фразу. Просто сменить устройство недостаточно — старую сид-фразу использовать нельзя. Это предупреждение следует на фоне масштабной атаки 30 июля, в ходе которой автоматизированный инструмент за 41 минуту опустошил 1196 кошельков, похитив около 1082 BTC (на тот момент ~$70,2 млн). Исследователи связывают эту атаку с обнаруженной уязвимостью, так как она произошла за 30 часов до публичного раскрытия проблемы Coinkite. Украденные средства пока остаются на четырёх адресах без движения.

cryptonews.ru1 ч. назад

Внимание, пользователи биткоина! Сегодняшний взлом может быть масштабнее, чем вы думали. Вот что нужно делать

cryptonews.ru1 ч. назад

Биткоин в августе: эксперты ждут проверки диапазона, а не быстрого разворота

Биткоин в августе, по мнению аналитиков, скорее всего, останется в состоянии проверки ключевых ценовых уровней, а не совершит резкий разворот к росту. Несмотря на восстановление в июле, сохраняется риск снижения ниже $60 тыс. Основными факторами давления остаются сложная макроэкономическая обстановка: высокие ставки в США, устойчивая инфляция и сильный доллар, что ограничивает аппетит к рисковым активам, включая криптовалюты. Эксперты отмечают, что август исторически слаб для крипторынка. Институциональный спрос остается вялым, о чем свидетельствуют чистые оттоки из биткоин-ETF. Рынок продолжает торговаться в узком диапазоне, преимущественно между $60 и $65 тыс. Прогнозы на месяц в основном сдержанные. Базовый сценарий (вероятность 50%) предполагает движение в коридоре $58–68 тыс. Негативный (30%) — снижение к $50–55 тыс. Позитивный (20%) — рост к $71–75 тыс. Ключевыми уровнями являются поддержка в районе $60–61 тыс. и сопротивление около $67 тыс., преодоление которого могло бы изменить текущий нисходящий тренд. Эксперты советуют инвесторам рассматривать текущие уровни как возможность для постепенного долгосрочного накопления, но быть готовыми к повышенной волатильности. Более существенные движения рынка ожидаются не раньше четвёртого квартала. Внимание рекомендуется уделять не только цене биткоина, но и динамике ставок, инфляции, потокам в ETF и общему настроению на рынке рисковых активов.

cryptonews.ru2 ч. назад

Биткоин в августе: эксперты ждут проверки диапазона, а не быстрого разворота

cryptonews.ru2 ч. назад

Аппаратный кошелек Coldcard взломан: хакеры вывели 594 биткоина за 25 минут

Аппаратные кошельки Coldcard от компании Coinkite были скомпрометированы из-за критической уязвимости, существовавшей пять лет. Ошибка в коде, допущенная в марте 2021 года, отключила защищенный генератор случайных чисел, что привело к созданию предсказуемых seed-фраз на основе серийного номера и системного времени. Это позволило злоумышленникам 30 июля 2026 года вывести около 594,5 BTC (примерно $40 млн) с 500 адресов всего за 25 минут, просто перебирая возможные варианты в офлайне. Компания Coinkite подтвердила уязвимость всех устройств, работавших на скомпрометированных прошивках (Mk2-Mk5, Q), и исключила финансовые компенсации. Для защиты средств владельцам необходимо: обновить прошивку до безопасных версий, сгенерировать новую seed-фразу на обновленном устройстве и полностью перевести все активы на новые адреса. Использование BIP-39 парольной фразы может снизить риски, но не заменяет необходимость смены ключа. Инцидент подчеркивает, что даже специализированное аппаратное обеспечение требует постоянного независимого аудита, особенно в криптографических функциях. Открытый исходный код не гарантирует быстрого обнаружения подобных ошибок, как показали пять лет невыявленной уязвимости и аналогичные случаи в прошлом.

cryptonews.ru2 ч. назад

Аппаратный кошелек Coldcard взломан: хакеры вывели 594 биткоина за 25 минут

cryptonews.ru2 ч. назад

Tether (USDT) опубликовал ожидаемые финансовые результаты за второй квартал! Вот его текущее состояние и активы

Крупнейший эмитент стейблкоинов Tether опубликовал финансовый отчёт за второй квартал 2026 года, подтверждённый аудитором BDO. Чистая операционная прибыль составила около $1,5 млрд, а превышение активов над обязательствами достигло $4,11 млрд. Объём USDT в обращении на 30 июня составил приблизительно $184,6 млрд, увеличившись за квартал на $446 млн. Доля Tether на мировом рынке стейблкоинов превысила 60%. Основную часть прибыли принесли инвестиции в казначейские облигации США и операции репо. Совокупные активы компании оцениваются в $187,75 млрд, обязательства — в $183,64 млрд, из которых $183,62 млрд связаны с выпущенными токенами. Tether сократил объём обеспеченных кредитов на $2,38 млрд (15%) и увеличил золотой запас на 14 тонн, доведя его до более чем 146 тонн. Компания остаётся одним из крупнейших мировых держателей гособлигаций США, а её пользовательская база выросла более чем на 30 миллионов человек. Генеральный директор Паоло Ардоино подчеркнул, что USDT полностью обеспечен резервами, и сообщил о прохождении всестороннего аудита в одной из "большой четвёрки" аудиторских фирм.

cryptonews.ru2 ч. назад

Tether (USDT) опубликовал ожидаемые финансовые результаты за второй квартал! Вот его текущее состояние и активы

cryptonews.ru2 ч. назад

Circle достигла важной вехи в области регулирования, получив лицензию на ведение трастовой деятельности от Департамента финансовых услуг штата Нью-Йорк (NYDFS)

Компания Circle, предоставляющая финансовые услуги и услуги в сфере стейблкоинов, достигла важного этапа, получив от Департамента финансовых услуг штата Нью-Йорк (NYDFS) устав трастовой компании с ограниченным кругом деятельности. Эта лицензия позволяет Circle расширить свою деятельность в штате Нью-Йорк, предлагая клиентам услуги по хранению активов, выпуск одобренных штатом стейблкоинов и управление резервными фондами для их обеспечения. Соучредитель и генеральный директор Circle Джереми Аллайр отметил, что получение данной лицензии было давней целью компании, подчеркивая ясность регулирования, которую она предоставляет. Он назвал NYDFS международным органом, устанавливающим стандарты в регулировании цифровых активов, а само достижение — результатом более чем десятилетней приверженности соблюдению нормативных требований. Компания рассматривает это как подтверждение своих высочайших стандартов безопасности, прозрачности и соответствия, сравнивая уровень проверки NYDFS с требованиями к полноценным коммерческим банкам. Данное разрешение от NYDFS последовало за недавним одобрением Управления валютного контролера США (OCC) на создание Circle National Trust, что перевело деятельность компании по выпуску стейблкоинов под федеральный надзор. Эти шаги, по словам руководства Circle, направлены на установление нового стандарта прозрачности и управления, укрепляя позиции стейблкоина USDC в глобальной финансовой системе.

cryptonews.ru3 ч. назад

Circle достигла важной вехи в области регулирования, получив лицензию на ведение трастовой деятельности от Департамента финансовых услуг штата Нью-Йорк (NYDFS)

cryptonews.ru3 ч. назад

Торговля

Спот

Популярные статьи

Как купить T

Добро пожаловать на HTX.com! Мы сделали приобретение Threshold Network Token (T) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки Threshold Network Token (T).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение Threshold Network Token (T)После приобретения вами Threshold Network Token (T) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля Threshold Network Token (T)С легкостью торгуйте Threshold Network Token (T) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

983 просмотров всегоОпубликовано 2024.03.29Обновлено 2026.06.02

Как купить T

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на T (T) представлены ниже.

活动图片