Автор | Сян Сяньчжи
Лю Цысинь в «Задаче трёх тел» создал образ, который впоследствии бесчисленное количество раз цитировали — Тёмный лес. Каждая цивилизация — это охотник с ружьём; кто первым себя обнаружит, тот первым и погибнет. В лесу не безлюдно — просто все знают, что зажжённый свет привлечёт пули, поэтому все сидят без света.
Весной 2026 года ведущие лаборатории ИИ вошли в такой тёмный лес.
16 апреля Anthropic первой выпустила Claude Opus 4.7. В тот же день они совершили необычный шаг — публично признали, что производительность Opus 4.7 уступает ещё не выпущенной модели Mythos, сославшись на соображения безопасности (safety concerns).
23 апреля OpenAI разместила на своём официальном сайте GPT-5.5. В тот же день Anthropic в своём официальном блоге опубликовала отчёт о расследовании инцидента под названием «An update on recent Claude Code quality reports», признав, что на протяжении последнего месяца Claude Code действительно стал «тупее» — одни выпускают новую карту, другие признают ошибку. Но этот «новый король» словно хвастается: мы признаём, что Claude временно глупее — но не забывайте, у нас на руках ещё есть неразыгранный Mythos.
24 апреля «загадочная восточная сила» DeepSeek V4 Preview вышла в свет; команда Лян Вэньфэна впервые официально объявила о глубокой привязке модели к Huawei Ascend 950PR; но все поняли — по-настоящему «полнокровный» V4 Pro Max выйдет только после начала массового производства сверхузлов на Ascend 950 во второй половине года.
Три компании, три действия. На поверхности — это их собственные ритмы выпуска продуктов, но если сложить всё вместе, проступает одна вещь:
У каждой в руках есть как минимум одно «ружьё» — модель мощнее публичной версии,下一代 архитектура, ещё не дошедшая до публики, сверхузел на новых чипах, ещё не развёрнутый массово. Но никто не решается первым поднять это ружьё.
Потому что в этой отрасли «цена первого хода» никогда не ограничивается лишь утечкой секретов. Первый ход означает — своими руками отдать противнику эталон своих максимальных способностей;意味着первым принять на себя весь огонь проверок безопасности, ужесточения регулирования и давления общественного мнения;意味着превратить себя в движущуюся мишень, по которой будут целиться все конкуренты в следующем раунде. В лесу нет места героизму — каждый, кто стреляет первым, становится следующим, в кого будут целиться.
Поэтому самое рациональное решение для охотников — выключить свет, затаить дыхание и спрятать оружие за спину.
Это и есть оптимальное решение в этой игре.
Уверенность Anthropic
Со стороны Claude за последний месяц разыгралась, пожалуй, худшая из всех публикаций версий.
Рано обновившись до Opus 4.7, Anthropic по-прежнему лидирует в различных рейтингах, да ещё и придерживает Mythos, доступный только корпоративным клиентам —一副неторопливая и уверенная поза.
Но цикл Opus 4.7 стал, пожалуй, худшим с точки зрения пользовательского опыта Claude, «шквал негативных отзывов».
В начале марта Anthropic изменила глубину рассуждений (reasoning depth) по умолчанию для Claude Code с high на medium. Мотивы этого решения понятны: в режиме high интерфейс часто выглядел зависшим,响应медленной до безумия платящих пользователей. Но проблема в том, что тогда они об этом не объявили.
В конце марта запустили «оптимизацию эффективности» — если сессия Claude Code простаивает более часа, система очищает старые reasoning block. По задумке, это должно было экономить вычислительные ресурсы. На практике это привело к тому, что после каждого раунда диалога Claude словно терял память, полностью забывая контекст. В сообщество разработчиков в те недели хлынул поток жалоб: «Claude начал забывать, что я просил его сделать в предыдущем раунде».
Недавно произошло третье событие — в системное промпт-сообщение добавили инструкцию на сжатие многословия (verbosity). По собственному позднему признанию Anthropic, эта инструкция напрямую снизила качество кода от Claude Code на 3%.
Сложившись вместе, эти три события привели к тому, что senior director из AMD написал на GitHub ту самую фразу: «Claude has regressed to the point it cannot be trusted to perform complex engineering» (Claude деградировал до такой степени, что ему больше нельзя доверять выполнение сложных инженерных задач). Статья Axios от 16 апреля «Anthropic's AI downgrade stings power users» вывела это в mainstream.
И только тогда Anthropic признала, что действительно есть некоторые проблемы.

7 апреля они тихо откатили调整настройки reasoning effort; 10 апреля исправили баг с кешем; 20 апреля убрали системный промпт на сжатие verbosity. Но настоящий отчёт о расследовании инцидента был опубликован только 23 апреля — и это как раз день публичного релиза GPT-5.5.
Эта доля пренебрежения, словно «ой, у меня баг в инженерной стратегии, починим», и重量级релиз OpenAI случились практически в одно и то же время. Сложно назвать это совпадением.
Ещё более показательно то, что при релизе Opus 4.7 Anthropic сделала反常ный шаг: публично признала, что производительность Opus 4.7 уступает ещё не выпущенной модели — Mythos. Это отчётливо видится как «стратегическое отступление» — Anthropic оставляет самые сильные возможности для корпоративного сегмента, не спеша выводить их в массы, потому что команда ещё не готова выпустить Mythos.
Этому можно верить. Но с точки зрения бизнес-нарратива,同样реальна и другая половина: Anthropic ждала шесть недель, чтобы公开признать деградацию Claude Code, и вынесла проблему на свет именно в день, когда OpenAI собиралась выложить новую карту. Если бы не достаточное давление со стороны конкурентов, если бы не Opus 4.7, доказавший, что «у нас ещё есть козыри в рукаве», это заявление, возможно, никогда бы не появилось.
Со стороны Claude, «выдавливание зубной пасты» (挤牙膏) означает не намеренное урезание возможностей, а то, что:节奏выпуска возможностей и节奏раскрытия проблем синхронизированы с ритмом конкурентов.
Демонстрация своих самых передовых способностей неминуемо превратит тебя в мишень. Или, иначе говоря, по мнению Anthropic, давления от версии 4.6 на конкурентов ещё не рассеялось —既然如此,更сильную карту не обязательно разыгрывать прямо сейчас.
Старый трюк OpenAI
Если Anthropic «прячет Mythos и не выпускает», то со стороны OpenAI «выдавливание пасты» ещё более скрытно — она оставляет право на释放возможностей за кривой нагрузки своих серверов и механизмом分级под названием auto-router.
В тот же день, 23 апреля, когда был выпущен GPT-5.5, Саймон Уиллison (сооснователь фреймворка Django, известный независимый обозреватель в мире ИИ) написал в своём блоге осторожную фразу: «It's not a dramatic departure from what we've had before.» (Это не dramatic отход от того, что у нас было раньше).

Он попутно добавил ключевую информацию: GPT-5.5 — это первая с GPT-4.5 полностью переобученная базовая модель OpenAI;也就是说,за полгода выпущенные 5.1, 5.2, 5.3, 5.4 были всего лишь инкрементальными обновлениями. Иными словами, прошлые четыре минорных обновления OpenAI выпускала, сдерживая силы — потому что они не знали, что выпустят конкуренты.
«Выпускать обновления, сдерживая силы» имеет более понятное название: выдавливать зубную пасту (挤牙膏).
Но更запоминающаяся сцена разыгралась через несколько часов после запуска GPT-5.5. Пользователи Codex создали на GitHub Issue #19241, жалуясь, что Fast mode сначала был очень быстрым, но когда пустили больше пользователей, он заметно замедлился, при этом计费шёл по тарифу Fast. Формулировки знакомы: «Просим OpenAI проверить, не понижается ли уровень GPT-5.5 Fast mode при высокой нагрузке».
Это почти точное повторение сцены с дня релиза GPT-5 7 августа 2025 года — тогда на Reddit r/ChatGPT набрало 4600+ апвотов «GPT-5 is horrible», и Сэм Олтман на следующий день в AMA лично признал «the autoswitcher broke... GPT-5 seemed way dumber» — признал, что router за кулисами понижал уровень для пользователей.
Тот же сценарий повторился восемь месяцев спустя.
Ещё более иронично, что за день до официального релиза GPT-5.5, Codex от OpenAI по ошибке выкатил внутреннюю staging-среду в production, что было замечено и заскриншошено несколькими Pro-пользователями, через несколько минут ошибку исправили, но утёкший контент уже разошёлся. Тогда в селекторе, помимо самого GPT-5.5, появились серия под названием Glacier (tooltip с надписью «Intelligence that moves continents»), модель для наук о жизни Heisenberg, модель неизвестного назначения Arcanine, а также несколько версий с кодовыми именами oai-2.1 и другие.
То есть, в то самое время, когда OpenAI выпускала GPT-5.5 как «следующее поколение», внутри работало как минимум 5-6 параллельных продуктовых линий, ни одна из которых ещё не дошла до публики.
OpenAI сама это признала. В официальной дорожной карте на 2026 год они использовали термин, давно обсуждаемый в академических кругах — capability overhang (отставание возможностей) — признав, что между реальными способностями современных больших моделей и эффектом, который фактически могут получить пользователи, существует огромный разрыв.
Знакомо? Это практически те же слова, что и у Anthropic про Mythos. Даже если утечка в Codex 22 апреля действительно была ошибкой, то, что OpenAI сама внесла термин capability overhang в дорожную карту, ясно передаёт сигнал — у нас на руках ещё очень много всего, решайте сами.
Только имея на руках гораздо больше, чем продаётся пользователям, можно выдавливать пасту. 24 часа жизни GPT-5.5 снова превратили эту предпосылку в прямую трансляцию.
Терпеливое ожидание Deepseek
Со стороны DeepSeek, способ «выдавливания» полностью изменился — она не прячет возможности, а ждёт более подходящего момента для их поставки.
1.6T MoE, контекст 1M, двойная спецификация Pro/Flash, цена 3.48 за 1M tokens — это в несколько десятков раз дешевле GPT-5.5, на порядок дешевле Opus 4.7. Независимые зарубежные обозреватели дают два вывода: производительность близка, но немного ниже GPT-5.4 / Gemini 3.1-Pro, цена «пробивает экономику передовых лабораторий».
Но в собственной системе координат DeepSeek, V4 Preview уже значительно дороже, чем та «жутко дешёвая» цена V3. Все понимают — это не полнокровная версия.
Полная история DeepSeek V4 не заканчивается релизом и даже не начинается с него.
Надо начать с несостоявшегося релиза R2 в 2025 году. R2 изначально планировался к выпуску в мае 2025 года, но в итоге был перенесён на осень-зиму. Вся инфраструктура китайского Deepseek мигрировала в экосистему CANN от Huawei. Для любой лаборатории это не может быть工程, выполненным за квартал — компилятор, операторы, библиотеки связи,框架вывода, маршрутизация MoE — всё нужно переписывать.
А в этот раз с V4, DeepSeek впервые официально внесла Ascend в список тренировочного железа. V4 — это первая версия, обученная на混合системе — Ascend впервые вступил в игру.
Но следующее поколение чипов Ascend 950DT, оптимизированных для крупномасштабного обучения, согласно дорожной карте Huawei, будет запущено в массовое производство только в Q4 2026 года.也就是说,обучение V4 удалось запустить, собрав его на чипах предыдущего поколения 950PR; чтобы полностью обучить и иметь возможность массово запускать полнокровную версию типа V4 Pro Max с 1.6T MoE, нужно ждать поставок следующего поколения.
Настоящая инженерная сложность заключается не в «можно ли обучить V4» — её уже обучили — а в «как заставить V4 работать на полную, стабильно и дёшево на Ascend».
Ascend 950PR был запущен в массовое производство в Q1 2026 года, с заявленной производительностью FP4 1.56 PFLOPS, внутричиповой памятью 112GB, на бумаге соответствует и превосходит NVIDIA H20. Но от того, что один чип может работать, до стабильного обслуживания запросов на вывод в миллионы токенов в секунду целым сверхузлом — две большие разницы. Полнокровная версия V4 Pro Max ждёт именно этот «сверхузел» — крупномасштабную кластерную версию серии Ascend 950, которая поступит во второй половине 2026 года.
Это формирует стратегию,完全отличную от первых двух. Логика выдавливания пасты у Anthropic и OpenAI заключается в том, что у меня есть кое-что посильнее, но я пока тебе не дам; логика выдавливания пасты у DeepSeek заключается в том, что я жду момента, чтобы цена моей полнокровной версии упала ещё на одну ступень.
Эта разница важна.
Настоящий козырь DeepSeek никогда не был в «самых передовых возможностях», а в «снижении цены за токен до уровня, на который другие не решаются, при достаточной производительности». V4 Preview адаптирована для работы на картах NVIDIA и Ascend 950PR, но для полнокровного вывода в量产масштабах необходимо ждать поставок сверхузлов. Как только этот момент настанет, произойдут две вещи одновременно: во-первых, возможности V4 Pro Max можно будет释放на полную; во-вторых, стоимость вывода и цены API упадут ещё на ступень — для компании, пробивающей рынок ценой,后者смертельнее前者.
Того момента «DeepSeek», который произошёл в начале 2025 года и которого все ждали, в этом релизе снова не случилось. А релиз V4 Preview на самом деле является трейлером, главное событие — это момент «DeepSeek + Huawei Ascend» во второй половине года.
С этой точки зрения, команда Лян Вэньфэна сейчас делает не вынужденное «сокрытие», а коммерчески сдержанный «выбор» — выбор отдать首映самой сильной версии в сцену, где у неё больше всего话语权: в первый день после大规模развёртывания отечественных сверхузлов. А до этого — закрепить叙事о性价比 ещё одним раундом с V4 Preview.

DeepSeek несёт на себе从来не «нарратив длинной доски» о том, чтобы вывести отечественную большую модель на первое место в каком-либо рейтинге, а «нарратив системности» о одновременной успешной работе четырёх линий: чипов, обучения, вывода и ценообразования —后者гораздо важнее前者.
Несколько дней назад Жэньсюй Хуан (Дженсен Хуанг) в подкасте Дваркеша Пателя сказал, что если DeepSeek выпустит首映на чипах Huawei, «то для нашей нации это ужасный результат» («a horrible outcome for our nation»).
Сейчас NVIDIA ещё контролирует передовые вычислительные мощности. Но согласно тому же «пятислойному пирогу ИИ», который抛出сам Хуан — энергетика, чипы, инфраструктура, модели, приложения — в отечественной индустрии больших моделей на каждом уровне уже есть работоспособные отечественные решения, и разрыв сокращается с видимой скоростью. Заполнив последний пазл — чипы, история opensource больших моделей от DeepSeek станет историей больше, чем американские большие модели: это важный шаг к тому, чтобы весь мир мог, не消耗излишних затрат,实现равноправие в доступе к интеллекту.
Чтобы весь мир мог обойти некоторые передовые вычислительные мощности, контролируемые гегемонами, и войти в эффективное智能общество.
Заключение
«Сокрытие» Anthropic — активное. У них есть Mythos, не выпустили,理由— безопасность.
«Сокрытие» OpenAI — структурное. У них есть Pro-уровень, не всегда дают,理由— инфраструктура и ценовое分层.
«Сокрытие» DeepSeek — необходимое. Оно касается целого叙事образца скачка общественного интеллекта.
Но с другой стороны, это極похоже на Тёмный лес, описанный Лю Цысинем: в этом тёмном智能лесу ни один顶尖охотник не выстрелит первым.
Обнаружить себя означает быть беззащитным,意味着не иметь козырей,意味着стать живой мишенью для другого охотника.
Никто не знает, кто сделает первый самый смертоносный выстрел. Но можно быть уверенным: та модель, которую вы используете сегодня, — не её истинное лицо.





