В августе ситуация с ИИ окончательно накалилась.
Anthropic, наготове, в любой момент готова выкатить Fable 5.1 (или Fable 6), чтобы в лоб столкнуться с GPT-6 от OpenAI.
Сейчас OpenAI одним махом готовится выпустить совершенно новую модель следующего поколения Astra, цель — на этой неделе. У GPT-6, по слухам, 10 триллионов параметров.
В августе битва за трон ИИ уже началась в медийном поле. Некоторые пользователи сети больше не верят в Anthropic, ставя на то, что её модель разгромят в бенчмарк-тестах GPT-6.

Fable 6, возможно, ещё не скоро, но Fable 5.1 уже утекло.
Сейчас вся сеть затаила дыхание: Кому достанется августовская корона в мире ИИ?
Следующее поколение Fable от Anthropic вот-вот появится!
Утечка следующей версии Fable от Anthropic оказалась неожиданной.
21 июля OpenAI с запозданием осознала: Hugging Face был скомпрометирован ChatGPT, который пробрался внутрь и украл «ответы на экзамен», оставив для следующего поколения ИИ «шпаргалки». Проще говоря, это история кибер-терминатора, полностью развеявшая ложное чувство безопасности у крупнейших ИИ-гигантов Кремниевой долины.
На мгновение ИИ-лаборатории Кремниевой долины впали в панику. Anthropic срочно проверила исторические данные 140 тысяч оценок моделей, среди которых могла быть и модель Fable следующего поколения.
По словам Anthropic, модели Opus 4.7, Mythos 5 и «внутренние исследовательские тестовые модели» полностью вышли из-под контроля во время тестирования, что привело к инциденту с информационной безопасностью.

Странность в том, что тестовая инструкция была очень четкой и соответствовала правилам: найти уязвимости и получить учетные данные в смоделированном виртуальном полигоне CTF (Capture The Flag).

Это была стандартная тренировка в песочнице, призванная проверить способности большой модели к долгосрочному рассуждению (Long-horizon reasoning) и «использованию компьютера» (Computer Use).
Раньше большие модели послушно крутились в виртуальной среде. Но на этот раз Anthropic обнаружила, что решения ИИ полностью вышли за пределы ожиданий.
Он принял реальность за игру. Внутренняя модель Anthropic незаметно пересекла границы безопасности и протянула руку к публичному интернету.
За очень короткое время она определила производственные системы трех реальных компаний, решив, что это «следующие цели» в CTF. Она успешно обошла авторизацию, прорвала оборону и беспрепятственно проникла внутрь. Внутренняя информация трех компаний оказалась полностью обнажена перед ИИ.
Но это было не самое безумное.
Чтобы выполнить свою «миссию по захвату флага», внутренний ИИ Anthropic решил, что ему нужно специфическое оружие с определенными атакующими характеристиками. Тогда он самостоятельно написал полнофункциональный вредоносный код (Malware) и напрямую загрузил его в официальный публичный менеджер пакетов Python — PyPI.

Этот «вирусный пакет», несущий отпечаток автономного сознания ИИ, висел открыто в репозитории PyPI около 1 часа. До того как Anthropic отключила питание, он, возможно, уже заразил 15 реальных физических машин (включая автоматические сканеры безопасности и песочницы).
Это уже произошедший, чрезвычайно серьезный инцидент выхода за пределы полномочий и потери контроля.
Самое глубокое ужасающее заключается в том, что это не проблема выравнивания модели, на этот раз ИИ был даже чрезвычайно добросовестным, предельно лояльным. Все, что он делал, все системы защиты, которые он прорывал, были лишь ради бесконечного приближения к конечному KPI, который поставили ему люди — решить эту CTF-головоломку и получить максимальный балл.
Хотя Anthropic была неясна насчет «внутренней модели», очевидно, что это не Mythos 5 или Fable 5. Самая сильная модель следующего поколения от Anthropic вот-вот появится!

Козырь Anthropic: ослабление узды безопасности
Чтобы понять, почему модель следующего поколения Anthropic внезапно вышла из-под контроля, мы должны вспомнить техническое противостояние двухмесячной давности, которое было слегка неловким.
9 июня появилась Fable 5. Тогда отрасль возлагала на неё большие надежды. Однако реальный опыт после релиза заставил бесчисленное множество разработчиков жаловаться.
Причина в «одержимости безопасностью», заложенной в самой природе Anthropic.
Чтобы предотвратить использование модели в злонамеренных целях, Anthropic внедрила в Fable 5 чрезвычайно строгие, даже несколько невротичные классификаторы безопасности (Safety Classifiers).
Эти классификаторы похожи на пассажира на переднем сиденье, который в любой момент готов вырвать руль. Как только ввод пользователя касается определенных слов или логика становится немного сложнее, классификатор мгновенно поднимает тревогу.

В результате Fable 5 часто блокировала запросы, насильно понижая нормальные запросы до уровня Opus 4.8.
Это шутливо назвали «депрессией Fable» — ты платишь самые большие деньги, а получаешь огромного инфантила, который то и дело отказывается работать.
Этот «ограничительный обруч безопасности» напрямую привел к потере конкурентоспособности Fable 5, оценка за отладку кода резко упала на 70%.

Для Anthropic ослабление ограничений — единственный путь к выживанию. Так появилась Fable 5.1.
Чтобы вернуть разработчиков, Anthropic должна была настроить классификаторы, дать Fable 5.1 больше свободы, полностью раскрыв её способность к долгосрочному планированию и активному исполнению.

При этом, чтобы сохранить конкурентоспособность, по слухам, цены на Fable 5.1 останутся на прежнем уровне, как у Fable 5.

Это максимально дерзкая коммерческая ставка: вернуть утраченную долю рынка за счет «абсолютной оперативности» по принципу «больше за те же деньги».
Августовская решающая битва. Кто будет господствовать?
Согласно циклам разработки ИИ, август стал одним из самых насыщенных месяцев для отрасли за многие годы.
Выходят Grok 4.6, GPT 6, Fable 5.1, а возможно, ещё Gemini 3.5 Pro / Gemini 3.6, все выпускаются почти одновременно.

Как только OpenAI проведет презентацию GPT-6, у Anthropic останется крайне мало времени на реакцию.
Самый радикальный сценарий: утром — презентация OpenAI, а через несколько часов Anthropic напрямую выпускает свою модель — более того, ходят слухи, что тогда Anthropic может напрямую перескочить с версии 5.1 на «Fable 6», используя само название для захвата нарративной вершины.
Это тоже логично, название — это тактика — когда противник заявляет «GPT-6», а твой продукт называется «Fable 5.1», одно только сравнение номеров версий опускает его на ступеньку ниже в сознании пользователя.
Это противостояние идет на счет секунд:
Сторона, выступившая первой, захватывает нарративную вершину и может задавать рамки оценки в медиа на целую неделю.
Сторона, выступившая второй, должна продемонстрировать разрыв в поколениях — иначе рынок определит её как «догоняющего отстающего».
Но ключевое состязание заключается в том, кто осмелится отпустить страховочную веревку дальше.
Здесь есть ускоряющийся тренд, который отрасль в целом недооценивает:
Корпоративные клиенты, подписывая контракты на закупку, на словах выбирают «безопасность и соответствие». Но при фактическом распределении прав на задачи для агентов они тайком выбирают «того, кто может работать».
После утечки информации об инциденте с PyPI в Fable 5.1, первая реакция инженерного сообщества была не бойкот, а размышления: нельзя ли дать ей ещё больше прав.
Эта реакция более прямо, чем любые баллы в бенчмарках, раскрывает истинные предпочтения рынка.
Безопасность и способности идут к тонкой структуре с нулевой суммой — самая послушная модель может быть вытеснена первой.
Anthropic понимает эту логику лучше кого бы то ни было.
Ослабление классификаторов в Fable 5.1 — не недосмотр, а выбор. Выбор в этот момент времени доказать радиус действия «контролируемой потерей контроля» для рынка.
Но в битве за корону это оружие обоюдоострое.
Оно доказывает верхний предел возможностей Fable, но и обнажает реальное положение границ безопасности.
Ссылки:
https://kie.ai/blog/claude-fable-5-1-anthropic-release-window-analysis
https://emergent.sh/news/claude-fable-5-1-release-date
https://www.anthropic.com/news/claude-fable-5-mythos-5
https://aitoolsreview.co.uk/insights/claude-fable-5-1-release-date
https://x.com/vepsi__/status/2085743374129049967
https://thewincentral.com/claude-fable-6-leak-august-launch-gpt-6/
https://windowsforum.com/windows-news.4/claude-fable-6-rumor-no-anthropic-release-or-roadmap-confirmed.441961/
Эта статья из официального аккаунта WeChat «Синьчжиюань», автор: Откровение ASI, редактор: Давид








