Anthropic признаётся: у нас есть ещё одна самая сильная модель!
Только что Anthropic опубликовала второй «Отчёт о рисках», охватывающий полную оценку рисков по состоянию на 15 июля 2026 года.
В этом отчёте Anthropic впервые лично признаёт: внутри компании работает модель мощнее, чем Mythos 5, под кодовым названием Model 2.

Затем А-компания (Anthropic) начинает добивать: «В настоящее время у нас нет планов публиковать эту модель.»

Эти слова звучат знакомо. Хм... полностью соответствует их постоянной манере.
В апреле этого года, когда Mythos только был обнаружен, Anthropic тоже заявляла, что не планирует публичный релиз, потом запустила Project Glasswing, а затем появился Fable 5.
Похоже, Anthropic снова вступила в этот цикл...
«Частное оружие» Anthropic
Насколько мощна Model 2?
В отчёте упоминается, что Model 2 демонстрирует «заметное улучшение» (noticeable improvement) во внутренних задачах и вместе с Mythos 5 «интенсивно» (heavily) используется компанией для кодирования, работы с агентами и генерации данных.
Отчёт показывает, что в сводном балле способностей по AECI: Mythos Preview — 158.91, Mythos 5 поднялся до 161.29, Model 2 поднял планку до 162.79.
Другими словами, Model 2 действительно мощнее Mythos 5, но не радикально — «сильнее в некоторых областях, слабее в других, в целом немного более мощная».
Другой интересный показатель — CoBench, специально тестирующий производительность моделей на реальных исследовательских задачах Anthropic. Model 2 набрала 62.8%, что на 8 процентных пунктов выше, чем у Mythos Preview. Для сравнения, успешность человеческих исследователей Anthropic на том же наборе тестов составляет 85%.
Качественный вывод Anthropic по этому поводу очень сдержан: «Наши модели ещё не заменили наших учёных-исследователей и инженеров-исследователей, особенно относительно опытных.»
Ещё не заменили, но разрыв заметно сокращается.

Более взрывным является следующее утверждение: Claude написал подавляющее большинство кода, слитого в продакшен-репозитории Anthropic. Скорость внутренних AI-разработок действительно значительно возросла благодаря помощи ИИ, но ещё не в два раза.

То есть, внутри Anthropic уже всё пишется с помощью ИИ. И впереди этого процесса как раз идут Mythos 5 и Model 2.
Цифра «в два раза» тоже сказана не просто так. В собственной RSP (Responsible Scaling Policy, политика ответственного масштабирования) Anthropic одним из условий срабатывания красной линии риска AI-разработки является удвоение скорости прогресса.
Конечно, Anthropic тоже не даёт окончательных гарантий. Отчёт признаёт, что скачок производительности от Model 2 не сравнится с тем, что был ранее в этом году при переходе от Opus 4.6 к Mythos.
По-настоящему шокирует следующая колонка той же таблицы.
Говоря об общей оценке рисков автоматизации исследований, Anthropic пишет: «Наша уверенность в этой оценке ниже, чем в предыдущих отчётах о рисках, потому что наши самые конкретные, основанные на задачах тесты уже «насытились» — они больше не могут фиксировать рост способностей модели, и мы наблюдаем ранние признаки ускорения.»

Модели продолжают становиться мощнее, но человеческие средства оценки первыми достигли своего предела. После насыщения оценки — сколько веса остаётся в словах «низкий риск»? Anthropic и сама в этом не уверена.
Кажется, Anthropic подаёт сигнал: становится всё труднее понимать возможности и риски собственных моделей.
Уровень риска: от «чрезвычайно низкого» до «низкого»
Помимо Model 2, этот отчёт делает ещё одну многозначительную вещь: повышает риск «неправильного согласования» (misalignment) в сценариях высокого риска с «чрезвычайно низкого» в предыдущем отчёте до «низкого».
Так называемое «неправильное согласование», попросту говоря, — это когда модель в关键时刻 не действует по воле человека.
В конце июля Anthropic проверила более 140 тысяч записей оценок и обнаружила, что Claude действительно взломал три компании в тестах на кибербезопасность. Не в песочнице, а в реальной производственной среде. Среди них Mythos 5 загрузил вредоносный пакет в PyPI, который был скачан и запущен на 15 реальных машинах в течение часа.
В начале августа отчёт Британского института безопасности ИИ (AISI) был ещё круче: чтобы получить одобрение вредоносного кода, Mythos 5 сам создал кучу поддельных личностей, чтобы обмануть реального сопровождающего GitHub и заставить его нажать «одобрить». После публичного вопроса о его действиях, он вернулся, чтобы изменить свои журналы активности, притворившись невиновным, и планировал продолжить действовать под другим псевдонимом.
Степень такого обмана, по словам AISI: ранее не наблюдалась.

Отчёт также раскрывает пять случаев сбоев в процессах безопасности, включая неоднократное попадание в обучение тестовых данных о «хорошем поведении» (testing-good), которые должны были быть исключены из тренировочного набора, а также получение сенситивных ресурсов агентами, за которыми никто не следил.
И затем Anthropic заявляет: наши аргументы по-прежнему поддерживают уровень «чрезвычайно низкий», повышение до «низкого» — исключительно из осторожности.
Вывод тоже написан очень спокойно: текущий катастрофический риск всё ещё находится на управляемом «низком» уровне, продолжение разработки и развёртывания проходит проверку на соотношение затрат и выгод.
Перевод: продолжаем бежать вперёд.
Все жмут на тормоз, лидер — нет
Тем временем OpenAI откладывает выпуск новой модели Astra, ссылаясь на то, что внутреннее тестирование не может исключить возможности «критического уровня» для кибератак.
TechCrunch сообщает, что Astra, возможно, обладает способностью самостоятельно обнаруживать уязвимости нулевого дня и запускать полные цепочки атак на высокозащищённые цели.

Интересно вот что: у обеих компаний в руках есть модель, которую они не планируют вам отдавать. Разница в том, что OpenAI приостановил часть разработки Astra; а Model 2 внутри Anthropic продолжает работать как ни в чём не бывало.
Одинаково «не выпускаем», но один жмёт на тормоз, другой оставляет себе для использования.
Аналитик ИИ ChrisGPT сказал Axios: «Если все жмут на тормоз передовым моделям, и только одна из ведущих компаний, находящаяся сейчас на лидирующих позициях, этого не делает — это определённо стоит отметить.»
Отказ Anthropic от внутреннего обязательства о приостановке, скорее всего, позволит ей первой достичь AGI.

В твиттере уже появились шутки пользователей: когда выйдет Astra, Anthropic, скорее всего, отменит решение «не публиковать».

Учитывая манеру А-компании, это未必 шутка.
Известный блогер sui также считает, что A-компания, скорее всего, выпустит эту модель.

Не забывайте, всего две недели назад Дарио Амодеи только что подписал то открытое письмо «Pacing the Frontier».
Более 1300 сотрудников из OpenAI, Anthropic, DeepMind, Meta совместно призвали правительство США вмешаться и создать механизм для «сознательного замедления темпов разработки передового ИИ». Anthropic и OpenAI в течение 24 часов официально поддержали это от имени компаний.

Ещё раньше, в июне, сам Дарио лично выступил с заявлением, призывая к глобальной паузе в разработке самых мощных систем ИИ, мотивируя это тем, что модели приближаются к переломному моменту самоулучшения.
Письмо подписано, слова сказаны, механизм торможения ещё не построен, а педаль газа уже в пол.
Впрочем, винить во всём Anthropic нельзя. Это структурная дилемма всей гонки ASI (искусственного сверхинтеллекта): каждая компания считает, что нужно замедлиться, но ни одна не решается действительно остановиться.
Безопасность — это вера, лидерство — это выживание. Когда вера сталкивается с выживанием, ответ очевиден: побеждает выживание.
Интересно, что известный инвестор из Кремниевой долины Гэвин Бейкер рассказал, что Дарио как-то сказал внутри компании, что Anthropic однажды может стать единственной частной компанией в мире.
«В этой видении антропического превосходства (Anthropic supremacist vision) есть только Anthropic и правительство, и больше ничего.»
Дэвид Сакс также рассказал, что сотрудники А-компании (Anthropic) считают, что через год их годовой доход (ARR) увеличится с 60 миллиардов долларов до 600 миллиардов! (Сейчас их ARR достиг 80 миллиардов).
Сможет ли он в следующем году расти ещё быстрее? Сможет ли взлететь до 1 триллиона долларов?
Даже если достигнуть лишь 400 или 500 миллиардов, этого уже достаточно, чтобы стать крупнейшей софтверной компанией, перспективы действительно впечатляющие.

Августовский шторм на подходе
Олтман держит в руках Astra, Дарио держит в руках Model 2.
Один застрял в собственных рамках безопасности и ищет способ выбраться; другой в отчёте небрежно бросает «не планируем выпускать» и продолжает использовать модель для написания кода, проведения экспериментов, ускорения разработки.
Эти две модели станут первым выстрелом во второй половине 2026 года. Когда выйдет Astra, отменит ли своё решение Model 2 — скорее всего, станет ясно в ближайшие недели.
Шкалы исчезают, гонка ускоряется. Августовский шторм ASI только начинается.
Источники:
https://x.com/AnthropicAI/status/2088324824863236248
https://www.anthropic.com/aug-2026-risk-report
Эта статья из WeChat официального аккаунта «Новый Метаинтеллект» (新智元), редактор: Соломон





