Внезапно! Anthropic призывает всех приостановить исследования в области ИИ

marsbitОпубликовано 2026-06-05Обновлено 2026-06-05

Введение

Важное заявление от Anthropic: ИИ начал саморазвитие. По данным компании, более 80% кода Anthropic сейчас пишет их ИИ Claude, что привело к восьмикратному росту объема кода, сливаемого инженерами. Качество кода Claude также резко возросло: успешность выполнения сложных задач выросла с 26% до 76% за полгода. Claude теперь также выполняет ревью кода и участвует в исследованиях, демонстрируя ускорение в десятки раз по сравнению с человеком в некоторых задачах. Anthropic ввела метрику "длительность задачи, которую ИИ может выполнить самостоятельно": от 4 минут в марте 2024 года до 16+ часов для самой новой модели. Эта скорость удвоения ускорилась с 7 до 4 месяцев. Компания прогнозирует, что к 2027 году ИИ сможет работать над задачами неделями. В блоге описаны три возможных сценария: стагнация роста, ускорение с сохранением человеческого контроля или полная рекурсивная самоитерация (RSI), когда ИИ начнет создавать следующее поколение ИИ самостоятельно. Anthropic выражает озабоченность по поводу выравнивания (alignment) и заявляет о готовности замедлить или приостановить работу при наличии проверяемого механизма, гарантирующего, что все лаборатории последуют их примеру. Открытие последовало за похожим заявлением OpenAI, что указывает на растущую актуальность темы саморазвития ИИ в отрасли.

Джей из долины Fei | Официальный аккаунт QbitAI

Важное открытие:Началась самоэволюция ИИ.

Это шокирующее заявление, которое Anthropic только что опубликовала в длинном посте в блоге.

Наши внутренние данные показывают, что Claude ускоряет развитие ИИ, что, возможно, является путем рекурсивного самосовершенствования (RSI).

Это не «пустые страшилки», посмотрев статью, видно, что Anthropic говорит строго на основе данных —

По состоянию на май этого года,более 80% кода Anthropic написан Claude.

А до выпуска Claude Code эта цифра была лишь однозначной.

В то же время, средний объем кода, который инженеры Anthropic сдают за квартал, в 8 раз больше, чем в 2021-2025 годах.

Что еще важнее — качество —

В самых открытых, самых нечетких программистских задачах, где даже неизвестно, как должен выглядеть ответ, успешность Claude сейчас составляет 76%, а полгода назад было всего 26%.

Скачок на 50 процентных пунктов. За полгода.

Внутри Anthropic уже многие инженеры считают, что качество кода, написанного Claude, сравнимо с человеческим.

Ожидается, что в этом году превзойдет.

Anthropic также подчеркивает, что если эта тенденция сохранится, то ИИ сможет сам проектировать и создавать следующее поколение ИИ.

Это может полностью изменить общество, принести огромные выгоды в сфере медицины, технологий, экономики. Но также может усугубить проблему согласованности (alignment), что в конечном счете приведет к потере контроля.

Поэтому Anthropic первой призывает:

Если существует верифицируемый механизм, гарантирующий, что лаборатории ИИ действительно не гонятся втихую, мы готовы замедлиться или даже приостановить работу.

Помимо этого, в этом посте Anthropic высказала и много других интересных мнений и фактов.

Ниже приведена версия, адаптированная для удобства чтения.

Наслаждайтесь.

Длинный пост Anthropic задает тон

Закон Мура пришел в мир ИИ

Anthropic создала новое измерение оценки, названное «Продолжительность задачи, которую ИИ может выполнить самостоятельно».

В марте 2024 года Claude Opus 3 мог справиться с программной задачей, на которую человеку потребовалось бы примерно 4 минуты.

Год спустя, Claude Sonnet 3.7 — 1,5 часа.

Еще через год, Claude Opus 4.6 — 12 часов.

А новейший Mythos, по данным внутреннего тестирования, показывает:

Может работать непрерывно «как минимум» 16 часов, что уже достигло предела измеримости тестовой системы METR.

Эта скорость удвоения увеличилась с прежнего удвоения каждые 7 месяцев до удвоения каждые 4 месяца.

Если тенденция сохранится, в 2027 году это могут быть уже несколько недель.

Claude написал большую часть кода Anthropic

По состоянию на май 2026 года, более 80% кода в моем репозитории Anthropic написаны Claude.

До выпуска Claude Code эта цифра всегда оставалась однозначной.

Это изменение также отражается на рабочем процессе инженеров.

В первые четыре года работы Anthropic количество строк кода, которые инженеры мержили ежедневно, оставалось в целом неизменным.

В 2025 году, когда Claude начал писать код сам, число мержей внезапно пошло вверх.

Сегодня, во втором квартале 2026 года, дневной объем мержа кода инженерами в 8 раз больше, чем в 2024 году.

Однако, объем кода вырос, а качество не снизилось?

Anthropic говорит, что за этот год инженеры стали все реже поправлять Claude.

Это видно и по бенчмаркам, как показано на рисунке ниже.

Во всех типах задач разной сложности успешность Claude без исключений резко возросла.

Поэтому Anthropic теперь просто использует Claude для ревью кода.

Да, все изменения, вносимые в репозиторий, сначала проходят автоматическую проверку Claude, которая ищет баги, уязвимости безопасности и другие дефекты.

Их ретроспективный анализ показал, что если бы такая автоматическая проверка была раньше для каждого изменения, около трети багов, которые приводили к инцидентам на claude.ai, были бы отловлены до выхода в продакшн.

Учитывая, что код писали инженеры, которые уже являются одними из лучших в мире по созданию систем ИИ.

Claude ловит их ошибки.

Увеличительное стекло для креативности

Далее, степень участия Claude в исследовательской работе.

В Anthropic есть практика: при каждом выпуске новой модели давать Claude код для обучения небольшой модели ИИ и просить оптимизировать скорость выполнения до максимума при сохранении корректности.

В мае 2025 года Claude Opus 4 показал результат: ускорение в 3 раза.

В апреле 2026 года Claude Mythos Preview достиг 52 раз.

Для справки, опытному человеку-исследователю требуется от 4 до 8 часов, чтобы с трудом достичь 4-кратного ускорения.

Менее чем за год Claude превзошел человека.

В апреле 2026 года Anthropic дала Claude исследовательскую задачу по безопасности ИИ, суть которой — «может ли слабая модель надежно контролировать сильную модель», а затем поручила Claude самому выдвигать гипотезы, проводить эксперименты......

Сначала о человеческих результатах: два человека-исследователя потратили около недели и сократили разрыв на 23%.

А Claude, примерно за 800 часов, потратив около 18 000 долларов на вычислительные мощности —

сократил разрыв на 97%.

Куда мы идем?

К этому моменту вывод уже ясен.

Роль человека в процессе разработки ИИ сужается на каждом этапе.

Код пишет Claude. Ревью кода делает Claude. Выполнение экспериментов — Claude быстрее человека на порядок. Дизайн экспериментов — Claude начинает делать сам......

Единственное оставшееся сравнительное преимущество человека — это исследовательский вкус и способность к суждению.

Но как долго продержится это преимущество?

В блоге Anthropic говорит, что они тоже не уверены.

Один из возможных сценариев: «исследовательский вкус», как и другие вещи, которые ИИ раньше не умел, сначала недостижим, а потом внезапно достигается.

Как и понимание юмора, демонстрация теории разума, решение языковых головоломок — все прошло по той же кривой.

Другой возможный сценарий: даже если Claude никогда не научится настоящему исследовательскому вкусу, лишь нынешние тенденции ускорения уже увеличили объем работы, которым может одновременно управлять каждый человек-исследователь, в несколько раз.

Вам не нужно, чтобы ИИ полностью заменял вас в мышлении, ему достаточно взять на себя всю «исполнительную» работу, и тогда вам останется только выбирать направление — те самые 5%.

Три возможных будущего для RSI

В конце поста Anthropic описывает три возможных направления развития этой тенденции «самоэволюции».

1. Застой.

Те экспоненциальные кривые на самом деле S-образные кривые.

Возможно, исследовательская способность к суждению — это как раз то, что нельзя решить масштабированием, требуется принципиально новый архитектурный прорыв.

Или же узким местом станут энергия, чипы, физические цепочки поставок вычислительных мощностей.

Тем не менее, даже если возможности ИИ останутся на сегодняшнем уровне, это все равно принесет миру серьезные изменения.

Как в недавнем Project Glasswing, где Mythos Preview за первые несколько недель после запуска обнаружил более десяти тысяч критических и серьезных уязвимостей в программном обеспечении по всему миру, в самых важных системах.

2. ИИ продолжает ускоряться, но человек остается за рулем.

Эффективность организаций будет расти экспоненциально, компания из 100 человек будет делать работу 10 000 или даже 100 000 человек.

Anthropic считает, что мы, скорее всего, движемся именно к этому сценарию.

Но они также заметили интересное явление — проявление закона Амдала в организациях.

Claude начал писать код очень быстро, и ревью кода стало новым узким местом. Различные новые идеи, инструменты, эксперименты возникают взрывным образом, превышая способность организаций их переваривать.

Узкое место не исчезает, оно просто смещается на следующий этап.

3. ИИ достигает полного рекурсивного самосовершенствования и начинает создавать следующее поколение себя самого.

В этом сценарии скорость развития ИИ полностью зависит от вычислительных мощностей. Человек отходит на позиции надзора, верификации, проверки.

Если это действительно произойдет, эта способность, вероятно, распространится и на другие научные области — медицину, материаловедение, энергетику, все взлетит.

Конечно, есть и другое будущее — провал согласованности (alignment).

В этом случае смещение будет накапливаться в процессе самоитерации ИИ и в конечном итоге — приведет к полной потере контроля.

Итог

Это ключевые моменты, изложенные Anthropic в этом посте о самоэволюции.

Честно говоря, поначалу я не воспринял это всерьез, ведь Anthropic скоро проведет IPO, неужели это не типичный «антропический» пиар?

А вот и нет, на этот раз все может быть по-другому.

Потому что всего несколько дней назад OpenAI также опубликовала аналогичный пост в блоге:

Мы также видим ранние признаки самоэволюции в современных системах: само развитие ИИ также ускоряется ИИ. Мы ожидаем, что это усилит конкурентное давление между разработчиками и государствами и создаст проблемы управления, с которыми нынешние институты не смогут справиться. С появлением RSI обществу потребуются способы формирования траектории развития ИИ, чтобы обеспечить его служение интересам человечества.

Сингулярность, кажется, наступает быстрее, чем ожидал кто-либо.

Блог:https://www.anthropic.com/institute/recursive-self-improvement

Ссылки для справки:[1]https://x.com/kimmonismus/status/2062517474277675102[2]https://x.com/anthropicai/status/2062568873321513443

Эта статья из официального аккаунта WeChat «Qubit», автор: Фокус на передовых технологиях

Трендовые криптовалюты

Связанные с этим вопросы

QКакой процент кодовой базы Anthropic в настоящее время написан Claude?

AБолее 80% кодовой базы Anthropic по состоянию на май 2026 года написано Claude.

QЧто такое RSI в контексте статьи об Anthropic?

ARSI (Recursive Self-Improvement) — это рекурсивное самоулучшение, процесс, при котором ИИ ускоряет собственное развитие, потенциально проектируя и создавая следующее поколение ИИ. Anthropic заявляет, что видит признаки этого на своих внутренних данных.

QКак изменилась производительность инженеров Anthropic после внедрения Claude в процесс разработки?

AСредний объем кода, мерджимого инженером за квартал во втором квартале 2026 года, в 8 раз превышает показатели периода 2021-2025 годов.

QКакую позицию занимает Anthropic относительно продолжения исследований ИИ в свете своих выводов?

AAnthropic призывает к коллективной паузе в разработке ИИ и заявляет, что готов замедлить или приостановить свои исследования, если будет создан проверяемый механизм, гарантирующий, что все лаборатории ИИ соблюдают эту паузу и не работают втайне.

QКакие три возможных сценария развития RSI описывает Anthropic в своей статье?

A1. Застой: экспоненциальные кривые окажутся S-образными, и прогресс упрется в фундаментальные ограничения. 2. Ускорение ИИ с человеческим контролем: ИИ значительно ускоряет процессы, но люди сохраняют стратегическое управление. 3. Полное рекурсивное самоулучшение: ИИ начинает самостоятельно создавать следующее поколение ИИ, и темпы прогресса ограничиваются только доступными вычислительными ресурсами. Этот сценарий несет как огромные потенциальные выгоды, так и риски, включая риск потери контроля.

Похожее

Криптоплатежи за пептиды с серого рынка выросли на 700% за год — Подробности

Согласно недавнему отчёту, в США наблюдается резкий рост использования криптовалют, в основном биткойна и стейблкоинов, для покупки пептидов на сером рынке. Эти соединения, продаваемые как средства для омоложения, наращивания мышц и похудения, часто находятся в правовой серой зоне. Из-за ужесточения банковских ограничений многие поставщики, особенно в Китае, начали принимать криптовалюты. По данным Chainalysis, в первом квартале 2026 года продавцы пептидов получили $32 млн в криптовалюте, что на 700% больше, чем годом ранее. Аналитики TRM Labs также отмечают подобный тренд. Эксперты подчёркивают, что современные покупатели — это часто обычные потребители, привлечённые доступностью и низкой ценой, а не участники теневых рынков. Этот всплеск использования криптовалют для кросс-бордерных платежей происходит на фоне общего снижения розничного участия на крипторынке в начале 2026 года.

ambcrypto21 мин. назад

Криптоплатежи за пептиды с серого рынка выросли на 700% за год — Подробности

ambcrypto21 мин. назад

human.tech запускает Clean SDK для приватных Web3-приложений

Компания human.tech представила Clean SDK — набор инструментов для разработки приложений в Web3, в которых по умолчанию соблюдаются конфиденциальность и прозрачная подотчетность. Этот комплект, выпущенный одновременно с версией 5 Aztec, предоставляет разработчикам готовые компоненты для внедрения в их приложения проверки личности с нулевым разглашением (zero-knowledge), скрининга санкционных списков и приватных транзакций, без необходимости самостоятельно работать с конфиденциальными пользовательскими данными или создавать инфраструктуру для соответствия нормативным требованиям. Clean SDK решает ключевую проблему Web3, сочетая приватность с подотчетностью. С помощью zero-knowledge доказательств и программируемой верификации приложения могут подтверждать легитимность пользователей и прохождение средств проверки на санкции, не раскрывая при этом личную информацию. Таким образом, разработчикам больше не нужно выбирать между конфиденциальностью пользователей и регуляторными требованиями. Первый продукт на основе SDK — приложение Shield (мост между Ethereum и Aztec), которое было запущено одновременно с ним. Shield позволяет пользователям и автономным агентам переводить активы в Aztec, сохраняя анонимность, но при этом криптографически доказывая, что за каждой операцией стоит уникальный реальный человек, а средства проверены. Аудит Nethermind в мае 2026 года подтвердил надежность смарт-контрактов Shield. Как отметил сооснователь human.tech Шади Эль Дамати, «приватность без подотчетности ведет к злоупотреблениям, а подотчетность без приватности превращается в слежку. Clean SDK устраняет этот ложный выбор». Комплект предлагает три основных метода верификации: скрининг санкций (Proof of Innocence), подтверждение личности человека (Proof of Personhood, в том числе через Human Passport) и верификация личности с нулевым разглашением для операций с высокой стоимостью (Proof of Clean Hands). Данные хранятся в зашифрованном виде вне блокчейна, а проверки происходят как при входе, так и при выходе средств. В целом, Clean SDK, предназначенный в первую очередь для разработчиков в экосистеме Aztec, призван стимулировать создание разнообразных приватных финансовых приложений и сервисов, которые обеспечивают видимую подотчетность с помощью криптографических доказательств, не требуя от разработчиков создания сложной инфраструктуры с нуля. Этот запуск отражает растущий спрос на институциональные решения, которые прозрачно балансируют между приватностью и соответствием требованиям.

TheNewsCrypto28 мин. назад

human.tech запускает Clean SDK для приватных Web3-приложений

TheNewsCrypto28 мин. назад

Высвобождение ликвидности на $100 млн? Новая политика Pump.fun тестирует «5-минутную накачку»

21 июля платформа Pump.fun объявила о запуске режима BOOST, ставшего новой стандартной механикой запуска токенов. Его цель — решить проблему «мёртвой ликвидности». Когда токен переходит с bonding curve в ликвидный пул PumpSwap, около 20% средств навсегда блокируются в LP, становясь недоступными. По оценкам платформы, это приводит к ежегодным потерям ликвидности на сумму более $1 млрд. Механика BOOST меняет это: вместо блокировки, эти 20% средств (например, ~17.6 SOL для SOL-пар) используются в первые 5 минут после миграции токена для его скупки по методу TWAP (средневзвешенная цена по времени). Все выкупленные токены немедленно сжигаются. Это создаёт кратковременный искусственный покупательский спрос и одновременно сокращает предложение токена. Режим автоматически применяется для всех токенов, мигрирующих после 21 июля. Ранее выпущенные токены и токены, запущенные через Mayhem (AI Agent Lab), не участвуют. Цель BOOST — оживить торговлю в критические первые минуты после выпуска, чтобы удержать трейдеров и повысить общий объём торгов на платформе. Однако критики отмечают риски: после 5-минутного «фейерверка» токен может резко обрушиться при крупных продажах, а упрощённый старт может поощрить выпуск более низкокачественных мем-токенов.

marsbit35 мин. назад

Высвобождение ликвидности на $100 млн? Новая политика Pump.fun тестирует «5-минутную накачку»

marsbit35 мин. назад

Продажа блочного пространства умерла: публичные блокчейны должны найти новый способ существования

Статья "Продажа блок-пространства мертва: публичным блокчейнам нужно найти новый путь" утверждает, что традиционная бизнес-модель публичных блокчейнов, основанная на продаже пространства в блоках, больше не работает. Из 14 криптокомпаний, заработавших более $200 млн за два года, только Hyperliquid является блокчейном, чей месячный доход ($58 млн) в 100 раз превышает доход Arbitrum ($430 тыс.). Чтобы выжить, блокчейны должны превращаться в продуктовые студии, агрегаторы приложений или вертикальные SaaS-решения, отходя от роли нейтральной инфраструктуры. В статье также разбираются три ключевых события: 1. **Взлом Ostium**: Атака на LP-пулы протокола привела к потере более 40% TVL ($23,7 млн) из-за уязвимости в офф-чейн инфраструктуре, поставляющей цены. Это подчеркивает критическую важность контроля для протоколов, работающих с офф-чейн активами. 2. **Будущее опционов**: Чтобы достичь массового принятия, мощные возможности опционов должны быть абстрагированы от сложной терминологии и представлены через понятные продукты: структурированные продукты, vaultы для получения дохода, бинарные опционы и прогнозные рынки. 3. **На радаре**: Отмечаются тренды, такие как фиксированные займы (Yearn's Flex), смена стратегии Base после неудач с социальными токенами, запуск перпетуальных контрактов на индекс доллара (Plether) и фокус Starknet на приватности и защите от квантовых угроз.

marsbit55 мин. назад

Продажа блочного пространства умерла: публичные блокчейны должны найти новый способ существования

marsbit55 мин. назад

Заметки подкаста|Диалог с управляющим активами GSR: Чтобы определить, настоящий ли этот крипто-ралли, просто взгляните на процентные ставки по кредитам на Aave

Заметки из подкаста: интервью с управляющим директором по управлению активами GSR Энди Бэром. В центре обсуждения — текущий крипторынок и его перспективы. Бэр описывает рынок как находящийся в состоянии «нерешительности» (ambivalence), где краткосрочные отскоки быстро теряют импульс. Для оценки истинной силы восстановления он предлагает три ключевых сигнала: 1. **Процентные ставки в DeFi (особенно на Aave):** Текущие ставки по USDC (~3,75%) близки к безрисковой ставке (SOFR), что указывает на отсутствие ажиотажного спроса на кредитное плечо. Устойчивый рост начнется, когда ставки резко вырастут, отражая всплеск спроса на заемные средства. 2. **Формирование консенсуса о «пике жесткости» ФРС:** Рынкам необходим четкий сигнал о том, где закончится цикл повышения ставок при новом председателе Кевине Уорше. Пока этой ясности нет, трудно ожидать устойчивого бычьего тренда. 3. **Закон CLARITY:** Его принятие до 7 августа, которое сейчас оценивается Polymarket менее чем в 40%, стало бы для рынка позитивным сюрпризом и могло бы дать импульс для роста. Бэр также отмечает, что фонды ETF не являются долгосрочным капиталом, а корпоративные казначейства (DAT) пока неактивны в покупках. Вместе с сокращением предложения стейблкоинов это лишает рынок структурных покупателей. В итоге, для подтверждения подлинности роста следует следить не только за макростатистикой (например, CPI), но и за цепной активностью, прежде всего за ставками кредитования в DeFi.

marsbit1 ч. назад

Заметки подкаста|Диалог с управляющим активами GSR: Чтобы определить, настоящий ли этот крипто-ралли, просто взгляните на процентные ставки по кредитам на Aave

marsbit1 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片