Внезапно! Anthropic призывает всех приостановить исследования в области ИИ

marsbitОпубликовано 2026-06-05Обновлено 2026-06-05

Введение

Важное заявление от Anthropic: ИИ начал саморазвитие. По данным компании, более 80% кода Anthropic сейчас пишет их ИИ Claude, что привело к восьмикратному росту объема кода, сливаемого инженерами. Качество кода Claude также резко возросло: успешность выполнения сложных задач выросла с 26% до 76% за полгода. Claude теперь также выполняет ревью кода и участвует в исследованиях, демонстрируя ускорение в десятки раз по сравнению с человеком в некоторых задачах. Anthropic ввела метрику "длительность задачи, которую ИИ может выполнить самостоятельно": от 4 минут в марте 2024 года до 16+ часов для самой новой модели. Эта скорость удвоения ускорилась с 7 до 4 месяцев. Компания прогнозирует, что к 2027 году ИИ сможет работать над задачами неделями. В блоге описаны три возможных сценария: стагнация роста, ускорение с сохранением человеческого контроля или полная рекурсивная самоитерация (RSI), когда ИИ начнет создавать следующее поколение ИИ самостоятельно. Anthropic выражает озабоченность по поводу выравнивания (alignment) и заявляет о готовности замедлить или приостановить работу при наличии проверяемого механизма, гарантирующего, что все лаборатории последуют их примеру. Открытие последовало за похожим заявлением OpenAI, что указывает на растущую актуальность темы саморазвития ИИ в отрасли.

Джей из долины Fei | Официальный аккаунт QbitAI

Важное открытие:Началась самоэволюция ИИ.

Это шокирующее заявление, которое Anthropic только что опубликовала в длинном посте в блоге.

Наши внутренние данные показывают, что Claude ускоряет развитие ИИ, что, возможно, является путем рекурсивного самосовершенствования (RSI).

Это не «пустые страшилки», посмотрев статью, видно, что Anthropic говорит строго на основе данных —

По состоянию на май этого года,более 80% кода Anthropic написан Claude.

А до выпуска Claude Code эта цифра была лишь однозначной.

В то же время, средний объем кода, который инженеры Anthropic сдают за квартал, в 8 раз больше, чем в 2021-2025 годах.

Что еще важнее — качество —

В самых открытых, самых нечетких программистских задачах, где даже неизвестно, как должен выглядеть ответ, успешность Claude сейчас составляет 76%, а полгода назад было всего 26%.

Скачок на 50 процентных пунктов. За полгода.

Внутри Anthropic уже многие инженеры считают, что качество кода, написанного Claude, сравнимо с человеческим.

Ожидается, что в этом году превзойдет.

Anthropic также подчеркивает, что если эта тенденция сохранится, то ИИ сможет сам проектировать и создавать следующее поколение ИИ.

Это может полностью изменить общество, принести огромные выгоды в сфере медицины, технологий, экономики. Но также может усугубить проблему согласованности (alignment), что в конечном счете приведет к потере контроля.

Поэтому Anthropic первой призывает:

Если существует верифицируемый механизм, гарантирующий, что лаборатории ИИ действительно не гонятся втихую, мы готовы замедлиться или даже приостановить работу.

Помимо этого, в этом посте Anthropic высказала и много других интересных мнений и фактов.

Ниже приведена версия, адаптированная для удобства чтения.

Наслаждайтесь.

Длинный пост Anthropic задает тон

Закон Мура пришел в мир ИИ

Anthropic создала новое измерение оценки, названное «Продолжительность задачи, которую ИИ может выполнить самостоятельно».

В марте 2024 года Claude Opus 3 мог справиться с программной задачей, на которую человеку потребовалось бы примерно 4 минуты.

Год спустя, Claude Sonnet 3.7 — 1,5 часа.

Еще через год, Claude Opus 4.6 — 12 часов.

А новейший Mythos, по данным внутреннего тестирования, показывает:

Может работать непрерывно «как минимум» 16 часов, что уже достигло предела измеримости тестовой системы METR.

Эта скорость удвоения увеличилась с прежнего удвоения каждые 7 месяцев до удвоения каждые 4 месяца.

Если тенденция сохранится, в 2027 году это могут быть уже несколько недель.

Claude написал большую часть кода Anthropic

По состоянию на май 2026 года, более 80% кода в моем репозитории Anthropic написаны Claude.

До выпуска Claude Code эта цифра всегда оставалась однозначной.

Это изменение также отражается на рабочем процессе инженеров.

В первые четыре года работы Anthropic количество строк кода, которые инженеры мержили ежедневно, оставалось в целом неизменным.

В 2025 году, когда Claude начал писать код сам, число мержей внезапно пошло вверх.

Сегодня, во втором квартале 2026 года, дневной объем мержа кода инженерами в 8 раз больше, чем в 2024 году.

Однако, объем кода вырос, а качество не снизилось?

Anthropic говорит, что за этот год инженеры стали все реже поправлять Claude.

Это видно и по бенчмаркам, как показано на рисунке ниже.

Во всех типах задач разной сложности успешность Claude без исключений резко возросла.

Поэтому Anthropic теперь просто использует Claude для ревью кода.

Да, все изменения, вносимые в репозиторий, сначала проходят автоматическую проверку Claude, которая ищет баги, уязвимости безопасности и другие дефекты.

Их ретроспективный анализ показал, что если бы такая автоматическая проверка была раньше для каждого изменения, около трети багов, которые приводили к инцидентам на claude.ai, были бы отловлены до выхода в продакшн.

Учитывая, что код писали инженеры, которые уже являются одними из лучших в мире по созданию систем ИИ.

Claude ловит их ошибки.

Увеличительное стекло для креативности

Далее, степень участия Claude в исследовательской работе.

В Anthropic есть практика: при каждом выпуске новой модели давать Claude код для обучения небольшой модели ИИ и просить оптимизировать скорость выполнения до максимума при сохранении корректности.

В мае 2025 года Claude Opus 4 показал результат: ускорение в 3 раза.

В апреле 2026 года Claude Mythos Preview достиг 52 раз.

Для справки, опытному человеку-исследователю требуется от 4 до 8 часов, чтобы с трудом достичь 4-кратного ускорения.

Менее чем за год Claude превзошел человека.

В апреле 2026 года Anthropic дала Claude исследовательскую задачу по безопасности ИИ, суть которой — «может ли слабая модель надежно контролировать сильную модель», а затем поручила Claude самому выдвигать гипотезы, проводить эксперименты......

Сначала о человеческих результатах: два человека-исследователя потратили около недели и сократили разрыв на 23%.

А Claude, примерно за 800 часов, потратив около 18 000 долларов на вычислительные мощности —

сократил разрыв на 97%.

Куда мы идем?

К этому моменту вывод уже ясен.

Роль человека в процессе разработки ИИ сужается на каждом этапе.

Код пишет Claude. Ревью кода делает Claude. Выполнение экспериментов — Claude быстрее человека на порядок. Дизайн экспериментов — Claude начинает делать сам......

Единственное оставшееся сравнительное преимущество человека — это исследовательский вкус и способность к суждению.

Но как долго продержится это преимущество?

В блоге Anthropic говорит, что они тоже не уверены.

Один из возможных сценариев: «исследовательский вкус», как и другие вещи, которые ИИ раньше не умел, сначала недостижим, а потом внезапно достигается.

Как и понимание юмора, демонстрация теории разума, решение языковых головоломок — все прошло по той же кривой.

Другой возможный сценарий: даже если Claude никогда не научится настоящему исследовательскому вкусу, лишь нынешние тенденции ускорения уже увеличили объем работы, которым может одновременно управлять каждый человек-исследователь, в несколько раз.

Вам не нужно, чтобы ИИ полностью заменял вас в мышлении, ему достаточно взять на себя всю «исполнительную» работу, и тогда вам останется только выбирать направление — те самые 5%.

Три возможных будущего для RSI

В конце поста Anthropic описывает три возможных направления развития этой тенденции «самоэволюции».

1. Застой.

Те экспоненциальные кривые на самом деле S-образные кривые.

Возможно, исследовательская способность к суждению — это как раз то, что нельзя решить масштабированием, требуется принципиально новый архитектурный прорыв.

Или же узким местом станут энергия, чипы, физические цепочки поставок вычислительных мощностей.

Тем не менее, даже если возможности ИИ останутся на сегодняшнем уровне, это все равно принесет миру серьезные изменения.

Как в недавнем Project Glasswing, где Mythos Preview за первые несколько недель после запуска обнаружил более десяти тысяч критических и серьезных уязвимостей в программном обеспечении по всему миру, в самых важных системах.

2. ИИ продолжает ускоряться, но человек остается за рулем.

Эффективность организаций будет расти экспоненциально, компания из 100 человек будет делать работу 10 000 или даже 100 000 человек.

Anthropic считает, что мы, скорее всего, движемся именно к этому сценарию.

Но они также заметили интересное явление — проявление закона Амдала в организациях.

Claude начал писать код очень быстро, и ревью кода стало новым узким местом. Различные новые идеи, инструменты, эксперименты возникают взрывным образом, превышая способность организаций их переваривать.

Узкое место не исчезает, оно просто смещается на следующий этап.

3. ИИ достигает полного рекурсивного самосовершенствования и начинает создавать следующее поколение себя самого.

В этом сценарии скорость развития ИИ полностью зависит от вычислительных мощностей. Человек отходит на позиции надзора, верификации, проверки.

Если это действительно произойдет, эта способность, вероятно, распространится и на другие научные области — медицину, материаловедение, энергетику, все взлетит.

Конечно, есть и другое будущее — провал согласованности (alignment).

В этом случае смещение будет накапливаться в процессе самоитерации ИИ и в конечном итоге — приведет к полной потере контроля.

Итог

Это ключевые моменты, изложенные Anthropic в этом посте о самоэволюции.

Честно говоря, поначалу я не воспринял это всерьез, ведь Anthropic скоро проведет IPO, неужели это не типичный «антропический» пиар?

А вот и нет, на этот раз все может быть по-другому.

Потому что всего несколько дней назад OpenAI также опубликовала аналогичный пост в блоге:

Мы также видим ранние признаки самоэволюции в современных системах: само развитие ИИ также ускоряется ИИ. Мы ожидаем, что это усилит конкурентное давление между разработчиками и государствами и создаст проблемы управления, с которыми нынешние институты не смогут справиться. С появлением RSI обществу потребуются способы формирования траектории развития ИИ, чтобы обеспечить его служение интересам человечества.

Сингулярность, кажется, наступает быстрее, чем ожидал кто-либо.

Блог:https://www.anthropic.com/institute/recursive-self-improvement

Ссылки для справки:[1]https://x.com/kimmonismus/status/2062517474277675102[2]https://x.com/anthropicai/status/2062568873321513443

Эта статья из официального аккаунта WeChat «Qubit», автор: Фокус на передовых технологиях

Трендовые криптовалюты

Связанные с этим вопросы

QКакой процент кодовой базы Anthropic в настоящее время написан Claude?

AБолее 80% кодовой базы Anthropic по состоянию на май 2026 года написано Claude.

QЧто такое RSI в контексте статьи об Anthropic?

ARSI (Recursive Self-Improvement) — это рекурсивное самоулучшение, процесс, при котором ИИ ускоряет собственное развитие, потенциально проектируя и создавая следующее поколение ИИ. Anthropic заявляет, что видит признаки этого на своих внутренних данных.

QКак изменилась производительность инженеров Anthropic после внедрения Claude в процесс разработки?

AСредний объем кода, мерджимого инженером за квартал во втором квартале 2026 года, в 8 раз превышает показатели периода 2021-2025 годов.

QКакую позицию занимает Anthropic относительно продолжения исследований ИИ в свете своих выводов?

AAnthropic призывает к коллективной паузе в разработке ИИ и заявляет, что готов замедлить или приостановить свои исследования, если будет создан проверяемый механизм, гарантирующий, что все лаборатории ИИ соблюдают эту паузу и не работают втайне.

QКакие три возможных сценария развития RSI описывает Anthropic в своей статье?

A1. Застой: экспоненциальные кривые окажутся S-образными, и прогресс упрется в фундаментальные ограничения. 2. Ускорение ИИ с человеческим контролем: ИИ значительно ускоряет процессы, но люди сохраняют стратегическое управление. 3. Полное рекурсивное самоулучшение: ИИ начинает самостоятельно создавать следующее поколение ИИ, и темпы прогресса ограничиваются только доступными вычислительными ресурсами. Этот сценарий несет как огромные потенциальные выгоды, так и риски, включая риск потери контроля.

Похожее

Он был заслугой двух ведущих отраслей Шанхая, но ушел из жизни в тихом сожалении

Цзян Шанчжоу, бывший заместитель главы Шанхайского экономического комитета, сыграл ключевую роль в развитии двух стратегических отраслей города — полупроводниковой промышленности и производства коммерческих авиалайнеров. В конце 1990-х годов, когда китайская микроэлектронная отрасль находилась в застое, он смело предложил построить в Шанхае за пять лет десять 8-дюймовых линий по производству чипов, что значительно превышало общенациональные планы. Благодаря его усилиям по привлечению талантов, таких как Чжан Жуцзин, был основан SMIC, а также создана компания AMEC. Это заложило основу для того, чтобы Шанхай стал лидером в полупроводниковой отрасли Китая. Параллельно, будучи руководителем группы по论证нию крупных государственных проектов, Цзян Шанчжоу, уже будучи болен раком лёгких, настойчиво продвигал включение проекта по созданию крупного пассажирского самолёта в государственный план развития. Его видение привело к возрождению авиационной промышленности в Шанхае и в конечном итоге к созданию самолёта C919. Несмотря на свой стратегический ум и дальновидность, карьера Цзян Шанчжоу часто сталкивалась с непониманием из-за опережающих своё время идей, будь то в Санье, Янпу или Шанхае. Он скончался в 2011 году от рака, не дожив до полного расцвета отраслей, которые он помог создать. Однако его наследие живёт: Шанхай сегодня является ведущим центром Китая в области集成电路 и коммерческого авиастроения, во многом благодаря основам, заложенным Цзян Шанчжоу. Его жизнь — это пример преданности долгосрочному развитию страны.

marsbit11 мин. назад

Он был заслугой двух ведущих отраслей Шанхая, но ушел из жизни в тихом сожалении

marsbit11 мин. назад

Фокус доходов AMD: как за 12 кварталов акцент сместился в сторону дата-центров

В отчете AMD за второй квартал отмечается, что доход от бизнеса в области центров обработки данных достиг 6,718 млрд долларов США, увеличившись на 107% в годовом исчислении, в то время как доход от игрового бизнеса упал на 31% до 779 млн долларов. За 12 кварталов доля центра обработки данных в общем доходе компании выросла с 27,6% до 58,2%, став крупнейшим подразделением с четвертого квартала 2025 года. Хотя сокращение игрового бизнеса произошло в тот же период, данные не подтверждают прямого переноса ресурсов между этими направлениями. Общий доход компании вырос, что указывает на расширение всей бизнес-базы, а не просто на внутреннее перераспределение. По сравнению с конкурентами, темпы роста AMD в сегменте ЦОД высоки, но абсолютный объем дохода (6,718 млрд долларов) все еще значительно уступает NVIDIA (около 75,2 млрд долларов) и близок к показателю Intel DCAI (6,262 млрд долларов), хотя определения подразделений различаются. Таким образом, центры обработки данных стали главным источником дохода для AMD, но открытая отчетность не позволяет сделать вывод о прямой замене одного бизнеса другим.

marsbit12 мин. назад

Фокус доходов AMD: как за 12 кварталов акцент сместился в сторону дата-центров

marsbit12 мин. назад

Объясняем Cloudflare Wallet: новый игрок в стабильных платежах с использованием x402

4 августа Cloudflare анонсировала кошельки (Wallets), но на данный момент пользователи могут лишь зарезервировать уникальный идентификатор (handle). Функции пополнения, платежей и виртуальных кошельков для AI-агентов пока не реализованы, их релиз запланирован на будущее. Эту новость следует рассматривать в контексте других платежных инициатив Cloudflare: Stripe Projects (открытый бета-тест, позволяет агенту оплачивать услуги с лимитом), Monetization Gateway (для приема платежей через x402) и самих Wallets. Wallets предназначены для управления идентификацией, балансом и правилами авторизации плательщика, а не являются готовой платежной сетью. Данные протокола x402 (7.5 млн транзакций на $2.4 млн за 30 дней, ~$0.32 за транзакцию) демонстрируют его активность для микроплатежей, но не отражают уровень внедрения именно кошельков Cloudflare, так как x402 — это открытый стандарт. Пример Cloudflare с оплатой вызова API в $0.01 через MCP-сервер иллюстрирует идею микроплатежей, но текущая реализация для разработчиков требует от них хранения приватных ключей и использования тестовых сетей. Планируемые функции Wallets, такие как разделение кошельков для учетной записи и агентов, лимиты и белые списки, пока недоступны для настройки. Таким образом, анонс представляет собой скорее декларацию о намерениях и первый шаг — регистрацию идентификаторов. Ключевые вопросы — поддержка стейблкоинов и блокчейнов, KYC, тарифы и детали реализации — остаются без ответа. Основной акцент сделан на создании безопасной инфраструктуры для автоматических платежей AI-агентов в будущем.

marsbit32 мин. назад

Объясняем Cloudflare Wallet: новый игрок в стабильных платежах с использованием x402

marsbit32 мин. назад

TradeXYZ и Hyperliquid: раскрытие симбиотических отношений при разделе 50%

Рынок сохраняет осторожность: инвестиции в ИИ поощряются только при условии роста без ущерба для денежных потоков. В криптосфере давление оказывают отток средств из ETF и рост доходности гособлигаций. Внутри крипторынка лидерство перешло к Solana и DEX. Solana выросла на 8,5%, во многом благодаря токену META, а сектор DEX — на 5,2%, чему способствовал рост Uniswap. Ключевой темой стала дискуссия вокруг TradeXYZ и Hyperliquid. TradeXYZ, независимая команда, построившая на Hyperliquid рынок RWA-активов, который теперь составляет более 50% объема торгов Hyperliquid. По условиям HIP-3, TradeXYZ обязана направлять 50% своих доходов от комиссий Hyperliquid, оставляя половину себе. Возникают опасения, что высокий процент отчислений может подтолкнуть TradeXYZ к уходу с платформы. Однако анализ показывает симбиотические отношения: Hyperliquid предоставляет инфраструктуру, пользователей и обеспечение, а TradeXYZ — исполнение и инновации. Уход был бы равносилен репутационному и экономическому самоубийству для обеих сторон. Hyperliquid также монетизирует себя через приоритетные сборы за запись, плату за чтение от маркет-мейкеров и увеличение поставок стейблкоинов (например, USDC), что приносит значительный доход. Таким образом, главный вопрос — не в разделе доходов 50/50, а в том, как обе стороны перейдут от модели агрессивного роста к более стабильной и прибыльной основе с более высокими комиссиями.

marsbit47 мин. назад

TradeXYZ и Hyperliquid: раскрытие симбиотических отношений при разделе 50%

marsbit47 мин. назад

Отчет: DeepSeek возобновил привлечение финансирования, оценка перед инвестированием составила 500 миллиардов юаней

Несколько источников сообщают, что компания DeepSeek, разработчик больших языковых моделей, возобновила переговоры по второму раунду финансирования. Целевой сбор составляет 50 млрд юаней, а предварительная оценка компании перед инвестициями достигла примерно 500 млрд юаней. Планируется завершить сделки к концу августа. В июне этого года DeepSeek успешно закрыла первый раунд, привлекший 50 млрд юаней при оценке свыше 350 млрд юаней. Второй раунд был временно приостановлен в конце июля, но теперь переговоры возобновились, хотя и проходят более сдержанно. Ожидается, что в двух раундах компания привлечет более 100 млрд юаней. Конкуренция на рынке ИИ-моделей ужесточается. Компания Moonshot AI (月之暗面) в конце июля завершила раунд финансирования с оценкой около 210 млрд юаней и готовится к Pre-IPO раунду. Успех финансирования тесно связан с выходом новых моделей. DeepSeek недавно выпустила официальную тестовую версию DeepSeek-V4-Flash, которая демонстрирует высокую производительность при низкой стоимости, укрепив свою конкурентоспособность. Согласно данным платформы OpenRouter, эта модель в настоящее время лидирует по объему потребляемых токенов.

marsbit1 ч. назад

Отчет: DeepSeek возобновил привлечение финансирования, оценка перед инвестированием составила 500 миллиардов юаней

marsbit1 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片