Anthropic данные: почти половина вызовов AI Agent приходится на разработку ПО, эти 16 вертикалей остаются голубым океаном

marsbitОпубликовано 2026-02-24Обновлено 2026-02-24

Введение

Новое исследование Anthropic показывает, что почти 50% вызовов инструментов AI Agent приходится на разработку программного обеспечения, в то время как 16 других вертикалей, включая здравоохранение, юриспруденцию и образование, составляют менее 5% каждая. Это указывает на огромный потенциал для создания вертикальных ИИ-решений. Ключевой вывод: модели ИИ способны работать автономно до 5 часов, но пользователи в среднем используют их только 42 минуты. Этот «дефицит доверия» представляет собой возможность для новых продуктов. Опытные пользователи чаще вмешиваются в работу агентов, переходя от предварительного одобрения к активному мониторингу. Trust растёт со временем: новые пользователи автоматически одобряют 20% сессий, а после 750 сессий — более 40%. Исследование подчёркивает, что автономность агентов формируется совместно моделью, пользователем и продуктом, а не является固有ным свойством. Регуляторные требования, обязывающие одобрять каждое действие, снижают продуктивность без повышения безопасности. Вертикальные ИИ-единороги будущего будут построены на глубоких отраслевых знаниях, интеграции с проприетарными данными и управлении изменениями на стороне клиента.

Автор: Garry's List

Компиляция: Deep Tide TechFlow

Введение от Deep Tide: Anthropic недавно опубликовала самое полное на сегодня исследование реального использования AI Agent. Ключевые данные: разработка программного обеспечения занимает почти 50% вызовов инструментов Agent, в то время как медицина, юриспруденция, образование и другие 16 вертикальных областей вместе составляют меньше половины оставшегося, причём доля каждой области не превышает 5%.

Это не сигнал о насыщении рынка, а карта для 300 вертикальных AI-единорогов — что ещё более ценно, в статье приводится контр интуитивное открытие: модель уже может работать автономно почти 5 часов, но пользователи на самом деле позволяют ей работать только 42 минуты. Этот "дефицит доверия" сам по себе является следующей продуктовой возможностью.

Полный текст ниже:

Разработка программного обеспечения составляет почти 50% всех вызовов инструментов AI Agent. Медицина, юриспруденция, финансы и другие 16 вертикальных областей практически не затронуты, каждая из них менее 5%. Это означает, что ждут своего создания 300 вертикальных AI-единорогов.

Если бы я сегодня начинал бизнес, я бы смотрел на красную область на той гистограмме выше, пока не увидел бы своё будущее.

Основатель Box Аарон Леви сказал:

Эта диаграмма — хорошее напоминание о том, насколько велики возможности в сфере AI Agent прямо сейчас.

Конечно, будет много горизонтальных возможностей для Agent, но также много рабочих процессов требуют глубоких предметных знаний, чтобы действительно помочь пользователям автоматизировать уникальные процессы в их вертикали.

Шаблон таков: создавайте Agent-программное обеспечение с доступом к проприетарным данным, чтобы эффективно связывать пользователей и Agent для обработки рабочих процессов, обладающее возможностями глубокого контекстного инжиниринга для конкретной области, а также способностью推动 управление изменениями на стороне клиента.

В настоящее время во многих областях всё ещё существуют огромные пробелы.

Разработка программного обеспечения занимает половину всей активности AI Agent. Другая половина распределена по 16 вертикальным областям, ни одна из которых не превышает 9%. Медицина — 1%, юриспруденция — 0.9%, образование — 1.8%. Это не насыщенные рынки, это рынки, которых почти не существует.

Anthropic только что опубликовала самое полное на сегодня исследование реального использования AI Agent. Ключевое открытие: разработка ПО составляет 49.7% вызовов инструментов Agent через их API. Заключение, похороненное глубже: всё остальное — это голубой океан.

Отставание во внедрении

Есть одна цифра, которая должна волновать предпринимателей: возможности модели уже далеко превосходят границы того, чему пользователи готовы ей доверять.

Оценка возможностей METR показывает, что Claude может решать задачи, на которые человеку потребовалось бы почти пять часов. Но при реальном использовании длительность сессии на 99.9-м процентиле составляет всего около 42 минут. Этот разрыв — между тем, что ИИ может делать, и тем, что мы ему позволяем — это огромная возможность.

Рис.: Максимальная продолжительность обучения Claude Code почти удвоилась за три месяца. Это повысило не только возможности, но и доверие.

Источник:x.com

С октября 2025 года по январь 2026 года длительность одной сессии на 99.9-м процентиле почти удвоилась — с менее чем 25 минут до более чем 45 минут. Рост был стабильным across всех версий моделей. Это не только то, что модели стали сильнее, но и то, что пользователи раз за разом учились в процессе использования, постепенно расширяя доверие к Agent.

"С августа по декабрь показатель успешности Claude Code в самых сложных задачах внутренних пользователей удвоился, в то же время количество человеческих вмешательств за сессию сократилось с 5.4 до 3.3."

Возможности уже есть, внедрение ещё не поспевает. Это не проблема, а продуктовая возможность.

Как эволюционирует доверие

Среди новых пользователей 20% автоматически одобряют действия Claude Code. К 750-й сессии более 40% сессий работают в режиме полного автоматического одобрения. Но есть контр интуитивное открытие: опытные пользователи, наоборот, чаще вмешиваются, а не реже. Новые пользователи вмешиваются в 5% раундов, старые — в 9%.

Рис.: Доверие — это навык, который накапливается. Новые пользователи автоматически одобряют 20% сессий. К 750 сессиям эта доля превышает 40%.

Изображение: Anthropic

Источник: x.com

Это не противоречие, а смена стратегии надзора. Новички поэтапно утверждают действия до их выполнения, опытные пользователи сначала授权 (дают разрешение), а затем вмешиваются в случае проблем — они перешли от предварительного утверждения к активному мониторингу.

Вот открытие, на которое стоит обратить внимание на уровне безопасности: в сложных задачах Claude Code主动 запрашивает разъяснения более чем в два раза чаще, чем люди主动 вмешиваются. Agent приостанавливается для подтверждения, а не мчится до конца. Это особенность, а не дефект.

"Ключевой вывод этого исследования: автономия, которую Agent осуществляет на практике, строится совместно моделью, пользователем и продуктом. Claude останавливается и задаёт вопросы, когда не уверен, тем самым ограничивая свою самостоятельность. Пользователи строят доверие в процессе collaboration с моделью и соответствующим образом调整 свою стратегию надзора."

Подход Леви к вертикальному ИИ

Аарон Леви указал на огромное богатство и ценность, которые ждут своего раскрытия: создавайте Agent-ПО с доступом к проприетарным данным, чтобы оно действительно решало реальных людей и проблемы, наполняйте его контекстом для максимизации интеллектуального вывода, и — это та часть, которую упускает большинство предпринимателей —推动 управление изменениями на стороне клиента.

Именно последнее делает вертикальный ИИ таким трудным для复制рования. Любой может сделать API-обёртку, но немногие могут真正驾驭特有的 рабочие процессы, регуляторные ограничения и организационное сопротивление, присущие, например, медицинским счетам, юридическому обнаружению или утверждению строительных разрешений.

SaaS за последние десятилетия рос в десять раз каждые десять лет. За последние 20 лет более 40% венчурных инвестиций пошло в SaaS-компании. В этой индустрии родилось более 170 SaaS-единорогов. Логика проста: у каждого из этих единорогов ждёт своего появления версия для вертикального ИИ. И ИИ-версия может быть в десять раз больше, потому что она заменяет не только software, но и операторов.

Сущность совместного построения

Ключевое открытие Anthropic заслуживает пристального внимания всех, кто участвует в разработке политики ИИ. Автономия — это не inherent свойство модели, а нечто, совместно构建ляемое моделью, пользователем и продуктом. Оценки до внедрения не могут это уловить,你必须 измерять это в реальном использовании.

Официальное заявление Anthropic:

Разработка программного обеспечения составляет около 50% вызовов инструментов Agent через наш API, но мы также видим, как появляются другие отрасли. По мере того как границы риска и автономии продолжают расширяться, мониторинг после развёртывания становится критически важным. Мы призываем других разработчиков моделей расширить это исследование.

Цифры на уровне безопасности обнадёживают: 73% вызовов инструментов имеют человека в цикле, и только 0.8% операций являются необратимыми. Сценарии развёртывания с наивысшим риском — такие как утечка API-ключей или автономные крипто-транзакции — в основном являются оценками безопасности, а не реальными production-средами.

"Нормативные требования, предписывающие конкретные模式 взаимодействия — например, требующие человеческого одобрения каждого操作 — будут создавать трение, не обязательно принося выгоды для безопасности."

Политики, принуждающие к "одобрению каждого действия", убьют выгоды для производительности, не увеличив безопасность. Лучшая цель — обеспечить, чтобы человек мог监控 и вмешиваться, а не предписывать конкретные рабочие процессы утверждения.

Где прячутся единороги

Карта нарисована. Разработкой программного обеспечения уже занимаются. Медицина, юриспруденция, финансы, образование, поддержка клиентов, логистика — 16 вертикальных областей, доля каждой на рынке выражается однозначными числами — все ждут, когда кто-то真正 внедрит предметные знания в Agent.

Ранее родилось 300 SaaS-единорогов, следующие 300 вертикальных AI-единорогов вот-вот появятся. Основатели, которые выберут вертикаль, внедрят предметные знания в Agent и поймут, как驱动 управление изменениями, будут владеть рынком корпоративного программного обеспечения следующего десятилетия.

Модель уже может работать пять часов, пользователи позволяют ей работать только 42 минуты. Это и есть сигнал: мы всё ещё находимся на самом раннем этапе, ещё многое можно построить, и в бесчисленных местах, которые ещё не видели и минуты работы интеллекта.

Связанные с этим вопросы

QКакой процент вызовов инструментов AI Agent приходится на сферу программной инженерии по данным Anthropic?

AСогласно исследованию Anthropic, на сферу программной инженерии приходится почти 50% (49,7%) всех вызовов инструментов AI Agent.

QСколько вертикальных областей, по данным статьи, остаются практически незатронутыми и имеют долю менее 5% каждая?

AСтатья упоминает 16 вертикальных областей, таких как здравоохранение, право, образование и другие, каждая из которых имеет долю менее 5% в общем объёме вызовов инструментов AI Agent.

QКаков разрыв между потенциальными возможностями модели Claude и её фактическим использованием по времени?

AМодель Claude способна решать задачи, на которые человеку потребовалось бы почти 5 часов, но на практике 99,9-й процентиль сессий длится всего около 42 минут. Это указывает на значительный разрыв между возможностями ИИ и уровнем доверия пользователей.

QКак меняется поведение пользователей по мере накопления опыта работы с AI Agent?

AНовые пользователи автоматически одобряют 20% сессий, а после 750 сессий более 40% сессий выполняются в режиме автоматического одобрения. Однако опытные пользователи чаще вмешиваются (9% шагов против 5% у новичков), переходя от предварительного одобрения к активному мониторингу.

QКакую стратегию для вертикального ИИ предлагает Аарон Леви, сооснователь Box?

AАарон Леви предлагает создавать агентское ПО, интегрированное с проприетарными данными, которое эффективно автоматизирует уникальные workflows в вертикальных областях, обладает глубокими domain-специфичными контекстными инженерными возможностями и способностью управлять изменениями на стороне клиента.

Похожее

Эксплойт Coldcard вызывает исход биткойнов, «бычья» консолидация крипторынка: Дайджест Ходлера, 2 августа

После утечки средств из кошельков Coldcard на сумму около $90 млн в биткойнах, мелкие держатели стали активно переводить средства на централизованные биржи. Объём переводов менее 1 BTC достиг максимума с 2022 года. По данным Galaxy Research, в результате трёх волн атак было скомпрометировано более 4500 адресов. Эксплойт использовал уязвимость в процессе генерации сида кошелька. В США обсуждение "Закона о ясности" (Clarity Act) зашло в тупик из-за разногласий по этическим нормам для политиков и регулированию стейблкоинов. Вероятность принятия закона до истечения срока крайне мала. Отчётность компаний за второй квартал показала снижение доходов: Coinbase сообщила о чистых убытках, а доход Robinhood от криптовалютных операций упал на 38%. При этом аналитик ARK Invest заявил, что индустрия вступает в фазу крупнейшей консолидации, что, по его мнению, является бычьим сигналом. Чемпионат мира по футболу 2026 года принёс $20 млрд объёма на блокчейн-рынках прогнозов. За неделю Bitcoin и Ether потеряли около 3% стоимости. Среди альткоинов лучше всего себя показали Cardano (ADA) и Uniswap (UNI). Аналитики Grayscale предположили, что дно рынка Bitcoin, возможно, уже достигнуто раньше традиционного четырёхлетнего цикла. В разделе FUD: основатель Telegram Павел Дуров объявлен в розыск в России, платформа Pump.fun уволила сотрудников перед получением ими токенов на миллионы долларов, а сотрудник Белого дома покинул пост на фоне обвинений в использовании инсайдерской информации для ставок на прогнозных рынках.

cointelegraph3 мин. назад

Эксплойт Coldcard вызывает исход биткойнов, «бычья» консолидация крипторынка: Дайджест Ходлера, 2 августа

cointelegraph3 мин. назад

ПОСЛЕДНИЕ НОВОСТИ: Дональд Трамп сделал резкое заявление по поводу Ирана! Он остановил атаки

Президент США Дональд Трамп заявил о приостановке запланированных масштабных военных действий против Ирана. Это решение было принято после обращения к нему Саудовской Аравии, ОАЭ, Катара и самого Ирана с просьбой предоставить время для дипломатических переговоров. Союзники в регионе полагают, что соглашение близко. Первоначальный этап переговоров будет сосредоточен на вопросах безопасности и возобновлении нормальной работы Ормузского пролива — ключевого маршрута для мировой нефтеторговли, чья безопасность критически важна для глобальных цен на энергоносители. После решения этих вопросов планируется начать переговоры по иранской ядерной программе. Новый раунд переговоров с Ираном начнётся завтра. В своём выступлении Трамп также коснулся темы валютного рынка, заявив, что США вмешались в поддержку японской иены, подчеркнув крепкие союзнические и взаимовыгодные экономические отношения с Японией.

cryptonews.ru1 ч. назад

ПОСЛЕДНИЕ НОВОСТИ: Дональд Трамп сделал резкое заявление по поводу Ирана! Он остановил атаки

cryptonews.ru1 ч. назад

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

Исследование Банка Италии показало, что стейблкоины (на примере USDC) не демонстрируют устойчивых системных преимуществ в стоимости и скорости международных денежных переводов по сравнению с традиционными сервисами. Анализ транзакций на 200 USDC в 10 платежных коридорах (Италия — Бразилия, Аргентина, Япония, ОАЭ, ЮАР и др.) выявил, что финальная стоимость переводов варьировалась от 0,3% до почти 9%. Сроки исполнения колебались от менее 20 минут в коридорах с инфраструктурой мгновенных платежей до 1-2 рабочих дней в ее отсутствие. Ключевые издержки и задержки связаны не с комиссиями блокчейна, а с процессами конвертации в фиатные валюты и работой локальных платежных систем. Хотя в большинстве изучных направлений стоимость переводов со стейблкоинами была ниже среднемирового показателя в 6,65%, по сравнению с сервисом Wise преимущество наблюдалось только в трех из семи сопоставимых случаев. Авторы отмечают, что преимущества стейблкоинов могли бы быть более заметны, если бы их можно было напрямую тратить без конвертации. Также подчеркивается, что запретительное регулирование не устраняет спрос на стейблкоины, а излишне жесткие правила лишь усложняют их использование для розничных клиентов. В контексте исследования упоминается значительное снижение общей капитализации рынка стейблкоинов в июле.

cryptonews.ru2 ч. назад

Банк Италии не увидел системных преимуществ стейблкоинов в переводах

cryptonews.ru2 ч. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

Исполнительный председатель MicroStrategy Майкл Сэйлор 2 августа опубликовал сообщение «Bitcoin Drive engaged», что вызвало спекуляции о новой покупке биткойнов компанией. Его отчет показал, что резерв MicroStrategy составляет 843 775 BTC стоимостью около $53,25 млрд, со средней себестоимостью $75 653 и нереализованным убытком в $10,58 млрд. Ранее аналогичный сигнал предшествовал объявлению о пополнении долларового резерва. В то же время, реестр компании отразил две недавние продажи на общую сумму 3 588 BTC, сократив запасы. Эти продажи, согласно документам SEC, были проведены для финансирования выплат по привилегированным акциям. Неделей ранее компания не покупала биткойны, увеличив свой долларовый резерв примерно до $3,75 млрд. Финансовые риски остаются высокими после отчетности об операционном убытке в $8,33 млрд за второй квартал 2026 года. Ожидается, что обновление данных в понедельник покажет, означает ли сообщение Сэйлора возврат к накоплению биткойнов, поскольку компания балансирует между своими крупными запасами криптовалюты и растущими денежными обязательствами.

cryptonews.ru2 ч. назад

«Биткойн-бум» в разгаре: новое заявление Сэйлора вызвало спекуляции о покупках

cryptonews.ru2 ч. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

Несмотря на медленное снижение в начале августа, на графике биткоина формируется перевёрнутая разворотная модель «голова и плечи». Цена $BTC колеблется около $63,200, формируя правое плечо, что является основным поводом для краткосрочного оптимизма. Ключевой вопрос — хватит ли покупателям сил для рывка к уровню $67,200 для подтверждения разворота. В то же время в паре ETH/BTC уже пробито разворотное дно. Ethereum демонстрирует относительную силу, закрепился в восходящем тренде и движется к цели 0,0312, а против доллара тестирует уровень $1875, открывая путь к $2163. Эта ротация капитала в пользу ETH лишает биткоин объёма, необходимого для быстрого роста. Таким образом, ситуация для биткоина остаётся напряжённой: либо он в ближайшие дни последует примеру Ethereum и осуществит быстрый рост выше $67,200, либо, если атака на «шею» паттерна не состоится, медведи возьмут контроль и отправят цену к уровням поддержки $60,000 и $58,000.

cryptonews.ru2 ч. назад

Паттерн на графике биткоина «голоса и плечи» сулит подъём к $67,200

cryptonews.ru2 ч. назад

Торговля

Спот
活动图片