Anthropic данные: почти половина вызовов AI Agent приходится на разработку ПО, эти 16 вертикалей остаются голубым океаном

marsbitОпубликовано 2026-02-24Обновлено 2026-02-24

Введение

Новое исследование Anthropic показывает, что почти 50% вызовов инструментов AI Agent приходится на разработку программного обеспечения, в то время как 16 других вертикалей, включая здравоохранение, юриспруденцию и образование, составляют менее 5% каждая. Это указывает на огромный потенциал для создания вертикальных ИИ-решений. Ключевой вывод: модели ИИ способны работать автономно до 5 часов, но пользователи в среднем используют их только 42 минуты. Этот «дефицит доверия» представляет собой возможность для новых продуктов. Опытные пользователи чаще вмешиваются в работу агентов, переходя от предварительного одобрения к активному мониторингу. Trust растёт со временем: новые пользователи автоматически одобряют 20% сессий, а после 750 сессий — более 40%. Исследование подчёркивает, что автономность агентов формируется совместно моделью, пользователем и продуктом, а не является固有ным свойством. Регуляторные требования, обязывающие одобрять каждое действие, снижают продуктивность без повышения безопасности. Вертикальные ИИ-единороги будущего будут построены на глубоких отраслевых знаниях, интеграции с проприетарными данными и управлении изменениями на стороне клиента.

Автор: Garry's List

Компиляция: Deep Tide TechFlow

Введение от Deep Tide: Anthropic недавно опубликовала самое полное на сегодня исследование реального использования AI Agent. Ключевые данные: разработка программного обеспечения занимает почти 50% вызовов инструментов Agent, в то время как медицина, юриспруденция, образование и другие 16 вертикальных областей вместе составляют меньше половины оставшегося, причём доля каждой области не превышает 5%.

Это не сигнал о насыщении рынка, а карта для 300 вертикальных AI-единорогов — что ещё более ценно, в статье приводится контр интуитивное открытие: модель уже может работать автономно почти 5 часов, но пользователи на самом деле позволяют ей работать только 42 минуты. Этот "дефицит доверия" сам по себе является следующей продуктовой возможностью.

Полный текст ниже:

Разработка программного обеспечения составляет почти 50% всех вызовов инструментов AI Agent. Медицина, юриспруденция, финансы и другие 16 вертикальных областей практически не затронуты, каждая из них менее 5%. Это означает, что ждут своего создания 300 вертикальных AI-единорогов.

Если бы я сегодня начинал бизнес, я бы смотрел на красную область на той гистограмме выше, пока не увидел бы своё будущее.

Основатель Box Аарон Леви сказал:

Эта диаграмма — хорошее напоминание о том, насколько велики возможности в сфере AI Agent прямо сейчас.

Конечно, будет много горизонтальных возможностей для Agent, но также много рабочих процессов требуют глубоких предметных знаний, чтобы действительно помочь пользователям автоматизировать уникальные процессы в их вертикали.

Шаблон таков: создавайте Agent-программное обеспечение с доступом к проприетарным данным, чтобы эффективно связывать пользователей и Agent для обработки рабочих процессов, обладающее возможностями глубокого контекстного инжиниринга для конкретной области, а также способностью推动 управление изменениями на стороне клиента.

В настоящее время во многих областях всё ещё существуют огромные пробелы.

Разработка программного обеспечения занимает половину всей активности AI Agent. Другая половина распределена по 16 вертикальным областям, ни одна из которых не превышает 9%. Медицина — 1%, юриспруденция — 0.9%, образование — 1.8%. Это не насыщенные рынки, это рынки, которых почти не существует.

Anthropic только что опубликовала самое полное на сегодня исследование реального использования AI Agent. Ключевое открытие: разработка ПО составляет 49.7% вызовов инструментов Agent через их API. Заключение, похороненное глубже: всё остальное — это голубой океан.

Отставание во внедрении

Есть одна цифра, которая должна волновать предпринимателей: возможности модели уже далеко превосходят границы того, чему пользователи готовы ей доверять.

Оценка возможностей METR показывает, что Claude может решать задачи, на которые человеку потребовалось бы почти пять часов. Но при реальном использовании длительность сессии на 99.9-м процентиле составляет всего около 42 минут. Этот разрыв — между тем, что ИИ может делать, и тем, что мы ему позволяем — это огромная возможность.

Рис.: Максимальная продолжительность обучения Claude Code почти удвоилась за три месяца. Это повысило не только возможности, но и доверие.

Источник:x.com

С октября 2025 года по январь 2026 года длительность одной сессии на 99.9-м процентиле почти удвоилась — с менее чем 25 минут до более чем 45 минут. Рост был стабильным across всех версий моделей. Это не только то, что модели стали сильнее, но и то, что пользователи раз за разом учились в процессе использования, постепенно расширяя доверие к Agent.

"С августа по декабрь показатель успешности Claude Code в самых сложных задачах внутренних пользователей удвоился, в то же время количество человеческих вмешательств за сессию сократилось с 5.4 до 3.3."

Возможности уже есть, внедрение ещё не поспевает. Это не проблема, а продуктовая возможность.

Как эволюционирует доверие

Среди новых пользователей 20% автоматически одобряют действия Claude Code. К 750-й сессии более 40% сессий работают в режиме полного автоматического одобрения. Но есть контр интуитивное открытие: опытные пользователи, наоборот, чаще вмешиваются, а не реже. Новые пользователи вмешиваются в 5% раундов, старые — в 9%.

Рис.: Доверие — это навык, который накапливается. Новые пользователи автоматически одобряют 20% сессий. К 750 сессиям эта доля превышает 40%.

Изображение: Anthropic

Источник: x.com

Это не противоречие, а смена стратегии надзора. Новички поэтапно утверждают действия до их выполнения, опытные пользователи сначала授权 (дают разрешение), а затем вмешиваются в случае проблем — они перешли от предварительного утверждения к активному мониторингу.

Вот открытие, на которое стоит обратить внимание на уровне безопасности: в сложных задачах Claude Code主动 запрашивает разъяснения более чем в два раза чаще, чем люди主动 вмешиваются. Agent приостанавливается для подтверждения, а не мчится до конца. Это особенность, а не дефект.

"Ключевой вывод этого исследования: автономия, которую Agent осуществляет на практике, строится совместно моделью, пользователем и продуктом. Claude останавливается и задаёт вопросы, когда не уверен, тем самым ограничивая свою самостоятельность. Пользователи строят доверие в процессе collaboration с моделью и соответствующим образом调整 свою стратегию надзора."

Подход Леви к вертикальному ИИ

Аарон Леви указал на огромное богатство и ценность, которые ждут своего раскрытия: создавайте Agent-ПО с доступом к проприетарным данным, чтобы оно действительно решало реальных людей и проблемы, наполняйте его контекстом для максимизации интеллектуального вывода, и — это та часть, которую упускает большинство предпринимателей —推动 управление изменениями на стороне клиента.

Именно последнее делает вертикальный ИИ таким трудным для复制рования. Любой может сделать API-обёртку, но немногие могут真正驾驭特有的 рабочие процессы, регуляторные ограничения и организационное сопротивление, присущие, например, медицинским счетам, юридическому обнаружению или утверждению строительных разрешений.

SaaS за последние десятилетия рос в десять раз каждые десять лет. За последние 20 лет более 40% венчурных инвестиций пошло в SaaS-компании. В этой индустрии родилось более 170 SaaS-единорогов. Логика проста: у каждого из этих единорогов ждёт своего появления версия для вертикального ИИ. И ИИ-версия может быть в десять раз больше, потому что она заменяет не только software, но и операторов.

Сущность совместного построения

Ключевое открытие Anthropic заслуживает пристального внимания всех, кто участвует в разработке политики ИИ. Автономия — это не inherent свойство модели, а нечто, совместно构建ляемое моделью, пользователем и продуктом. Оценки до внедрения не могут это уловить,你必须 измерять это в реальном использовании.

Официальное заявление Anthropic:

Разработка программного обеспечения составляет около 50% вызовов инструментов Agent через наш API, но мы также видим, как появляются другие отрасли. По мере того как границы риска и автономии продолжают расширяться, мониторинг после развёртывания становится критически важным. Мы призываем других разработчиков моделей расширить это исследование.

Цифры на уровне безопасности обнадёживают: 73% вызовов инструментов имеют человека в цикле, и только 0.8% операций являются необратимыми. Сценарии развёртывания с наивысшим риском — такие как утечка API-ключей или автономные крипто-транзакции — в основном являются оценками безопасности, а не реальными production-средами.

"Нормативные требования, предписывающие конкретные模式 взаимодействия — например, требующие человеческого одобрения каждого操作 — будут создавать трение, не обязательно принося выгоды для безопасности."

Политики, принуждающие к "одобрению каждого действия", убьют выгоды для производительности, не увеличив безопасность. Лучшая цель — обеспечить, чтобы человек мог监控 и вмешиваться, а не предписывать конкретные рабочие процессы утверждения.

Где прячутся единороги

Карта нарисована. Разработкой программного обеспечения уже занимаются. Медицина, юриспруденция, финансы, образование, поддержка клиентов, логистика — 16 вертикальных областей, доля каждой на рынке выражается однозначными числами — все ждут, когда кто-то真正 внедрит предметные знания в Agent.

Ранее родилось 300 SaaS-единорогов, следующие 300 вертикальных AI-единорогов вот-вот появятся. Основатели, которые выберут вертикаль, внедрят предметные знания в Agent и поймут, как驱动 управление изменениями, будут владеть рынком корпоративного программного обеспечения следующего десятилетия.

Модель уже может работать пять часов, пользователи позволяют ей работать только 42 минуты. Это и есть сигнал: мы всё ещё находимся на самом раннем этапе, ещё многое можно построить, и в бесчисленных местах, которые ещё не видели и минуты работы интеллекта.

Связанные с этим вопросы

QКакой процент вызовов инструментов AI Agent приходится на сферу программной инженерии по данным Anthropic?

AСогласно исследованию Anthropic, на сферу программной инженерии приходится почти 50% (49,7%) всех вызовов инструментов AI Agent.

QСколько вертикальных областей, по данным статьи, остаются практически незатронутыми и имеют долю менее 5% каждая?

AСтатья упоминает 16 вертикальных областей, таких как здравоохранение, право, образование и другие, каждая из которых имеет долю менее 5% в общем объёме вызовов инструментов AI Agent.

QКаков разрыв между потенциальными возможностями модели Claude и её фактическим использованием по времени?

AМодель Claude способна решать задачи, на которые человеку потребовалось бы почти 5 часов, но на практике 99,9-й процентиль сессий длится всего около 42 минут. Это указывает на значительный разрыв между возможностями ИИ и уровнем доверия пользователей.

QКак меняется поведение пользователей по мере накопления опыта работы с AI Agent?

AНовые пользователи автоматически одобряют 20% сессий, а после 750 сессий более 40% сессий выполняются в режиме автоматического одобрения. Однако опытные пользователи чаще вмешиваются (9% шагов против 5% у новичков), переходя от предварительного одобрения к активному мониторингу.

QКакую стратегию для вертикального ИИ предлагает Аарон Леви, сооснователь Box?

AАарон Леви предлагает создавать агентское ПО, интегрированное с проприетарными данными, которое эффективно автоматизирует уникальные workflows в вертикальных областях, обладает глубокими domain-специфичными контекстными инженерными возможностями и способностью управлять изменениями на стороне клиента.

Похожее

Майкл Сэйлор: «Мы никогда не говорили, что никогда не будем продавать биткоины»

Председатель стратегической комиссии Майкл Сэйлор прокомментировал сообщения о новом разрешении компании Strategy на продажу биткоинов. Он заявил, что данное разрешение не является новым — оно было объявлено ещё 29 июня в рамках системы управления капиталом компании. Соглашение позволяет продавать BTC на сумму до 5 миллиардов долларов для определённых целей, но не обязывает компанию к продаже. Сэйлор подчеркнул, что Strategy никогда официально не брала на себя обязательство никогда не продавать свои биткоины, хотя и рассчитывает оставаться чистым покупателем BTC в долгосрочной перспективе. Он назвал текущие новости «старыми», переподанными как новые, и подтвердил, что программа монетизации биткоинов компании не предполагает обязательной продажи её активов.

cryptonews.ru1 ч. назад

Майкл Сэйлор: «Мы никогда не говорили, что никогда не будем продавать биткоины»

cryptonews.ru1 ч. назад

«Летняя пила» продолжается: пробой $67 000 станет началом роста биткоина

Цена биткоина продолжает консолидироваться в диапазоне $58 000–$67 000 с начала июня. 1 августа актив снизился до $62 217. Аналитики расходятся в краткосрочных прогнозах: некоторые, как Crypto Candy, ожидают тестирования уровня $60 000 или ниже, пока цена находится под $66 000. Другие, как Jelle, видят в боковом движении «летнюю пилу» и придерживаются стратегии усреднения. Ключевым для определения дальнейшего направления считается уровень $67 000. По мнению Daan Crypto Trades, его пробой необходим для выхода из затянувшейся паузы. Roman полагает, что уверенный пробой с объемом может быстро запустить рост к $70 000–$80 000 и выше. С долгосрочной точки зрения, макроаналитик Герт ван Лаген рассматривает текущую фазу как накопление в рамках масштабной формации «чаша с ручкой». Он отмечает, что долгосрочные держатели не спешат продавать актив, о чем говорит показатель NUPL. Таким образом, рынок находится в решающей фазе, где пробой либо поддержки $60 000, либо сопротивления $67 000 задаст тренд на ближайшее будущее.

cryptonews.ru1 ч. назад

«Летняя пила» продолжается: пробой $67 000 станет началом роста биткоина

cryptonews.ru1 ч. назад

На неделе с 3 по 9 августа стоит обратить внимание: Закон CLARITY, возможно, будет поставлен на голосование в Сенате; SpaceX и Circle опубликуют финансовые отчеты

**Важные события на следующей неделе (3–9 августа 2026 г.)** **Ключевые даты:** * **3 августа:** Публикация отчетов American Bitcoin за Q2. Полное закрытие сервисов DeFi-трекера Zapper и кошелька Ctrl Wallet. LayerZero прекратит поддержку ретрансляторов v1. Upbit прекратит торговлю токенами AQT и AERGO. * **4 августа:** Публикация финансовых отчетов SpaceX и Hut 8 за второй квартал 2026 года. * **5 августа:** Circle опубликует отчет за Q2. Начинается предварительное ценовое консультирование для IPO компании Unitree Tech (Ушу Цзишу) в Китае. * **6 августа:** Первая крупная разблокировка акций SpaceX — до 12% от общего капитала. * **7 августа:** Выход важных данных по рынку труда США (отчет о занятости за июль). Предельный срок для Сената США — получить 60 голосов в поддержку **Закона CLARITY** (билль о регулировании криптовалют и этике). Ожидается выпуск Grok 4.6 от xAI. * **8 августа:** Начало принудительной подачи сигналов в сети Bitcoin согласно предложению BIP-110. * **На неделе (дата уточняется):** Ожидается голосование полного состава Сената США по **Закону CLARITY**. Выход нового релиза XRP Ledger (v3.3.0) с новыми функциями, такими как конфиденциальные данные и пакетные транзакции. **Основные темы недели:** корпоративная отчетность (SpaceX, Circle), регулирование (CLARITY Act), рыночные события (разблокировка акций SpaceX, отчет по занятости в США) и обновления в технологиях блокчейна.

marsbit2 ч. назад

На неделе с 3 по 9 августа стоит обратить внимание: Закон CLARITY, возможно, будет поставлен на голосование в Сенате; SpaceX и Circle опубликуют финансовые отчеты

marsbit2 ч. назад

Акции упали сильнее, чем криптовалюты. Куда делись деньги?

Автор: Кэти,白话区块链 28-29 июля, Сеул. Индекс Kospi впервые в истории Южной Кореи два дня подряд срабатывал на приостановку торгов. Первый день: падение на 10.84%, второй день: -5.98%. SK Hynix, крупнейшая по весу акция, потеряла за два дня около 23%. Падение Nasdaq, глобальный обвал акций полупроводниковых компаний, массовые потери на кредитных ETF. За два дня откат Kospi от пика июня достиг 40%. Июль угрожает стать худшим месяцем в истории индекса. Все ранее перегретые сделки были перевернуты, как стол. Это не локальный негатив по одной акции, а глобальное принудительное снижение кредитного плеча. Самое парадоксальное: на этот раз больше всего на «криптовалютное» падение похожи именно акции. Спот: прибыль SK Hynix за второй квартал достигла рекордных 60.54 трлн вон, но из-за несоответствия прогнозу в 64.22 трлн акция подверглась жесткой распродаже. Хорошие новости не растут — это уже плохая новость. Производные инструменты пострадали еще сильнее. Кредитный ETF с плечом 2x на SK Hynix упал на 83% с пика, потеряв в стоимости более 1 трлн гонконгских долларов. Эмитент был вынужден изменить правила продукта. Неожиданно: Биткоин, известный высокой волатильностью, с 1 июля вырос почти на 15%, в то время как акции демонстрировали «криптовалютную» динамику. Это не паника всего рынка, а точечный сброс перегретых позиций. Триггеры: отчет SK Hynix и фактор Китая — крупнейшее IPO ChangXin Memory, направленное на расширение производства DRAM, создало конкуренцию для нарратива о дефиците памяти для ИИ. Дополнительное давление — нормализация политики Банка Японии и потенциальное сокращение кэрри-трейда в иенах. Эксперт Дэн Найлз считает, что это не крах логики ИИ, а «краткосрочное дно», вызванное принудительными ликвидациями мелких инвесторов и хедж-фондов. Промышленная логика не мертва — умерло кредитное плечо. Перетекли ли деньги из акций в Биткоин? Нет. «Устойчивость» Биткоина объясняется тем, что он уже прошел фазу распродаж раньше. В мае-июне американские спотовые BTC-ETF зафиксировали рекордный отток средств. К июлю продавать было уже нечего. Небольшой приток в июле — лишь частичное восстановление. Настоящие «защитные» деньги пошли в золото. Коэффициент корреляции между Биткоином и золотом упал до -0.88. Нарратив о «цифровом золоте» разбит: золото — для сохранения капитала, Биткоин — для роста. Деньги придут в криптоактивы при выполнении трех условий: смягчение глобального давления на ликвидность; снижение ставок ФРС без рецессии; принятие закона CLARITY, устраняющего регуляторные неопределенности. Пока Биткоин — не убежище, а актив, который раньше других прошел очистку. Но когда шторм утихнет и глобальный капитал снова начнет распределяться, Биткоин займет место в первых рядах очереди. Место уже зарезервировано.

marsbit2 ч. назад

Акции упали сильнее, чем криптовалюты. Куда делись деньги?

marsbit2 ч. назад

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

Источник: интервью Рэя Далио, основателя Bridgewater Associates, для подкаста "The Diary Of A CEO". Далио, предсказавший кризис 2008 года, обсуждает "большой цикл" — концепцию, охватывающую долговые проблемы, растущее неравенство и геополитические сдвиги. Он указывает, что текущий ажиотаж вокруг ИИ демонстрирует классические признаки пузыря, который может лопнуть из-за высокой долговой нагрузки, роста процентных ставок и чрезмерной эмиссии акций, что способно привести к рецессии. Для защиты личного капитала в неопределенные времена Далио советует диверсификацию: вместо хранения наличных инвестировать в акции, золото, облигации. Сам он держит около 1% портфеля в биткоине, считая его "твердыми деньгами", но предпочитает физическое золото из-за его статуса резервного актива и независимости от технологических рисков. Говоря о влиянии ИИ, Далио отмечает, что технология заменяет не только физический труд, но и элементы мышления, что увеличит разрыв между капиталом и трудом. Ключевыми останутся человеческие качества — эмоции и интуиция, а успеха добьются те, кто научится работать в партнерстве с ИИ. На геополитической арене, по его мнению, мир движется к регионализации с центрами в виде США и Китая. Вовлечение США в конфликты, подобные иранскому, обнажает снижение их абсолютного влияния. Внутренние вызовы, такие как дебаты о налогах на богатство, риск капитального бегства и низкая производительность, также ставят под вопрос стабильность традиционных держав в текущей фазе цикла.

marsbit5 ч. назад

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

marsbit5 ч. назад

Торговля

Спот
活动图片