Почему больше AI Agent не означает более высокой производительности?

marsbitОпубликовано 2026-05-31Обновлено 2026-05-31

Введение

В статье обсуждается концепция «налога на оркестрацию» — скрытой стоимости управления несколькими AI-агентами. Хотя запуск агентов стал простым и дешёвым, реальная нагрузка ложится на разработчика, который должен проверять, анализировать и интегрировать их результаты. Человеческое внимание — это «единый глобальный замок» (GIL) системы: оно не масштабируется и остаётся узким местом. Множество параллельных агентов создаёт иллюзию продуктивности, но на деле лишь увеличивает очередь задач на ревью и ведёт к перегрузке, поверхностному анализу и накоплению технического и когнитивного долга. Решение — проектировать рабочий процесс с учётом ограниченной пропускной способности человеческого внимания: запускать агентов в соответствии со скоростью их проверки, группировать задачи, разделять работу на независимые и сложные части, а также выделять время для глубокой фокусировки. Итог: истинная продуктивность определяется не количеством запущенных агентов, а способностью эффективно управлять своим вниманием как ключевым и невозобновляемым ресурсом.

Редакционное примечание: По мере того, как AI Agent становятся дешевле и их проще вызывать, разработка программного обеспечения вступает в новую фазу: проблема уже не в том, можно ли запустить больше агентов, а в том, есть ли у людей достаточно внимания, чтобы управлять ими, оценивать и объединять их результаты.

В этой статье предлагается очень наглядная концепция — «налог на оркестрацию». Запустить агента дешево, достаточно одного промпта или клика; но действительно дороги последующие этапы: проверить правильность результата, понять его влияние на архитектуру системы, разрешить конфликты между разными агентами и в итоге решить, какой код попадет в основную ветку. Эту работу нельзя просто распараллелить, она все равно возвращается к одному серийному ресурсу — человеческому суждению.

Автор сравнивает разработчика с «GIL» в системе AI Agent — тем самым блокировщиком в одном потоке, который ограничивает итоговую пропускную способность параллельной системы. Несколько агентов могут работать одновременно, но как только дело доходит до архитектурных решений, ревью кода и разрешения конфликтов, все должно снова пройти через мозг разработчика. Таким образом, больше агентов не обязательно означает больший выход продукта, это может лишь удлинить очередь задач на проверку и погрузить разработчика в более частые переключения контекста и когнитивную усталость.

Это также момент, который легко упустить в нынешнем буме инструментов для ИИ-программирования: ощущение эффективности и реальная производительность — не всегда одно и то же. Панель управления, заполненная запущенными агентами, создает иллюзию «высокой продуктивности»; но если разработчик по-настоящему не понимает, не проверяет и не интегрирует эти изменения, система в конечном итоге накопит не производительность, а технический и когнитивный долг.

Таким образом, данная статья по-настоящему обсуждает не «как использовать больше агентов», а «как перепроектировать рабочий процесс вокруг человеческого внимания». В эпоху агентов ключевая способность заключается не только в умении задавать вопросы и делегировать задачи, но и в понимании того, какие задачи можно поручить машине для параллельной обработки, а какие задачи необходимо оставить для человеческого суждения; когда следует проводить ревью пакетами, а когда стоит прекратить оркестрацию и снова сосредоточиться на одной ключевой проблеме.

ИИ расширяет возможности параллельной разработки ПО, но человеческое внимание по-прежнему остается самым дефицитным и невоспроизводимым ресурсом в системе. По-настоящему зрелый рабочий процесс с агентами заключается не в том, чтобы сбросить все задачи на машину, а в том, чтобы, как при проектировании производственной системы, тщательно проектировать архитектуру собственного внимания.

Ниже представлен оригинальный текст:

Сейчас запустить больше AI Agent стало очень просто. Но то, что больше агентов работает одновременно, не означает, что «вас» тоже стало больше. Ваша когнитивная пропускная способность не поддается распараллеливанию. Все решения, которые действительно необходимы для их направления, оценки результатов, слияния изменений, в конечном счете все равно должны пройти через один и тот же последовательный процессор — то есть вас самих.

Так называемый «налог на оркестрацию» по сути и есть та цена, которую вы платите, забывая об этом. И единственное настоящее решение — начать проектировать собственное внимание, как и любую другую параллельную систему.

Недавно я участвовал в панельной дискуссии на Google I/O вместе с Ричардом Серотером, Аджей Хаммерли и Сиерой Яспан, где мы обсуждали, как сейчас выглядит разработка ПО и как она может развиваться дальше. Под конец Ричард спросил нас: какую одну вещь разработчики, послушав нас, должны вынести для себя и изменить?

Я озвучил мысль, которая не дает мне покоя последние несколько месяцев: ощущение, что ты очень занят, отнюдь не равно реальной продуктивности. Вы можете одновременно запустить 20 агентов и чувствовать себя загруженным до предела. Но это не значит, что вы выполнили работу, соответствующую 20 агентам.

Ранее в той же дискуссии Ричард дал этой проблеме название. Он сказал: «То, о чем ты сейчас говоришь, и есть налог на оркестрацию. Тебе не удастся успешно управлять 20 агентами в своей голове».

Он был абсолютно прав. Я хочу разобрать эту концепцию более полно, потому что это не вопрос самодисциплины, а вопрос архитектуры.

Тогда в ходе панели я почти мимоходом бросил фразу, которая с тех пор не выходит у меня из головы: запуск нескольких агентов не означает, что в мире стало больше вас.

Асимметрия, которую не учитывают

В рабочем процессе с агентами существует скрытая асимметрия.

Запустить агента очень дешево. Достаточно одного нажатия клавиши или одного промпта. Но завершить цикл работы агента совсем не дешево. Кто-то должен проверить, правильный ли результат он вернул, и согласовать его с изменениями, внесенными другими агентами.

Этот кто-то — вы. И вас всего один.

В прошлом месяце я частично затрагивал эту проблему в статье «Ваш предел параллельных агентов», в основном обсуждая тревогу окружения: вы не знаете, какая из параллельных нитей тихо терпит неудачу. Эта же статья хочет поговорить о структуре, лежащей в основе этих затрат.

Когда вы начинаете рассматривать разработку с агентами как параллельную систему, вы понимаете, что человек сам является лишь компонентом этой системы. Очень медленным последовательным компонентом.

Вы — тот самый ресурс в одном потоке

Если вы писали параллельный код, у вас уже есть интуиция для понимания этой проблемы. Просто раньше вы применяли эту интуицию не там.

В Python есть глобальная блокировка интерпретатора, или GIL. Вы можете создать сколько угодно потоков, но в любой момент времени только один поток может выполнять байт-код Python, потому что все они должны сначала захватить эту блокировку.

Вы — GIL для ваших AI Agent.

Они все могут работать одновременно. Но как только их работа требует настоящего понимания архитектуры системы или разрешения конфликтов слияния, она должна сначала захватить эту блокировку. А эта блокировка всего одна, и она у вас.

Закон Амдала очень точно это описывает: предел ускорения от распараллеливания зависит от той части работы, которую все равно необходимо выполнять последовательно. Если в вашем процессе есть значительная часть, которую нельзя распараллелить, то сколько бы ядер вы ни добавили, вы в итоге упретесь в жесткий потолок.

В разработке с агентами эта последовательная часть — суждение.

Запуск 8 агентов не ускорит время вашего принятия решений. Он только удлинит очередь задач, ожидающих вашей обработки.

Это очень старый факт из инженерии производительности, но многих он по-прежнему удивляет: оптимизация части, не являющейся узким местом, не повысит общую пропускную способность. Вы лишь накапливаете больше незавершенной работы перед узким местом.

Добавление агентов оптимизирует ту часть, которая изначально не была ограничением. Настоящее ограничение — этап ревью, и пропускная способность всей системы в точности равна пропускной способности этого этапа.

Налог на оркестрацию — это структурный разрыв между производственной мощностью агентов и тем, что вы реально можете слить воедино. Он возникает, когда вы заставляете ресурс в одном потоке управлять параллельной системой.

Упорством структурный потолок не преодолеть

В той панельной дискуссии я сказал: никогда еще мои инструменты не казались мне такими эффективными, но и никогда еще я не чувствовал себя таким измотанным.

Оба эти чувства абсолютно реальны, и они происходят из одной и той же причины.

У этой усталости есть очень конкретный источник: это ощущение, когда последовательный процессор постоянно загружен на 100% без какого-либо запаса.

Каждый раз, когда вы возвращаетесь к агенту, вышедшему из поля вашего внимания, вы платите стоимость переключения контекста. Вы должны очистить сознание, а затем с нуля перезагрузить другой контекст.

ЦП может сделать это за микросекунды, и даже тогда архитекторы стараются избегать частых переключений. Вам же на это требуются минуты, и контекст никогда не восстановить идеально.

5 агентов — это не 5-кратное повторение одного объема работы. Это 5 холодных запусков с перезагрузкой контекста плюс постоянно работающий в фоне мыслительный процесс, который беспокоится, какого же агента вам сейчас стоит проверить.

Вы не можете преодолеть структурное ограничение, просто «работая усерднее». Этот налог всегда придется платить.

Если вы попытаетесь упорствовать, он в конечном итоге проявится в другой форме: либо ревью кода станет все более поверхностным, либо вы войдете в состояние «когнитивной капитуляции» — потому что формирование собственного суждения слишком истощает внимание, и вы просто принимаете код, написанный агентом.

Вы либо платите этот налог осознанно, либо позволяете ему незаметно разрушать ваше понимание собственной системы.

Проектируйте свое внимание как систему

Поэтому вы должны относиться к своему вниманию как к дефицитному последовательному ресурсу.

Вы же не стали бы проектировать распределенную систему, совершенно не думая об узких местах. Так проявите такое же уважение к своему мозгу.

Вот несколько методов, которые реально работают для меня:

Расширяйте команду агентов в соответствии со способностью к ревью, а не с возможностями интерфейса.

Хорошая параллельная система использует механизм обратного давления, чтобы избежать бесконечного роста очереди. Производители должны замедлиться, чтобы соответствовать пропускной способности потребителя.

Количество ваших агентов — это производители, ваша способность к ревью — потребитель. Правильное количество параллельных агентов — это то количество, результаты которого вы можете качественно проверить. Для большинства людей это обычно очень небольшое однозначное число.

Инструменты ИИ, конечно, с радостью позволят вам запустить 20 агентов, но это всего лишь функция интерфейса, не означающая, что вы действительно способны ими управлять.

Классифицируйте задачи.

Когда Ричард спросил меня, как я с этим справляюсь, я упомянул этот метод. Я делю задачи на две кучки.

Первая — относительно независимая работа, которую я готов поручить агенту, работающему в фоновом режиме в облаке. Эти задачи могут выполняться асинхронно и обычно требуют от меня лишь финальной проверки.

Вторая — сложные задачи, где самой работой является принятие решения. Например, странный баг или проектирование архитектуры.

Самая большая ошибка — пытаться распараллелить и задачи второго типа. Параллельная обработка нескольких сложных задач не увеличит ваш выход, а лишь вызовет постоянную борьбу за ту самую блокировку, и в итоге все результаты ухудшатся.

Пакетное ревью.

Каждое переключение контекста обходится вам дорого. Сесть и проверить результаты 4 агентов за один раз намного дешевле, чем проверить одного, заняться другим делом, а затем «холодно» вернуться к проверке следующего.

Давайте агентам более длинный поводок. Пусть работа немного накопится, а затем обрабатывайте ее пакетами.

Используйте эту блокировку только для принятия решений.

Не тратьте свой мозг на то, что машина может проверить сама. Пусть агенты пишут проходящие тесты или генерируют скриншоты.

Пусть они сами докажут те 80% скучной, но проверяемой части. Тогда ваше дефицитное внимание потребуется лишь для тех 20%, которые действительно требуют человеческого суждения.

Защищайте свое последовательное время.

Узкому месту нужно ваше лучшее время, а не обрывки, оставшиеся между проверками агентов.

Иногда самым высокоэффективным действием оказывается полная остановка оркестрации: выключить компьютер, забитый агентами, и сосредоточиться только на одной проблеме, надежно удерживая блокировку на всем протяжении процесса.

Оркестрация — это не настоящая работа. Это лишь накладные расходы вокруг работы.

Аджа отметила, что способность к архитектуре теперь стала самым насущным навыком: нужно понимать, какую задачу можно доверить агенту, а какая для него слишком велика.

Я хотел бы добавить: вы сами — компонент этой системы. У вашего внимания есть известная, очень низкая последовательная пропускная способность. Система либо будет уважать эту цифру, либо обойдет ее, незаметно снизив ваши стандарты.

Занятость не равна продуктивности

Это чрезвычайно важно, потому что такой сценарий неудачи для вас самих практически невидим.

20 запущенных агентов создают ощущение «взрыва продуктивности». Панель управления забита, все движется. Но это ощущение уже оторвано от реального слияния качественного кода в основную ветку.

Вы можете быть загружены до предела, почти ничего реально не производя. Изнутри эти два состояния ощущаются почти одинаково.

Сиера упомянула исследование Маргарет-Энн Стори о долгах. Мы говорили и о техническом долге, и о когнитивном долге.

Налог на оркестрацию, который вы не заплатили, заставит вас накапливать оба этих долга одновременно.

Вы сливаете то, что не прочитали внимательно. Ваша ментальная модель кодовой базы безнадежно устарела. Эти проблемы не появятся сегодня на панели управления. Они проявятся, когда в продакшене случится сбой — и вы, глядя на систему, внезапно осознаете, что уже не понимаете, как она на самом деле работает.

Итак, настоящий вывод таков: запустить агента — не умение. Любой может запустить 20.

Настоящее умение — спроектировать систему вокруг того ресурса, который нельзя клонировать и нельзя распараллелить.

Этот ресурс — ваше внимание.

Проектируйте его, как проектировали бы любой критически важный компонент в производственной среде.

Трендовые криптовалюты

Связанные с этим вопросы

QЧто такое «налог на оркестрацию» в контексте использования AI Agent?

A«Налог на оркестрацию» — это концепция, обозначающая скрытые затраты человеческого внимания и суждений, возникающие при управлении несколькими AI Agent. Хотя запуск агентов обходится дешево, проверка их результатов, разрешение конфликтов и принятие решений о слиянии кода требуют последовательной обработки человеком, который выступает «узким местом» системы.

QПочему увеличение количества AI Agent не всегда приводит к росту производительности?

AУвеличение количества AI Agent не ведёт к росту производительности, потому что человеческое внимание и способность к суждению являются последовательными и не могут быть распараллелены. Даже если множество агентов работают одновременно, все их результаты должны быть проверены и интегрированы одним человеком, что создаёт очередь задач и вызывает когнитивную усталость, не увеличивая итоговую пропускную способность системы.

QКак автор предлагает управлять вниманием при работе с AI Agent?

AАвтор предлагает относиться к собственному вниманию как к дефицитному последовательному ресурсу и проектировать рабочий процесс вокруг него. Это включает: увеличение числа агентов только в соответствии со способностью их проверять, классификацию задач, пакетный обзор результатов, автоматизацию проверяемых машиной аспектов и защиту непрерывного времени для глубокой работы, требующей суждений.

QКакую аналогию использует автор для объяснения роли человека в системе с AI Agent?

AАвтор использует аналогию с Global Interpreter Lock (GIL) в Python. Человек сравнивается с GIL — единым блокирующим ресурсом («замком»), который необходим для выполнения критических операций, таких как архитектурные решения или слияние кода. Множество агентов могут работать параллельно, но для этапов, требующих человеческого суждения, они должны «получить этот замок», то есть дождаться внимания разработчика.

QКакие риски возникают при игнорировании «налога на оркестрацию»?

AИгнорирование «налога на оркестрацию» приводит к накоплению технического и когнитивного долга. Разработчик, перегруженный проверкой, начинает поверхностно ревьюить код или слепо принимать результаты агентов, что ухудшает понимание системы и качество кода. В долгосрочной перспективе это проявляется в сбоях в производственной среде, когда система становится непонятной и неуправляемой для своего создателя.

Похожее

Matrixdock два года подряд проходит независимую проверку резервов, продолжая совершенствовать систему прозрачности резервов

Недавно платформа токенизации RWA Matrixdock, входящая в состав BIT (бывший Matrixport), завершила свой четвертый последовательный полугодовой независимый аудит резервов. Проверку, как и в прошлый раз, провела международная инспекционно-сертификационная компания Bureau Veritas, расширив аудиторский охват, включив в него продукт токенизированного серебра XAGm. Этот аудит подтверждает соответствие физических запасов золота и серебра, лежащих в основе XAUm и XAGm, данным в записях. Проверка охватила 574 слитка из аффинажных заводов, сертифицированных LBMA, хранящихся в трех институциональных хранилищах: Malca-Amit Singapore, Brink's Hong Kong и Brink's Singapore. По состоянию на дату аудита резервы XAUm (16 331,179 унций золота) и XAGm (65 934 унции серебра) полностью соответствовали количеству токенов в обращении. Matrixdock проводит независимую проверку резервов дважды в год в течение двух лет подряд с помощью одного и того же аудитора, что создает стабильную и последовательную систему. Компания называет этот подход «резервной прозрачностью» (Reserve Transparency Stack). Помимо регулярных аудитов, платформа ежемесячно публикует отчеты о резервах, предоставляет доказательства резервов в блокчейне (Proof of Reserves) и инструмент для проверки привязки токенов к конкретным слиткам (Gold Allocation Lookup). Такая постоянная проверяемость базовых активов формирует основу для интеграции токенизированных активов в более широкие финансовые сценарии, такие как управление капиталом и кредитование. Непрерывная верификация становится ключевым элементом инфраструктуры цепочки поставок в цифровых финансах.

marsbit1 мин. назад

Matrixdock два года подряд проходит независимую проверку резервов, продолжая совершенствовать систему прозрачности резервов

marsbit1 мин. назад

Hyperliquid открывает развертывание рынков предсказаний: стейкинг токенов HYPE на $30 млн с возможностью получать до 50% комиссий

Hyperliquid открывает развертывание прогнозных рынков для всех: стейкинг на $30 млн в токенах HYPE с возможностью получения до 50% комиссий. После обновления HIP-4, которое ввело на платформе функции торговли на исход событий, Hyperliquid планирует позволить любому пользователю запускать собственные прогнозные рынки. В настоящее время такие рынки контролируются валидаторами, но в будущем их количество сократится до менее 10 в год, а остальные станут общедоступными. Для запуска рынка необходимо застейкать 500 000 токенов HYPE (около $30 млн). Эти средства выступают гарантией и могут быть изъяты, если валидаторы сочтут определение рынка неясным или его расчеты ошибочными. Взамен создатель рынка может получать до 50% торговых комиссий с него. Эта модель, аналогичная используемой для бессрочных контрактов, кардинально отличается от централизованного подхода таких платформ, как Polymarket и Kalshi. Этот шаг следует за рекордным летом для индустрии прогнозных рынков, объем торгов которой достиг $50 млрд в июне, в основном благодаря ставкам на Чемпионат мира. Несмотря на то, что доля Hyperliquid пока невелика ($176 млн), платформа, уже демонстрирующая рекордные объемы на DEX, надеется за счет децентрализованной модели занять более существенную позицию в этом растущем сегменте.

marsbit3 мин. назад

Hyperliquid открывает развертывание рынков предсказаний: стейкинг токенов HYPE на $30 млн с возможностью получать до 50% комиссий

marsbit3 мин. назад

Франция жестко ограничивает Polymarket, 30 стран последовали примеру, вынуждая ЕС пересмотреть определение прогнозных рынков

Франция в лице Национального агенства по азартным играм (ANJ) ужесточила меры против платформы прогнозных рынков Polymarket, приказав интернет-провайдерам заблокировать к ней доступ на территории страны. Регулятор квалифицировал Polymarket не как финансовый инструмент или криптобиржу, а как нелицензионную азартную платформу, что влечёт более жёсткие ограничения. Основной аргумент — защита потребителей от потенциального вреда и отсутствие у платформы обязательных для лицензионного игорного бизнеса защитных механизмов (лимиты ставок, инструменты самоисключения). Решение основано на данных о значительном трафике из Франции, сохранявшемся даже после предыдущих запретов на финансовые операции, а также на расследованиях манипуляций (например, с данными метеодатчиков для влияния на контракты). Франция стала крупнейшей экономикой ЕС, применившей полную блокировку. Этот прецедент может иметь далеко идущие последствия для всего ЕС. Подход Франции противоречит рамкам Регламента MiCA, регулирующего криптоактивы как финансовые инструменты. Если другие страны-члены последуют примеру Франции, прогнозные рынки по всей ЕС могут быть запрещены по законам об азартных играх, а не регулироваться как финансовые рынки. Это создаст серьёзные препятствия для планов экспансии на европейский рынок регулируемых платформ, таких как американская Kalshi. Франция теперь выступает в роли тестового случая для европейского регулирования в этой сфере.

Foresight News8 мин. назад

Франция жестко ограничивает Polymarket, 30 стран последовали примеру, вынуждая ЕС пересмотреть определение прогнозных рынков

Foresight News8 мин. назад

OpenAI: время сумерек. Выручка может сократиться на 70%. Как долго продержится оценка в триллион юаней?

Авторский анализ представляет OpenAI в кризисном состоянии: компания сталкивается с иском от Apple о хищении интеллектуальной собственности, что ставит под угрозу её аппаратный бизнес, агрессивной ценовой войной с китайскими конкурентами вроде DeepSeek, а также несоответствием прогнозам по доходам от рекламы в ChatGPT. При наихудшем сценарии (прекращение аппаратного бизнеса, слабые рекламные доходы и снижение цен на модели на 80%) прогнозируется падение выручки OpenAI на 70% к 2030 году и отрицательный денежный поток в размере 165 миллиардов долларов вместо ожидаемой прибыли. Это ставит под вопрос жизнеспособность её текущей оценки в 100 миллиардов долларов. Статья также указывает на чрезмерную зависимость всего рынка от темы ИИ. Влияние ИИ распространяется на различные сектора: недвижимость (центры обработки данных), коммунальные услуги, промышленность и финансы, делая истинную диверсификацию портфеля сложной задачей. В качестве примера сектора, менее зависимого от ИИ, упоминается здравоохранение. В заключительной части отмечаются проблемы Netflix: замедление роста вовлечённости пользователей, усиление конкуренции со стороны платформ коротких видео и снижение прозрачности отчётности компании, что вызывает беспокойство инвесторов.

链捕手10 мин. назад

OpenAI: время сумерек. Выручка может сократиться на 70%. Как долго продержится оценка в триллион юаней?

链捕手10 мин. назад

Grayscale подала заявку на ETF для Worldcoin, пока WLD вырос на 8% – Что дальше?

Криптовалютный фонд Grayscale подал заявку на запуск биржевого фонда (ETF) на базе токена Worldcoin (WLD), что спровоцировало рост его цены примерно на 8% за сутки. Согласно документу S-1, поданному в SEC 20 июля 2026 года, фонд под тикером "GWLD" планируется разместить на бирже Nasdaq. Его цель — предоставить инвесторам доступ к активам WLD без необходимости непосредственного владения криптовалютой. Активы будут храниться у BitGo Bank & Trust. Этот шаг Grayscale происходит на фоне восстановления интереса к ETF после восьми недель оттока средств. При этом сам Grayscale демонстрирует неоднозначные результаты: пока его BTC-фонд привлёк $41,4 млн, флагманский GBTC, напротив, столкнулся с оттоком в $45,4 млн. Общий приток в спотовые биткоин-ETF с середины июля пока не смог существенно повлиять на рост рыночных цен.

ambcrypto23 мин. назад

Grayscale подала заявку на ETF для Worldcoin, пока WLD вырос на 8% – Что дальше?

ambcrypto23 мин. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片