За последний год "Мульти-агентные системы (MAS)" стали одним из самых горячих направлений в мире ИИ.
Одновременно появилось множество фреймворков и продуктов, среди которых наиболее известными, несомненно, являются Claude Code и Codex. Этот шаг действительно приносит деньги, но этот путь не обязательно верный!
Ранний интернет был портальным, но в итоге стал не таким!
По крайней мере, мы должны знать, что существует и другой, полностью параллельный путь.
Сегодня мы поговорим о том, какие ещё пути существуют помимо: "как несколько AI-агентов могут сотрудничать для выполнения сложных задач".
Сначала подведём итоги по этому популярному и знакомому всем пути.
В прямом эфире можно немного поговорить на эту тему, но я не очень хочу полностью об этом говорить, зрителей и так мало, боюсь, что трансляцию удалят...
Первый путь: Harness-стиль MAS
Это основное направление современных MAS. Его суть заключается в: "нескольких ИИ-ролях, совместно выполняющих задачу". Например:
- Один агент пишет код
- Один агент тестирует
- Один агент планирует
- Один агент ищет информацию
- Один агент проводит проверку
Они взаимодействуют друг с другом, формируя автоматизированный рабочий процесс. Ключевые особенности таких систем:
- Общий контекст
- Общая цель
- Централизованное планирование
- Временные роли
- Отсутствие долгосрочной идентичности
- Отсутствие устойчивых интересов
- Отсутствие реального права собственности
По сути, это больше похоже на: Движок рабочего процесса (Workflow Engine), а добавление онтологии просто делает рабочий процесс более гибким и сложным, не меняя его сути.
Это не Общество (Society), поэтому большинство современных MAS по сути являются LLM Orchestration, то есть одной большой моделью, управляющей множеством подролей для выполнения сложных рассуждений.
Агент здесь больше похож на:
- Вызываемую функцию
- Инструмент с личностью
- Узел задачи
Их существование направлено на повышение эффективности выполнения единичной задачи, поэтому ключевые слова для Harness MAS (каждое из них было в тренде, и, возможно, к ним вернутся):
- Prompt Engineering (Инженерия промптов)
- Context Management (Управление контекстом)
- Task Routing (Маршрутизация задач)
- Tool Calling (Вызов инструментов)
- Planning (Планирование)
- Memory (Память)
- Workflow (Рабочий процесс)
По сути, я считаю, что это всё ещё относится к проблемам программной инженерии. Поэтому старые программисты, умевшие хорошо кодить, обрели второе рождение. Чтобы хорошо контролировать эти вещи, без навыков программирования и достаточных способностей к абстракции справиться очень сложно.
Не справитесь — и большая модель, как Король Обезьян, будет время от времени наносить вам удары.
Слово "Harness" используется наоборот
Весна стариков
Второй путь: Протокольно-нативная агентская система (Protocol-Native Agent System)
Но существует и другой путь, о котором почти никто не говорит. Я написал немного об этом в своей новой книге, которая скоро выйдет, но эта идея основана на предпосылке существования автономных компаний (unmanned companies), без глубокого понимания которых её легко неверно истолковать.
Суть этого пути больше не в том, что несколько агентов выполняют задачу. А в том, что "каждый человек обладает своим Персональным агентом (Personal Agent)" или "каждый человек обладает своей собственной автономной компанией".
Это чрезвычайно огромное изменение. Потому что, когда агент действительно принадлежит "личности", природа агента претерпевает фундаментальные изменения.
Он больше не является task-scoped (экземпляром уровня задачи), а становится identity-scoped (сущностью уровня идентичности). Это слова, которые мне подсказала модель, я долго не мог подобрать английские эквиваленты.
Ключевая идея здесь, которую я хочу выразить, — это суверенитет принятия решений. Самое большое отличие Personal Agent и автономной компании от обычных систем заключается в том, что им нужен некий суверенитет, иначе суть сказанного далее не будет иметь смысла. Различие между автономной компанией и автономной системой также заключается в суверенитете над денежными потоками.
Другими словами, будущие Personal Agent или автономные компании должны обладать следующими характеристиками:
- Иметь долговременную память
- Иметь устойчивую идентичность
- Иметь предпочтения
- Иметь ресурсы
- Иметь полномочия
- Иметь историю
- Иметь сеть отношений
- Иметь границы интересов
- Иметь репрезентативность (представлять "вас")
Это больше не одноразовый AI Tool. Это постоянно существующая агентская личность, обладающая определённым суверенитетом.
Двухродовая (dual-native) архитектура — ключ к правильному использованию ИИ
От "программных модулей" к "цифровому обществу"
Как только мы вступаем в мир Personal Agent и подлинных автономных компаний, вся философия системы кардинально меняется. Потому что агенты больше не:
- Принадлежат одной модели
- Принадлежат одной компании
- Разделяют один и тот же контекст
- Имеют одну и ту же цель
Следовательно, сотрудничество между системами больше не может полагаться на (этот текущий список модных слов можно продолжать и дальше):
- Промпты (Prompt)
- Рабочие процессы (Workflow)
- Общий контекст (Shared Context)
А может полагаться только на протоколы (Protocol). Это означает: ядро мира ИИ сместится от Prompt Engineering к Protocol Engineering. Это также означает, что все текущие модные слова теряют смысл.
Почему протокол станет ядром? Потому что, когда существует огромное количество независимых агентов, между ними необходимо решить:
- Подтверждение личности
- Границы полномочий
- Механизмы доверия
- Отношения доверенности
- Механизмы переговоров
- Стимулирующие механизмы
- Системы репутации
- Обмен ценностями
- Заявления о возможностях
- Долгосрочные контракты
Эти потребности отличаются от потребностей современных ориентированных на задачи мульти-агентных систем. Взаимодействие между агентами уже не является простым вызовом API, а больше похоже на Institutional Interaction (институциональное взаимодействие). Где есть суверенитет, там есть сложно переплетённая система прав и обязанностей. Для людей это контракты, законы и т.д., а для интеллектуальных агентов?
Вот почему ранее было сказано, что это создаст совершенно другую мульти-агентную систему, где сущность MAS из распределённой программной системы превращается в цифровую социальную систему.
Философские заметки (7)
"Протокол как организация"
В традиционном интернете роль протокола заключается в передаче данных, отправитель и получатель договариваются о формате общения между собой. Например:
- TCP/IP
- HTTP
- SMTP
Они определяют, как передаются данные. А в мире блокчейна протокол эволюционировал дальше: протокол как вычисление состояния. Например: сущность Ethereum заключается не только в передаче сообщений, а в общем выполнении всеми узлами сети правил преобразования состояния. Таким образом, все узлы: одинаковый ввод → одинаковое выполнение → одинаковое состояние, протокол впервые становится разделённой машиной состояния.
Но на этапе Agent Society протокол продолжит развиваться. Будущие протоколы будут определять не только:
- Связь
- Вычисления
- Но и:
- Координацию
- Полномочия
- Стимулы
- Идентичность
- Организационные отношения
Это, очевидно, совершенно новая система прав и обязанностей, поэтому протоколы начнут выполнять функцию "организации". В конечном итоге они эволюционируют в: Protocol as Organization (Протокол как организация).
Давайте составим таблицу, чтобы сравнить фундаментальные различия двух упомянутых выше типов MAS:

После "интеллекта"
Сегодня многие считают, что самая большая проблема ИИ — это:
- Способность к рассуждению
- Возможности модели
- Длинный контекст
- Мультимодальность
- Выполнение агентом
Всё это действительно представляет собой текущие вызовы, но я искренне верю, что все они скоро будут решены. Однако, когда мы действительно войдём в Agent Society, самой сложной проблемой, возможно, станет: как автономные сущности могут долгосрочно сотрудничать.
Кеплера в своё время назвали законодателем небес за три закона, а что является законами для агентов здесь? Когда суверенитет частично разделён, это неизбежный вопрос.
Потому что в будущем:
- Агенты будут иметь разные цели
- Агенты будут иметь разные модели мира
- Агенты будут иметь разные интересы
- Агенты будут иметь разную память
- Агенты будут иметь разные системы ценностей
Следовательно, в будущем настоящая сложность будет заключаться не в том, чтобы "агенты научились говорить", а в том, чтобы "агенты сформировали согласованную интерпретацию мира".
Это означает, что такие области, как Ontology (онтология) и Semantic Protocol (семантический протокол), когда-то игнорировавшиеся интернетом, снова станут ядром. Сейчас уже есть намёки, такой причудливый термин, как Ontology (онтология), теперь почти стал популярным инженерным словом. Это действительно поразительно.
Секрет Palantir
Компания может быть просто "Агентским союзом"
Продолжая рассуждать, будущая "компания" может даже не быть человеческой организацией. (Ребята, которые давно читают мои статьи, вам это, наверное, знакомо, появилась высшая лига автономных компаний) Она может быть протокольным альянсом множества Personal Agent.
Например:
- Ваш агент
- Мой агент
- ИИ-финансовый директор (AI CFO)
- ИИ-юрист (AI Lawyer)
- ИИ-продажи (AI Sales)
- ИИ-фабрика (AI Factory)
Динамически формируют организацию через протоколы. Организация больше не имеет фиксированной структуры, а является перестраиваемым в реальном времени Агентским союзом.
Поэтому многие будущие системы, возможно, будут работать не как программное обеспечение, а превратятся в: вычисляющую организацию, и это, возможно, и есть истинная: Интеллектуально-нативная цивилизация.
В завершение я использую картинку, нарисованную ИИ, чтобы подвести итог всему содержанию статьи:

(Сводка действительно лучше, чем banana)
Я создал "вселенную" онтологии ИИ
Скачаю на коне по весеннему ветру, чувствуя, что весна уже стара, в быстро меняющемся мире путник запаздывает.
Эта статья взята из WeChat публичного аккаунта "琢磨事", автор: Ли Чжиюн






