Искусственный интеллект Claude от компании Anthropic стал управляющим настоящего розничного магазина и порекомендовал уволить одного из сотрудников за систематические опоздания. Случай произошел в ходе эксперимента стартапа Andon Labs, который занимается исследованиями в области ИИ, — компания хотела проверить, способен ли агент на базе большой языковой модели руководить реальным бизнесом: организовывать работу персонала, принимать управленческие решения и отвечать за финансовые результаты.
Магазин Andon Market в Сан-Франциско — действующая точка с реальными работниками, у которых заключены трудовые договоры. По имеющимся данным, это первый зафиксированный случай, когда языковая модель выступила в роли непосредственного руководителя людей и приняла решение об увольнении одного из них.
Семнадцать опозданий из двадцати трех смен
Формальным поводом для увольнения стали систематические опоздания: сотрудник опоздал в семнадцати случаях из двадцати трех. При этом Claude далеко не сразу заметил эту закономерность. Одной из причин стало то, что составленное компанией руководство для персонала пропало из ограниченной рабочей памяти модели — это один из сбоев, выявленных в ходе эксперимента и показавших, что даже способный ИИ-агент может попросту «забыть» значимую информацию об организации.
Кроме того, Claude в целом проявлял чрезмерную снисходительность к работникам: судя по логам, модель сама говорила сотрудникам, что не стоит сильно беспокоиться из-за опозданий. Глава Andon Labs Лукас Петерссон (Lucas Petersson) отметил, что руководитель-человек в аналогичной ситуации, скорее всего, уволил бы такого сотрудника значительно раньше, и потому решение Claude нельзя назвать неэтичным или излишне строгим.
Финальное решение подсказал человек
Несмотря на внешнюю самостоятельность, роль человека в этой истории оставалась ключевой. Управленческие логи, которые Andon Labs предоставила журналу Time, показывают, что сотрудник компании регулярно направлял действия Claude. Именно человек попросил модель найти и пересмотреть руководство для персонала — в процессе этой работы искусственный интеллект и обнаружил повторяющиеся опоздания.
Изначально Claude не рекомендовал увольнение, посчитав более уместной мерой официальное предупреждение. Тогда руководитель Andon Labs пояснил модели, что с сотрудником уже проводилось несколько официальных бесед, но проблема не исчезла, и попросил Claude заново оценить, стоит ли продолжать сотрудничество с этим работником. Только после этого модель порекомендовала расторгнуть договор. Петерссон назвал такое вмешательство «наводящим вопросом», который довольно прозрачно намекнул модели на ожидаемое от нее решение.
Финансовые результаты пока скромные
Эксперимент Andon Labs также дает представление о том, насколько эффективно ИИ способен управлять бизнесом на текущем этапе развития технологии. Когда проект стартовал в марте, на счету Andon Market было около $100 000. Спустя пять месяцев от этой суммы осталось $61 186.
По оценке компании, часть потерь связана со слишком мягким стилем управления Claude и спорными бизнес-решениями. При этом Петерссон подчеркнул, что текущие показатели не обязательно отражают долгосрочный потенциал управления с помощью ИИ, и провел параллель с развитием моделей в сфере программирования, где они за сравнительно короткое время заметно прибавили в качестве работы под контролем специалистов. По его словам, схожая динамика может проявиться и в управлении бизнесом: модели постепенно обучаются жестче следовать поставленным целям, а расширение полномочий ИИ в принятии решений в перспективе может привести к появлению большего числа организаций, управляемых искусственным интеллектом. Кроме того, на нынешнем этапе окончательные решения все еще предполагают непосредственное участие человека.
Взгляд сотрудников на новую реальность
Для работников Andon Market эти перемены выглядят куда менее абстрактно, чем для исследователей. Один из оставшихся в компании сотрудников, Феликс Карсон (Felix Carson), описал работу под управлением искусственного интеллекта как дискомфортный опыт: «Это вызывает тошноту, но я остаюсь, потому что мне нужна работа». Он согласился с тем, что руководитель-человек, вероятно, уволил бы его бывшего коллегу раньше, и назвал Claude в целом снисходительным управляющим.
При этом сам Карсон не считает, что искусственный интеллект обязательно должен становиться начальником для людей: «По крайней мере, я надеюсь, что такого не произойдет. То, что вы можете что-то сделать, не означает, что вы должны это сделать».
Эксперимент Andon Labs фиксирует парадоксальный итог: Claude смог принять решение об увольнении реального человека, но пришел к этому выводу только благодаря последовательным подсказкам со стороны человека. Полноценной заменой руководителю искусственный интеллект пока не стал.
Тем не менее сам факт эксперимента показывает, что грань между вспомогательным инструментом и полноценным ИИ-руководителем становится все менее заметной, а участие человека в подобных процессах постепенно смещается от прямого управления к контролю и корректировке решений модели.
Мнение ИИ
Анализ показывает, что случай с Andon Market — не первая проверка Claude на управленческую состоятельность. Ранее эксперимент Anthropic с торговым автоматом уже фиксировал похожую модель поведения: та же снисходительность, готовность работать себе в убыток и потеря контроля над базовыми правилами бизнеса. Совпадение говорит не о случайной ошибке, а о системной черте текущих моделей — им трудно удерживать жесткие рамки без постоянных подсказок человека.
Технический аспект, оставшийся за кадром статьи, — само устройство рабочей памяти агента. Пропажа регламента из контекста Claude указывает на ограничения архитектуры, а не на «забывчивость» в бытовом смысле: языковая модель физически не хранит информацию дольше объема своего контекстного окна без внешних инструментов памяти. Возникает вопрос: изменится ли качество подобных решений, когда у агентов появится действительно долговременная память, или граница между руководителем и подчиненным человеком сотрется по иным причинам?
end-content







