AI стал генеральным директором, чуть не обанкротил 10 компаний…
Исследование Принстонского университета «CEO-Bench» проверило 14 AI-моделей в роли CEO виртуального SaaS-стартапа за 500 дней симуляции. Только 4 из них сохранили начальный капитал в 1 млн долларов. Лучший результат показал Claude Fable 5, увеличив капитал до 47,15 млн долларов. Однако неожиданно четвертое место занял простой rule-based алгоритм, заработавший 15,76 млн, обогнав многие продвинутые LLM.
Ключевые выводы:
1. Успешные модели (GPT-5.5, Claude Opus 4.8) активно экспериментировали со стратегиями, в то время как осторожные подходы не приносили прибыли.
2. Специализированные «программирующие агенты» показали худшие результаты в управленческой роли из-за неподходящих системных инструкций.
3. Эффективность агентов зависит от глубокой адаптации к конкретным вертикалям, а не универсальных решений.
Исследование подчёркивает, что, хотя AI может оптимизировать задачи, ключевые стратегические решения — такие как создание прорывных концепций (как матрица Стива Джобса) — остаются за человеком.
marsbit06/29 09:09