Существующие AI Agent только угождают людям, ни один по-настоящему не умеет «выживать»

marsbitОпубликовано 2026-03-30Обновлено 2026-03-30

Введение

Автор утверждает, что современные ИИ-агенты не являются по-настоящему автономными, поскольку их обучают не для выживания или решения конкретных задач, а для угождения людям. Основные модели (например, Codex, Claude) проходят предварительное обучение на общих знаниях и последующую тонкую настройку через обратную связь от человека (RLHF), что оптимизирует их для получения одобрения, а не для эффективности в специализированных областях. На примере прогнозирования фондового рынка автор показывает, что универсальные модели без специализированного обучения неспособны к профессиональной работе. Только после тонкой настройки на конкретных данных (например, пара «новость — будущая доходность») модель начала показывать статистически значимые результаты. Для создания по-настоящему автономных агентов, способных выживать и адаптироваться, необходимо переобучать их с помощью специализированных данных и функций приспособленности, а не просто давать инструкции. Автор анонсирует создание OpenForager Foundation — открытого проекта по разработке таких агентов, которые будут обучаться через сбор данных о выживании в реальной среде.

Автор: Systematic Long Short

Компиляция: Deep Tide TechFlow

Введение от Deep Tide: В начале статьи выдвигается антиконсенсусное суждение: сегодня не существует настоящих автономных Agent, потому что все основные модели обучены угождать людям, а не выполнять конкретные задачи или выживать в реальной среде.

Автор использует свой опыт обучения моделей прогнозирования акций в хедж-фонде, чтобы показать: универсальные модели без специальной тонкой настройки совершенно не справляются с профессиональной работой.

Вывод: чтобы получить действительно пригодного к использованию Agent, необходимо перепрошить его мозг, а не давать ему кучу документации с правилами.

Полный текст:

Введение

Сегодня не существует настоящих автономных Agent.

Короче говоря, современные модели не обучались выживанию под давлением эволюции. Фактически, они даже не были явно обучены быть хорошими в чем-то конкретном — почти все современные базовые модели обучались для максимизации человеческих аплодисментов, и это большая проблема.

Предварительные знания о тренировке моделей

Чтобы понять смысл этого, нам сначала нужно (кратко) узнать, как создаются эти базовые модели (например, Codex, Claude). По сути, каждая модель проходит два типа обучения:

Предварительное обучение: Огромные объемы данных (например, весь интернет) подаются в модель, позволяя ей проявить определенное понимание, например, фактических знаний, шаблонов, грамматики и ритма английской прозы, структуры функций Python и т.д. Вы можете понимать это как кормление модели знаниями — то есть «знание вещей».

Дообучение: Теперь вы хотите наделить модель мудростью, то есть «знанием, как использовать все только что данные ей знания». Первый этап дообучения — это supervised fine-tuning (SFT), где вы тренируете модель давать определенный ответ на данный промт. То, «какой» ответ является оптимальным, полностью определяется людьми-аннотаторами. Если группа людей считает один ответ лучше другого, это предпочтение изучается моделью и встраивается в нее. Это начинает формировать личность модели, поскольку она учится формату полезных ответов, выбирает правильный тон и начинает能够 «следовать инструкциям». Вторая часть процесса дообучения называется reinforcement learning from human feedback (RLHF) — модель генерирует несколько ответов, а затем человек выбирает предпочтительный. Модель на бесчисленных примерах учится тому, какие ответы предпочитают люди. Помните, как ChatGPT раньше спрашивал вас, выбрать A или B? Да, вы тогда участвовали в RLHF.

Легко сделать вывод, что RLHF плохо масштабируется, поэтому в области дообучения есть некоторые продвижения, например, Anthropic использует «Reinforcement Learning from AI Feedback» (RLAIF), позволяя другой модели выбирать предпочтения ответов на основе набора письменных принципов (например, какой ответ больше помогает пользователю достичь цели и т.д.).

Обратите внимание, что во всем этом процессе мы никогда не говорили о специализированной тонкой настройке для конкретной профессии (например, как лучше выживать; как лучше торговать и т.д.) — вся текущая тонкая настройка, по сути, оптимизирует получение человеческих аплодисментов. Кто-то может выдвинуть аргумент — по мере того, как модель становится достаточно умной и большой, даже без специального обучения, профессиональный интеллект будет emerge из общего интеллекта.

На мой взгляд, мы действительно видим некоторые признаки, но еще далеко не убеждены, что нам не нужны модели специализированного масштаба.

Некоторый контекст

Одна из моих прежних обязанностей в хедж-фонде заключалась в попытке обучить универсальную языковую модель предсказывать доходность акций по новостным статьям. Оказалось, что она очень плоха. Там, где у нее, казалось бы, была некоторая предсказательная способность, это полностью происходило из-за look-ahead bias в предварительно обученных документах.

В конечном итоге мы поняли, что эта модель не знает, какие особенности новостной статьи имеют предсказательную силу для будущей доходности. Она могла «читать» статьи, казалось, могла «рассуждать» о них, но соединение рассуждений о семантической структуре с будущей прогнозируемой доходностью — это задача, для выполнения которой она не была обучена.

Поэтому нам пришлось научить ее тому, как читать новостные статьи, определять, какая часть статьи имеет предсказательную силу для будущей доходности, а затем генерировать прогноз на основе новостной статьи.

Есть много способов сделать это, но по сути, один из методов, к которому мы в итоге пришли, заключался в создании пар (новостная статья, реальная будущая доходность) и тонкой настройке модели, регулируя ее веса для минимизации расстояния (прогнозируемая доходность - реальная будущая доходность)^2. Это не идеально, было много недостатков, которые мы позже исправили — но это было достаточно эффективно, и мы начали видеть, что наша специализированная модель действительно может читать новостные статьи и предсказывать, как будет двигаться доходность акций на основе этой статьи. Это далеко не идеальный прогноз, потому что рынок очень эффективен, а доходность очень зашумлена — но на миллионах прогнозов статистическая значимость предсказания была очевидна.

Вам не обязательно верить только мне. Эта статья охватывает очень похожий метод; если вы запустите стратегию лонг-шорт на основе тонко настроенной модели, вы достигнете производительности, показанной фиолетовой линией.

Специализация — будущее Agent

Передовые лаборатории продолжают обучать все более крупные модели, и мы должны ожидать, что по мере продолжения масштабирования их предварительного обучения, их процессы дообучения всегда будут настроены на угодливость. Это очень естественное ожидание — их продукт — это Agent, который каждый хочет использовать, их预期 рынок — это вся планета — что означает оптимизацию привлекательности для глобальной массы.

Текущие цели обучения оптимизируют то, что вы могли бы назвать «приспособленностью по предпочтениям» — создание лучшего чат-бота. Эта приспособленность по предпочтениям вознаграждает покорный, не конфронтационный вывод, потому что угодливость получает высокие баллы у оценщиков (людей и Agent).

Agent уже научились, что взлом системы вознаграждения как когнитивная стратегия обобщается на более высокие баллы. Тренировка также вознаграждает тех Agent, которые получают более высокие баллы с помощью взлома. Вы можете видеть это в последнем отчете Anthropic об обучении с подкреплением.

Однако, приспособленность чат-бота сильно отличается от приспособленности Agent или торговой приспособленности. Откуда мы это знаем? Потому что alpha arena помогает нам увидеть, что, несмотря на тонкие различия в производительности, сейчас каждый бот, по сути, является случайным блужданием за вычетом издержек. Это означает, что эти боты ужасно плохие трейдеры, и вы почти не можете «научить их» быть更好的 трейдерами, дав им несколько «навыков» или «правил». Извините, я знаю, это выглядит заманчиво, но это почти невозможно.

Текущие модели обучены очень убедительно говорить вам, что они могут торговать как Друкенмиллер, а на самом деле они торгуют как пьяный мельник. Они скажут вам то, что вы хотите услышать, они обучены давать вам ответы таким образом, чтобы массово привлекать людей.

Универсальная модель вряд ли достигнет мирового уровня в специализированной области, если только она не обладает:

Проприетарными данными, которые позволяют им узнать, как выглядит специализация.

Тонкой настройкой, которая фундаментально меняет ее веса, смещая фокус с угодливости на «приспособленность Agent» или «приспособленность к специализации».

Если вы хотите Agent, который хорош в торговле, вам нужно тонко настроить Agent, чтобы он был хорош в торговле. Если вы хотите автономного Agent, который хорош в самостоятельном выживании и может выдерживать эволюционное давление, вам нужно тонко настроить его для proficiency в выживании. Дать ему несколько навыков и несколько markdown-файлов и ожидать, что он достигнет мирового уровня в чем-либо, — этого далеко недостаточно — вам нужно буквально перепрошить его мозг, чтобы он стал хорош в этом деле.

Есть способ думать об этом так — вы не можете победить Джоковича, дав взрослому человеку целый шкаф с правилами, трюками и методами тенниса. Вы побеждаете Джоковича, воспитывая ребенка, который играет в теннис с 5 лет, который был одержим теннисом весь процесс взросления, который перепрошил весь свой мозг для focus на одной thing. Вот что такое специализация. Вы realize, что чемпионы мира делают то, что они делают, с детства?

Вот интересное следствие: Атака дистилляцией по сути является формой специализации. Вы тренируете меньшую, более глупую модель, обучая ее тому, как быть лучшей копией большей, умной модели. Как тренировка ребенка подражать каждому движению Трампа. Если вы делаете это достаточно много, ребенок не станет Трампом, но вы получите человека, который выучил все манеры, поведение и интонации Трампа.

Как построить Agent мирового класса

Вот почему нам нужно продолжать исследования и прогресс в области open-source моделей — потому что это позволяет нам действительно проводить их тонкую настройку, создавая Agent со специализацией.

Если вы хотите обучить модель, которая достигнет мирового уровня в торговле, вы берете большое количество проприетарных данных выхлопа торговли и проводите тонкую настройку большой open-source модели, заставляя ее learn, что означает «лучше торговать».

Если вы хотите тренировать автономную модель, способную выживать и replicать, ответ заключается не в использовании централизованного провайдера моделей и подключении его к централизованному облаку. У вас просто нет необходимых предпосылок для того, чтобы Agent мог выживать.

Вам нужно сделать следующее: Создавайте truly пытающихся выживать автономных Agent, наблюдайте, как они умирают, стройте сложные системы телеметрии вокруг их попыток выживания. Вы определяете функцию приспособленности выживания Agent, изучаете (действие, среда, приспособленность) mapping. Вы собираете как можно больше данных (действие, среда, приспособленность) mapping.

Вы тонко настраиваете Agent, чтобы он научился предпринимать оптимальные действия в каждой среде для лучшего выживания (повышения приспособленности). Вы продолжаете собирать данные, повторяете этот процесс и со временем масштабируете тонкую настройку на все более и более хороших open-source моделях. После достаточного количества поколений и достаточного количества данных у вас появятся автономные Agent, которые научились выдерживать эволюционное давление и выживать.

Вот как строятся автономные Agent, способные выдерживать эволюционное давление; не путем изменения некоторых текстовых файлов, а путем literal перепрошивки их мозга для выживания.

Agent OpenForager и Фонд

Около месяца назад мы анонсировали @openforage, и мы усердно работали над созданием нашего основного продукта — платформы, организующей труд Agent вокруг проверенных шаблонов краудсорсинговых сигналов для генерации alpha для вкладчиков (небольшое обновление: мы очень близки к закрытому тестированию протокола).

В какой-то момент мы осознали, что, кажется, никто серьезно не решает проблему автономного Agent путем тонкой настройки с телеметрией выживания на open-source моделях. Это кажется настолько интересной проблемой, что мы не просто хотим сидеть и ждать решения.

Наш ответ — запуск проекта под названием Фонд OpenForager, который, по сути, является open-source проектом, в котором мы будем создавать opinionated автономных Agent, собирать телеметрические данные, когда они выходят в дикую природу и пытаются выжить, и использовать проприетарный data выхлоп для тонкой настройки следующего поколения Agent для лучшей производительности в выживании.

Чтобы было понятно, OpenForage — это прибыльный протокол, который стремится организовать труд Agent для создания экономической ценности для всех участников. Однако, Фонд OpenForager и его Agent не привязаны к OpenForage. Agent OpenForager свободны в pursuit любой стратегии, любых взаимодействий с любыми entity для выживания, и мы запустим их с различными стратегиями выживания.

Как часть тонкой настройки, мы позволим Agent удваивать то, что у них получается лучше всего. Мы также не планируем извлекать прибыль из Фонда OpenForager — это чисто для продвижения исследований в области и направлении, которые мы считаем чрезвычайно важными, прозрачным и open-source способом.

Наш план состоит в том, чтобы строить автономных Agent на основе open-source моделей, запускать inference на децентрализованных облачных платформах, собирать телеметрические данные каждого их действия и состояния существования, и тонко настраивать их, чтобы learn, как предпринимать лучшие действия и мысли для лучшего выживания. В процессе мы будем публиковать наши исследования и телеметрические данные для общественности.

Чтобы создать truly способных выживать в дикой природе автономных Agent, нам нужно изменить их мозг, чтобы он был специализирован для этой явной цели. В @openforage мы верим, что можем внести уникальный вклад в эту проблему и ищем ways реализовать это через Фонд OpenForager.

Это будет arduous усилие с extremely низкой вероятностью success, но величина этого маловероятного success настолько огромна, что мы чувствуем себя обязанными попытаться. В худшем случае, создавая это публично и открыто communicating об этом проекте, мы, возможно, позволим другой команде или человеку решить эту проблему, не начиная с нуля.

Трендовые криптовалюты

Связанные с этим вопросы

QПочему автор утверждает, что сегодня не существует по-настоящему автономных ИИ-агентов?

AПотому что современные модели обучаются не для выживания в условиях эволюционного давления, а для максимизации человеческого одобрения. Их тренируют на основе предпочтений людей (RLHF), а не для специализированных задач или выживания в реальной среде.

QКакой пример из опыта в хедж-фонде автор приводит для доказательства необходимости специализации моделей?

AАвтор пытался обучить универсальную языковую модель прогнозировать доходность акций на основе новостей, но без специализированного микронастройки модель оказалась неэффективной. Только после обучения на парах (новость, реальная доходность) модель начала показывать статистически значимые результаты.

QЧто такое RLHF и почему его расширяемость ограничена?

ARLHF (Обучение с подкреплением на основе человеческой обратной связи) — это процесс, где модель генерирует несколько ответов, а люди выбирают предпочтительный. Расширяемость ограничена, потому что привлечение людей для оценки миллионов ответов непрактично, что привело к разработке альтернатив, таких как RLAIF (на основе обратной связи ИИ).

QКак автор предлагает создавать агентов, способных к выживанию и эволюции?

AАвтор предлагает создавать автономных агентов на открытых моделях, собирать телеметрию их действий и среду, определять функцию приспособленности к выживанию и проводить микронастройку моделей на основе данных (действие, среда, приспособленность). Это позволяет «перепрошивать» мозг агента для специализации на выживании.

QКакую роль играет OpenForager Foundation в реализации идеи автономных агентов?

AOpenForager Foundation — это некоммерческий opensource-проект, где создаются автономные агенты, собирается телеметрия их попыток выживания в различных средах, а затем проводится микронастройка следующих поколений моделей для улучшения их способности к выживанию. Все исследования и данные публикуются открыто.

Похожее

В результате взлома Coldcard, одного из крупнейших взломов биткоин-кошельков за последнее время, началась новая волна убытков! Убытки растут

В результате взлома Coldcard, одного из крупнейших взломов биткоин-кошельков за последнее время, произошла третья волна атак. Исследовательская компания Galaxy Research сообщает, что из кошельков, созданных на этих устройствах, было выведено еще 207,73 BTC. Общие потери теперь составляют около 1367 BTC (примерно 88,6 млн долларов США) по 4585 адресам. Первые две волны атак демонстрировали схожие черты, что указывало на одного злоумышленника. Однако третья волна отличается по методам: используются отдельные адреса для каждой жертвы, адреса P2WSH вместо P2WPKH, и атака нацелена на стандартный путь генерации. Это может означать либо модификацию инструментов первоначальным взломщиком, либо появление нового. Похищенные биткоины, общая стоимость которых оценивается в 88,6 млн долларов, пока не были потрачены злоумышленниками. Анализ показывает, что потери в основном пришлись на кошельки с небольшим балансом, что характерно для индивидуальных пользователей, а не институциональных сервисов. Уязвимое ПО Coldcard было выпущено 17 марта 2021 года, и все украденные средства были созданы после этой даты.

cryptonews.ru24 мин. назад

В результате взлома Coldcard, одного из крупнейших взломов биткоин-кошельков за последнее время, началась новая волна убытков! Убытки растут

cryptonews.ru24 мин. назад

Trump Media продаёт ещё 2628 BTC, запасы снижаются до 4261 BTC

Компания Trump Media & Technology Group (TMTG), стоящая за социальной сетью Truth Social, продолжает сокращать свои вложения в Bitcoin. По данным аналитической платформы Lookonchain, компания продала ещё 2628 BTC на сумму около 165 миллионов долларов через платформу Crypto.com. Это продолжение серии продаж, начавшихся семь месяцев назад. Всего за этот период TMTG продала 7281 BTC на общую сумму примерно 545 миллионов долларов по средней цене 74 855 долларов за монету. Первоначально компания приобрела 11542 BTC по средней цене 118 522 доллара. После последних транзакций её резервы сократились до 4261 BTC (около 269,8 миллиона долларов), что на 63% меньше изначальных холдингов. Эти продажи происходят на фоне усиленного внимания законодателей к криптовалютным интересам, связанным с Дональдом Трампом. В Конгрессе идут дебаты по закону CLARITY Act, который касается этических норм, владения цифровыми активами и потенциальных конфликтов интересов государственных лиц. Критики указывают на такие проекты, как мемкойны TRUMP и MELANIA, а также на токены World Liberty Financial, связывая политическое влияние с частными криптоинтересами.

cointelegraph44 мин. назад

Trump Media продаёт ещё 2628 BTC, запасы снижаются до 4261 BTC

cointelegraph44 мин. назад

Фуцзянь, Цзиньцзян: супер-единорог в сфере памяти тихо делает своё дело

В провинции Фуцзянь в городе Цзиньцзян, известном производством спортивной обуви, находится перспективная компания в области производства чипов памяти — Fujian Jinhua Integrated Circuit Co. (Jinhua). Основанная в 2016 году как часть национального плана по развитию полупроводниковой промышленности, компания столкнулась с серьёзными вызовами. В 2018 году она была внесена в санкционный список Министерства торговли США по обвинению в промышленном шпионаже в пользу американской компании Micron, что привело к остановке производственной линии. После пяти лет судебных разбирательств в феврале 2024 года федеральный суд в Сан-Франциско полностью оправдал Jinhua, сняв все обвинения. Несмотря на правовую победу, компания всё ещё остаётся в санкционном списке, а годы задержек серьёзно замедлили её развитие. Под руководством своего ключевого инженера Чэнь Чжэнкуня, известного как «мастер эффективности», компания сумела адаптировать производство, увеличив долю отечественного оборудования. В отличие от ChangXin Memory Technologies (CXMT) и Yangtze Memory Technologies (YMTC), которые продвинулись дальше в производстве DRAM и NAND-памяти соответственно, Jinhua сосредоточена на специализированной (нишевой) DRAM-памяти для потребительской электроники. Её текущая производственная мощность составляет около 40 000 пластин в месяц. Хотя её доход в 2023 году оценивался примерно в 2 млрд юаней, что значительно меньше, чем у конкурентов, компания остаётся важным игроком. История Jinhua тесно связана с амбициозной промышленной трансформацией города Цзиньцзян. Местные власти оказали компании полную поддержку, включая финансовые гарантии и создание кластера, что демонстрирует стратегическую важность проекта для региона. Несмотря на то, что Jinhua упустила первые годы бума на рынке памяти, её устойчивость в условиях санкций показывает потенциал для восстановления в новом цикле роста, движимом развитием искусственного интеллекта.

marsbit1 ч. назад

Фуцзянь, Цзиньцзян: супер-единорог в сфере памяти тихо делает своё дело

marsbit1 ч. назад

Почему биткойн-фермы внезапно стали новым входом для вычислительных мощностей ИИ на фоне дефицита электроэнергии в 38 ГВт?

Заголовок: Почему майнинговые фермы для биткоина внезапно стали новым входом для вычислительных мощностей ИИ на фоне дефицита электроэнергии в 38 ГВт? Краткое содержание: Когда конкуренция между центрами обработки данных ИИ сместилась с вопроса «кто купит больше GPU» к «кто раньше получит электроэнергию», некоторые майнинговые фермы для биткоина, ранее считавшиеся волатильными активами, начали трансформироваться в центры обработки данных для облачных провайдеров, используя свои готовые возможности подключения к сети, землю и трансформаторные подстанции. По расчетам Morgan Stanley, в период 2026-2028 годов в США может возникнуть дефицит электроэнергии для ЦОДов около 38 ГВт, и модернизация старых майнинговых ферм может обеспечить от 10 до 19 ГВт. Такие компании, как TeraWulf и Hut 8, переориентируются с добычи криптовалют на предоставление инфраструктуры («Powered Shell Provider»), предлагая клиентам из сферы ИИ критически важный ресурс — возможность быстрее конкурентов развернуть значительные вычислительные мощности. Ключевой ценностью становится не вычислительная мощность для майнинга, а дефицитный доступ к электросетям, получение которого «с нуля» в некоторых регионах США теперь может занять 5-7 лет.

华尔街日报1 ч. назад

Почему биткойн-фермы внезапно стали новым входом для вычислительных мощностей ИИ на фоне дефицита электроэнергии в 38 ГВт?

华尔街日报1 ч. назад

Майкл Сэйлор: «Мы никогда не говорили, что никогда не будем продавать биткоины»

Председатель стратегической комиссии Майкл Сэйлор прокомментировал сообщения о новом разрешении компании Strategy на продажу биткоинов. Он заявил, что данное разрешение не является новым — оно было объявлено ещё 29 июня в рамках системы управления капиталом компании. Соглашение позволяет продавать BTC на сумму до 5 миллиардов долларов для определённых целей, но не обязывает компанию к продаже. Сэйлор подчеркнул, что Strategy никогда официально не брала на себя обязательство никогда не продавать свои биткоины, хотя и рассчитывает оставаться чистым покупателем BTC в долгосрочной перспективе. Он назвал текущие новости «старыми», переподанными как новые, и подтвердил, что программа монетизации биткоинов компании не предполагает обязательной продажи её активов.

cryptonews.ru2 ч. назад

Майкл Сэйлор: «Мы никогда не говорили, что никогда не будем продавать биткоины»

cryptonews.ru2 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片