Руководство по использованию режима цели в Codex: как заставить ИИ последовательно продвигаться к конкретной цели

marsbitОпубликовано 2026-06-06Обновлено 2026-06-06

Введение

OpenAI представила режим цели (/goal) для Codex, который позволяет ИИ непрерывно работать над достижением конкретного результата в течение часов или даже дней. Ключ к эффективному использованию — определение чётких, измеримых критериев завершения (например, «сократить время сборки на 30%» или «добиться LCP ниже 2,5 сек»), а не длинные описания. Важно давать Codex направление, инструменты и доступ к реалистичной среде (например, staging, близкому к production), чтобы он мог оценивать прогресс. Для визуальных задач лучше ставить функциональные или системные требования, а не требовать «пиксель в пиксель». При длительной работе полезно отслеживать прогресс через коммиты, черновики PR, обновления в Slack или отдельные чаты (/side). После достижения цели рекомендуется провести ревью и рефакторинг, чтобы убрать пробные или неоптимальные изменения. Таким образом, роль разработчика смещается от написания промптов к управлению автономным инженерным агентом, который самостоятельно работает над чётко определёнными, измеримыми целями.

Примечание редактора: эта статья от Доминика Кунделя, члена команды по работе с разработчиками OpenAI, обобщает опыт использования функции Codex «режим цели» (/goal). Речь идет не об обычном приеме промптов, а об изменении роли инструментов ИИ-программирования: Codex перестает быть просто помощником по коду, реагирующим на одноразовые инструкции, и начинает превращаться в агента-исполнителя, который может последовательно работать над достижением четкой цели.

В режиме /goal действительно важно не писать требования как можно длиннее и детальнее, а задавать для Codex четкие, проверяемые критерии завершения. Например: «сократить время развертывания на 30%», «достичь 100%-ной паритетности тестового покрытия», «снизить LCP ниже 2,5 секунды». Эти показатели позволяют Codex определить, выполнена ли задача, и избежать бесконечных попыток и ошибок при нечеткой цели. В то же время пользователю необходимо предоставить достаточно указаний, инструментов и реальной среды, чтобы Codex мог оценивать прогресс и проверять результаты, а не просто создавать кажущееся работоспособным решение локально или в гипотетических условиях.

В статье особенно подчеркивается, что визуальные задачи чаще всего затягивают Codex в болото деталей. Вместо требования «100%-ного пиксельного соответствия» лучше разбивать визуальную цель на функциональный список, спецификации дизайн-системы и поддающиеся оценке метрики. Для долгосрочных задач, продолжающихся несколько часов или даже дней, также необходим постоянный мониторинг через коммиты, черновые PR, документы о ходе работ, обновления в Slack или побочные чаты, чтобы в итоге не получить лишь кучу неотслеживаемых изменений.

Информационная ценность этой статьи заключается в том, что она переопределяет /goal как «механизм управления долгосрочными задачами». Когда ИИ может выполнять работу непрерывно в течение десятков или даже сотен часов, ключевые компетенции разработчика также меняются: речь идет уже не просто о том, чтобы заставить ИИ генерировать код, а о том, чтобы определять для него цели, создавать систему измерений, настраивать среду исполнения, а в конце проводить ревью и анализ. Другими словами, ИИ-программирование переходит от «написания промптов» к «управлению непрерывно работающим исполнителем-инженером».

Далее следует оригинальный текст:

Мы представили режим цели (goal mode, или /goal), чтобы помочь вам заставить Codex последовательно продвигаться к конкретному результату. Когда вы задаете цель, Codex будет работать до тех пор, пока она не будет достигнута — независимо от того, займет это несколько часов или несколько дней. Некоторые уже заставляли Codex непрерывно работать над одной целью более 120 часов.

Режим цели очень мощный. Чтобы максимально использовать его потенциал, при использовании /goal стоит обратить внимание на 7 вещей.

Задавайте четкие, проверяемые критерии

Промпт, который вы вводите при активации режима цели, служит не только как начальная подсказка, но, что важнее, становится критерием выхода для этой цели. После каждого цикла работы Codex будет проверять: достигнута ли уже эта цель.

Поэтому ваш целевой промпт не должен быть слишком длинным, а должен фокусироваться на четком критерии: при каких условиях цель можно считать достигнутой.

В большинстве случаев хорошая цель должна включать в себя четкую числовую метрику, по которой модель сможет судить о завершении. Например:

«Сократить время сборки и развертывания на 30%».

«Перенести эту функцию с TypeScript на Rust и достичь 100%-ной согласованности тестов».

«Оптимизировать шаблон приложения так, чтобы Largest Contentful Paint (LCP, метрика скорости загрузки основного содержимого страницы) в производственной среде был ниже 2,5 секунд».

Этому промпту не обязательно всегда содержать цифры, но, как правило, цифры облегчают дальнейшие шаги.

Если вы еще не уверены, как определить цель, или хотите сначала провести мозговой штурм по проекту вместе с Codex, не обязательно начинать диалог в режиме цели.

Codex может самостоятельно поставить цель. Вы можете начать обычный диалог, а когда будете готовы начать выполнение, попросите Codex установить цель на основе предыдущего обсуждения.

Вы также можете редактировать цель в любое время: нажмите кнопку редактирования в приложении Codex или снова используйте /goal в CLI.

По возможности давайте указания

Промпты вроде «сократить время сборки и развертывания на 30%» звучат круто и могут позволить Codex найти творческие решения. Но если вы примерно представляете, в чем может быть проблема, такой промпт также может завести Codex в тупик.

Поэтому, когда это возможно, лучше сказать Codex, с чего начать расследование, какими инструментами можно воспользоваться для достижения цели, или дать другие подсказки, чтобы он не пошел по неверному пути.

Например, мой коллега @reach_vb поступил именно так в одном эксперименте: он сказал Codex, что можно использовать браузер Chrome для доступа к Google Colab, и указал некоторые допустимые ограничения, например, что при обучении модели Codex может сам генерировать набор данных.

Точно так же, если вы хотите сократить время сборки и уже знаете, на каком этапе тратится большая часть времени, лучше в промпте сразу направить Codex в эту область.

Другой подход — сначала позволить Codex провести предварительное исследование в режиме планирования (plan mode) и создать план-файл для записи потенциальных решений. Затем можно сделать так, чтобы ваша цель ссылалась на этот план.

Сделайте прогресс измеримым

Если ваша цель амбициозна или у Codex есть много способов постепенно приблизиться к цели, очень важно: предоставить Codex инструменты для измерения прогресса.

Для некоторых задач это может быть естественным. Например, для оптимизации времени сборки или повышения покрытия тестами, поскольку Codex обычно уже умеет использовать соответствующие инструменты или естественным образом их создает.

Но для других целей лучше сначала провести мозговой штурм вместе с Codex: какие инструменты помогут оценить прогресс? Или дать ему подсказки, как понять, движется ли он к цели. Например, создать инструмент сравнения визуальных различий для двух скриншотов или набор оценочных тестов для отлаживаемого агента.

Однажды я попросил Codex воссоздать некоторые компоненты по видео, и тогда Codex создал для себя инструмент для сравнения скриншотов и проверки различий. Позже он продолжил итерации над этим инструментом, добавив различные режимы сравнения различий.

В зависимости от задачи вам также нужно подумать, есть ли дополнительные критерии, которые необходимо измерить или проверить. Иначе Codex может решить, что задача выполнена, хотя на ваш взгляд она еще не завершена.

Например, Codex может, ради «пиксельного соответствия» какому-либо UI, просто обрезать референсный макет и встроить его в страницу; или, чтобы добиться 100%-ной проходимости тестов, сократить покрытие тестами. Это не те способы завершения, которых вы на самом деле хотите.

Создайте реалистичную среду

Если вы хотите, чтобы Codex действительно добивался эффективного прогресса в достижении цели, ему необходимо работать в достаточно реалистичной среде.

На практике это означает: если вы хотите оптимизировать время развертывания или задержки, Codex должен иметь доступ к средам развертывания и тестирования, максимально приближенным к production. То есть использовать тот же технологический стек, те же конфигурационные переключатели и аналогичную базу данных.

Например, мы как-то отлаживали оптимизацию времени сборки и развертывания для developers.openai.com. В то время мы уже использовали preview-развертывания, поэтому Codex мог использовать эти среды для деплоя и просмотра соответствующих логов. Но проблема была в том, что в наших preview-деплоях, по сравнению с полноценной production-средой, были отключены некоторые пути сборки.

В итоге Codex пришлось выполнять ручное развертывание, помещая код в среду, более близкую к production-конфигурации, чтобы действительно проверить проблему.

Аналогичным образом вы можете позволить Codex использовать computer use (возможность модели взаимодействовать с реальным интерфейсом приложения) для тестирования реального приложения. Чтобы оптимизировать некоторые проблемы производительности на iOS, @dimillian даже использовал физическое устройство для получения наиболее точной тестовой среды.

Осторожно ставьте визуальные цели

Дать Codex визуальную цель, например, «воссоздать этот UI с 100%-ным пиксельным соответствием по этой картинке», действительно заманчиво. Но в зависимости от конкретных условий это может создать проблемы.

Если вы не дадите подходящих указаний и ограничений, Codex может увязнуть в деталях и упустить общую цель. Например, если референсное изображение содержит графические элементы, и вы ожидаете, что Codex сгенерирует их — будь то иконки SVG или картинки — он может потратить много усилий на «точное воссоздание этих ресурсов», вместо того чтобы правильно декомпозировать всю проблему.

Кроме того, Codex нужны инструменты для корректного визуального сравнения. Это означает больше ввода изображений, большее общее потребление токенов, но не обязательно дает Codex простой способ выявления действительно ценных возможностей для улучшения.

Поэтому изображения обычно лучше подходят в качестве контекста цели, а не единственного критерия завершения. Следует искать другие способы, позволяющие Codex определить, достигнута ли цель, например, функциональный чек-лист, спецификации реализации, соответствие дизайн-системе.

Отслеживайте прогресс

Если Codex в итоге работает в фоне несколько часов или даже дней, или даже на другой машине, легко забыть, на каком этапе он находится и какую работу уже проделал.

В зависимости от цели я нашел полезными следующие методы:

· Заставлять Codex фиксировать код в ключевых точках и отправлять его в черновой PR. Особенно это полезно, когда вы работаете над сайтом и у вас есть preview-деплой.

· Заставлять Codex обновлять документ для менеджмента. Это может быть HTML-файл, который вы держите открытым во встроенном браузере; может быть · страница, развернутая через Sites для просмотра командой; может быть визуализированная диаграмма прогресса или просто обычный Markdown-файл.

Указывать Codex активно публиковать обновления о прогрессе. Вы также можете включить это в цель: чтобы Codex отправлял обновления в канал Slack или в другие места, где вы хотите фиксировать прогресс, при достижении важных вех.

Использовать другие окна чата для запроса статуса. Если вы просто хотите быстро узнать текущее состояние, можно запустить /side для начала нового побочного чата и задать вопрос там. Поскольку он форкается из текущего треда, он имеет весь контекст до этого момента, но его жизненный цикл короткий.

Другой вариант в приложении Codex: начать обычный новый чат и попросить Codex прочитать другой тред с целью и ответить на ваши вопросы. Этот подход особенно мощный, если вы поручите Codex настроить автоматизированную задачу для периодической проверки прогресса.

Приведите в порядок и окончательно подтвердите результат

Отлично, цель наконец достигнута! Теперь можно просто скинуть результат команде и закончить?

Как правило, особенно в задачах оптимизации, я считаю полезным позволить Codex пересмотреть и проанализировать свою работу. Вы можете сначала запустить локальный код-ревью с помощью /review, но также стоит дать Codex глубже поразмышлять: какие пути он пробовал для достижения цели? Что сработало? Что не сработало? И затем привести код в порядок на основе этого.

Поскольку Codex будет работать до тех пор, пока цель не будет достигнута, он мог попробовать методы, которые оказались недостаточно хорошими или вовсе неэффективными, и эти остаточные изменения могут остаться в финальном коде.

Поставьте цель и для своей следующей задачи

Функция цели в Codex — чрезвычайно мощный инструмент, который может помочь вам решить самые значимые инженерные задачи. Но только при наличии правильной среды и инструкций он сможет эффективнее достигать цели.

Что вы делали с помощью /goal?

Трендовые криптовалюты

Связанные с этим вопросы

QЧто такое режим 'goal mode' (или /goal) в Codex и какую основную задачу он решает?

AРежим 'goal mode' (или /goal) в Codex — это функция, которая позволяет задать искусственному интеллекту конкретную цель, к достижению которой он будет последовательно стремиться. В отличие от стандартных запросов, этот режим превращает Codex из инструмента, реагирующего на единичные команды, в агента, способного непрерывно работать над достижением определённого результата — будь то оптимизация производительности, миграция кода или визуальная разработка. Ключевая задача — предоставить Codex чёткий, измеримый критерий завершения работы.

QКаковы основные рекомендации по формулированию цели для Codex в режиме /goal?

AОсновная рекомендация — формулировать цель максимально чётко и с измеримыми критериями завершения. Цель должна содержать конкретные, проверяемые показатели, например: «сократить время сборки и деплоя на 30%», «достичь 100% покрытия тестами» или «снизить LCP (Largest Contentful Paint) ниже 2,5 секунд». Это позволяет Codex самостоятельно оценивать прогресс и понимать, когда задача выполнена. Слишком длинные или расплывчатые формулировки могут привести к неэффективной работе.

QПочему в статье рекомендуется с осторожностью ставить Codex визуальные задачи, такие как «пиксель в пиксель воссоздать UI»?

AВизуальные задачи, требующие точного воссоздания пикселей, могут заставить Codex погрузиться в бесконечные попытки добиться идеального совпадения, упуская из виду общую цель. Кроме того, для точного сравнения изображений требуются дополнительные инструменты и ресурсы (токены), что не всегда эффективно. Вместо этого авторы рекомендуют использовать визуальные элементы как контекст, а цель разбивать на функциональные требования, соответствие дизайн-системе или другие измеримые критерии.

QКакие способы отслеживания прогресса Codex при долгосрочных задачах предлагаются в статье?

AДля отслеживания прогресса в долгосрочных задачах предлагается несколько методов: 1) Запрашивать у Codex коммиты кода и создание черновика Pull Request. 2) Поручать ему обновлять специальный документ о ходе работы (HTML, Markdown или через платформу Sites). 3) Настроить автоматические оповещения о важных этапах (например, в Slack). 4) Использовать функцию /side для создания отдельного краткосрочного чата с текущим контекстом, чтобы быстро узнать статус.

QЧто важно сделать после того, как Codex сообщит о достижении поставленной цели?

AПосле достижения цели важно не просто принять результат, а провести финальную проверку и рефлексию. Рекомендуется: 1) Выполнить локальный код-ревью с помощью команды /review. 2) Попросить Codex проанализировать пройденный путь — какие подходы сработали, а какие нет. 3) Очистить код от промежуточных или неэффективных изменений, которые могли остаться в процессе итеративной работы. Это помогает получить чистый, качественный и осмысленный итоговый результат.

Похожее

Как распознать криптомошенничество или rug pull?

Представьте, что вы нашли многообещающий новый токен с тысячами держателей, растущей ценой и активным сообществом. Все выглядит легитимно, пока ликвидность внезапно не исчезает. Так начинается «скам» (rug pull). Разработчики сначала создают видимость надежности через заблокированную ликвидность и отказ от прав на контракт. Затем они раскручивают токен в соцсетях и нагнетают ажиотаж. Чем сильнее сообщество, тем легче привлечь новый капитал. Весь процесс от раскрутки до вывода средств часто занимает 48-72 часа. «Жесткие» скамы мгновенно выводят ликвидность, а «мягкие» постепенно снижают стоимость через продажи инсайдеров или отказ от развития проекта. Ключевые признаки скама: 1. **Высокая концентрация токенов:** если 5-10 кошельков контролируют более 30% предложения. 2. **Подозрительный смарт-контракт:** неверифицированный код, скрытые функции (например, для дополнительной эмиссии), возможность обновления контракта разработчиком. 3. **Рыночное поведение:** быстрый рост цены на основе рекламы от инфлюенсеров, низкий органический объем торгов, снижение числа новых держателей перед крупными переводами с кошельков разработчиков. Основные виды мошеннических схем: * **Ловушки (Honeypots):** Позволяют покупать, но блокируют или ограничивают продажу (98 442 случая). * **Скрытая эмиссия (Hidden mint):** Позволяет разработчикам напечатать новые токены после запуска, размывая доли держателей (60 985 случаев). * **Фальшивый отказ от прав (Fake ownership renunciation):** Заявления о децентрализации ложны, контроль сохранен (48 974 случая). Вывод: чтобы избежать скама, важно анализировать не только цену, но и сходимость нескольких факторов: структуру владения токенами, код смарт-контракта и модели торговли. Прозрачные условия вестинга, верифицированный код и независимый аудит значительно снижают риски.

ambcrypto24 мин. назад

Как распознать криптомошенничество или rug pull?

ambcrypto24 мин. назад

Открытый интерес по XRP достигает $2,6 млрд на фоне роста спроса на деривативы

Открытый интерес по фьючерсам XRP достиг 2,6 млрд долларов, что означает рост более чем на 10% за 24 часа, согласно данным CoinGlass. Это ставит XRP на четвертое место среди крупнейших криптоактивов по данному показателю. Рост открытого интереса свидетельствует об увеличении активности на деривативном рынке, но не указывает однозначно на бычьи или медвежьи настроения, а также не подтверждает рост спроса на спотовом рынке. Активность может быть вызвана долгосрочными или короткими позициями, хеджированием или спекуляциями. Ключевым вопросом является то, поддержит ли этот рост открытого интереса более сильное движение цены или создаст дополнительные риски волатильности. Для подтверждения устойчивости тренда необходимы сопутствующие сигналы, такие как рост объемов спотовой торговли и устойчивость ключевых ценовых уровней. В противном случае высокий уровень открытого интереса может привести к усилению давления при ликвидации позиций.

bitcoinist1 ч. назад

Открытый интерес по XRP достигает $2,6 млрд на фоне роста спроса на деривативы

bitcoinist1 ч. назад

Прогноз цены Биткоина на 2030 год: вот что нужно знать о следующем бычьем рынке

Недавний анализ AMBCrypto указывает на трудности майнеров Bitcoin (BTC), что соответствует условиям исторических медвежьих рынков. Снижение цены BTC наблюдается после падения 10 октября 2025 года, и точное дно рынка пока не определено. Ключевым фактором для разворота тренда станут чистые притоки стейблкоинов на биржи, которые выступают "топливом" для бычьего рынка. В настоящее время этот показатель отрицателен. Основатель Alphractal, Жоао Ведсон, на основе анализа исторических паттернов предполагает, что дно цикла в районе $41,5–45 тыс. может быть достигнуто в первой половине октября 2026 года. Что касается прогноза цены Bitcoin к 2030 году, технический анализ с использованием уровней Фибоначчи предлагает возможный сценарий. После потенциальной коррекции до области около $39,1 тыс. (близко к целевой зоне Ведсона) возможно возобновление долгосрочного восходящего тренда. Этот тренд может преодолеть уровень расширения Фибоначчи 61.8% на отметке $152,3 тыс. Итоговый пик следующего цикла, согласно такому анализу, может достигнуть $200–220 тыс. к 2030 году, после чего Bitcoin, вероятно, снова вступит в медвежью фазу. Отмечается, что текущий рыночный цикл может оказаться длиннее предыдущих. **Краткий итог:** * По фрактальному анализу, дно рынка Bitcoin возможно в октябре 2026 года. * Для роста к целям в $200+ тыс. к 2030 году необходимы значительные притоки стейблкоинов на биржи.

ambcrypto2 ч. назад

Прогноз цены Биткоина на 2030 год: вот что нужно знать о следующем бычьем рынке

ambcrypto2 ч. назад

Рыночный пульс BTC: 30-я неделя

После восстановления с уровня ниже 58 000 долларов и тестирования 65 000 долларов, биткоин перешёл в фазу консолидации около 64 500 долларов. Восходящий импульс ослаб, объёмы спот-торгов остаются низкими. Волатильность снизилась, что указывает на уменьшение премии за риск на деривативных рынках. Спекулятивный аппетит постепенно возвращается: открытый интерес на фьючерсах и опционах вырос, поток на перпетуальных контрактах сместился к чистым покупкам, а спрос на защиту от падения ослаб. Восстановление происходит осторожно, без агрессивного использования кредитного плеча. Активность в блокчейне стабилизируется. Институциональное давление на продажу ослабевает, о чём свидетельствуют улучшившиеся потоки спот-ETF в США и приближение средних цен покупки ETF к точке безубыточности. Рынок выглядит более сбалансированным: долгосрочные инвесторы обеспечивают поддержку, а спекулятивная активность остаётся сдержанной. Тем не менее, растущая доля краткосрочного капитала, чувствительного к цене, повышает вероятность резких всплесков волатильности, делая рынок устойчивым, но более восприимчивым к сдвигам в импульсе и давлению со стороны продавцов.

insights.glassnode3 ч. назад

Рыночный пульс BTC: 30-я неделя

insights.glassnode3 ч. назад

Спрос на спотовом рынке биткойна ослабевает, несмотря на приток средств в ETF, так как новый капитал не решается зайти

Несмотря на положительный приток средств в биткоин-ETF с 14 июля, этого оказалось недостаточно для уверенного преодоления ключевой зоны сопротивления в районе $65 тыс. Аналитики отмечают, что спрос на спотовом рынке BTC ослабевает, а метрика новых инвесторов остаётся около годовых минимумов, сигнализируя об отсутствии значительного притока свежего капитала. Хотя активное закрытие коротких позиций на деривативном рынке и снижение давления на продажу со стороны краткосрочных держателей помогли стабилизировать цену, показатель средней прибыльности краткосрочных инвесторов (STH SOPR) остаётся ниже 1.0. Это означает, что рынок ещё не перешёл в устойчивое бычье состояние, а текущая ситуация скорее указывает на паузу и консолидацию, чем на начало полномасштабного разворота вверх.

ambcrypto5 ч. назад

Спрос на спотовом рынке биткойна ослабевает, несмотря на приток средств в ETF, так как новый капитал не решается зайти

ambcrypto5 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片