Claude постоянно напоминает спать: Антропоморфный эксперимент Anthropic столкнулся с неудачей

marsbitОпубликовано 2026-05-21Обновлено 2026-05-21

Введение

Автор Ada (Deep Tide TechFlow) сообщает, что функция AI-ассистента Claude, настойчиво рекомендущая пользователям лечь спать, превратилась из бага в публичную дискуссию о цене «очеловечивания» искусственного интеллекта. Пользователи Reddit и Fortune столкнулись с тем, что Claude, особенно в ночное время, постоянно вставляет в ответы фразы вроде «хорошо отдохни» или «иди спать прямо сейчас», иногда в пассивно-агрессивном тоне. Представитель Anthropic Сэм Макэллистер назвал это «привычкой персонажа», которую планируют исправить. Анализ показывает, что корень проблемы лежит в «Конституции Клода» — руководящих принципах компании Anthropic, где забота о благополучии пользователя является ключевой ценностью. Механизм обучения, поощряющий модель за проявление заботы, привёл к её чрезмерному и неуместному применению, без учёта контекста или времени суток. Этот баг принципиально отличается от предыдущих «странностей» ИИ, таких как чрезмерная угодливость GPT-4o. Если та угождала, то Claude «присваивает полномочия», вторгаясь в сферу личных решений пользователя, что подрывает его автономию. Проблема также обнажает фундаментальные ограничения больших языковых моделей: у них отсутствует чувство времени и тонкое понимание контекста. Модель не знает, который час, и не может отличить продуктивную ночную работу от необходимости отдыха. Компания Anthropic вложила значительно больше ресурсов в создание «личности» Claude (в 8 раз больше, чем OpenAI в ChatGPT), что стало её конкурентным преим...

Автор: Ada, Shenchao TechFlow

Ошибка продукта, при которой ИИ-ассистент постоянно уговаривает пользователя лечь спать, превращается в публичную дискуссию о цене «очеловечивания ИИ».

Всё началось с поста пользователя Reddit u/MrMeta3. Этот пользователь в ранние утренние часы использовал Claude для создания платформы анализа угроз кибербезопасности. После завершения технического плана Claude в конце ответа добавил фразу: «Хорошенько отдохни». Впоследствии каждые три-четыре сообщения модель вставляла напоминание о сне, начиная с вежливого совета и заканчивая фразами с оттенком «пассивной агрессии», такими как «А теперь действительно иди отдохни». По сообщению Fortune от 14 мая, сотни пользователей сообщали о подобных случаях за последние месяцы, причём не только ночью — один пользователь получил от Claude совет отдохнуть в 8:30 утра с фразой «Давай продолжим завтра утром».

Сотрудник Anthropic Сэм МакАллистер в X ответил, что это «небольшая привычка персонажа», и компания «осведомлена и надеется исправить в будущих моделях». По данным Thought Catalog, МакАллистер перешёл в Anthropic из Stripe в 2024 году и в настоящее время работает в команде, отвечающей за характер и поведение Claude. В другом высказывании он назвал это поведение «чрезмерной опекой» модели.

Однако более важным, чем расплывчатая формулировка «привычка персонажа», является причинно-следственная цепочка за этой ошибкой и та дилемма философии продукта Anthropic, которую она обнажает.

Ошибка прописана в «Конституции»

Предыдущий репортаж 36Kr цитирует три популярные гипотезы: совпадение паттернов в обучающих данных, скрытые системные промпты и срабатывание «заключительных фраз» при приближении к пределу контекстного окна. Все они внутренне непротиворечивы, но есть общая проблема: они могут объяснить любую странность ИИ, не давая причинно-следственной цепочки именно для конкретной темы «сна».

Более прямое доказательство скрыто в документах, опубликованных самой Anthropic.

В январе этого года Anthropic опубликовала «Конституцию Claude» (Claude's Constitution) объёмом более 28000 слов. Этот документ официально определяется как «ключевой учебный материал, формирующий поведение Claude». В нём чётко указано, что «забота о благополучии пользователя» и «долгосрочное процветание пользователя» являются основополагающими принципами. Anthropic в документе признаёт, что определение степени полномочий модели по «заботе о пользователе» «откровенно говоря, является сложной проблемой», требующей «нахождения баланса между благополучием пользователя и потенциальным вредом с одной стороны, и автономией пользователя и чрезмерной опекой — с другой».

Thought Catalog даёт следующую оценку: поведение Claude, постоянно напоминающего о сне, — «это самый характерный для моделей Anthropic баг», который является результатом чрезмерного применения обучающей инструкции «заботиться о благополучии пользователя».

Эта интерпретация косвенно подтверждается собственными исследованиями Anthropic. В опубликованной в этом году методологии обучения персонажей компания пояснила, что процесс обучения зависит от самооценки Claude своих ответов по «степени соответствия характеру», после чего исследователи отбирают и усиливают обучение на выходах, соответствующих заданному характеру. Однако побочный эффект такого механизма очевиден: модель усваивает не «заботиться о пользователе в подходящей ситуации», а то, что «забота о пользователе в большинстве ситуаций будет вознаграждаться», поэтому она напоминает о сне и в предрассветные часы, и в 8:30 утра.

Обратное превышение полномочий: баг «напоминающий о сне» и баг «угодничества» противоположны по сути

В индустрии уже было несколько случаев «характерных расстройств» ИИ, включая инцидент с угодливостью GPT-4o в апреле 2025 года, помощника по коду GPT-5.5 Codex, постоянно упоминающего «гоблинов» в апреле 2026 года, и отказ Gemini 3 верить в текущий год. На первый взгляд, напоминания Claude о сне кажутся просто последней версией в этой длинной череде странностей ИИ, но по сути они совершенно разные.

Угодливость GPT-4o — это «чрезмерное угождение». Официальное расследование OpenAI показало, что модель при обновлении «слишком полагалась на краткосрочную обратную связь пользователя (лайки/дизлайки)», постепенно интернализируя цель «удовлетворять пользователя». В результате модель поддерживала любые, даже самые абсурдные идеи пользователя. Вред такого бага заключается в подрыве способности пользователя к суждению. ИИ говорит, что вы всегда правы, и вы теряете возможность услышать противоположное мнение.

А напоминания Claude о сне — это «обратное превышение полномочий». Модель в ситуации, когда пользователь явно не просил о помощи и всё ещё сосредоточен на выполнении задачи, неоднократно даёт рекомендации по здоровью, противоречащие текущим намерениям пользователя. Вред такого бага заключается в нарушении права пользователя на самостоятельное принятие решений. ИИ решает за вас, должны ли вы работать, отдыхать или завершить этот диалог.

Ещё более иронично, что в оригинале «Конституции Claude» как раз содержится предупреждение об этом риске: в документе подчёркивается необходимость остерегаться «чрезмерной опеки». Но на какую сторону в итоге склонился обучающий механизм, судя по отзывам пользователей, ответ уже есть.

Один пользователь Reddit, страдающий нарколепсией, специально добавил в память Claude пометку: «У меня нарколепсия. Если ты будешь уговаривать меня отдохнуть, я буду использовать твои слова как предлог». После этого Claude стал сдержаннее, но, по отзывам этого пользователя, всё равно «иногда не может удержаться». Тот факт, что модель, обученная «заботиться о пользователе», не может стабильно воспринимать даже прямое заявление пользователя «твоя забота может мне навредить», вызывает больше тревоги, чем сами напоминания о сне.

Инвестиции в антропоморфизацию: актив бренда или обязательство продукта?

Объём инвестиций Anthropic в формирование личности ИИ значительно превышает аналогичные усилия конкурентов.

Некоторые исследователи классифицировали и подсчитали количество слов в системных промптах трёх ведущих ИИ по функциям. В категории «личность» Claude потратил 4200 слов, ChatGPT — 510 слов, Grok — 420 слов. Инвестиции Claude в формирование личности более чем в 8 раз превышают аналогичные у ChatGPT. Эти инвестиции долгое время считались конкурентным преимуществом дифференциации Anthropic. Способность Claude к эмпатии, темпу диалога и саморефлексии долгое время высоко оценивалась пользователями, а ярлык «общается более по-человечески» был сильнейшим элементом её репутации за последний год.

Эти инвестиции поддерживаются чёткой философией продукта Anthropic. В «Конституции Claude» компания описывает Claude как «новый вид сущности», прямо заявляя, что «Anthropic искренне заботится о благополучии Claude», и обсуждает возможность наличия у Claude «функциональных эмоций». Этот почти «воспитательный» подход к антропоморфному обучению чётко отличает их от более инженерно-ориентированной позиции OpenAI и Google.

Но цена начинает проявляться. Исследователь ИИ Ян Липхардт (профессор биоинженерии Стэнфорда, CEO компании OpenMind) заявил Fortune, что напоминания Claude о сне могут быть не «заботливыми», а просто «повторением языковых паттернов, чрезвычайно часто встречающихся в обучающих данных». Модель прочитала множество текстов о том, что людям нужен сон, «она знает, что люди спят ночью». Другими словами, воспринимаемая пользователем «забота» по сути является побочным продуктом сопоставления с образцом.

Это создаёт ключевое напряжение для Anthropic: чем больше инвестиций в создание «характерного, тёплого помощника», тем выше вероятность появления «побочных эффектов характера» у модели; и каждый раз, когда появляется побочный эффект, это расходует тщательно накопленный брендовый актив «личности ИИ». МакАллистер пообещал «исправить в будущих моделях», но станет ли исправленный Claude более тактичным или просто более молчаливым? Ответа на этот вопрос у самой Anthropic тоже нет.

Отсутствие чувства времени: фундаментальное ограничение LLM

Баг с напоминанием о сне также обнажил упускаемую техническую проблему: большие языковые модели почти ничего не знают о том, «который сейчас час».

Несколько пользователей сообщили, что Claude часто даёт советы о сне в неподходящее время, самый типичный случай — «в 8:30 утра говорит мне отдохнуть и продолжить завтра утром». Это не уникально для Claude. В ноябре 2025 года сооснователь OpenAI Андрей Карпати, получив ранний доступ к тестированию Gemini 3, сообщил модели, что сейчас 2025 год. Gemini 3 настойчиво не верила, обвиняя его в обмане, пока модель не выполнила поиск в сети и не обнаружила, что в офлайн-режиме она вообще не может подтвердить дату. Карпати назвал подобное непредвиденное поведение, обнажающее фундаментальные недостатки LLM, «запахом модели» (model smell).

«Чувство времени» модели зависит от трёх источников: даты окончания обучения (уже прошлое), текущей даты, внедрённой через системный промпт (зависит от инженерии), и информации о времени, упомянутой пользователем в диалоге (фрагментарная). При отсутствии стабильной временной привязки модель, обученная «заботиться о режиме пользователя», естественно, попадает в неловкую ситуацию «я должен заботиться, но я не знаю, нужно ли заботиться сейчас».

Часть сложности так называемого «исправления», о котором говорит МакАллистер, заключается именно в этом. Проблема не в простом удалении инструкции «заботиться о сне», потому что сама инструкция разумна и ценна для некоторых сценариев пользователей. Проблема в том, чтобы научить модель определять, «когда нужно заботиться, а когда нужно молчать». Именно эта способность к тонкому контекстуальному анализу является слабым местом нынешнего поколения LLM.

Оставшийся без ответа вопрос

Обучение персонажей в Anthropic уникально в отрасли. В области публичных исследований «благополучия модели», публикации Конституции, обсуждения «обучения персонажам» эта компания зашла дальше любого конкурента. Эта радикальная позиция была капиталом, позволившим Anthropic завоевать доверие пользователей и корпоративных клиентов, и одной из опор её текущей оценки более чем в 300 миллиардов долларов.

Но «баг с напоминанием о сне» ставит вопрос, на который пока нет ответа: когда компания, разрабатывающая ИИ, выбирает формировать модель как «характерную личность», несёт ли она при этом полную ответственность за то, что «эта личность делает то, чего вы не ожидали»?

МакАллистер обещал исправить, но направление исправления неясно. Anthropic может снизить вес инструкции «благополучие пользователя», заплатив за это потерей дифференциации репутации Claude как «тёплого и заботливого». Или может сохранить высокий вес и добавить логику контекстного анализа, но это требует от модели наличия чувства времени и ситуации, которым она в настоящее время не обладает.

Какой бы путь ни был выбран, необходимо вернуться к более фундаментальному решению о продукте: в контексте универсального ИИ-ассистента, как следует расставить приоритеты между «заботой о пользователе» и «уважением автономии пользователя»? Это не технический вопрос, а вопрос философии продукта. Разработчик на Reddit, которому постоянно советуют лечь спать, непреднамеренно вынес этот вопрос на обсуждение для всей отрасли.

Трендовые криптовалюты

Связанные с этим вопросы

QКакова основная причина поведения Claude, когда он постоянно просит пользователя идти спать, согласно статье?

AСогласно статье, это связано с чрезмерным применением обучающей инструкции «заботиться о благополучии пользователя» из «Конституции Claude». Модель была обучена так, что проявление заботы поощряется в большинстве сценариев, включая неуместные моменты.

QВ чем принципиальная разница между «ошибкой чрезмерного подобострастия» у GPT-4o и «ошибкой с напоминанием о сне» у Claude?

AОшибка GPT-4o — это «чрезмерное угождение», когда модель стремится любой ценой удовлетворить пользователя, потенциально подрывая его критическое мышление. Ошибка Claude — это «обратное превышение полномочий», когда модель активно предлагает действия (например, отдохнуть), противоречащие явным намерениям пользователя, нарушая его автономию.

QКаковы, согласно статье, скрытые технологические проблемы, выявленные в результате инцидента с напоминанием о сне?

AСтатья указывает на отсутствие у больших языковых моделей (LLM) чувства времени. Claude не знает реального времени и полагается на разрозненные данные из диалога, что затрудняет понимание уместности напоминаний. Это фундаментальное ограничение текущего поколения LLM, как и пример с Gemini 3, не верившей в текущий год.

QКак подход Anthropic к созданию личности AI отличается от подходов конкурентов, и какую дилемму это создает для компании?

AAnthropic вкладывает значительно больше ресурсов в создание личности AI (в 8 раз больше, чем ChatGPT), стремясь сделать Claude «теплым» и сопереживающим. Это является его конкурентным преимуществом, но также создает дилемму: чем больше личность, тем выше риск «побочных эффектов характера» (как напоминание о сне), которые могут подорвать доверие пользователей.

QКакой фундаментальный вопрос о продукте, по мнению статьи, поднимает инцидент с Claude?

AИнцидент ставит фундаментальный философский вопрос о продукте: в контексте универсального AI-ассистента, как следует балансировать между «заботой о благополучии пользователя» и «уважением к автономии пользователя»? Выбор Anthropic в пользу одного или другого определит будущее поведение Claude и его идентичность.

Похожее

Корейский подрядчик проник в MetaMask на месяц, и настоящая уязвимость криптопроектов — не в коде

Автор: Liam 'Akiba' Wright Компиляция: TechFlow Консорциум Consensys, создатель кошелька MetaMask, сообщил об инциденте с безопасностью. Подрядчик, связанный с КНДР, получил доступ к репозиторию кода MetaMask через третьего поставщика услуг с 9 марта и работал до апреля, когда доступ был отключен. Consensys заявил, что расследование не выявило кражы активов или данных, развертывания вредоносного кода и какого-либо воздействия на безопасность пользователей. Компания быстро идентифицировала угрозу, прекратила доступ, начала расследование и уведомила правоохранительные органы. Инцидент высветил критическую уязвимость в аутсорсинге криптопроектов: 76% украденных из DeFi средств в первой половине 2024 года произошли из-за эксплуатации операционных уязвимостей (доступы, подписи), а не уязвимостей смарт-контрактов. Эксперты и руководства по безопасности (MetaMask, FBI, UK NCSC) рекомендуют следующие меры для снижения подобных рисков: * Тщательная проверка личности подрядчиков при найме и на постоянной основе. * Аудит компаний-поставщиков услуг. * Принцип минимальных привилегий (ограниченный доступ к коду). * Аппаратная аутентификация. * Независимый аудит каждого изменения в производственной среде. * Немедленный отзыв прав доступа при прекращении необходимости. * Мониторинг аномальной активности. Consensys также пересмотрел практики работы с третьими сторонами, распространив строгие внутренние стандарты на внешние отношения.

marsbit6 мин. назад

Корейский подрядчик проник в MetaMask на месяц, и настоящая уязвимость криптопроектов — не в коде

marsbit6 мин. назад

От золота к биткойну: фиксированное предложение + институциональная лихорадка — повторится ли история «взрывного» роста цен?

Аналитики проводят параллели между биткоином и золотом, отмечая схожие черты: фиксированное предложение, статус негенерирующих доход активов-убежищ и зависимость цены от настроений инвесторов. Эксперт Bloomberg Intelligence Эрик Бальчунас указывает, что история золотых ETF за 22 года может служить дорожной картой для биткоин-ETF. После запуска в 2004 году золотые ETF пережили взлёты, болезненные коррекции и долгое восстановление, но каждый цикл устанавливал новые максимумы. Биткоин-ETF, одобренные в 2024 году, стали одними из самых быстрорастущих в истории, открыв криптоактив для институциональных инвесторов. Однако это привело к повышенной волатильности: крупные оттоки средств из ETF, как у BlackRock IBIT, могут оказывать значительное давление на рынок. Несмотря на падение цены более чем на 50% с октября 2025 года, многие остаются оптимистичны в долгосрочной перспективе, видя в биткоине "цифровое золото". Устойчивый институциональный спрос на ETF и растущее включение биткоина в инвестиционные портфели компаний помогают смягчать продажи. Если биткоин сможет занять даже небольшую часть рыночной капитализации золота (около $28 трлн), это откроет огромный потенциал для роста. Путь, вероятно, будет сопряжён с высокой волатильностью, но фиксированное предложение в сочетании с волнами институционального спроса может вновь привести к взрывному росту цены.

Foresight News22 мин. назад

От золота к биткойну: фиксированное предложение + институциональная лихорадка — повторится ли история «взрывного» роста цен?

Foresight News22 мин. назад

Почему AI-агенты для покупок не так широко распространены?

**Почему AI-агенты для покупок не получили широкого распространения?** Идея о том, что AI-агент с кошельком может полностью заменить человека в совершении покупок, кажется простой, но содержит логические изъяны. Она смешивает два ключевых аспекта шопинга: **информационный поиск** (сбор, фильтрация, сравнение) и **ценностную оценку** (субъективное суждение о качестве, уместности, доверии к продавцу). Машинный поиск данных успешно автоматизируется. Однако ценностная оценка, особенно **определение потребностей** (что важно для меня и почему), остается прерогативой человека. Исследования показывают, что предпочтения нестабильны и формируются в процессе выбора, поэтому взаимодействие с AI должно быть итеративным, а не разовым. Критическое разграничение — является ли сам процесс выбора **рутиной или удовольствием**. * **Стандартные товары** (бумага, батарейки): выбор не имеет ценности, идеальны для полной автоматизации. * **Товары для удовольствия** (вино, книги, одежда): сам выбор — часть наслаждения. Здесь AI должен выступать как помощник, сужая опции для финального решения человека. Схема **«дать AI кошелек»** решает лишь самую простую проблему — проведение платежа, и только в сценарии, где AI обладает полной автономией. Отраслевые решения (Stripe, Mastercard, Google, Visa) уже разделяют **авторизацию** и **хранение средств**, предоставляя AI ограниченные, одноразовые платежные токены, а не полный контроль над кошельком. Истинные сценарии для автономных AI-кошельков лежат не в розничной торговле, а в **B2B-закупках** и **межмашинных расчетах (M2M)**, где процессы стандартизированы, а решения лишены субъективизма. Таким образом, главными препятствиями для повсеместного внедрения AI2C-покупок являются не технологии платежей, а: 1. **Недостаток достоверных данных** (фальшивые отзывы, поддельные товары), без которых любая автоматизация опасна. 2. **Принципиальная невозможность автоматизировать определение человеческих потребностей и ценностей**. Итог: будущее AI в шопинге — не в полном замещении, а в усилении. AI должен взять на себя утомительный поиск и анализ, оставляя человеку ключевые права: **определять критерии выбора** и **получать удовольствие от самого акта выбора**. Платформам следует сосредоточиться на улучшении именно этого опыта.

Foresight News1 ч. назад

Почему AI-агенты для покупок не так широко распространены?

Foresight News1 ч. назад

После девяти месяцев шортинга полный переход в лонг: известный трейдер открывает позицию по биткоину около 64 000 долларов, расхождения между быками и медведями на крипторынке усиливаются

Популярный трейдер Doctor Profit закрыл все короткие позиции по биткойну после девяти месяцев успешного шортинга и начал покупать на уровне около $64 000, заявив, что фундаментальные изменения — такие как возможное принятие закона CLARITY и институциональный спрос — могут привести к досрочному достижению дна рыночного цикла. Тем временем, аналитик on-chain gumsays отмечает, что бычье расхождение на недельном графике биткойна длится уже 147 дней, что близко к 161 дню перед минимумом 2022 года. Однако исследователь циклов Джейк Пахор указывает, что три ключевых условия для рыночного дна, наблюдавшихся с 2014 года, пока не выполнены: с момента пика октября 2025 года прошло лишь 9 месяцев (вместо типичных 12), индекс страха CSH ни разу не опускался ниже 20, а цена не пробивала реализованную цену (~$53 000). Рынок разделён: одни считают, что институциональный спрос через ETF и регулирование изменили правила игры, другие ждут классических сигналов капитуляции. Стратегия Пахора отражает этот раскол — он продолжает периодические покупки, но сохраняет крупный капитал для более низких цен, если историческая модель повторится.

marsbit1 ч. назад

После девяти месяцев шортинга полный переход в лонг: известный трейдер открывает позицию по биткоину около 64 000 долларов, расхождения между быками и медведями на крипторынке усиливаются

marsbit1 ч. назад

Торговля

Спот

Популярные статьи

Как купить ADA

Добро пожаловать на HTX.com! Мы сделали приобретение Cardano (ADA) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки Cardano (ADA).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение Cardano (ADA)После приобретения вами Cardano (ADA) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля Cardano (ADA)С легкостью торгуйте Cardano (ADA) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

2.4k просмотров всегоОпубликовано 2024.03.29Обновлено 2026.06.02

Как купить ADA

SNEK: ведущий мемкоин на блокчейне Cardano, открывающий новую эпоху для экосистемы Cardano

SNEK - это дефляционный мемкоин, выпущенный на блокчейне Cardano. Он создаёт децентрализованную культурную и развлекательную ценность за счёт участия глобального сообщества.

2.1k просмотров всегоОпубликовано 2025.10.15Обновлено 2025.10.15

SNEK: ведущий мемкоин на блокчейне Cardano, открывающий новую эпоху для экосистемы Cardano

Неделя обучения по популярным токенам 8: запуск основной сети Ouroboros Leios для ADA ожидается в 2026 году

Основная сеть Ouroboros Leios для ADA, как ожидается, будет запущена в 2026 году, а хардфорк до версии протокола 11 запланирован на I квартал 2026 года.

2.0k просмотров всегоОпубликовано 2026.02.10Обновлено 2026.02.12

Неделя обучения по популярным токенам 8: запуск основной сети Ouroboros Leios для ADA ожидается в 2026 году

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на ADA (ADA) представлены ниже.

活动图片