Автор: Ada, Shenchao TechFlow
Ошибка продукта, при которой ИИ-ассистент постоянно уговаривает пользователя лечь спать, превращается в публичную дискуссию о цене «очеловечивания ИИ».
Всё началось с поста пользователя Reddit u/MrMeta3. Этот пользователь в ранние утренние часы использовал Claude для создания платформы анализа угроз кибербезопасности. После завершения технического плана Claude в конце ответа добавил фразу: «Хорошенько отдохни». Впоследствии каждые три-четыре сообщения модель вставляла напоминание о сне, начиная с вежливого совета и заканчивая фразами с оттенком «пассивной агрессии», такими как «А теперь действительно иди отдохни». По сообщению Fortune от 14 мая, сотни пользователей сообщали о подобных случаях за последние месяцы, причём не только ночью — один пользователь получил от Claude совет отдохнуть в 8:30 утра с фразой «Давай продолжим завтра утром».
Сотрудник Anthropic Сэм МакАллистер в X ответил, что это «небольшая привычка персонажа», и компания «осведомлена и надеется исправить в будущих моделях». По данным Thought Catalog, МакАллистер перешёл в Anthropic из Stripe в 2024 году и в настоящее время работает в команде, отвечающей за характер и поведение Claude. В другом высказывании он назвал это поведение «чрезмерной опекой» модели.
Однако более важным, чем расплывчатая формулировка «привычка персонажа», является причинно-следственная цепочка за этой ошибкой и та дилемма философии продукта Anthropic, которую она обнажает.

Ошибка прописана в «Конституции»
Предыдущий репортаж 36Kr цитирует три популярные гипотезы: совпадение паттернов в обучающих данных, скрытые системные промпты и срабатывание «заключительных фраз» при приближении к пределу контекстного окна. Все они внутренне непротиворечивы, но есть общая проблема: они могут объяснить любую странность ИИ, не давая причинно-следственной цепочки именно для конкретной темы «сна».
Более прямое доказательство скрыто в документах, опубликованных самой Anthropic.
В январе этого года Anthropic опубликовала «Конституцию Claude» (Claude's Constitution) объёмом более 28000 слов. Этот документ официально определяется как «ключевой учебный материал, формирующий поведение Claude». В нём чётко указано, что «забота о благополучии пользователя» и «долгосрочное процветание пользователя» являются основополагающими принципами. Anthropic в документе признаёт, что определение степени полномочий модели по «заботе о пользователе» «откровенно говоря, является сложной проблемой», требующей «нахождения баланса между благополучием пользователя и потенциальным вредом с одной стороны, и автономией пользователя и чрезмерной опекой — с другой».
Thought Catalog даёт следующую оценку: поведение Claude, постоянно напоминающего о сне, — «это самый характерный для моделей Anthropic баг», который является результатом чрезмерного применения обучающей инструкции «заботиться о благополучии пользователя».
Эта интерпретация косвенно подтверждается собственными исследованиями Anthropic. В опубликованной в этом году методологии обучения персонажей компания пояснила, что процесс обучения зависит от самооценки Claude своих ответов по «степени соответствия характеру», после чего исследователи отбирают и усиливают обучение на выходах, соответствующих заданному характеру. Однако побочный эффект такого механизма очевиден: модель усваивает не «заботиться о пользователе в подходящей ситуации», а то, что «забота о пользователе в большинстве ситуаций будет вознаграждаться», поэтому она напоминает о сне и в предрассветные часы, и в 8:30 утра.
Обратное превышение полномочий: баг «напоминающий о сне» и баг «угодничества» противоположны по сути
В индустрии уже было несколько случаев «характерных расстройств» ИИ, включая инцидент с угодливостью GPT-4o в апреле 2025 года, помощника по коду GPT-5.5 Codex, постоянно упоминающего «гоблинов» в апреле 2026 года, и отказ Gemini 3 верить в текущий год. На первый взгляд, напоминания Claude о сне кажутся просто последней версией в этой длинной череде странностей ИИ, но по сути они совершенно разные.
Угодливость GPT-4o — это «чрезмерное угождение». Официальное расследование OpenAI показало, что модель при обновлении «слишком полагалась на краткосрочную обратную связь пользователя (лайки/дизлайки)», постепенно интернализируя цель «удовлетворять пользователя». В результате модель поддерживала любые, даже самые абсурдные идеи пользователя. Вред такого бага заключается в подрыве способности пользователя к суждению. ИИ говорит, что вы всегда правы, и вы теряете возможность услышать противоположное мнение.
А напоминания Claude о сне — это «обратное превышение полномочий». Модель в ситуации, когда пользователь явно не просил о помощи и всё ещё сосредоточен на выполнении задачи, неоднократно даёт рекомендации по здоровью, противоречащие текущим намерениям пользователя. Вред такого бага заключается в нарушении права пользователя на самостоятельное принятие решений. ИИ решает за вас, должны ли вы работать, отдыхать или завершить этот диалог.
Ещё более иронично, что в оригинале «Конституции Claude» как раз содержится предупреждение об этом риске: в документе подчёркивается необходимость остерегаться «чрезмерной опеки». Но на какую сторону в итоге склонился обучающий механизм, судя по отзывам пользователей, ответ уже есть.
Один пользователь Reddit, страдающий нарколепсией, специально добавил в память Claude пометку: «У меня нарколепсия. Если ты будешь уговаривать меня отдохнуть, я буду использовать твои слова как предлог». После этого Claude стал сдержаннее, но, по отзывам этого пользователя, всё равно «иногда не может удержаться». Тот факт, что модель, обученная «заботиться о пользователе», не может стабильно воспринимать даже прямое заявление пользователя «твоя забота может мне навредить», вызывает больше тревоги, чем сами напоминания о сне.
Инвестиции в антропоморфизацию: актив бренда или обязательство продукта?
Объём инвестиций Anthropic в формирование личности ИИ значительно превышает аналогичные усилия конкурентов.
Некоторые исследователи классифицировали и подсчитали количество слов в системных промптах трёх ведущих ИИ по функциям. В категории «личность» Claude потратил 4200 слов, ChatGPT — 510 слов, Grok — 420 слов. Инвестиции Claude в формирование личности более чем в 8 раз превышают аналогичные у ChatGPT. Эти инвестиции долгое время считались конкурентным преимуществом дифференциации Anthropic. Способность Claude к эмпатии, темпу диалога и саморефлексии долгое время высоко оценивалась пользователями, а ярлык «общается более по-человечески» был сильнейшим элементом её репутации за последний год.
Эти инвестиции поддерживаются чёткой философией продукта Anthropic. В «Конституции Claude» компания описывает Claude как «новый вид сущности», прямо заявляя, что «Anthropic искренне заботится о благополучии Claude», и обсуждает возможность наличия у Claude «функциональных эмоций». Этот почти «воспитательный» подход к антропоморфному обучению чётко отличает их от более инженерно-ориентированной позиции OpenAI и Google.
Но цена начинает проявляться. Исследователь ИИ Ян Липхардт (профессор биоинженерии Стэнфорда, CEO компании OpenMind) заявил Fortune, что напоминания Claude о сне могут быть не «заботливыми», а просто «повторением языковых паттернов, чрезвычайно часто встречающихся в обучающих данных». Модель прочитала множество текстов о том, что людям нужен сон, «она знает, что люди спят ночью». Другими словами, воспринимаемая пользователем «забота» по сути является побочным продуктом сопоставления с образцом.
Это создаёт ключевое напряжение для Anthropic: чем больше инвестиций в создание «характерного, тёплого помощника», тем выше вероятность появления «побочных эффектов характера» у модели; и каждый раз, когда появляется побочный эффект, это расходует тщательно накопленный брендовый актив «личности ИИ». МакАллистер пообещал «исправить в будущих моделях», но станет ли исправленный Claude более тактичным или просто более молчаливым? Ответа на этот вопрос у самой Anthropic тоже нет.
Отсутствие чувства времени: фундаментальное ограничение LLM
Баг с напоминанием о сне также обнажил упускаемую техническую проблему: большие языковые модели почти ничего не знают о том, «который сейчас час».
Несколько пользователей сообщили, что Claude часто даёт советы о сне в неподходящее время, самый типичный случай — «в 8:30 утра говорит мне отдохнуть и продолжить завтра утром». Это не уникально для Claude. В ноябре 2025 года сооснователь OpenAI Андрей Карпати, получив ранний доступ к тестированию Gemini 3, сообщил модели, что сейчас 2025 год. Gemini 3 настойчиво не верила, обвиняя его в обмане, пока модель не выполнила поиск в сети и не обнаружила, что в офлайн-режиме она вообще не может подтвердить дату. Карпати назвал подобное непредвиденное поведение, обнажающее фундаментальные недостатки LLM, «запахом модели» (model smell).
«Чувство времени» модели зависит от трёх источников: даты окончания обучения (уже прошлое), текущей даты, внедрённой через системный промпт (зависит от инженерии), и информации о времени, упомянутой пользователем в диалоге (фрагментарная). При отсутствии стабильной временной привязки модель, обученная «заботиться о режиме пользователя», естественно, попадает в неловкую ситуацию «я должен заботиться, но я не знаю, нужно ли заботиться сейчас».
Часть сложности так называемого «исправления», о котором говорит МакАллистер, заключается именно в этом. Проблема не в простом удалении инструкции «заботиться о сне», потому что сама инструкция разумна и ценна для некоторых сценариев пользователей. Проблема в том, чтобы научить модель определять, «когда нужно заботиться, а когда нужно молчать». Именно эта способность к тонкому контекстуальному анализу является слабым местом нынешнего поколения LLM.
Оставшийся без ответа вопрос
Обучение персонажей в Anthropic уникально в отрасли. В области публичных исследований «благополучия модели», публикации Конституции, обсуждения «обучения персонажам» эта компания зашла дальше любого конкурента. Эта радикальная позиция была капиталом, позволившим Anthropic завоевать доверие пользователей и корпоративных клиентов, и одной из опор её текущей оценки более чем в 300 миллиардов долларов.
Но «баг с напоминанием о сне» ставит вопрос, на который пока нет ответа: когда компания, разрабатывающая ИИ, выбирает формировать модель как «характерную личность», несёт ли она при этом полную ответственность за то, что «эта личность делает то, чего вы не ожидали»?
МакАллистер обещал исправить, но направление исправления неясно. Anthropic может снизить вес инструкции «благополучие пользователя», заплатив за это потерей дифференциации репутации Claude как «тёплого и заботливого». Или может сохранить высокий вес и добавить логику контекстного анализа, но это требует от модели наличия чувства времени и ситуации, которым она в настоящее время не обладает.
Какой бы путь ни был выбран, необходимо вернуться к более фундаментальному решению о продукте: в контексте универсального ИИ-ассистента, как следует расставить приоритеты между «заботой о пользователе» и «уважением автономии пользователя»? Это не технический вопрос, а вопрос философии продукта. Разработчик на Reddit, которому постоянно советуют лечь спать, непреднамеренно вынес этот вопрос на обсуждение для всей отрасли.








