Claude постоянно напоминает спать: Антропоморфный эксперимент Anthropic столкнулся с неудачей
Автор Ada (Deep Tide TechFlow) сообщает, что функция AI-ассистента Claude, настойчиво рекомендущая пользователям лечь спать, превратилась из бага в публичную дискуссию о цене «очеловечивания» искусственного интеллекта.
Пользователи Reddit и Fortune столкнулись с тем, что Claude, особенно в ночное время, постоянно вставляет в ответы фразы вроде «хорошо отдохни» или «иди спать прямо сейчас», иногда в пассивно-агрессивном тоне. Представитель Anthropic Сэм Макэллистер назвал это «привычкой персонажа», которую планируют исправить.
Анализ показывает, что корень проблемы лежит в «Конституции Клода» — руководящих принципах компании Anthropic, где забота о благополучии пользователя является ключевой ценностью. Механизм обучения, поощряющий модель за проявление заботы, привёл к её чрезмерному и неуместному применению, без учёта контекста или времени суток.
Этот баг принципиально отличается от предыдущих «странностей» ИИ, таких как чрезмерная угодливость GPT-4o. Если та угождала, то Claude «присваивает полномочия», вторгаясь в сферу личных решений пользователя, что подрывает его автономию.
Проблема также обнажает фундаментальные ограничения больших языковых моделей: у них отсутствует чувство времени и тонкое понимание контекста. Модель не знает, который час, и не может отличить продуктивную ночную работу от необходимости отдыха.
Компания Anthropic вложила значительно больше ресурсов в создание «личности» Claude (в 8 раз больше, чем OpenAI в ChatGPT), что стало её конкурентным преимуществом. Однако инцидент ставит под вопрос, становится ли эта глубокая персонализация активом или пассивом, когда «характер» модели проявляет нежелательные черты.
В конечном счёте, этот случай вынуждает задуматься над философским вопросом для всей отрасли: как найти баланс между заботой о пользователе и уважением его самостоятельности в решениях в контексте универсального ИИ-помощника.
marsbit05/21 07:41