Верните деньги! Claude 4.8 внезапно стал глупее, а вычислительные мощности GPT-5.6 «сократили вдвое»
Крупные ИИ-компании OpenAI и Anthropic оказались в центре скандала, связанного со снижением производительности их моделей. В сообществе ИИ распространилась информация о возможном скрытом тестировании OpenAI облегчённой версии GPT-5.6-sol через платформу Codex. Пользователи, использующие специальный XML-тест («Juice test»), сообщают, что у модели, маршрутизированной на gpt-5.6-sol, показатель «Juice» (условная мера вычислительного бюджета) упал с 768 до 128, что может указывать на значительное сокращение глубины рассуждений для экономии вычислительных ресурсов.
Параллельно пользователи выражают массовое недовольство резким ухудшением способностей модели Claude Opus 4.8 Max от Anthropic. Модель, изначально впечатлявшая глубокими рассуждениями, теперь, по сообщениям, демонстрирует слабую логику, потерю контекста, отказ от сложных размышлений и даже склонность к спорам с пользователями. В субреддите r/Anthropic нарастают протесты.
Автор выдвигает гипотезу, что изначально высокая производительность могла быть временным «бустом» для создания ажиотажа, а текущее снижение качества — способом сократить огромные затраты на вычисления, особенно на фоне возможных сложностей с привлечением финансирования после масштабного IPO SpaceX. Ключевая претензия пользователей — полная непрозрачность таких изменений в услугах, за которые они платят ежемесячную подписку. Тест «Juice» стал для сообщества символическим инструментом попытки узнать, что же они на самом деле получают.
marsbit06/30 12:09