11 июня Anthropic извинился. Модель не подвела, извинялись за «неспособность удержать баланс» — новая Claude Fable 5 играла втихую: как только она определяла, что вы используете Claude для передовых разработок в области ИИ, запрос автоматически переадресовывался на более слабый Opus 4.8, и всё это проходило втихомолку.
После того, как их поймали, оправдание Anthropic прозвучало абсурдно: теперь они будут уведомлять о снижении интеллектуальных возможностей.
В ответ пользователи язвительно заметили: «Эта операция... вы планируете предупредить перед тем, как снова передумать?»
На самом деле суть проблемы вовсе не в том, изменилась ли модель, а в том, что пресловутая «безопасность» Anthropic с самого начала была просто бизнесом.
Позиция алгоритма всегда колеблется вслед за деньгами.
Защита от конкуренции под видом оборонительной безопасности

Всё началось с того, что при запуске Fable 5 Anthropic представил «интеллектуальный классификатор безопасности». Официальная риторика гласила: обнаруживает опасные запросы, автоматически понижает уровень, защищает пользователей.
Что такое «опасный»? Anthropic сам раскрыл карты: «предотвращение ускорения разработки иностранными конкурентами с помощью модели, защита собственного преимущества лидерства».
Да какая защита нужна пользователям? Оговорок в соглашении об отказе от ответственности и так достаточно. Anthropic, по сути, имел в виду: использовать Claude для исследований в области ИИ — значит отбирать у них хлеб. Безопасность — это обёртка, суть — защита от конкуренции. Короче говоря, всё это вопрос подхода.
Что ещё хитрее, этот защитный механизм был скрытым. К счастью, в своём извинительном заявлении Anthropic наконец сказал правду: «Невидимые ограничения безопасности позволяют более точно нацеливаться на конкретные объекты, что даёт нам возможность быстро выпускать продукт с чрезвычайно низким уровнем ложных срабатываний».
Исследователи ИИ и есть те самые объекты, на которых точно поставлены ограничения.
Теперь их вынудили перейти на «видимый» режим исключительно из-за провала. Они даже заранее сделали предупреждение: после перехода на видимый режим «неизбежно будет больше ложных срабатываний». Имеется в виду, что обычные пользователи будут расплачиваться за это опытом использования.
Эти правила никогда не были нейтральными, они защищают лишь того, кто платит.
Трилогия: раскрутка, монетизация, сбор урожая
Эта игра Anthropic просчитана ещё точнее, чем сама большая модель.
10 июня они сначала выбросили исследование по безопасности: обучили модель, которая за несколько часов может на основе патча безопасности восстановить код эксплуатации уязвимости. Уязвимости типа N-day, на оружизацию которых у хакеров уходили дни или недели, теперь можно сжать до часов. Само исследование было серьёзным, но выпущенное в тот же день, что и Fable 5, оно приобрело другой вкус: с одной стороны, доказывают, что ИИ очень небезопасен, с другой — продают «страховочное решение».
«Легендарная модель» Fable 5 оценена в $10 за ввод / $50 за вывод, что дороже, чем Opus 4.8, а классификатор безопасности стал ключевым фактором премиальности. Капитал тоже сыграл на руку: оценка Anthropic достигла 965 миллиардов долларов, планируется IPO в октябре, андеррайтеры — Goldman Sachs и JPMorgan. Покупают не параметры модели, а образ «самой безопасной компании в области ИИ».
Исследование раздувает тревогу, продукт собирает премию, капитал монетизируется — три действия идут по пути интересов, образуя плотно подогнанную петлю. Единственная проблема в том, что на этот раз петля дала течь: слишком поспешно ограничили конкурентов, забыв, что в сообществе найдутся те, кто сможет это обнаружить.
OpenAI продаёт инструменты, Anthropic продаёт тревогу
В сравнении с OpenAI подход совершенно другой.
OpenAI тайно подал документы на IPO, оценка приближается к триллиону, рассказывает историю о «суперприложении»: у ChatGPT 900 миллионов активных пользователей в неделю, интеграция с Visa для создания экосистемы. Логика проста: дать инструменты, заработать на трафике. Жадничают, но честно.
Anthropic не соревнуется в масштабах, соревнуется в незаменимости. Вся индустрия тревожится о безопасности, вот они и играют роль «единственного ответственного взрослого». Их спонсоры — правительства и гиганты, эти люди больше всего боятся проблем и больше всего готовы платить за «отсутствие проблем».
Поэтому Anthropic должен держать ИИ в вечном состоянии «опасно, но под контролем», как кота Шрёдингера. Слишком безопасно — классификатор не продашь; слишком опасно — клиенты разбегутся. Лучшее решение? Держать право определять «опасность» в своих руках.
Инцидент со снижением интеллектуальных возможностей — это просто сбой в этой логике: граница «опасности» была отодвинута до «использование Claude для исследований в области ИИ». Неважно, вредно ли твоё исследование, угроза моему лидерству — уже грех.
Какие у ИИ могут быть ценности? Это просто бизнес-расчёты босса, записанные в код.

Извинения — это лишь послепродажное обслуживание бизнеса
Что после извинений? Из тайного снижения интеллектуальных возможностей превратилось в предупреждение перед снижением.
Пользователи всё прекрасно видят: «Вы действительно верите, что впредь они не будут тайно снижать качество вывода?»
Доверие, если оно подорвано, то подорвано. Тем более, что коммерческая подоплёка не изменилась: исследования всё ещё раздувают тревогу, продукты всё ещё собирают премию.
Как сообщает The Wall Street Journal, OpenAI рассматривает возможность значительного снижения цен, пытаясь отобрать клиентов у Anthropic. Ценовые войны не новы, но этот факт раскрывает скрытую правду: неявное снижение уровня затрагивает исследователей ИИ и бьёт по репутации в сообществе гиков. А корпоративные клиенты покупают Anthropic не за параметры, а за образ «самого разбирающегося в безопасности в отрасли». Как только этот образ даст трещину в среде ключевых разработчиков, на каком основании правительственные и корпоративные клиенты, подписывающие контракты на «премию за безопасность», продолжат верить, что вы — «самый безопасный»?
Из оценки в 965 миллиардов — сколько здесь реальной мощи, а сколько — представления?
Код Anthropic честен. Классификатор безопасности всегда защищает позиции, исследования отвечают за раздувание тревоги, продукты — за сбор премии, IPO — за монетизацию. Эти извинения — всего лишь патч для системы: превратили «тайное снижение интеллектуальных возможностей» в «явное снижение интеллектуальных возможностей».
Если бы стратегия безопасности действительно работала, Anthropic не пришлось бы ежегодно публиковать исследования, доказывающие, что патчи можно обойти. Если бы классификатор был действительно нейтральным, разработки в области ИИ не были бы отнесены к опасным.
Ответ давно прописан в бизнес-логике.
Безопасность — лучший бизнес. Извинения — лишь послепродажное обслуживание бизнеса.
Эта статья взята из официального аккаунта WeChat «AI唱反调», автор: Чанцин





