Программисты по всему миру зря тратят деньги на Anthropic, и компания наконец решила вмешаться

marsbitОпубликовано 2026-08-17Обновлено 2026-08-17

Введение

Компания Anthropic опубликовала рекомендации по оптимизации затрат на использование Claude Code. Основная проблема — неэффективное использование токенов, что приводит к неоправданно высоким расходам. Средний разработчик тратит $13 в день, а ежемесячные счета достигают $150–250. Ключевые советы по экономии: 1. Очищайте контекст (/clear) после завершения задачи, чтобы не накапливать ненужные данные. 2. Фиксируйте модель и уровень сложности (effort) в начале сессии. Их смена аннулирует кеш. 3. Используйте @ для прикрепления файлов, а не указывайте пути вручную. 4. Добавляйте тихие флаги (quiet flags) к командам с большим выводом, чтобы сократить лог. 5. Сжимайте диалог (/compact), пока кеш активен (стоимость в 10 раз ниже). 6. Выносите задачи с большим выводом в Subagent, чтобы изолировать контекст. Основные принципы тарификации: * Входные токены дешевле выходных в 5 раз, так как генерация требует последовательных вычислений. * Использование кеша подсказок (prompt cache) снижает стоимость повторяющихся входных данных на 90%. * Кеш аннулируется при смене модели, уровня сложности, сжатии диалога или по истечении времени (1 час для подписчиков, 5 минут для API). * Контекст диалога неконтролируемо растет (O(n²)) из-за добавления файлов и выводов команд, увеличивая стоимость каждого нового запроса. Управление токенами становится новым критически важным навыком разработчика в эпоху AI, позволяя значительно повысить эффективность при тех же бюджетах.

Только что (15-го числа) Anthropic опубликовала пост в блоге.

Суть сообщения: Коллеги, хватит сжигать токены понапрасну, мы не можем на это смотреть!

Для этого компания подробно изложила шесть правил экономии:

1. После выполнения задачи — /clear. Починили один баг — очистите текущий диалог. Не тащите прочитанные файлы и вывод команд из предыдущей задачи в следующую, чтобы они зря не занимали контекст.

2. Сразу задавайте модель и уровень усилия (effort level). Если сменить их в процессе диалога, ранее накопленный кэш промптов полностью аннулируется, и вся история диалога будет пересчитана по полной стоимости.

3. Используйте @ для ссылки на файлы, не вводите пути вручную. Прикрепляйте файлы к сообщению с помощью @, чтобы Claude не тратил дополнительный вызов инструмента на чтение. Если вы просто напишете имя файла, Claude может сначала провести поиск и открыть несколько файлов для проверки — все эти действия попадут в историю диалога и будут учитываться в каждом последующем раунде.

4. Добавляйте параметр тишины (quiet flag) к командам с большим выводом. В CLAUDE.md укажите что-то вроде --reporter=dot, чтобы вывод тестов показывал лишь несколько строк резюме, а не сотни строк деталей. Чем короче вывод, тем меньше он занимает контекста.

5. Делайте /compact перед перерывом. Сжатие диалога, пока он еще в кэше, обойдется в десять раз дешевле. Если сделать это после возвращения, когда кэш уже истек, придется перечитать весь диалог по полной цене и только потом сжимать.

6. Задачи с большим выводом передавайте суб-агенту (subagent). Суб-агент работает в отдельном окне контекста и возвращает только итоговый результат. Файлы, которые он читает, и вывод команд в процессе не попадают в ваш основной диалог.

Жизненный путь токена

Работа в Claude Code оплачивается по объему потребления (API) или по подписке с тремя тарифами от 20 до 200 долларов в месяц.

По подсчетам компании, разработчики в среднем тратят 13 долларов в день на токены, а месячный расход составляет от 150 до 250 долларов.

И это лишь средний показатель. На исправление одного и того же бага при разных подходах к вопросам можно потратить в несколько раз больше.

Кроме того, в каждом раунде диалога повторно отправляется всё содержимое всех предыдущих раундов. Чем длиннее сессия, тем дороже каждый следующий раунд.

Чтобы понять, куда уходят деньги, нужно разобраться в логике тарификации токенов.

Каждый раз, когда вы вводите инструкцию в Claude Code, происходит два процесса.

Первый — предварительное заполнение (prefill), когда модель считывает весь ваш запрос целиком: системный промпт, CLAUDE.md, ваше сообщение и всю накопленную историю диалога. Это входящие токены.

Второй — декодирование (decode), когда модель выдает ответ по одному токену, включая её «размышления», вызовы инструментов и текст, который вы видите. Это исходящие токены.

Ключевая разница здесь.

Предварительное заполнение выполняется параллельно, все входящие токены обрабатываются GPU за один раз. Декодирование — последовательно, каждый новый токен требует отдельного прогона модели. Ответ в 200 токенов — это 200 независимых вычислений.

Поэтому неудивительно, что исходящие токены стоят в 5 раз дороже входящих.

На основе этого итоговый счет определяется двумя факторами.

Первый — модель, которая определяет цену одного токена.

Opus 5: 5$ / млн токенов (ввод), 25$ (вывод).

Sonnet 5: 2$ (ввод), 10$ (вывод).

Haiku 4.5: 1$ (ввод), 5$ (вывод).

Второй — уровень усилия (effort level), который определяет количество токенов.

Большинство исходящих токенов в сессии — это токены «размышлений», и уровень усилия как раз контролирует их объем. Чем выше уровень, тем дольше «думает» модель и тем больше токенов «размышлений» она выдает. Разница между max и low может достигать нескольких раз.

Для простых задач используйте Sonnet, для сложных — Opus. Деньги, потраченные на применение «тяжелой артиллерии» для пустяков, уходят впустую.

Кэш промптов — главный инструмент экономии

В тарификации токенов есть еще одна огромная переменная — кэширование.

Каждый запрос в Claude Code начинается с одного и того же префикса: системный промпт, определения инструментов, CLAUDE.md и история диалога.

Если префикс этого запроса побайтно совпадает с предыдущим, сервер не пересчитывает его заново, а загружает предыдущий результат вычислений.

Чтение из кэша стоит всего 0.1 от обычной цены ввода, экономия сразу 90%.

Запись в кэш дороже, максимум в 2 раза. Но запись происходит лишь один раз, а каждый последующий раунд использует чтение по цене 0.1.

Приведем пример.

Предположим, в вашей истории диалога 50 тысяч токенов. Без кэша каждый раунд перечитывания этих 50 тыс. токенов стоит полную цену. Но при попадании в кэш те же 50 тыс. токенов обойдутся в десять раз дешевле.

Если сессия включает 20-30 раундов, сэкономленная сумма благодаря кэшированию будет огромной.

Это ваш главный рычаг для экономии.

Но у кэша есть фатальный недостаток. Он должен совпадать с самого первого байта запроса подряд. Любое изменение в середине аннулирует всё после него.

Конкретно, есть шесть ситуаций:

1. Смена модели через /model: У каждой модели свой кэш. Переключение с Sonnet на Opus приводит к полному предварительному заполнению всей истории диалога по цене Opus, без скидок.

2. Смена уровня усилия через /effort: Уровень усилия — тоже часть ключа кэша. После смены вся история диалога пересчитывается.

3. Включение/выключение Fast mode: Эффект как в первых двух случаях — кэш аннулируется.

4. Сжатие диалога через /compact: Диалог переписывается в резюме, исходное содержимое больше не совпадает, старый кэш становится недействительным.

5. Истечение времени: Кэш пользователей подписки живет 1 час, у API-пользователей по умолчанию — 5 минут. После истечения следующая сессия полностью пересчитывается.

6. Восстановление старой сессии: Если прошло слишком много времени, кэш давно исчез, и почти наверняка произойдет пересчет по полной цене.

Плохая новость: любое из этих действий вернет стоимость всей истории диалога с 0.1 к полной цене.

Хорошая новость: зная, что аннулирует кэш, вы знаете, как его сохранить.

Например, фиксируйте модель и уровень усилия в начале сессии и не меняйте их. Не делайте /compact, пока кэш «горячий», делайте это перед перерывом.

Тут есть еще один скрытый подводный камень.

Режим opusplan каждый раз переключает модель при входе и выходе из плана. Вход — аннулирует кэш. Выход — снова аннулирует. Каждое переключение — это полная стоимость prefill.

Ваша сессия тайно толстеет

Кэш помогает сократить стоимость повторной отправки истории до одной десятой.

Но есть одна вещь, с которой он не справляется. Сама история постепенно раздувается с каждым раундом.

Каждый раз, когда Claude читает файл, его содержимое добавляется в диалог. Каждый раз, когда Claude запускает команду, её вывод тоже добавляется. И с того раунда, где это произошло, все последующие раунды будут нести эту информацию с собой.

40-й раунд диалога повторно отправляет всё содержимое, накопленное с 1-го по 39-й раунды.

Такой рост близок к квадратичному — O(n2).

В Claude Code есть предохранительный механизм.

Если вывод команды превышает 30000 символов, он не загружается в диалог, а записывается во временный файл, в диалоге остается лишь краткое резюме. Но вывод меньше 30000 символов ничто не контролирует.

Например, тестовый фреймворк завершил работу и вывел 400 строк с результатами, по несколько десятков символов в каждой — общий объем меньше порога в 30k.

И эти 400 строк остаются в истории диалога как есть, и каждый следующий раунд будет переотправлять их заново.

В блоге Anthropic даются несколько практических советов по «похудению».

1. Используйте @ для ссылки на файлы.

Не вводите пути вручную, заставляя Claude искать самостоятельно. Ссылка через @ прикрепляет файл прямо к сообщению, экономя операцию чтения.

Если вы просто укажете имя файла, Claude может сначала выполнить grep, открыть несколько файлов для проверки. И все эти попытки попадут в историю диалога, увеличивая стоимость.

2. Добавляйте quiet flag к «шумным» командам.

В CLAUDE.md пропишите что-то вроде «run tests with npx vitest run --reporter=dot». Тогда запуск тестов будет выводить лишь несколько точек-результатов, а не сотни строк деталей. Минута на настройку сэкономит сотни строк контекста в каждой будущей сессии.

3. Изолируйте задачи с большим выводом в суб-агенте.

Суб-агент работает в своем собственном окне контекста и возвращает только ответ. Файлы, которые он читал, и вывод команд в процессе отбрасываются. Подходит для задач вроде «проверь логи на наличие ошибок» или «просмотри этот большой файл». Вам важен вывод, а не процесс.

И самое важное правило.

4. /clear при смене задачи.

Починили один баг — /clear, начинайте следующее дело. Файлы, вывод команд, промежуточные изыскания от предыдущего бага не имеют отношения к следующей задаче, но если их не очистить, они будут занимать место и потреблять токены в каждом последующем раунде.

Если не хотите полностью очищать, используйте /compact, чтобы сжать диалог в резюме. 10-20 тысяч токенов можно сжать до 1-3 тысяч.

Кроме того, в блоге упоминается менее известная, но бесплатная операция — /rewind.

Если последние несколько раундов пошли не туда, /rewind просто отсекает их, оставляя предыдущий кэш полностью нетронутым.

Управление токенами — это тоже навык разработчика

Разобрав все эти приемы, можно заметить закономерность. У тех, кто пишет код, появляется новый набор навыков.

Он не связан с фреймворками или языками, а касается того, какую модель выбрать, как управлять контекстом, как сохранить кэш, какой уровень усилия подходит.

Эти способности год назад не существовали. Но сейчас именно они определяют, потратите ли вы на одну и ту же задачу 3 доллара или 30.

Сам Anthropic — лучший пример.

Они пишут 80% кода с помощью ИИ, объем слияний кода за год вырос в 8 раз, скорость прохождения тестов увеличилась в 52 раза. При такой интенсивности использования ИИ, если не контролировать токены, одни только затраты на вычисления могут съесть весь бюджет.

С этой точки зрения, этот пост в блоге — не просто советы по экономии, а скорее новый инстинкт, который должен развиться у тех, кто пишет код в эпоху ИИ:

понимать, что потребляет каждое ваше действие, и знать, как за те же деньги сделать больше работы.

Те, кто это поймет, сэкономят не просто несколько долларов на токенах.

Ссылки:

https://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions

Статья из WeChat официального аккаунта «新智元» (New Wisdom), автор: Моисей

Трендовые криптовалюты

Связанные с этим вопросы

QЧто такое токены предварительного заполнения (prefill tokens) и декодированные токены (decode tokens) в контексте Claude Code, и почему они имеют разную стоимость?

AТокены предварительного заполнения (prefill tokens) — это все входные данные (системные подсказки, история диалога, ваш запрос), которые модель обрабатывает параллельно за один проход. Декодированные токены (decode tokens) — это выходные данные модели (её "размышления", вызовы инструментов, финальный ответ), которые генерируются последовательно, по одному токену за вычислительный шаг. Поскольку декодирование требует многократных последовательных вычислений, выходные токены стоят примерно в 5 раз дороже входных.

QЧто такое кэширование подсказок (prompt caching) в Claude Code и как оно помогает экономить?

AКэширование подсказок — это механизм, при котором если префикс текущего запроса (системные подсказки, CLAUDE.md, история диалога) полностью совпадает с предыдущим запросом, сервер не вычисляет его заново, а загружает сохранённый результат из кэша. Чтение из кэша стоит всего 0.1 от полной цены входных токенов (экономия 90%). Это позволяет значительно снизить стоимость каждого последующего раунда в длинной сессии, где большая часть контекста остаётся неизменной.

QКакие шесть основных ошибок пользователей приводят к неэффективному расходу токенов и увеличению стоимости сессий в Claude Code?

A1. Не очищать историю (/clear) между задачами, что приводит к накоплению нерелевантного контекста. 2. Переключать модель или уровень усилия (/effort) в середине сессии, что аннулирует кэш. 3. Не использовать @ для ссылки на файлы, заставляя Claude искать их и добавлять действия в историю. 4. Не использовать "quiet flags" для команд с большим выводом, что захламляет контекст. 5. Не использовать /compact пока кэш активен, делая сжатие дороже. 6. Не использовать суб-агентов для задач с большим выводом, засоряя основную историю диалога.

QКакие действия приводят к сбросу (аннулированию) кэша подсказок в Claude Code?

AКэш подсказок аннулируется в следующих случаях: 1. Смена модели (команда /model). 2. Изменение уровня усилия рассуждений (/effort). 3. Переключение режима Fast Mode. 4. Сжатие истории диалога (/compact) — так как содержание меняется. 5. Истечение времени жизни кэша (1 час для подписчиков, 5 минут для API по умолчанию). 6. Возобновление старой, "остывшей" сессии. Любое из этих действий заставляет систему пересчитывать весь контекст по полной цене.

QКакие конкретные приёмы рекомендует Anthropic для "похудения" истории диалога и снижения затрат на токены?

AAnthropic рекомендует: 1. Использовать @ для прикрепления файлов, а не указывать пути вручную. 2. Настраивать "тихие" флаги (quiet flags) в CLAUDE.md для шумных команд (например, тестов), чтобы сократить их вывод. 3. Использовать суб-агентов (subagent) для задач с большим объёмом вывода, изолируя промежуточные данные от основной сессии. 4. Регулярно использовать /clear для завершения отдельных задач и /compact для сжатия длинной истории в краткое изложение. 5. Использовать /rewind для отмены ошибочных шагов без потери кэша предыдущей части диалога.

Похожее

CEO или «пророк»? Anthropic сталкивается с «отступничеством веры»

Статья освещает внутренние проблемы и противоречия в компании Anthropic, создателе ИИ Claude. Несмотря на рекордную оценку (около $1 трлн) и стремительный рост выручки (рост в 14 раз во втором квартале 2026 года), компания сталкивается с падением морального духа среди сотрудников и инвесторов. Критика направлена на закрытость руководства и культуру, которая изначально строилась вокруг философии безопасности ИИ, но теперь многими воспринимается как догматичная. Генеральный директор Дарио Амодеи тратит значительное время на поддержание этой культуры через специальные собрания, которые некоторые сравнивают с «проповедью». Особое беспокойство вызвало заявление Амодеи о том, что Anthropic может однажды стать «единственной частной компанией в мире», что породило сравнения с техноолигархиями из научной фантастики и опасения по поводу чрезмерной концентрации власти. Компания демонстрирует противоречия: публично выступая за безопасность ИИ, она одновременно ослабляет свои правила ответственного развития, чтобы не отставать от конкурентов, и вовлекается в политические споры, например, с администрацией Трампа по вопросам оборонных контрактов. Недавнее введение цифровых водяных знаков в вывод Claude также вызвало недовольство пользователей. Несмотря на внутренние трения и внешнюю критику, Anthropic продолжает привлекать ведущих специалистов (например, из Google и Microsoft) и показывает впечатляющие финансовые результаты. Ключевой вызов для компании теперь заключается в управлении своим первоначальным «вероучением», которое из источника силы рискует превратиться в проблему для управления и роста.

marsbit37 мин. назад

CEO или «пророк»? Anthropic сталкивается с «отступничеством веры»

marsbit37 мин. назад

Генеральный директор Anthropic опровергает слухи, обращается к ИИ после смерти отца, обещает победить рак за 10 лет

Генеральный директор Anthropic Дарио Амодеи в редком развернутом посте в социальных сетях жестко ответил на ключевые сомнения Кремниевой долины накануне потенциально крупнейшего в истории IPO компании с оценкой в $2 трлн. Он отверг распространившиеся слухи о стремлении Anthropic стать «единственной частной компанией в мире», назвав их «полной чушью». Амодеи подчеркнул, что компания, наоборот, обеспокоена чрезмерной концентрацией экономической власти. Он также ответил на критику со стороны Илона Маска и Дженсена Хуанга, заявив, что регулирование ИИ не обязательно ведет к захвату регулирования или централизации власти, и привел в пример поддерживаемый Anthropic законопроект в Калифорнии, который, по его словам, обязывает только крупнейших игроков. Главным амбициозным заявлением Амодеи стал прогноз о том, что ИИ сможет вылечить большинство человеческих болезней в течение 5-10 лет. Он объявил об усилении инвестиций Anthropic в биомедицинские исследования, пообещав представить первые обнадеживающие результаты в ближайшие месяцы. Личной мотивацией для этой миссии стала смерть его отца от гепатита С в 2006 году, незадолго до появления эффективного лекарства. Этот нарратив, представленный накануне IPO, призван переопределить восприятие Anthropic не просто как конкурента OpenAI, а как компании, решающей фундаментальные проблемы человечества. Финансовые показатели компании впечатляют: годовая выручка выросла с $1 млрд в январе 2025 года до $47 млрд в мае 2026 года, а доля на корпоративном рынке API достигла 32%, обогнав OpenAI.

marsbit37 мин. назад

Генеральный директор Anthropic опровергает слухи, обращается к ИИ после смерти отца, обещает победить рак за 10 лет

marsbit37 мин. назад

Торговля

Спот

Популярные статьи

Как купить CORE

Добро пожаловать на HTX.com! Мы сделали приобретение CORE (CORE) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки CORE (CORE).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение CORE (CORE)После приобретения вами CORE (CORE) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля CORE (CORE)С легкостью торгуйте CORE (CORE) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

794 просмотров всегоОпубликовано 2024.03.29Обновлено 2026.06.02

Как купить CORE

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на CORE (CORE) представлены ниже.

活动图片