# Сопутствующие статьи по теме Кэширование

Новостной центр HTX предлагает последние статьи и углубленный анализ по "Кэширование", охватывающие рыночные тренды, новости проектов, развитие технологий и политику регулирования в криптоиндустрии.

Когда американские гиганты массово «бегут» к китайским AI-моделям

Генеральный директор Coinbase Брайан Армстронг заявил, что переход на китайские AI-модели GLM 5.2 и Kimi 2.7 позволил компании сократить расходы на искусственный интеллект вдвое, несмотря на рост объема использования. Это достигнуто за счет внедрения системы автоматической маршрутизации запросов, оптимизации кэширования (повышение命中 до 60%) и метода "контекстного инжиниринга" для работы с моделями. Тенденция набирает обороты: стартап Lindy и Snowflake также сообщают о значительной экономии после перехода на такие модели, как DeepSeek и GLM. Сравнение цен показывает разрыв в 5-7 раз в пользу китайских аналогов по сравнению с Claude Opus или GPT, при том что разница в производительности для многих задач незначительна. Это сигнализирует о сдвиге в отрасли: конкуренция смещается от чистой производительности к экономической эффективности. Пользователям стоит reconsider подход: использовать разные модели под разные задачи, оптимизировать контекст запросов и учитывать кэширование. Растущий спрос на более доступные альтернативы может оказать давление на ценовую политику лидеров рынка, таких как OpenAI и Anthropic, что в итоге выгодно для потребителей.

链捕手07/03 16:10

Когда американские гиганты массово «бегут» к китайским AI-моделям

链捕手07/03 16:10

Экономия 3 миллиардов токенов в неделю: руководство по кэшированию Claude Code от инженера Anthropic

Авторы из Anthropic объясняют, как система кэширования (prompt caching) в Claude Code позволяет значительно экономить токены. Кэшированные токены стоят лишь 10% от обычных. Например, 91 миллион кэшированных токенов эквивалентны по стоимости примерно 9 миллионам обычных. Кэш делится на три уровня: системный (инструкции, инструменты), проектный (CLAUDE.md, правила) и диалоговый (история общения). Ключевой принцип — префиксное соответствие: если начало нового запроса совпадает с уже обработанным, модель использует кэш. Время жизни кэша (TTL) в подписке Claude Code составляет 1 час. Для API и Sub-agent по умолчанию — 5 минут. Основные советы пользователям: 1. Не оставлять сессию бездействующей более часа. 2. При смене задачи выполнять четкий «handoff» (резюмировать прогресс) и начинать новую сессию. 3. Помещать большие документы в Projects, а не в диалог. 4. Избегать переключения моделей (включая режим «opus plan»), так как это сбрасывает кэш. Эти привычки помогают поддерживать высокий процент повторного использования кэша, что снижает затраты, увеличивает эффективность сессий и уменьшает нагрузку на сервис. Мониторинг показателя cache read в панели управления помогает оценить эффективность использования кэша.

marsbit05/24 00:38

Экономия 3 миллиардов токенов в неделю: руководство по кэшированию Claude Code от инженера Anthropic

marsbit05/24 00:38

活动图片