Programadores de todo el mundo están regalándole dinero a Anthropic, y la empresa ya no puede seguir viéndolo

marsbitXuất bản vào 2026-08-17Cập nhật gần nhất vào 2026-08-17

Tóm tắt

Hace unos días, Anthropic publicó una guía esencial para que los desarrolladores ahorren costes al usar Claude Code. El gasto mensual promedio oscila entre 150 y 250 dólares, y la factura depende del modelo (Opus, Sonnet, Haiku), el esfuerzo de razonamiento y, sobre todo, de una gestión eficiente de los tokens. La clave del ahorro es aprovechar la caché de prompts, que permite reutilizar cálculos anteriores por solo una décima parte del coste. Para mantenerla activa, hay que evitar cambios durante la sesión: no cambiar de modelo, no ajustar el esfuerzo de razonamiento y no activar/desactivar el modo rápido. La compresión (/compact) debe hacerse al final, cuando la caché aún está caliente. El otro gran factor es controlar la expansión del contexto. Cada archivo leído o salida de comando se añade al historial, encareciendo cada nueva interacción (crecimiento O(n²)). Para evitarlo, Anthropic recomienda: 1. Usar @ para adjuntar archivos directamente, en lugar de hacer que Claude los busque. 2. Añadir flags silenciosos (--reporter=dot) a comandos ruidosos para reducir su salida. 3. Usar subagentes para tareas con mucha salida, aislando ese proceso. 4. Usar /clear al terminar una tarea para no arrastrar contexto irrelevante. 5. Usar /rewind para eliminar turnos de conversación desviados sin perder la caché. En resumen, dominar estos aspectos —elegir el modelo adecuado, gestionar el contexto y preservar la caché— se ha convertido en una habilidad fundamental para los desarr...

Recién (el día 15), Anthropic publicó una entrada en su blog.

El mensaje central es: ¡Oigan, dejen de quemar tokens innecesariamente, ya no podemos seguir viéndolo!

Para ello, la empresa detalló seis principios para ahorrar dinero. Aquí los presentamos:

1. /clear después de cada tarea. Después de arreglar un bug, limpia la conversación actual. No arrastres a la siguiente tarea los archivos leídos o las salidas de comandos de la tarea anterior, ocupando espacio de contexto sin necesidad.

2. Define el modelo y el nivel de esfuerzo (effort level) desde el principio. Si los cambias a mitad de camino, toda la caché de prompts acumulada se invalidará y todo el historial de la conversación se tendrá que recalcular a precio completo.

3. Usa @ para hacer referencia a archivos, no escribas la ruta manualmente. Usa @ para adjuntar el archivo directamente al mensaje; así Claude no gastará otra llamada de herramienta para leerlo. Si solo escribes el nombre del archivo, Claude podría buscarlo primero, abriendo y probando varios archivos. Todas esas operaciones entrarán en el historial de la conversación y se arrastrarán en cada turno posterior.

4. Añade parámetros de silencio (quiet flag) a comandos con mucha salida. Escribe una configuración como --reporter=dot en CLAUDE.md, para que la salida de las pruebas solo imprima un resumen de unas pocas líneas, en lugar de cientos de líneas de detalle. Menos salida = menos contexto ocupado.

5. Haz /compact antes de tomar un descanso. Comprimir la conversación mientras aún está en caché cuesta solo una décima parte. Si esperas a que la caché expire cuando regreses, tendrás que releer y comprimir todo a precio completo.

6. Delega tareas con mucha salida a un sub-Agent. El sub-Agent se ejecuta en una ventana de contexto independiente. Solo devuelve la conclusión cuando termina; los archivos leídos y las salidas de comandos durante el proceso no entran en tu conversación principal.

La vida de un token

Para trabajar con Claude Code, la API se factura por uso, y las suscripciones mensuales tienen tres niveles: desde 20 hasta 200 dólares.

Según cálculos oficiales, los desarrolladores consumen un promedio de 13 dólares en tokens al día, gastando entre 150 y 250 dólares al mes.

Y eso es solo el promedio. Arreglar el mismo bug con diferentes enfoques puede costar varias veces más.

Además, cada turno de la conversación vuelve a enviar todo el contenido acumulado de los turnos anteriores. Cuanto más larga es la sesión, más caro resulta cada turno.

¿En qué se gasta este dinero? Hay que entender la lógica de facturación de los tokens.

Cada vez que introduces un comando en Claude Code, ocurren dos cosas en segundo plano.

La primera es el prellenado (prefill), donde el modelo lee toda tu solicitud de una vez: las instrucciones del sistema, CLAUDE.md, tu mensaje y todo lo acumulado en la conversación anterior. Estos son tokens de entrada.

La segunda es la decodificación (decode), donde el modelo escribe palabra por palabra, incluyendo su razonamiento, llamadas a herramientas y el texto final que ves. Estos son tokens de salida.

La diferencia clave está aquí.

El prellenado es en paralelo; todos los tokens de entrada pasan por la GPU de una vez. La decodificación es en serie; cada token generado requiere una ejecución independiente del modelo. Una respuesta de 200 tokens son 200 cálculos independientes.

Por eso no es difícil entender que los tokens de salida sean 5 veces más caros que los de entrada.

Sobre esta base, la factura final depende de dos cosas.

Primero, el modelo, que determina el precio por token.

  • Opus 5: 5 USD / millón de tokens (entrada), 25 USD (salida).
  • Sonnet 5: 2 USD (entrada), 10 USD (salida).
  • Haiku 4.5: 1 USD (entrada), 5 USD (salida).

Segundo, el nivel de esfuerzo, que determina la cantidad de tokens.

La mayoría de tokens de salida en una sesión son tokens de "razonamiento". El nivel de esfuerzo controla esta cantidad. A mayor esfuerzo, más piensa el modelo, generando más tokens de razonamiento. La diferencia entre 'max' y 'low' puede ser de varias veces.

Usa Sonnet para tareas sencillas, y reserva Opus para los problemas difíciles. Gastar dinero en usar un martillo pilón para matar una mosca es el desperdicio más tonto.

La caché de prompts es la mayor herramienta de ahorro

En la fijación de precios de tokens hay otra variable enorme: la caché.

Cada solicitud en Claude Code comienza con el mismo prefijo: las instrucciones del sistema, definiciones de herramientas, CLAUDE.md y el historial de la conversación.

Si el prefijo de esta solicitud es idéntico (byte por byte) al de la anterior, el servidor no lo recalcula, sino que carga el resultado del cálculo anterior.

Leer de la caché cuesta solo 0.1 veces el precio normal de entrada, ahorrando directamente un 90%.

Escribir en la caché es un poco más caro, hasta 2 veces. Pero la escritura solo ocurre una vez, y cada turno posterior disfruta del precio de lectura de 0.1 veces.

Un ejemplo:

Supongamos que tu historial de conversación tiene 50,000 tokens. Sin caché, cada turno tendría que pagar el precio completo solo por releer esos 50k tokens. Pero con la caché activa, esos mismos 50k tokens cuestan solo una décima parte.

En una sesión de 20 o 30 turnos, el descuento acumulado por aciertos de caché es astronómico.

Este es tu mayor palanca para aprovechar el sistema.

Pero la caché tiene una debilidad fatal. Debe coincidir de forma continua desde el primer byte de la solicitud; cualquier cambio en medio invalida todo lo posterior.

En concreto, hay seis situaciones:

1. Cambiar de modelo con /model: Cada modelo tiene su caché independiente. Cambiar de Sonnet a Opus significa que todo el historial se prellena de nuevo al precio de Opus, sin descuento.

2. Cambiar el nivel de esfuerzo con /effort: El nivel de esfuerzo también es parte de la clave de caché. Cambiarlo hace que todo el historial se tenga que recalcular.

3. Activar/desactivar el Fast mode: Tiene el mismo efecto que los dos casos anteriores; la caché se invalida.

4. Comprimir la conversación con /compact: La conversación se reescribe como un resumen, el contenido original ya no coincide, y la caché antigua se invalida.

5. Expiración por tiempo: La caché de usuarios suscritos se mantiene 1 hora, para usuarios de API por defecto son 5 minutos. Pasado ese tiempo, el siguiente turno recalcula todo desde cero.

6. Recuperar una sesión antigua: Si ha pasado demasiado tiempo, la caché ya no existe, y es casi seguro que se recalculará al precio completo.

La mala noticia es que cualquiera de estas situaciones significa que todo el historial de la conversación pasa de costar 0.1 veces a costar el precio completo.

La buena noticia es que, sabiendo qué invalida la caché, puedes saber cómo preservarla.

Por ejemplo: bloquear el modelo y el nivel de esfuerzo al inicio de la sesión y no cambiarlos. No hacer /compact mientras la caché está activa, sino ejecutarlo cuando vayas a hacer una pausa.

Además, hay una trampa oculta.

El modo opusplan cambia de modelo cada vez que entras o sales del plan. Entrar invalida la caché una vez. Salir, la invalida otra. Saltar entre ellos significa pagar un prefill completo en cada salto.

Tu sesión se está engordando a escondidas

La caché te ayuda a reducir el coste de reenviar el historial a una décima parte.

Pero hay algo con lo que no puede ayudarte: el historial en sí se infla turno tras turno.

Cada vez que Claude lee un archivo, su contenido se añade a la conversación. Cada vez que Claude ejecuta un comando, su salida también se añade. A partir del turno en que se añade, cada turno posterior lo arrastra.

El turno 40 de una conversación está reenviando todo el contenido acumulado de los turnos 1 a 39.

Este crecimiento es casi cuadrático, O(n²).

Claude Code tiene un mecanismo de seguridad.

Si la salida de un comando supera los 30,000 caracteres, no se inserta en la conversación, sino que se escribe en un archivo temporal y solo se coloca un resumen en la conversación. Pero las salidas menores a 30,000 no tienen este control.

Por ejemplo, si un framework de pruebas termina e imprime 400 líneas de registros de aprobación, cada una de varias decenas de caracteres, el total no llega a 30,000, por lo que no alcanza ese umbral.

Así, esas 400 líneas permanecen intactas en el historial de la conversación, siendo reenviadas en cada turno posterior.

Para esto, el blog de Anthropic ofrece algunas formas prácticas de adelgazar la conversación.

1. Haz referencia a archivos con @.

No escribas manualmente la ruta para que Claude la busque. Usar @ adjunta el archivo directamente al mensaje, ahorrando una operación de lectura.

Si solo dices el nombre del archivo, Claude podría hacer primero una búsqueda con grep, abriendo varios archivos para ver cuál es correcto. Todas esas pruebas entrarán en el historial de la conversación, aumentando el coste innecesariamente.

2. Añade quiet flags a comandos "ruidosos".

Escribe en CLAUDE.md algo como «run tests with npx vitest run --reporter=dot». Así, cada vez que ejecutes pruebas solo saldrán unas pocas líneas de puntos como resultado, no cientos de líneas de detalles. Un minuto de configuración te ahorrará cientos de líneas de contexto en cada sesión.

3. Aísla tareas de gran salida con subagents.

El subagent se ejecuta en su propia ventana de contexto independiente. Solo devuelve la respuesta cuando termina; los archivos leídos y las salidas de comandos durante el proceso se descartan. Es ideal para tareas como "revisa los logs en busca de anomalías" o "analiza este archivo grande". Solo quieres la conclusión, no el proceso.

Y el principio más importante:

4. /clear al cambiar de tarea.

Después de arreglar un bug, haz /clear y comienza la siguiente cosa. Los archivos, salidas de comandos y exploraciones del bug anterior no tienen nada que ver con la siguiente tarea. Pero si no los limpias, ocuparán espacio y consumirán tokens en cada turno posterior.

Si no quieres borrarlo todo, /compact puede comprimir la conversación en un resumen. De 10,000 a 20,000 tokens se pueden comprimir a 1,000 o 3,000.

Además, el blog menciona una operación poco conocida pero gratuita: /rewind.

Si los últimos turnos se desvían, /rewind los elimina directamente, dejando la caché anterior intacta.

Gestionar tokens también es una habilidad del desarrollador

Analizando todas estas operaciones, descubres un patrón. Quienes programan están desarrollando un nuevo conjunto de habilidades.

No tiene que ver con frameworks o lenguajes, sino con saber qué modelo elegir, cómo gestionar el contexto, cómo preservar la caché y qué nivel de esfuerzo es adecuado.

Estas capacidades no existían hace un año. Pero ahora determinan si gastas 3 o 30 dólares en la misma tarea.

El propio Anthropic es el mejor ejemplo.

Escriben el 80% de su código con IA, la cantidad de fusiones de código se multiplicó por 8 en un año, y las pruebas de referencia se aceleran 52 veces. Usar la IA con esta intensidad, si nadie gestiona los tokens, solo el coste de inferencia podría agotar el presupuesto.

Desde esta perspectiva, más que consejos para ahorrar dinero, este blog habla de un nuevo instinto que quienes programan en la era de la IA deben desarrollar:

Saber qué consume cada una de tus operaciones y cómo hacer que el mismo presupuesto rinda más.

Quienes lo entiendan no solo aprovecharán unos cuantos dólares en tokens.

Referencias:

https://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions

Este artículo proviene del WeChat Official Account "New Zhiyuan", autor: Mo Xi

Tiền kỹ thuật số thịnh hành

Câu hỏi Liên quan

Q¿Cuál es la principal causa por la que un token de salida cuesta cinco veces más que uno de entrada en Claude Code?

AUn token de salida cuesta cinco veces más porque el proceso de decodificación (generar la respuesta) es secuencial y requiere ejecutar el modelo una vez por cada token, mientras que la prellenado (leer la entrada) se hace en paralelo de una sola vez.

QSegún el artículo, ¿qué dos factores determinan el coste final de una sesión en Claude Code?

AEl coste final está determinado por el modelo elegido (que fija el precio por token) y el nivel de esfuerzo de razonamiento (que controla la cantidad de tokens de "pensamiento" generados).

Q¿Cuál es el mayor beneficio del uso de caché de prompts (prompt caching) y cuándo se pierde este beneficio?

AEl mayor beneficio es que leer del caché cuesta solo el 10% del precio normal de los tokens de entrada, ahorrando un 90%. Este beneficio se pierde si se cambia el modelo, el nivel de esfuerzo, se usa /compact, se desactiva el modo rápido, expira el tiempo de caché o se recupera una sesión antigua.

Q¿Por qué recomienda el artículo usar el comando /clear después de completar una tarea como arreglar un bug?

ASe recomienda usar /clear para limpiar el diálogo después de una tarea, porque los archivos, salidas de comandos y exploraciones de la tarea anterior permanecen en el historial y se vuelven a enviar en cada turno posterior, ocupando contexto y generando costes innecesarios para la siguiente tarea.

Q¿Qué estrategia sugiere el artículo para manejar tareas que generan una gran salida (como revisar archivos de log), sin inflar el historial principal de la conversación?

AEl artículo sugiere delegar esas tareas a un subagente (subagent). El subagente se ejecuta en una ventana de contexto independiente y solo devuelve la conclusión al diálogo principal, descartando todos los archivos leídos y salidas de comandos generados durante el proceso.

Nội dung Liên quan

Elon Musk và Công ty X Tiến Thêm Bước Về Tiền Mã Hóa! Một Kỷ Nguyên Thanh Toán Mới Đang Ló Dạng! Đây Là Chi Tiết

Nền tảng truyền thông xã hội X của Elon Musk đang xem xét khả năng sử dụng stablecoin để trả thưởng cho những người sáng tạo nội dung. Theo nguồn tin, X đang đàm phán về việc sử dụng stablecoin, chủ yếu là USDC, cho các khoản thanh toán này. Kế hoạch hiện vẫn đang được thảo luận và chưa có quyết định cuối cùng hay thời điểm triển khai cụ thể. Nếu được thực hiện, nó có thể cho phép các nhà sáng tạo nội dung trên toàn cầu nhận tiền nhanh hơn dưới dạng kỹ thuật số. Các chuyên gia nhận định việc sử dụng stablecoin, đặc biệt trong thanh toán xuyên biên giới, có thể trở thành một giải pháp thay thế cho các hệ thống thanh toán truyền thống. Bài báo cũng đề cập rằng SpaceX, một công ty khác của Elon Musk, đã sử dụng stablecoin để thực hiện các khoản thanh toán xuyên biên giới cho dịch vụ Starlink ở một số quốc gia. Mặc dù chưa được phê duyệt, việc X cân nhắc sử dụng các đồng tiền kỹ thuật số như USDC được coi là một tín hiệu mới về khả năng mở rộng ứng dụng của stablecoin vào các giao dịch thanh toán kỹ thuật số hàng ngày.

cryptonews.ru2 giờ trước

Elon Musk và Công ty X Tiến Thêm Bước Về Tiền Mã Hóa! Một Kỷ Nguyên Thanh Toán Mới Đang Ló Dạng! Đây Là Chi Tiết

cryptonews.ru2 giờ trước

Nhà đầu tư tiền điện tử mất 1010 ETH do truy cập trang web Tornado Cash lỗi thời

Nhà đầu tư tiền điện tử mất 1.010 ETH do truy cập trang web Tornado Cash lỗi thời bị chiếm đoạt. Các nhà phân tích từ Wu Blockchain cho biết nạn nhân đã sử dụng dấu trang trình duyệt cũ để vào trang trộn tiền điện tử, lúc này tên miền đã bị kẻ xấu kiểm soát và triển khai giao diện giả mạo. Tin rằng mình đang tương tác với hợp đồng thông minh Tornado Cash thật, nạn nhân đã cấp quyền truy cập tài sản cho bọn lừa đảo, và số tiền bị rút sạch trong vòng 12 giờ. Số tiền bị đánh cắp, hiện nằm rải rác trên nhiều địa chỉ ví do tội phạm kiểm soát, được rút thành nhiều lần nhỏ. Nhóm Tornado Cash đã mất quyền kiểm soát tên miền cũ sau lệnh trừng phạt của OFAC Mỹ năm 2022, và kể từ đó, bọn tội phạm đã đăng ký lại và vận hành trang web lừa đảo. Trong 12 tháng qua, trang web giả này được cho là đã đánh cắp tổng cộng khoảng 4.000 ETH từ nhiều người dùng. Trong bối cảnh này, các chuyên gia bảo mật Bitdefender cũng cảnh báo về phần mềm độc hại Lumma Stealer đang được phát tán dưới vỏ bọc là bản phim lậu của bộ phim "Oppenheimer" đạo diễn bởi Christopher Nolan.

cryptonews.ru2 giờ trước

Nhà đầu tư tiền điện tử mất 1010 ETH do truy cập trang web Tornado Cash lỗi thời

cryptonews.ru2 giờ trước

Các chuyên gia phân tích: MiCA chưa gây ra đợt rút vốn toàn cầu đáng kể khỏi USDT

Các nhà phân tích cho biết Quy định về Thị trường Tài sản Crypto (MiCA) của châu Âu chưa gây ra hiện tượng rút tiền hàng loạt trên toàn cầu khỏi stablecoin USDT. Dữ liệu từ Artemis Analytics và một nghiên cứu độc lập của Đại học LUISS và Đại học Surrey chỉ ra rằng việc hạn chế USDT trên các sàn giao dịch được quản lý ở châu Âu chưa dẫn đến sự sụt giảm đáng kể về nguồn cung hoặc nhu cầu toàn cầu đối với USDT. Nghiên cứu xác nhận MiCA đã thay đổi cơ cấu giao dịch trên một số nền tảng cụ thể ở châu Âu, nơi thị phần của USDC đã tăng lên sau khi USDT bị hạn chế. Tuy nhiên, thị phần và khối lượng giao dịch tổng hợp của các stablecoin hàng đầu hầu như không thay đổi trên quy mô toàn cầu. USDT vẫn giữ vị trí dẫn đầu với vốn hóa thị trường khoảng 183 tỷ USD vào cuối tháng 7. Hoạt động với USDT tiếp tục mở rộng mạnh mẽ bên ngoài châu Âu, đặc biệt trên các mạng như BNB Chain và Tron, phản ánh xu hướng áp dụng số hóa đô la trên các thị trường mới nổi. Trong khi đó, tại châu Âu, việc Tether không đăng ký theo MiCA đã khiến nhiều dịch vụ phải hạn chế USDT. Dù vậy, dữ liệu không cho thấy sự dịch chuyển thanh khoản quy mô lớn hoặc thay đổi đột ngột trùng khớp với thời điểm MiCA có hiệu lực.

cryptonews.ru2 giờ trước

Các chuyên gia phân tích: MiCA chưa gây ra đợt rút vốn toàn cầu đáng kể khỏi USDT

cryptonews.ru2 giờ trước

Giao dịch

Giao ngay

Bài viết Nổi bật

Làm thế nào để Mua CORE

Chào mừng bạn đến với HTX.com! Chúng tôi đã làm cho mua CORE (CORE) trở nên đơn giản và thuận tiện. Làm theo hướng dẫn từng bước của chúng tôi để bắt đầu hành trình tiền kỹ thuật số của bạn.Bước 1: Tạo Tài khoản HTX của BạnSử dụng email hoặc số điện thoại của bạn để đăng ký tài khoản miễn phí trên HTX. Trải nghiệm hành trình đăng ký không rắc rối và mở khóa tất cả tính năng. Nhận Tài khoản của tôiBước 2: Truy cập Mua Crypto và Chọn Phương thức Thanh toán của BạnThẻ Tín dụng/Ghi nợ: Sử dụng Visa hoặc Mastercard của bạn để mua CORE (CORE) ngay lập tức.Số dư: Sử dụng tiền từ số dư tài khoản HTX của bạn để giao dịch liền mạch.Bên thứ ba: Chúng tôi đã thêm những phương thức thanh toán phổ biến như Google Pay và Apple Pay để nâng cao sự tiện lợi.P2P: Giao dịch trực tiếp với người dùng khác trên HTX.Thị trường mua bán phi tập trung (OTC): Chúng tôi cung cấp những dịch vụ được thiết kế riêng và tỷ giá hối đoái cạnh tranh cho nhà giao dịch.Bước 3: Lưu trữ CORE (CORE) của BạnSau khi mua CORE (CORE), lưu trữ trong tài khoản HTX của bạn. Ngoài ra, bạn có thể gửi đi nơi khác qua chuyển khoản blockchain hoặc sử dụng để giao dịch những tiền kỹ thuật số khác.Bước 4: Giao dịch CORE (CORE)Giao dịch CORE (CORE) dễ dàng trên thị trường giao ngay của HTX. Chỉ cần truy cập vào tài khoản của bạn, chọn cặp giao dịch, thực hiện giao dịch và theo dõi trong thời gian thực. Chúng tôi cung cấp trải nghiệm thân thiện với người dùng cho cả người mới bắt đầu và người giao dịch dày dạn kinh nghiệm.

Tổng lượt xem 630Xuất bản vào 2024.12.13Cập nhật vào 2026.06.02

Làm thế nào để Mua CORE

Thảo luận

Chào mừng đến với Cộng đồng HTX. Tại đây, bạn có thể được thông báo về những phát triển nền tảng mới nhất và có quyền truy cập vào thông tin chuyên sâu về thị trường. Ý kiến ​​của người dùng về giá của CORE (CORE) được trình bày dưới đây.

活动图片