Durante los próximos tres meses, los precios de la API y de los créditos (el uso bajo demanda más allá del límite incluido en el plan) se reducirán conjuntamente en más de un 20%.
Actualmente, los cambios en el lado de la API ya están en vigor de forma inmediata, y los créditos elegibles para ChatGPT Work y Codex se están enviando progresivamente.

Sin embargo, las suscripciones Pro, Plus y Business no bajan ni un céntimo. Las cantidades incluidas en los planes tampoco han aumentado.
Lo que baja es la parte que se factura por token. Es decir, cuanto más API uses, más ahorrarás.
¿Cuánto dinero se puede ahorrar realmente?
El precio anterior de la API de Sol era de 5 dólares por millón de tokens de entrada y 30 dólares por millón de salida, siendo el más caro de la familia GPT-5.6.
Ahora, si consultas la página de precios: 4 dólares de entrada, 20 dólares de salida.
La entrada baja un 20%, sin duda. Pero el recorte de salida, de 30 a 20 dólares, supone un tercio exacto.

Así que, cuando la compañía dice que los precios bajan "más del 20%", se queda corta. El token de salida, que era el más caro, ha bajado un 33% de golpe.
Supongamos que un Agente grande consume 100 millones de tokens de entrada y 20 millones de tokens de salida al mes. Antes costaba 1100 dólares, ahora solo 800, una reducción combinada de aproximadamente el 27,3%.
Cuánto ahorras exactamente depende completamente de tu proporción entrada/salida. Tareas con mucha entrada, como el procesamiento por lotes de documentos, ahorran alrededor de un 20%. Escenarios donde la salida es la protagonista, como escribir código como loco en Codex, pueden ahorrar un 30% o más.

En resumen: cuanto más uses Sol como herramienta de producción a tope, más ahorrarás con esta medida.
El nivel de caché también se ha ajustado: la entrada en caché baja de 0,5 a 0,4 dólares, y la escritura en caché baja de 6,25 a 5 dólares. Los ajustes de contexto largo también bajan: la entrada pasa de 10 a 8 dólares, y la salida de 45 a 30 dólares.

OpenAI Developers respondió más tarde diciendo que el precio puede bajar porque ahora Sol funciona de manera más eficiente.

La final de los dos gigantes ASI: el precio se convierte en el segundo campo de batalla
En la ronda anterior de reducciones de precios de OpenAI, Sol fue el único modelo que no se movió.
Luna bajó un 80% de golpe, y la principal, Terra, un 20%. Solo el buque insignia, Sol, mantuvo su precio original, aunque añadió un modo Fast que aceleraba sin coste adicional.
En ese momento, la estrategia de OpenAI era clara: los modelos baratos para el volumen, la carta más cara para mantener el prestigio.
Esta vez, le toca a Sol bajar al ring. Y en este momento, no parece una coincidencia.
El conocido 'influencer' tecnológico Chubby lo tiene claro: Esto va claramente dirigido a Anthropic.
Anthropic no está pasando por su mejor momento. Las críticas negativas sobre Opus 5 aún no se han digerido, y los límites de tasa del plan de suscripción Fable 5 están siendo muy criticados por los usuarios.
Con esta gran reducción de precios, OpenAI quiere robarle usuarios a Anthropic.
El periodista tecnológico Tae Kim va aún más allá: OpenAI está usando tácticas comerciales en el 'roadshow' de la OPV de Anthropic.

Esto no son habladurías.
Anthropic presentó el documento confidencial S-1 ante la SEC el 1 de junio de este año, iniciando oficialmente el proceso de OPV. Según varios medios, los bancos de inversión comenzaron a organizar reuniones de la dirección con posibles inversores a mediados de julio, siendo la ventana para el 'roadshow' precisamente de agosto a septiembre.
Fecha objetivo de salida a bolsa: en octubre como muy pronto, en el Nasdaq, con una valoración que apunta a los 2 billones de dólares.
En el camino hacia el 'roadshow', lo peor que puede pasar es que la competencia haga movimientos.
Tras las batallas de benchmarks, el precio se ha convertido en el segundo campo de batalla de la final entre los dos gigantes ASI.
Que OpenAI se atreva a recortar precios tan drásticamente tampoco es un impulso momentáneo.
Su apuesta anterior, agresiva, por construir su propia capacidad de cálculo y por arquitecturas de modelos más eficientes, está empezando a dar sus frutos.
Hace solo unos días, OpenAI anunció que había asegurado aproximadamente 8 IT-GW de capacidad de cálculo en el parque PORTS-Pike del condado de Pike, Ohio. OpenAI firmó un arrendamiento de 20 años; NVIDIA proporcionará en exclusiva la infraestructura de computación de IA.
Anteriormente, OpenAI también llegó a un acuerdo de cinco años con Oracle por más de 300.000 millones de dólares, correspondiente a una nueva capacidad máxima de 4,5 GW, y firmó un acuerdo de despliegue de 6 GW de GPU con AMD.
OpenAI confirmó en abril de este año que ya había asegurado una capacidad de infraestructura de IA superior a los 10 GW, con el objetivo de ampliarla a 30 GW para 2030.
Cuanto más completa es la infraestructura, menor es el coste marginal y mayor el espacio para bajar precios. Es un círculo virtuoso: la eficiencia del modelo mejora → los costes de inferencia bajan → se libera espacio de precios → llegan más usuarios → los ingresos crecen → se invierte más en infraestructura.

Podría decirse que este círculo virtuoso de OpenAI está despegando. Ellos mismos han dicho que GPT-5.6 Sol participó en la optimización de su propio núcleo de inferencia de producción, reduciendo el coste del servicio de extremo a extremo en un 20% y mejorando la eficiencia de generación de tokens en más de un 15%.
Pero esta reducción de precios, además de crear presión activamente, también tiene un componente de obligación.
DeepSeek V4 Flash se lanzó oficialmente el 31 de julio, y su precio parece no costar nada.
Y es aún más estimulante el misterioso modelo llamado "Ox Alpha" que apareció hace dos días. Ventana de contexto de 1M, admite entrada de texto, imágenes y vídeo, y es gratuito durante una semana.
Ahora, los modelos de código abierto chinos no solo son baratos, sino que sus capacidades también se están acercando continuamente a los modelos punteros.
Así que esta reducción de precios de Sol es tanto un ataque activo contra Anthropic como una defensa contra los modelos de bajo precio chinos.
Codex supera los 20 millones
El mismo día también salieron otras cifras.
Tibo, responsable de Codex, anunció que los usuarios activos de Codex superaron los 20 millones esta semana.

Para celebrar este hito, el equipo otorgó un reinicio único del límite BANKED a todos los usuarios de Codex y ChatGPT Work.
Sin embargo, respecto a los problemas reportados por la comunidad sobre el consumo demasiado rápido de los límites, Tibo dijo que actualmente no se han detectado anomalías, pero que ya se ha iniciado una investigación formal y se comunicarán los resultados en cuanto estén disponibles.
También trazó una línea clara: convertir cuentas de suscripción en tráfico de API mediante sub2api para revenderlo o compartirlo entre varias personas no está respaldado por la compañía. Este tipo de uso será marcado directamente por los sistemas de control de riesgos.
El camino de dividir una cuenta mensual para venderla a cien personas está bloqueado.
Usarlo normalmente a través del cliente oficial, o de clientes de código abierto como Pi u OpenCode, no tiene ningún problema.
Referencias:
https://x.com/OpenAI/status/2090885187634905500
https://x.com/OpenAI/status/2090885188897460249
https://x.com/kimmonismus/status/2090890956287492564
https://x.com/rohanpaul_ai/status/2090885980849050036
https://x.com/rohanpaul_ai/status/2090891370663989566
https://x.com/thsottiaux/status/2090766694897619318
Este artículo proviene de la cuenta oficial de WeChat "New Zhiyuan", autor: Revelación ASI, editor: Salomón







