¡Acaba de exponerse GPT-6 por OpenAI! Se rumorea que tiene 10 billones de parámetros y será lanzado a la fuerza en agosto

marsbitPublicado a 2026-08-10Actualizado a 2026-08-10

Resumen

Según informes de filtraciones, OpenAI podría lanzar GPT-6 (también conocido como Astra), un modelo con aproximadamente 10 billones de parámetros, en agosto. Esta versión, que superaría en escala a GPT-4, enfrentaría la competencia directa de Anthropic, que planea presentar su modelo Fable 5.1 en el mismo mes. Además, se menciona un proyecto futuro aún más ambicioso llamado "Doug", que sería el modelo de preentrenamiento más grande de OpenAI hasta la fecha, entrenado potencialmente con la próxima generación de chips de Nvidia. Se especula que Doug podría lanzarse a finales de año. El artículo sugiere que OpenAI busca recuperar su ventaja competitiva en preentrenamiento a gran escala, un área donde rivales como Anthropic habrían tomado la delantera. También destaca un cambio en el panorama de la IA, donde Google y DeepMind parecen perder impulso, dejando a OpenAI y Anthropic como los principales contendientes en la carrera por la supremacía de los modelos de lenguaje avanzados.

¡GPT-6 con 10 billones de parámetros será lanzado este mes!

Acaba de surgir una noticia explosiva en X.

El periodista de inteligencia artificial ChrisGPT filtró que, incluso bajo la presión de la supervisión gubernamental, GPT-6 (Astra) aún se lanzará en agosto.

GPT-6 es el modelo Astra cuyo lanzamiento OpenAI suspendió de emergencia ayer.

Hace nueve meses, OpenAI comenzó a esforzarse más, reasignando recursos computacionales. Al darse cuenta de que Anthropic llevaba la delantera en el preentrenamiento, ¡OpenAI se puso nervioso!

Se estima que GPT-4 tiene aproximadamente 1.8 billones de parámetros. Si Astra realmente tiene 10 billones de parámetros, sería más de cinco veces mayor que GPT-4.

En cualquier caso, OpenAI ha invertido una escala sin precedentes en preentrenamiento.

No se apresuren, aún hay más.

La segunda revelación de ChrisGPT es la "bestia épica" de fin de año con el nombre en código Doug.

No solo es el modelo de preentrenamiento más grande hasta la fecha de OpenAI, sino que supuestamente hace que Fable parezca un producto primitivo.

Además, no es GPT-6.

Pero este modelo necesita ser preentrenado primero y luego pasar por extensas pruebas de seguridad cibernética, por lo que su lanzamiento podría retrasarse hasta antes de noviembre.

Casualmente, hace poco, el presidente de OpenAI, Greg, retuiteó una publicación en X:

GPT-4 se entrenó precisamente hace cuatro años, el 8 de agosto.

La industria especula que GPT-4 tenía 1.8 billones de parámetros. Cuatro años después, ¡GPT-6 alcanza los 10 billones de parámetros, completando un salto aterrador en orden de magnitud!

Se puede inferir que GPT-6 exhibirá capacidades de razonamiento lógico y generalización inimaginables.

La bestia final de fin de año, Doug:

Reduce a Fable 5 a un "hombre primitivo"

El nombre Doug no solo fue mencionado por ChrisGPT; anteriormente, la conocida institución SemiAnalysis también lo había mencionado.

Según la información filtrada, la base computacional de Doug es extremadamente lujosa.

El conocido experto en información de vanguardia, Pankaj Kumar, señaló que es muy probable que Doug haya sido entrenado utilizando los futuros chips Vera Rubin de Nvidia, ¡aún no desplegados ampliamente!

En general, OpenAI está jugando una partida muy grande.

En agosto, primero sorprenderá con GPT-6 de 10 billones para atraer a los usuarios; a fin de año, lanzará a la bestia Doug para asegurar el primer lugar absoluto.

Tibo, quien también está en guerra con Boris, anticipó la sorpresa

Agosto, la batalla decisiva de ASI

En julio de 2026, varias fuentes filtraron que el próximo modelo de OpenAI utilizaría una nueva base de preentrenamiento (superando el "Spud" de aproximadamente 4T tokens), con una escala de aproximadamente 10T, un contexto que podría alcanzar 1.5M tokens, compitiendo directamente con Mythos/Fable de Anthropic.

Ahora la situación está clara: el lanzamiento de Astra se retrasó debido a una suspensión por seguridad, pero Anthropic no esperará.

Anthropic se prepara para lanzar Fable 5.1 en agosto, con un precio similar al de Fable 5, compitiendo directamente con Astra.

Anthropic probablemente esté utilizando una táctica de "caballo de Troya": la razón por la que Opus 5 se lanzó con moderación fue precisamente para usar a Fable 5.1 como una emboscada, esperando a que GPT-6 apareciera para interceptarlo inmediatamente.

¿Quién se convertirá en el rey de los modelos grandes? Esta pregunta se vuelve más apremiante que nunca en agosto.

Superando el "muro del preentrenamiento": el contraataque desesperado de OpenAI

¿Por qué es tan importante Doug?

Porque apunta a una realidad que toda la industria ha evitado enfrentar: desde el lanzamiento de GPT-4o en mayo de 2024, OpenAI no ha completado el preentrenamiento a gran escala del próximo modelo de vanguardia en más de dos años.

o1, o3, GPT-5 hasta GPT-5.5, esencialmente son ajustes posteriores, aprendizaje por refuerzo y cómputo de razonamiento basados en la arquitectura de la era GPT-4o. El "motor" de GPT no ha cambiado en dos años.

Debido a graves cuellos de botella en el preentrenamiento, proyectos como Orion fueron degradados por no cumplir las expectativas.

¡Pero! OpenAI nunca abandonó la línea central del preentrenamiento.

El lanzamiento de Gemini 3 a finales del año pasado hizo que Sam Altman se decidiera a cambiar el "motor".

Inmediatamente después, surgió el nuevo modelo de preentrenamiento con nombre en código Garlic. Según se informa, el director de investigación, Mark Chen, dijo al equipo que la empresa había resuelto problemas clave en el preentrenamiento.

Pero Garlic fue más un experimento de validación; Doug es el verdadero producto resultante de escalar a un tamaño mayor.

Es probable que hayan superado el cuello de botella de la degradación del rendimiento y resuelto la estabilidad de clústeres de decenas de miles de tarjetas, lo que condujo al nacimiento de Doug.

Durante mucho tiempo, SemiAnalysis ha enfatizado: las Leyes de Escalado aún son efectivas.

La serie o1 demuestra: los modelos pueden escalar continuamente en "tiempo de razonamiento".

¡Y el regreso triunfal de Doug proclama: en la dimensión fundamental del "preentrenamiento", mientras la potencia computacional y los datos sigan el ritmo, las Leyes de Escalado aún pueden crear milagros!

Solo quedan dos de los tres gigantes

Hoy, de los tres grandes, solo quedan dos.

El 5 de agosto, el panorama de IA de Google perdió una esquina.

El científico jefe de 27 años, Jeff Dean, junto con tres investigadores principales, abandonaron para emprender. El mismo día, el premio Nobel Demis Hassabis renunció como CEO de DeepMind, pasando a ser presidente. Las acciones de Alphabet cayeron más del 4% ese día.

DeepMind ya no es un laboratorio de vanguardia. El lugar que inventó el Transformer ahora está suministrando investigadores de élite a la competencia.

Hace poco, Silicon Valley aún tenía los "tres gigantes" de ASI; ahora, en la pista solo quedan OpenAI y Anthropic.

Ahora, Anthropic tiene en sus manos a Fable 5. OpenAI tiene en sus manos las iteraciones continuas 5.5, 5.6, y el próximo 6.

Actualmente, OpenAI tiene dos cartas bajo la manga: Astra en agosto y Doug a fin de año.

En los últimos dos años, OpenAI demostró que el motor viejo aún podía exprimirse mucho más. Cuando el motor se renueve, ¿qué tan rápido podrá este sistema, ya ajustado al límite, impulsar el vehículo?

Esta respuesta la revelará Doug a fin de año.

Referencias:

https://x.com/ChrisGPT/status/2086220662264250764

https://newsletter.semianalysis.com/p/gemini-is-cooked-but-gcp-is-cooking

Este artículo proviene del WeChat público "New Zhiyuan", autor: ASI Apocalipsis, editor: Aeneas Salomón

Preguntas relacionadas

Q¿Cuál es el parámetro clave que se atribuye al GPT-6 y cómo se compara con el GPT-4?

ASe atribuye al GPT-6 un tamaño de 10 billones de parámetros. En comparación, se estima que el GPT-4 tiene aproximadamente 1.8 billones de parámetros, por lo que el GPT-6 sería más de cinco veces más grande.

Q¿Qué dos modelos importantes menciona el artículo que OpenAI planea lanzar y cuáles son sus fechas estimadas de lanzamiento?

AEl artículo menciona que OpenAI planea lanzar dos modelos importantes: el GPT-6 (también llamado Astra), con lanzamiento estimado para agosto, y un modelo más grande y avanzado con el nombre en clave 'Doug', cuyo lanzamiento está previsto para finales de año, posiblemente en noviembre.

QSegún el artículo, ¿qué compañía es el principal competidor de OpenAI en la carrera por el modelo de IA más avanzado y qué modelo lanzará en agosto?

AEl principal competidor de OpenAI mencionado en el artículo es Anthropic. Se afirma que Anthropic planea lanzar su modelo Fable 5.1 en agosto para competir directamente con el GPT-6 (Astra) de OpenAI.

Q¿Qué problema fundamental de entrenamiento previo (pre-training) había enfrentado OpenAI según el artículo y cómo lo superó?

ASegún el artículo, OpenAI había enfrentado un grave cuello de botella en el entrenamiento previo, sin completar un entrenamiento a gran escala de un modelo de última generación en más de dos años desde el GPT-4o. Superó este problema resolviendo cuestiones clave como la degradación del rendimiento y la estabilidad de los clústeres a gran escala (de decenas de miles de chips), lo que condujo al desarrollo del modelo 'Doug'.

Q¿Qué cambio significativo ocurrió en el panorama de la IA el 5 de agosto, según se describe en el artículo?

AEl 5 de agosto, el panorama de la IA cambió significativamente con la salida de Jeff Dean, científico jefe de Google durante 27 años, y tres investigadores principales, quienes se fueron para iniciar su propia empresa. El mismo día, Demis Hassabis, ganador del premio Nobel, renunció como CEO de DeepMind para convertirse en presidente. Estos eventos hicieron que la carrera por la IA avanzada se concentrara principalmente en OpenAI y Anthropic.

Lecturas Relacionadas

Diseño de Chips: La "Reconfiguración del Flujo de Caja" y la "Ventana para la Transición de Capacidades" de la «Renta Institucional»

El sector chino de diseño de semiconductores presenta una división extrema en los resultados del primer semestre de 2026. Empresas como Jiangbolong y GigaDevice reportan enormes aumentos de beneficios, mientras que otras como StarPower y CETC Chip experimentan fuertes caídas. Este artículo argumenta que estas ganancias no se deben principalmente a la creación de valor de mercado, sino a una **"transferencia institucional" de rentas** desde los sectores usuarios finales (como la automoción) hacia los diseñadores, impulsada por la escasez de capacidad y los mandatos de sustitución de importaciones ("compliance"). Sin embargo, el análisis sostiene que, más allá de la distorsión competitiva, este mecanismo ha logrado algo crucial: una **"reestructuración institucional del flujo de caja"**. Por primera vez, muchas empresas de diseño tienen flujos de caja operativos positivos y sostenidos, rompiendo el círculo vicioso histórico de dependencia de financiación externa y ciclos de desarrollo cortos. Esto abre una **"ventana de transición de capacidades"** estructural y de largo plazo (posiblemente hasta 2030), facilitada por la escasez continua de chips y políticas que evolucionan de subsidios a una **"vinculación ecológica forzosa"**, integrando chips nacionales en cadenas de suministro clave. Para las empresas receptoras de rentas, el reto es transformar este efectivo en I+D a largo plazo (chips para IA, automoción) para construir ventajas tecnológicas reales. Paralelamente, las empresas pagadoras enfrentan un **"despeje marketizado"** doloroso pero necesario, que puede forjar alianzas más profundas con los clientes. Finalmente, empresas como Montage Technology y Fudan Microelectronics demuestran un crecimiento basado en demanda de mercado real, señalando el camino a seguir. La conclusión es que, aunque el periodo de rentas institucionales conlleva distorsiones, también proporciona una oportunidad histórica para que las empresas con visión estratégica salten de ser **"recolectoras de rentas" a "definidoras de tecnología"** con capacidades independientes de mercado.

marsbitHace 26 min(s)

Diseño de Chips: La "Reconfiguración del Flujo de Caja" y la "Ventana para la Transición de Capacidades" de la «Renta Institucional»

marsbitHace 26 min(s)

Karpathy dice que faltan diez años, pero este camino ya está abarrotado de gente

Andrej Karpathy afirmó que lograr modelos de lenguaje (LLM) con aprendizaje continuo real podría llevar una década, pero este campo ya es un área de intensa investigación y desarrollo. El aprendizaje continuo busca que los modelos aprendan de nuevas experiencias después del despliegue sin olvidar lo anterior, enfrentando el gran desafío del "olvido catastrófico". Actualmente, existen varios enfoques técnicos: 1. **Memoria externa**: Como MemGPT o las ideas de Karpathy (LLM Wiki), almacenan nuevo conocimiento en bases de datos externas, recuperándolo cuando es necesario. Es seguro pero no "internaliza" el conocimiento en el modelo. 2. **Ingeniería de contexto**: Métodos como ACE (Agentic Context Engineering) hacen evolucionar el contexto de entrada del modelo como un "manual" que mejora con la experiencia, evitando modificar los pesos del modelo. 3. **Post-entrenamiento continuo**: Actualiza los pesos del modelo mediante fine-tuning (por ejemplo, usando técnicas como LoRA o SDFT - Self-Distillation Fine-Tuning) para internalizar conocimientos, pero debe gestionar cuidadosamente el olvido. 4. **Re-pretrain o pre-entrenamiento continuo**: Entrenar el modelo base con nuevos corpus, es costoso computacionalmente y propenso al olvido. 5. **Enfoques emergentes**: Buscan redefinir el aprendizaje. SEAL permite que el modelo genere sus propias instrucciones de actualización. El "Aprendizaje Anidado" propone arquitecturas con múltiples escalas de memoria y actualización. La "Era de la Experiencia" aboga por que el AI aprenda de la interacción autónoma con entornos. En conclusión, es probable que las soluciones futuras combinen múltiples capas: memoria externa para conocimiento a corto plazo y cambios de parámetros para habilidades consolidadas. Aunque el olvido catastrófico sigue siendo un obstáculo clave, el aprendizaje continuo ha pasado de ser una aspiración a un campo de innovación activa con múltiples vías en desarrollo.

marsbitHace 32 min(s)

Karpathy dice que faltan diez años, pero este camino ya está abarrotado de gente

marsbitHace 32 min(s)

Tendencias del Mercado de Valores de EE.UU. (10 de agosto): Empleo no agrícola cae en 23,000, la inflación toma el relevo para probar nuevos máximos

**Resumen del Mercado Bursátil de EE.UU. (10 de agosto):** La semana pasada, los principales índices estadounidenses registraron sus mayores ganancias semanales desde mediados de abril, impulsados por una recuperación tecnológica y ajustes en las expectativas de tasas de interés. Las variables clave del fin de semana se centraron en las negociaciones del Estrecho de Ormuz, la asignación de capital de Berkshire Hathaway y la aprobación de fondos gubernamentales. El foco de esta semana se desplaza hacia los datos de inflación (IPC y PPI) para verificar si respaldan los precios actuales de las tasas. El informe de empleo de julio, que mostró una pérdida de 23,000 puestos de trabajo, redujo la probabilidad de un aumento de tasas en septiembre, aliviando la presión sobre las valoraciones tecnológicas. Sin embargo, si la inflación supera las expectativas o el petróleo repunta, podrían revertirse rápidamente las operaciones relacionadas con las tasas. Además, los resultados empresariales de compañías como CoreWeave, Lumentum, Cisco y Applied Materials, junto con las ventas minoristas, configurarán el sentimiento del mercado. El S&P 500 se encuentra en máximos históricos y requiere el apoyo conjunto de ganancias corporativas e inflación controlada para mantener su momentum alcista.

marsbitHace 34 min(s)

Tendencias del Mercado de Valores de EE.UU. (10 de agosto): Empleo no agrícola cae en 23,000, la inflación toma el relevo para probar nuevos máximos

marsbitHace 34 min(s)

Trading

Spot
活动图片