OpenAI acelera con una mejora de 16 veces y lanza GPT-5.6 Multi-Agent v2, abriendo un monstruoso diálogo de 741 turnos en 1 segundo

marsbitPublicado a 2026-08-17Actualizado a 2026-08-17

Resumen

OpenAI anuncia dos grandes avances en ChatGPT. Primero, una optimización masiva de rendimiento reduce el tiempo de carga de conversaciones largas en un 94%, disminuye el uso de memoria en un 41.2% y recorta las solicitudes de red en un 98.2%. Una conversación de prueba de 741 rondas ahora se abre en 1.66 segundos. En segundo lugar, se lanza oficialmente la versión Multi-Agent v2 con GPT-5.6. Este sistema permite al agente principal delegar automáticamente subtareas a modelos especializados como Sol, Terra o Luna, cada uno con su propia intensidad de razonamiento, eliminando la necesidad de elegir manualmente el modelo. Estos cambios combinados hacen que ChatGPT sea más rápido, eficiente y conviertan la interacción compleja con IA en una experiencia fluida y automática.

¡OpenAI sigue lanzando grandes noticias!

Hoy (16), un mensaje interno de Slack de OpenAI reveló que ChatGPT recibirá una actualización de rendimiento "épica".

Según los datos de pruebas técnicas, la optimización del rendimiento de ChatGPT es tan exagerada que parece "irreal":

La velocidad de carga de la aplicación se disparó un 94%, el crecimiento de la memoria heap se redujo un 87.8% y el uso total de memoria se redujo en un 41.2%.

Las solicitudes de red cayeron en un 98.2% y la carga del historial de conversación se redujo en un 99.6%.

Casi al mismo tiempo, Codex lanzó la versión GPT-5.6 "Multi-Agent v2".

El Agente principal ahora puede delegar automáticamente diferentes subtareas a diferentes modelos, y cada sub-Agente puede configurar su intensidad de razonamiento por separado.

Greg Brockman, presidente de OpenAI, señaló: "Avanzamos hacia la despedida de la selección manual de modelos".

Sin duda, esta combinación de OpenAI —

elimina directamente las tediosas "esperas" y "elecciones" para los usuarios, permitiendo que ChatGPT ofrezca una experiencia de interacción verdaderamente fluida y ultrarrápida.

ChatGPT se renueva, la carga se dispara un 94%

Muchos no saben que esta gran mejora de rendimiento de ChatGPT es una batalla clave tras la partida del "rey de la programación", Scott Gray.

Siempre, lo que más temían los usuarios de ChatGPT era que las conversaciones largas se volvieran lentas o que la página web se bloqueara por completo.

En el foro oficial de OpenAI, alguien incluso publicó una pregunta: "¿La nueva versión de Codex es más lenta?", y muchos estuvieron de acuerdo.

Esta vez, Andrew Ambrosino, responsable de Codex, compartió una captura de pantalla interna de Slack, revelando los datos:

Para las pruebas internas, usaron una conversación "monstruosa" de ¡741 turnos y un volumen de 231 MB!

Esto parece un caso extremo, pero es algo cotidiano en la era de los Agentes.

Antes, las conversaciones eran historiales de chat, con unas decenas de turnos como máximo; ahora, en una tarea un poco compleja, como leer código, ejecutar pruebas, modificar y verificar, fácilmente se superan los cientos de turnos.

Para una conversación tan intensa, el tiempo promedio para abrirla se redujo de 27.62 segundos a 1.66 segundos.

El crecimiento de memoria de toda la aplicación se redujo de 1030.7 MiB a 606 MiB;

Las solicitudes de red necesarias para abrirla una vez bajaron de 894 a 16; los elementos de sesión que debían cargarse pasaron de 15,529 a 64.

Esta es una gran optimización del front-end de OpenAI para las conversaciones extremadamente largas de ChatGPT.

Dos palabras: fluidez

¿Qué cambios puede traer?

En pocas palabras, los historiales de chat que abarcan meses se abrirán mucho más rápido.

Los desarrolladores que usan sesiones intensivas de Codex con cientos de llamadas a herramientas notarán que la interfaz es notablemente más ágil y el uso de memoria del dispositivo también disminuye.

Volver a una conversación antigua y larga ya no será tan lento como "cargar una partida guardada en una PS3 casi inservible".

Lo ingenioso es que ChatGPT ya no necesita cargar y renderizar todo el historial solo porque abres una conversación.

Puede almacenar la mayor parte del contenido y cargar solo la pequeña parte que realmente necesita la persona en ese momento.

La misma conversación, pero eliminando gran parte del trabajo innecesario.

Para quienes están acostumbrados a estar en conversaciones de IA muy largas, esto es una mejora de infraestructura que puede sonar aburrida, pero que podría elevar significativamente la experiencia del producto.

Multi-Agent v2 se lanza por completo, ya no hay que elegir GPT manualmente

Esta misma semana, OpenAI actualizó discretamente ChatGPT.

Hasta hoy, el ingeniero de OpenAI, Eric Provencher, anunció oficialmente: Multi-Agent v2 ya está disponible por completo.

Su objetivo principal: división inteligente del trabajo.

El Agente principal puede delegar automáticamente subtareas a cualquier modelo compatible, incluido Luna, y cada sub-Agente admite configurar su intensidad de razonamiento de forma independiente.

Ahora, ChatGPT/Codex tiene estas opciones:

GPT-5.6 Sol: El más potente, para codificación Agente compleja.

GPT-5.6 Terra: Principal para programación diaria.

GPT-5.6 Luna: El más rápido y económico.

Daybreak: Especializado en ciberseguridad.

GPT-5.5: Programación compleja, investigación, tareas generales.

De hecho, hace tres semanas, en la lista de modelos de Codex, Sol y Terra estaban etiquetados como multi_agent_v2, mientras que el más económico, Luna, estaba etiquetado como v1.

El resultado fue que cuando el Agente principal intentaba asignar tareas a Luna, el sistema respondía directamente con "modelo desconocido".

En GitHub, los desarrolladores abrieron al menos dos issues por este problema.

En el foro oficial de OpenAI, hubo una publicación titulada "Devuélvannos a Luna". El autor decía que antes había usado un "hook" para forzar el uso de Luna, con resultados sorprendentemente buenos, y ahora ese camino estaba bloqueado.

En el pasado, las personas tenían que seleccionar manualmente los modelos; en el futuro, el sistema Agente dividirá automáticamente, ejecutará en paralelo y resumirá los resultados, convirtiendo los modelos en recursos de cálculo internos.

Solo el 20% de los pasos de una tarea compleja requieren el modelo más potente; el resto puede delegarse a modelos más económicos.

De esta manera, se puede reducir significativamente el costo de inferencia, acelerando la transformación de ChatGPT de una herramienta de chat a una plataforma de flujo de trabajo.

ChatGPT evoluciona in situ, llega el monstruo completamente automatizado

El front-end ha limpiado la "carga histórica" y el back-end ha conectado la "distribución inteligente".

Esta combinación de "golpes en la base" por parte de OpenAI no solo permite que ChatGPT se despida definitivamente de la era de las ralentizaciones, sino que también anuncia a toda la industria:

Los modelos grandes están acelerando su evolución de "herramienta de chat" a una verdadera "plataforma de flujo de trabajo completamente automatizado".

Ya no hay que preocuparse por elegir qué modelo balancea mejor el costo, ni esperar pacientemente a que se desplieguen lentamente conversaciones monstruosas de cientos de turnos.

Solo hay que enviar la tarea compleja; el sistema se encargará automáticamente de la descomposición, la programación de modelos y el renderizado ultrarrápido.

La era de la fluidez extrema para los Agentes ha llegado realmente.

Ante un ChatGPT tan "imperceptible" y poderoso, ¿está tu productividad lista para despegar?

Referencias:

https://x.com/Ananth7e/status/2088490421676863782?s=20

https://x.com/ajambrosino/status/2088401536057827344?s=20

https://x.com/gdb/status/2088658133971509640

Este artículo proviene del WeChat público "New Zhiyuan", autor: Taozi

Preguntas relacionadas

Q¿Cuáles son los principales anuncios de rendimiento que OpenAI ha hecho para ChatGPT?

AOpenAI anunció mejoras significativas en el rendimiento de ChatGPT, incluyendo un aumento del 94% en la velocidad de carga de la aplicación, una reducción del 87,8% en el crecimiento de la memoria heap, una disminución del 41,2% en el uso total de memoria, una caída del 98,2% en las solicitudes de red y una reducción del 99,6% en la carga del historial de conversaciones.

Q¿Qué es el nuevo sistema Multi-Agent v2 de GPT-5.6 y cómo funciona?

AEl sistema Multi-Agent v2 de GPT-5.6 permite al agente principal delegar automáticamente subtareas a diferentes modelos especializados (como GPT-5.6 Sol, Terra, Luna, Daybreak o GPT-5.5). Cada sub-agente puede configurarse con una intensidad de razonamiento independiente, eliminando la necesidad de que el usuario seleccione manualmente el modelo para cada tarea.

Q¿Cómo se probó la mejora de rendimiento de ChatGPT y qué resultados se obtuvieron?

ASe probó la mejora con una conversación 'monstruosa' de 741 turnos y un tamaño de 231 MB. Los resultados mostraron que el tiempo promedio para abrirla se redujo de 27,62 segundos a 1,66 segundos. Además, las solicitudes de red pasaron de 894 a 16, y los elementos de sesión cargados disminuyeron de 15,529 a 64.

Q¿Qué problema de usabilidad resuelve la optimización del frontend de ChatGPT?

ALa optimización del frontend resuelve el problema de lentitud y bloqueo en conversaciones muy largas. En lugar de cargar y renderizar todo el historial al abrir un chat, ahora solo carga la parte que el usuario necesita en ese momento, haciendo que la experiencia sea mucho más fluida, incluso con conversaciones de meses o cientos de interacciones.

QSegún el artículo, ¿hacia qué está evolucionando ChatGPT con estas actualizaciones?

ACon estas actualizaciones, ChatGPT está evolucionando de una simple herramienta de chat hacia una 'plataforma de flujo de trabajo completamente automatizada'. La combinación de optimizaciones de rendimiento y el sistema Multi-Agent v2 permite manejar tareas complejas automáticamente, sin que el usuario tenga que preocuparse por elegir modelos o esperar cargas lentas.

Lecturas Relacionadas

Robert Kiyosaki pronostica que el oro alcanzará los 10,000 dólares y la plata los 200 dólares, ante una deuda nacional de EE.UU. que se acerca a los 40 billones de dólares

Robert Kiyosaki, autor de 'Padre Rico, Padre Pobre', advirtió sobre el rápido aumento de la deuda federal de EE.UU., que se acerca a los 40 billones de dólares. En este contexto, compartió predicciones ambiciosas para los metales preciosos, citando a Jim Rickards: el oro podría alcanzar los 10.000 dólares por onza y la plata los 200 dólares. Kiyosaki señaló que, de los dos, prefiere la plata para agosto de 2026, a pesar de que su precio actual ronda los 65 dólares. Criticó el ahorro en efectivo, afirmando que los ahorradores son los "más grandes perdedores" debido a la inflación. Aunque no proporcionó cálculos detallados, su postura se basa en la creencia de que los activos como el oro, la plata y Bitcoin protegen mejor que el dinero fiduciario frente a la devaluación. El informe del Consejo Mundial del Oro del segundo trimestre señaló factores mixtos para el oro, como la demanda de bancos centrales y la volatilidad de los ETF. Para la plata, el 'World Silver Survey 2026' proyecta un mayor déficit de mercado y un aumento de la demanda de inversión, aunque una caída en el consumo industrial. Estas condiciones podrían ofrecer cierto apoyo a los precios, pero no garantizan que se alcancen los niveles pronosticados por Kiyosaki y Rickards.

cryptonews.ruHace 10 min(s)

Robert Kiyosaki pronostica que el oro alcanzará los 10,000 dólares y la plata los 200 dólares, ante una deuda nacional de EE.UU. que se acerca a los 40 billones de dólares

cryptonews.ruHace 10 min(s)

Trading

Spot
活动图片