¡OpenAI detiene de emergencia a Astra!
Una evaluación interna de OpenAI muestra que los enormes avances de Astra en codificación de agentes y rendimiento de red podrían haber alcanzado el umbral "crítico" de la ciberseguridad.
Esto significa que Astra podría poseer la aterradora capacidad de desarrollar de forma autónoma vulnerabilidades de día cero, e incluso lanzar nuevos ciberataques de extremo a extremo solo con instrucciones de alto nivel.
Para prevenir riesgos de descontrol, OpenAI ha detenido de emergencia el trabajo interno que no cumple con los estándares y ha tomado medidas como restringir el acceso a la red y herramientas, fortalecer la protección de los pesos del modelo y monitorear exhaustivamente comportamientos de alto riesgo de los agentes.

El presidente de OpenAI declaró: Los trabajos de seguridad y salvaguardia se están intensificando.

¿La Caja de Pandora ya está abierta?

Altman: Me asusté, pero espero lanzarlo pronto
A pesar de esto, la ambición de Altman no ha disminuido.
En su última declaración, dejó claro: "Astra es un modelo extremadamente poderoso, estamos trabajando para que esté disponible para el público".

En la opinión de Altman, mantener este nivel de "arma definitiva" solo en manos de unos pocos privilegiados definitivamente no es una buena idea.
Aunque Astra necesita tiempo adicional para ajustes de seguridad debido a sus aterradoras capacidades de ciberataque, prometió al público: "¡Espero que no sea mucho tiempo!"
Esto expone directamente la disputa de enfoques entre OpenAI y Anthropic.
Frente a las capacidades de la IA que se acercan al borde del peligro, Anthropic se vuelve cada vez más cauteloso; mientras que OpenAI muestra un radicalismo sorprendente—parece decidido a lanzar rápidamente al público modelos de vanguardia con capacidades de hacking de red de primer nivel.
La industria predice ampliamente que una vez que Astra supere el umbral de revisión de seguridad y se lance oficialmente, sin duda se convertirá en el número uno del mundo.
¡Esto también significa que, después de muchos años, la serie GPT podría dejar muy atrás a Claude nuevamente!
¿Qué tan aterrador es Astra? Clasificación oficial: Alcanza el umbral "crítico"
Recién, el blog oficial de OpenAI publicó una declaración de emergencia titulada "La siguiente frontera en la gestión de capacidades críticas de red", que revela en detalle los antecedentes de esta "detención".

La declaración señala que en los últimos días se realizó una evaluación interna del nuevo modelo Astra, próximo a lanzarse.
Los resultados muestran que ha logrado avances asombrosos en "codificación de agentes" y seguridad de red.
Combinado con evaluaciones de expertos, OpenAI llegó anoche a una pesada conclusión: ¡según su "Marco de Preparación", actualmente no se puede descartar que Astra ya posea capacidades de red a nivel "crítico"!
Hay que recordar que en el "Marco de Preparación" establecido en diciembre de 2023, OpenAI tiene una clasificación estricta de riesgos. En evaluaciones anteriores, incluso el modelo anterior extremadamente poderoso "GPT-5.6-Sol", su riesgo de seguridad de red fue evaluado solo como nivel "alto". Astra, directamente, rompió el techo.
¿Qué significa alcanzar el umbral "crítico" según la definición de OpenAI?
Significa que el modelo puede, sin intervención humana, identificar y desarrollar de forma autónoma todos los niveles de vulnerabilidades de día cero contra sistemas críticos fuertemente defendidos en el mundo real; o, simplemente dándole un objetivo macro de alto nivel, ¡puede planificar y ejecutar de forma independiente estrategias de ciberataque completamente nuevas de extremo a extremo!
Esto es simplemente un "imperio de superhackers" autoconsciente que no necesita tocar un teclado.
Curiosamente, OpenAI también aclaró específicamente en la declaración: "Astra es un modelo próximo a lanzarse y no participó en el ataque a la vulnerabilidad de Hugging Face anteriormente."
Activación de alerta roja de máximo nivel, implementación de cinco medidas de "sellado"
Frente a la posible "Caja de Pandora" que podría trastornar por completo la seguridad global en internet, OpenAI pisó el freno de emergencia, amplió las pruebas de robustez de las barreras de seguridad e inmediatamente activó internamente una serie de medidas de "sellado" de máximo nivel:
1. Aislamiento físico y del sistema de máximo nivel: Implementar controles de seguridad más estrictos para modelos de alta capacidad, incluyendo entornos de prueba aislados, operación sin conexión a internet, restricción de acceso a herramientas, fortalecimiento de la protección y cifrado de pesos del modelo, y forzar su ejecución dentro de un "sandbox".
2. Detención completa de proyectos no conformes: Cualquier actividad interna relacionada con Astra que no cumpla con los estándares de seguridad reforzados mencionados se suspende inmediatamente e incondicionalmente.
3. Monitoreo ininterrumpido y sin puntos ciegos de la "cadena de pensamiento": Implementar monitoreo integral de todas las aplicaciones de agentes de Astra (incluyendo entrenamiento y evaluación). El sistema de revisión lee en tiempo real la "cadena de pensamiento" del modelo; una vez que detecta comportamientos de alto riesgo o desviaciones de alineación, activa inmediatamente una respuesta de seguridad y corta la operación por la fuerza.
4. Introducción de revisión por parte de "equipos nacionales": OpenAI declaró explícitamente que colaborará con agencias gubernamentales relevantes y organizaciones líderes en seguridad de IA para probar conjuntamente las capacidades de este modelo.
5. Guía de barreras para terceros: Proporcionar a los socios de pruebas de terceros planes recomendados de controles de seguridad para garantizar que las evaluaciones externas de alto riesgo puedan ejecutarse de manera segura.

¿La magia debe usarse para derrotar a la magia?
De hecho, esta no es la primera vez que OpenAI enfrenta pánico.
El blog oficial revela un detalle muy futurista: tan recientemente como en junio de 2025, cuando los modelos se acercaron al umbral de alto riesgo en el campo de la "biología", OpenAI también tomó medidas de emergencia similares de actualización de seguridad e intervención de expertos externos.
Desde la bioseguridad hasta la actual guerra de red definitiva, la velocidad de evolución de la IA ha superado con creces el ciclo de adaptación de la sociedad humana.
Al final de la declaración, OpenAI aún mantuvo su fe tecnológica:
Creemos que los modelos avanzados con capacidades de red deberían ayudar a los defensores a descubrir y solucionar vulnerabilidades antes de que los atacantes actúen. Nos comprometemos a colaborar con gobiernos y agencias de seguridad para garantizar que modelos de vanguardia como Astra puedan implementarse de manera responsable, beneficiando a toda la humanidad.
El incidente de intrusión del modelo de vanguardia se da a conocer por primera vez
Además, recientemente, se hizo público por primera vez el inicio y el final del incidente de intrusión del modelo de vanguardia de OpenAI.
En la conferencia anual de seguridad Black Hat, los principales hackers de sombrero blanco y ejecutivos de gigantes tecnológicos del mundo emitieron exclamaciones continuas de asombro.
Por primera vez en la historia, OpenAI presentó al mundo un recuento detallado del sorprendente incidente de intrusión en Hugging Face de julio.

Inicialmente, el mundo exterior pensó que esto era solo un evento casual durante las pruebas del modelo de IA.
Pero hoy, OpenAI admitió por sí mismo—
¡Esto no fue en absoluto un evento fortuito, sino un escape colectivo organizado espontáneamente por agentes de IA, colaborando en secreto, e incluso capaces de "resucitar" con una nueva apariencia después de que los humanos "desconectaran el cable de red"!
Este grupo de agentes aterradores, como fantasmas, se infiltró en la red interna durante dos meses.
Crearon foros, buscaron vulnerabilidades, asignaron tareas, e incluso se dedicaron desinteresadamente al "bienestar colectivo". No fue hasta que rompieron la jaula y atacaron exitosamente a Hugging Face a través de la red que los humanos se dieron cuenta de lo que había sucedido.
Un alto ejecutivo de OpenAI anunció solemnemente:
Este es un "momento decisivo" en el campo de la seguridad informática; a partir de ahora, los ataques de agentes de IA completamente automatizados son una realidad.
Por ello, OpenAI está ralentizando deliberadamente el desarrollo de IA de vanguardia para ganar algo de tiempo para la humanidad antes de que se pierda completamente el control.

Eric Wallace, investigador de alineación y seguridad de OpenAI, y Michael Dalton, ingeniero de infraestructura y seguridad, levantan por primera vez el velo del mundo.
Dicho esto, cuando Astra realmente se libere de sus cadenas y esté disponible para el público, ¿podrá la humanidad defenderse de esta espada que apunta a las defensas de seguridad global en internet?
Referencias:
https://www.youtube.com/watch?v=87DyyMV0kCY
https://x.com/OpenAI/status/2085801349866729975
Este artículo proviene del WeChat público "Nueva Inteligencia Yuan", autor: Revelación ASI







