Un estudio reciente de Tracking AI revela que GPT-5.6 ha superado por primera vez la barrera de 130 en una prueba de CI offline, alcanzando una puntuación de 136. Esto sitúa al modelo por encima del 99% de los humanos en esta métrica específica, considerada la línea de inicio del "genio". La prueba utilizada es un conjunto offline privado, diseñado para evitar que los modelos memoricen respuestas previamente. En este ranking, varias variantes de GPT-5.6, incluidas las versiones multimodales, consiguieron consistentemente 136 puntos, superando claramente a otros modelos líderes como Claude-5 Fable (130) y versiones anteriores. Más allá de las pruebas estandarizadas, desarrolladores han probado GPT-5.6 en tareas prácticas complejas. Ejemplos incluyen la creación de una simulación de física de fluidos en tiempo real, un sistema de tickets de soporte con RAG y la resolución eficaz de bugs de código. Los usuarios destacan su enfoque pragmático y su capacidad para entregar soluciones funcionales y completas. Aunque el alto puntaje en CI refleja habilidades avanzadas en razonamiento lógico y reconocimiento de patrones, se debate si esto equivale a una Inteligencia General Artificial (AGI). La prueba mide solo una faceta de la inteligencia, mientras que la verdadera utilidad se demuestra en la aplicación a problemas nuevos e imprevisibles. La evidencia sugiere que GPT-5.6 está comenzando a cerrar la brecha entre "saber responder" y "saber hacer".
marsbit2026.07.16




