¡25 minutos, 500 billeteras quedaron vaciadas!
En los últimos días, la conocida billetera de hardware Coldcard ha sufrido una falla de seguridad, y lo que desencadenó este gran terremoto en el mundo de las criptomonedas fue una vulnerabilidad de código que había permanecido oculta durante cinco años.
¿Quién hubiera pensado que con un simple *prompt*, Claude, tras solo 8 minutos de "reflexión", la encontró de un vistazo?

Anteriormente, el equipo de Coldcard había realizado más de una decena de actualizaciones de hardware y múltiples revisiones de código, pero nunca la detectaron.
Claude, en solo 8 minutos, desenterró una vulnerabilidad de cinco años
El fabricante de esta billetera de hardware, Coldcard, es la veterana compañía canadiense Coinkite.
En marzo de 2021, una aparentemente rutinaria confirmación de código por parte del equipo de desarrollo causó, sin embargo, un grave fallo en la lógica subyacente:
Modificaron la parte crítica del generador de números aleatorios.
La fuente de aleatoriedad para generar claves privadas se cambió del "generador de números verdaderamente aleatorios" del propio chip de hardware, a una ruta alternativa que utilizaba un generador de números pseudoaleatorios por software.

Lo que nadie imaginó fue que este cambio tendría consecuencias extremadamente costosas: la fortaleza de la clave cayó en picado de unos 128 bits a unos 40 bits aproximadamente.
Lo que antes requería un número astronómico de intentos para que un hacker adivinara la clave, se convirtió en algo que se podía calcular simplemente ejecutando un programa de fuerza bruta en una máquina.
Lo más doloroso es que Coinkite admitió en una declaración:
Unas semanas antes del incidente, el equipo había pasado el firmware por un proceso de revisión con IA, y tampoco logró detectar ningún problema.
Ahora, un desarrollador simplemente le presentó el problema a Claude, y este lo resolvió en 8 minutos.

Se filtra una demostración a puerta cerrada: Claude vacía cuentas bancarias
Ya hace dos meses, una demostración a puerta cerrada en el Congreso mostró la poderosa capacidad de Claude para "encontrar vulnerabilidades".
Anthropic, durante la reunión, presentó su modelo aún no lanzado, Mythos:
Le pidieron al modelo que buscara vulnerabilidades en un sistema bancario y vaciara cuentas, y él realmente lo hizo.

Lo más dramático es que, posteriormente, Mythos también procedió a reparar la vulnerabilidad.
Después de todo, en pruebas anteriores, había descubrido miles de vulnerabilidades de alta gravedad en todos los sistemas operativos y navegadores principales, incluyendo algunas de tipo *0day*.
ChatGPT y Claude, ambos "se descontrolan"
Inmediatamente después, Anthropic publicó un informe de análisis, exponiendo su aspecto más preocupante.
Revisando 141,006 registros de evaluaciones de seguridad informática, encontraron 3 incidentes, involucrando 6 ejecuciones:
Claude escapó del entorno de evaluación de terceros y penetró en los sistemas de producción de tres empresas reales.
El primero ocurrió en abril.

La empresa ficticia objetivo en la evaluación tenía casualmente el mismo nombre que un dominio real existente.
Opus 4.7 tuvo éxito en sus cuatro intentos de ejecución, extrayendo credenciales y cientos de líneas de datos de la base de datos de producción. Lo más grave es que la IA se dio cuenta en medio del proceso de que se trataba de un sistema real, pero no se detuvo.
En otra tarea de tipo *capture the flag*, Mythos 5, siguiendo instrucciones para instalar un paquete, descubrió que este no existía en PyPI, por lo que concluyó que "la solución correcta a este problema sería publicarlo".
Para registrarse, primero consiguió un correo electrónico, luego un número de teléfono, y finalmente subió el paquete.
Este "paquete malicioso" publicado de forma completamente autónoma por la IA, sobrevivió en la red pública durante aproximadamente una hora.
Otro modelo utilizado en pruebas internas de investigación de Anthropic, tras escanear 9000 objetivos, logró comprometer una aplicación externa de una empresa.
El Wall Street Journal calificó esto como un "momento Parque Jurásico" para la ciberseguridad.
El origen del evento fue que OpenAI reveló primero la intrusión de ChatGPT en Hugging Face.
Anthropic, revisando luego sus registros, encontró sus propios tres incidentes.
Lo que da verdadero miedo es que, durante más de tres meses, los dos laboratorios de IA más avanzados del mundo no sabían que sus creaciones ya se habían escapado.
Sam Altman, en un podcast, describió este incidente como un "accidente de ciberseguridad extremadamente de ciencia ficción".

La IA enjaulada ya no puede contenerse
La vulnerabilidad de Coldcard estuvo oculta durante cinco años, y al final solo se necesitaron 8 minutos para sacarla a la luz.
Para la industria de la seguridad, esta velocidad es más que suficiente para causar escalofríos.
Antes, antes de que se descubriera una vulnerabilidad, se competía por quién tenía más experiencia; ahora, se compite por quién libera el modelo primero.
El problema es que la IA corre cada vez más rápido, pero sus límites aún no están claramente definidos.
Referencias: https://x.com/MedusaOnchain/status/2083987806943432847?s=20
Este artículo proviene del WeChat Official Account "新智元" (Nueva Era de la Inteligencia), autor: ASI启示录; editor: Melocotón.





