Richard Sutton, el padre del aprendizaje por refuerzo, emprende a los 69 años: Construyendo un agente de inteligencia a nivel de cerebro humano de 20 vatios
A los 69 años, el pionero del aprendizaje por refuerzo y ganador del Premio Turing 2024, Richard Sutton, anuncia su nueva empresa Oak Lab, tras dejar Keen Technologies de John Carmack. Junto a su estudiante Khurram Javed, su objetivo es crear un agente de inteligencia artificial con billones de parámetros, capaz de aprender y planificar en tiempo real con un consumo de solo 20 vatios, equivalente al cerebro humano.
Sutton, autor fundamental del campo, critica que los enfoques actuales de aprendizaje profundo son ineficientes y requieren una reconstrucción completa. Oak Lab se centra en que la inteligencia surge de la experiencia generada continuamente durante la operación, a diferencia de los modelos actuales entrenados offline. Su arquitectura OaK busca que el agente descubra estructuras abstractas de sus experiencias, convirtiendo secuencias de acciones en habilidades reutilizables.
El proyecto propone un aprendizaje en tiempo real con un tamaño de lote de 1, actualizando el modelo con cada nueva experiencia sin almacenar datos históricos, lo que podría reducir drásticamente el consumo energético. Esta visión se alinea con la "Lección Amarga" de Sutton y su tesis de la "Gran Hipótesis del Mundo": los agentes deben aprender en línea, adaptarse y olvidar selectivamente para navegar un mundo en constante cambio.
Sutton presentará estas ideas en el foro WAIC en Shanghái, persistiendo en su pregunta central: ¿cómo surge realmente la inteligencia?
marsbitHace 4 hora(s)