¡Ahora mismo! Expuesto el primer modelo de Ilya
¡Noticias de última hora! Ilya Sutskever, ex científico jefe de OpenAI y cofundador de Safe Superintelligence Inc. (SSI), podría estar a punto de revelar su primer modelo tras más de dos años de silencio. Según una filtración en X, SSI estaría desarrollando un motor de inferencia basado en Test-Time Training (TTT), que permite a los modelos seguir aprendiendo y ajustando sus pesos durante la fase de inferencia, mejorando su rendimiento incluso con un tamaño reducido.
La filtración sugiere que el modelo, diseñado para "aprender a aprender", podría competir con modelos mucho más grandes. Además, se afirma que SSI ya tiene una versión lista, con planes de escalarla 10 veces, y que una primera versión limitada podría lanzarse este mes de agosto.
Estos rumores coinciden con declaraciones previas de Ilya, quien enfatizó la importancia del aprendizaje continuo post-despliegue para una inteligencia general verdadera, y con la reciente inversión y colaboración estratégica de NVIDIA con SSI, la cual multiplicará su capacidad computacional.
Aunque la técnica TTT no es nueva, su implementación en un modelo práctico plantea desafíos de seguridad, ya que el modelo podría aprender comportamientos no deseados. Sin embargo, el enfoque de SSI en "superinteligencia segura" podría abordar estos riesgos.
La expectación se debe al historial visionario de Ilya en hitos como AlexNet y GPT. Si la filtración es cierta, SSI no estaría creando otro modelo de lenguaje gigante, sino un sistema que evoluciona mientras resuelve problemas, marcando un posible cambio de rumbo en la industria de la IA.
marsbit08/13 08:32