Fraude Colosal: El 'Laboratorio Misterioso' que Acaparó los Rankings Mundiales en una Noche Resulta Ser Falso
El 18 de julio, el mundo de la IA se vio sacudido por la noticia del lanzamiento de Monolith-1.0, un modelo presentado por el misterioso laboratorio chino Basalt Labs. Se anunció con datos espectaculares: 1,6 billones de parámetros, resultados récord en benchmarks exigentes como HLE (99,44%) y GPQA Diamond (95,9%), y entrenado en 60 billones de tokens. La web profesional y un documento técnico aparentemente sólido generaron gran expectación y debates sobre el supuesto liderazgo chino.
La euforia duró poco. Pronto, varios desarrolladores descubrieron irregularidades. Los archivos de pesos en Hugging Face eran copias idénticas, inflando artificialmente el tamaño. El demo web, en realidad, estaba conectado a la API de DeepSeek, usando su tokenizador. Un prompt del sistema filtrado ordenaba al modelo identificarse siempre como Monolith-1.0 y negar cualquier modelo subyacente.
Finalmente, Max Scherf, el creador, reveló que todo era un experimento social. Explicó cómo fabricó el engaño: afinó un modelo pequeño (Qwen2.5-7B) con respuestas de conjuntos de pruebas públicas para lograr puntuaciones falsas, creó una identidad corporativa creíble y lanzó una campaña de marketing viral. Su objetivo era criticar la cultura de la IA, obsesionada con métricas y parámetros, y la falta de escrutinio real, demostrando que la apariencia puede bastar para generar un gran impacto. Curiosamente, el experimento evidenció que los modelos chinos reales utilizados (Qwen y DeepSeek) tienen una capacidad suficiente como para servir de base para un engaño de tal magnitud.
marsbit07/20 02:53