Nace el «DeepSeek Biológico» chino: 4 talentos de Oxford dejan que la IA tome las riendas de la ciencia de la vida

marsbitPublished on 2026-08-04Last updated on 2026-08-04

Abstract

DeepSeek-V4-Flash acaba de revolucionar el campo de los modelos de lenguaje general, y ahora llega su equivalente chino para las ciencias de la vida: GeneLLM. Desarrollado por Jindushengke, fundada por cuatro talentos graduados de Oxford, este modelo multimodal es el primero del mundo entrenado directamente con datos ómicos crudos, y ha sido publicado en prestigiosas revistas como *Nature Communications* y *Advanced Science*. GeneLLM opera de manera similar a un modelo de lenguaje, pero en lugar de predecir la siguiente palabra, predice la siguiente secuencia de información biológica. Utiliza las cuatro bases del ARN (A, U, G, C) como tokens fundamentales, aprendiendo patrones directamente de datos crudos de transcriptómica, proteómica y metabolómica, sin depender de anotaciones genéticas predefinidas. Con versiones de 1.5B y 30B de parámetros, el modelo puede lograr una alta precisión en el diagnóstico de enfermedades con costos de secuenciación reducidos en un 83%, allanando el camino para una medicina de precisión más accesible. Sin embargo, la visión de Jindushengke va más allá del modelo. La compañía ha desarrollado BioFord Harness, una infraestructura que conecta la inteligencia artificial con el laboratorio físico. Este sistema traduce las intenciones científicas en instrucciones ejecutables para diversos equipos, gestiona su programación y hace que los resultados (incluyendo los fracasos) retroalimenten el ciclo de aprendizaje. La plataforma BioFord Agent integra ci...

Mientras DeepSeek-V4-Flash sorprendía al panorama mundial de los modelos de lenguaje general, su versión china para ciencias de la vida ya seguía sus pasos.

Recientemente, GeneLLM, un modelo de lenguaje grande multómico para ciencias de la vida desarrollado por Jindushenke (fundado por 4 talentos retornados de la Universidad de Oxford), ha sido publicado sucesivamente en prestigiosas revistas académicas internacionales como Nature Communications y Advanced Science.

Como el primer modelo de lenguaje grande multómico del mundo entrenado directamente con datos omicos originales, GeneLLM es otro modelo destacado después de AlphaFold de Google y EVO 2 de la Universidad de Stanford, llenando el vacío en los modelos base de ciencias de la vida en China, mereciendo ser llamado el 'DeepSeek' chino de ciencias de la vida, permitiendo que la IA comience a comprender los múltiples 'lenguajes' y el 'sistema' completo de la vida.

Predecir el siguiente mensaje de vida, como predecir el siguiente token

La identificación de enfermedades es solo un escenario de aplicación de GeneLLM. Lo que Jindushenke realmente quiere hacer es crear el 'Claude Code' de las ciencias de la vida.

El núcleo de modelos de lenguaje grande como ChatGPT, Claude y DeepSeek es la predicción del siguiente token.

GeneLLM tiene un enfoque similar, pero no predice palabras, sino información vital.

Las cuatro bases nitrogenadas en la secuencia de ARN - adenina (A), uracilo (U), guanina (G) y citosina (C) - se convierten en los tokens básicos para que GeneLLM comprenda el lenguaje de la vida.

El análisis bioinformático tradicional suele depender de anotaciones genéticas, alineación de secuencias y etiquetas definidas manualmente. Este método, aunque preciso, limita de antemano el alcance cognitivo del modelo y puede perder muchas señales biológicas desconocidas ocultas en los datos originales.

GeneLLM toma un camino diferente, aprendiendo directamente de los datos de secuenciación original sin procesar.

Utiliza datos originales multómicos (transcriptómica, proteómica, metabolómica, etc.) como datos de entrenamiento, permitiendo que el modelo descubra de forma autónoma patrones relacionados con enfermedades.

Actualmente, GeneLLM ha completado el preentrenamiento de un modelo de 1.5 mil millones de parámetros con 3.5 billones de secuencias de bases, y la versión XLarge ha logrado el preentrenamiento de un modelo de 30 mil millones de parámetros, ampliando continuamente la barrera tecnológica.

Como el primer modelo grande multómico del mundo preentrenado con datos de secuenciación original, GeneLLM incluye dos etapas principales:

(1) Preentrenamiento no supervisado y minería de prototipos

(2) Ajuste fino a nivel de paciente (Disease Tuning)

GeneLLM primero necesita resolver un problema:

¿Cómo convertir datos vitales complejos en un lenguaje que la IA pueda entender?

En el Procesamiento del Lenguaje Natural, el algoritmo BPE divide las oraciones en tokens; GeneLLM, por su parte, divide fragmentos de secuenciación de ARN de aproximadamente 150 pb de longitud en 'tokens de vida' utilizando una ventana deslizante de 7 bases (7-mer).

Posteriormente, el modelo utiliza la arquitectura Transformer para predecir la siguiente base nitrogenada sin anotaciones genéticas ni etiquetas manuales.

Esto significa que la IA no consulta primero el 'diccionario' compilado por humanos, sino que aprende directamente de las señales originales de la vida.

Durante el entrenamiento, GeneLLM procesó decenas de billones de 'reads' de ARN, entrenándose en un clúster de cientos de GPUs NVIDIA A100.

A partir de aquí, las capacidades de generalización de GeneLLM comienzan a 'emerger'.

Como un importante avance innovador en el campo de las ciencias de la vida, este modelo nacional GeneLLM puede aplicarse en múltiples áreas como el descubrimiento de fármacos, medicina de precisión, biología sintética, monitoreo ambiental, microbiología y agrobiología, diseño de proteínas y moléculas, siendo uno de los pocos modelos grandes en el mundo que ha logrado una implementación práctica en escenarios reales.

Solo después de examinar las innovaciones subyacentes de GeneLLM en 'datos, arquitectura, entrenamiento', podemos comprender realmente: ¿por qué representa el 'DeepSeek biológico' de China?

Silicon Valley apila decenas de miles de H100 para lograr billones de parámetros, DeepSeek mejora la eficiencia computacional mediante innovaciones algorítmicas, y GeneLLM, con una estrategia similar, aprovecha miles de millones de datos de ciencias de la vida.

Si AlphaFold permitió que la IA viera por primera vez la 'estructura' de la vida, y EVO2 que comenzara a entender el 'código', entonces GeneLLM busca comprender aún más el 'sistema' de la vida.

Y lo más impactante es la eficiencia. Los métodos tradicionales dependen de secuenciación profunda de 6 Gb, con costos altos y difícil implementación. GeneLLM mantiene un AUC > 0.8 incluso con una profundidad extremadamente baja de 1 Gb (reducción del 83% en costos).

Esto significa una verdadera esperanza de hacer realidad una medicina de precisión accesible.

Comienza a emerger un nuevo paradigma de investigación: dejar que la IA aprenda de los datos vitales, llevando a las ciencias de la vida a una nueva etapa de exploración predecible, computable y escalable.

No solo es un modelo, es la infraestructura inteligente del 'último kilómetro'

Pero la estrategia de Jindushenke no se limita al modelo base.

Tomando el modelo grande multómico GeneLLM como base cognitiva de la vida, Jindushenko construye un sistema de ejecución que conecta la inteligencia de la IA con el mundo físico. A través de la capa de ejecución de experimentos inteligentes Harness y el ciclo cerrado de datos DBTL (Diseñar-Construir-Probar-Aprender), se logra un ciclo completo de IA para la Ciencia: desde la comprensión de las leyes de la vida y la generación de hipótesis científicas, hasta la verificación experimental automatizada y la optimización iterativa continua.

Como dijo Liam Fedus, ex vicepresidente de OpenAI y responsable de entrenamiento posterior, los LLM actuales ya han agotado el texto y código limitados de Internet, y el próximo avance significativo en el descubrimiento científico debe depender de la iteración experimental.

Es decir, no se puede depender solo de leer lo que los humanos ya han escrito para descubrir nuevos conocimientos; la IA debe realizar sus propios experimentos.

Pero surge un problema:

Los servicios de Internet tienen API de forma natural, la información en red es digital por naturaleza, pero los equipos de investigación provienen de diferentes fabricantes, con protocolos diversos, complejos y costosos, y nadie puede reconstruirlos en unos meses.

La mayoría de los laboratorios actuales están diseñados para humanos: paneles de instrumentos, movimientos de pipeteo, estado de las muestras, juicios in situ, la gran mayoría no se convierte en señales que las máquinas puedan entender.

Que la IA entre en el laboratorio no es solo un problema de capacidad del modelo actual, sino que requiere una nueva infraestructura.

Por lo tanto, que la IA entre en el laboratorio no es solo un problema de capacidad del modelo, necesita un Harness físico: convertir el laboratorio en un sistema compilable, programable, observable y rastreable.

Este es el verdadero 'último kilómetro' de la IA4S.

BioFord Harness, haciendo que el laboratorio 'se mueva solo'

Para ello, Jindu desarrolló un sistema llamado BioFord Harness.

Es una infraestructura que conecta la IA con el laboratorio físico.

No hacen que el brazo robótico imite la mano humana, sino que convierten el laboratorio en un sistema compilable, programable, observable y rastreable.

En este proceso, el Harness físico debe lograr al menos tres cosas:

1. Compilar la intención científica o el DSL experimental en instrucciones ejecutables por diferentes dispositivos;

2. Gestionar la programación entre múltiples dispositivos, la gestión de restricciones de recursos y seguridad, y manejar excepciones;

3. Hacer que los resultados experimentales, registros de dispositivos y parámetros ambientales fluyan de vuelta, convirtiéndose en la entrada para el siguiente ciclo de diseño de modelos y experimentos.

Problema científico → Comprensión de IA → Diseño experimental → Programación de dispositivos → Ejecución → Flujo de datos → Optimización del modelo → Siguiente ciclo.

Así se pone en marcha la rueda volante de los datos científicos experimentales.

Cinco agentes inteligentes, convirtiendo el flujo de investigación en una 'línea de ensamblaje'

La plataforma de investigación de inteligencia incorporada BioFord Agent, por su parte, conecta hacia abajo con la capa física del laboratorio, y hacia arriba soporta la capa cognitiva del científico, utilizando la IA física en el medio para cerrar la brecha entre el razonamiento y la ejecución.

En la capa cognitiva, BioFord Agent está compuesto por una red colaborativa de cinco agentes inteligentes, que cubren todo el proceso de investigación en ciencias de la vida, pudiendo mejorar la eficiencia de la investigación varias veces.

Agente de recuperación de literatura

Agente de diseño experimental

Agente científico

Agente de programación experimental

Agente de análisis de datos

Por ejemplo, el agente de recuperación de literatura puede ayudarte rápidamente a buscar y leer una gran cantidad de literatura, completar revisiones bibliográficas y ayudar a plantear hipótesis.

El agente de diseño experimental permite que los equipos de investigación acorten el ciclo de diseño experimental de varios meses a una semana.

Y el agente de programación experimental lanzado por Jindushenke, basado en la Capa de Abstracción de Instrumentos Universales (Universal Instrument Abstraction Layer), rompe las barreras de protocolo entre múltiples tipos de dispositivos heterogéneos.

Ya sea un termociclador (PCR), un lector de microplacas, un citómetro de flujo o una estación de trabajo de pipeteo automatizado, todos pueden ser gestionados y programados de manera unificada. El sistema incorpora algoritmos de programación dinámica, puede planificar lotes automáticamente, evitar conflictos en tiempo real y registrar los parámetros experimentales en todo el proceso, formando una cadena de auditoría rastreable.

Esto significa que la IA ya no se queda en la fase de 'dar consejos', sino que realmente entra en el laboratorio, opera equipos, ejecuta tareas, convirtiéndose en un 'asistente de investigación' confiable.

Los datos de fracaso, quizás más valiosos que los de éxito

El valor más profundo que resuelve este sistema es: hacer que cada experimento, ya sea exitoso o fallido, se convierta en datos que el sistema puede digerir.

En un laboratorio tradicional, un registro de fracaso puede ser solo una línea de 'resultado no conforme a lo esperado', la experiencia queda en la mente de la persona, y cuando esa persona se va, la experiencia también se pierde.

En el sistema BioFord, cada fracaso es un valioso dato de entrenamiento: la lógica de selección de parámetros, el registro de condiciones ambientales, la prueba de caminos erróneos... todo se sedimenta, convirtiéndose en parte de la 'experiencia' del sistema.

La próxima vez, la IA sabrá: este camino no lleva a ninguna parte.

Es significativo que en esta carrera, no gana quien tiene más potencia de cálculo, ni quien tiene el modelo más grande.

La potencia de cálculo se puede comprar, pero los datos de investigación no.

Jin Yongcheng, fundador y CEO de Jindushenke, dijo: 'Durante el proceso de investigación y desarrollo, gradualmente descubrimos que la IA para BioScience no es simplemente acumular modelos y datos. Para quienes realizan experimentos, el problema final a resolver sigue siendo la incapacidad de ejecutar después del cálculo, y el error al ejecutar.'

Esta es la barrera más importante y difícil de replicar en el campo de la IA4S.

Cuatro personas de Oxford, incluido un compañero de Luo Fuli

En 2022, cuando Jin Yongcheng obtuvo su doctorado en Bioingeniería de la Universidad de Oxford, enfrentó una elección.

Su tutor era Hagan Bayley, miembro de la Royal Society y fundador de Oxford Nanopore, una empresa británica líder en secuenciación de tercera generación, y el laboratorio tenía una profunda tradición de 'implementación de resultados'. Quedarse en el Reino Unido era un camino claro y seguro.

Pero eligió otro camino: meter una 'tecnología prototipo' del laboratorio en su maleta y llevarla de vuelta a China. Junto a él viajaron otros tres exalumnos de Oxford: el doctor en Biología Deng Siwei, el investigador asociado de la Facultad de Informática Sha Lei (doctor en Informática de la Universidad de Pekín, compañero de Luo Fuli, responsable del modelo grande de Xiaomi), y Zhou Tianyao, experto en implementación de productos. Los cuatro poseen conocimientos complementarios en bioingeniería, inteligencia artificial, biología computacional y operaciones comerciales, formando un equipo indispensable. Formaron un equipo para proyectos de investigación conjuntos, logrando la predicción y detección de enfermedades combinando IA y tecnología transcriptómica. Las cuatro personas, como piezas de un rompecabezas, se complementan perfectamente y pueden llevar a cabo investigaciones altamente interdisciplinarias.

El nombre de la empresa 'Jindushenke': 'Jin' proviene de Oxford (Jin en chino suena similar a Ox-), simbolizando su partida desde las alturas académicas de los laboratorios de Oxford; 'Du' significa cruzar, ayudar a otros a cruzar, que es el destino al que creen que la IA para la Ciencia debería llegar.

Actualmente, la plataforma de investigación de IA física BioFord Agent de Jindushenke ya se ha implementado en algunas universidades prestigiosas de China, con resultados significativos, reduciendo el ciclo de investigación de varios meses a solo una semana.

El viento sopla: 4 rondas de financiación en 1 año, escena del 'verdadero interés' del capital

Sin embargo, seguir un camino 'nunca antes recorrido' inevitablemente conlleva soledad.

Al inicio de la empresa, las dificultades fueron abrumadoras. En ese momento, el emprendimiento en IA estaba en auge, pero los intentos de 'IA+' en ciencias de la vida eran escasos. 'Quienes entienden de IA no necesariamente entienden de ciencias de la vida, y la mayoría de quienes entienden de ciencias de la vida no entienden de IA.'

Jin Yongcheng admitió: 'Los inversores no podían entender lo que estábamos haciendo.'

El equipo eligió el 'camino más difícil': comenzar desde un modelo base biológico grande, una dirección en la que a nivel global hay muy pocas empresas.

En 2025, llegó un punto de inflexión.

En ese momento, el Consejo de Estado emitió las 'Opiniones sobre la implementación profunda de la acción 'Inteligencia Artificial+', incluyendo la IA para la Ciencia, y el campo comenzó a despegar.

Jindushenke logró el récord de 'completar 4 rondas de financiación en un año'. La línea de tiempo principal de financiación de la empresa puede considerarse un referente en la industria.

Ronda Ángel+: Liderada por Sequoia Capital China Seed Fund;

Ronda Pre-A+: Liderada por Chuangdongfang Investment con una inversión de decenas de millones de yuanes;

Ronda Pre-A+: Inversión de decenas de millones de yuanes de Nanshan Zhanxintou;

Ronda Serie A: Liderada por Gaotejia Investment con una inversión cercana a los 100 millones de yuanes.

Teng Yuhang, socio ejecutivo de Gaotejia Investment, comentó: 'Jindushenke ha convertido la investigación básica en ciencias de la vida en una infraestructura de 'capacidad de cálculo + experimentación' suscribible y escalable.'

Y el objetivo de Jin Yongcheng es aún más lejano: 'No nos conformamos con vender software, queremos construir el sistema operativo inteligente para el campo de las ciencias de la vida. Así como Intel definió la capacidad de cálculo de la era de las PC, esperamos definir un nuevo paradigma de investigación y desarrollo para las ciencias de la vida en la era de la IA.'

Desde el laboratorio de Oxford hasta Shenzhen, desde la incomprensión hasta recibir fuertes inversiones de capital de primer nivel, la historia de estos cuatro talentos de Oxford no es solo una leyenda empresarial, sino también una profunda reflexión sobre 'qué podemos hacer por la humanidad'.

Cuando la IA aprende a 'investigar toda la noche' por sí misma, el descubrimiento científico tal vez ya no dependa de la inspiración casual de un genio, sino que se convierta en una expectativa inevitable. Este camino, ellos apenas lo están comenzando.

Mapa de la industria: Jindu sigue el camino de la IA física ligera

En el mapa más amplio de la IA para BioScience, Jindu no está solo, pero su enfoque es completamente diferente.

El primer tipo es el científico de IA en el extremo digital.

Biomni (ahora comercializado como Phylo), incubado en Stanford, tiene más de 150 herramientas especializadas y puede ejecutar automáticamente revisiones de literatura, generación de hipótesis y análisis bioinformático.

FutureHouse, respaldado por Eric Schmidt, se dedica a construir científicos de IA que puedan generar hipótesis y escribir artículos de forma autónoma.

Sin embargo, aunque son poderosos, todavía se limitan al mundo digital.

El segundo tipo es la ruta autónoma de pila completa.

XtalPi (晶泰科技) ha desplegado más de 300 estaciones de trabajo 'IA + robótica' a nivel mundial.

Lila Sciences, incubada por Flagship Pioneering, con 550 millones de dólares en financiación, intenta que la IA se haga cargo completamente del diseño, ejecución y rediseño de experimentos, con el objetivo de lograr una 'súper inteligencia científica'.

Pero todo esto requiere demasiado dinero.

El tercer tipo es la ruta de tubería integral (end-to-end).

Insilico Medicine (英矽智能) lleva la IA directamente a su propia tubería de descubrimiento de fármacos innovadores, con su primer fármaco descubierto por IA en fase clínica III, pero ellos son 'constructores de automóviles', no 'reparadores de caminos'.

Y la elección de Jindushenke es: centrarse en construir el Harness físico, ser la infraestructura del 'último kilómetro' entre el modelo y el sistema experimental físico.

No competir en la base, no hacer tuberías integrales, no hacer científicos de IA puramente digitales. Solo hacer ese kilómetro es, sin duda, un enfoque más ligero.

Jin Yongcheng lo expresa claramente: 'El verdadero punto de inflexión de la IA para la Ciencia no es cuán parecido responda el modelo a un científico, sino si el laboratorio puede comenzar a funcionar como un sistema de aprendizaje continuo.'

Además, en el campo global de la IA para la Ciencia, Jindu no se limita simplemente a 'hacer solo el último kilómetro'.

Para ser más precisos, utiliza el último kilómetro como punto de entrada para competir por la orquestación de todo el flujo de trabajo de investigación.

En comparación con los científicos de IA puramente digitales, puede tocar el mundo físico; en comparación con la construcción de fábricas científicas con activos pesados propios, tiene la oportunidad de tomar el control de los laboratorios existentes de los clientes; en comparación con las empresas integrales de descubrimiento de fármacos con IA, no tiene que apostar su destino a una sola tubería clínica.

Su verdadera barrera de entrada no será el número de parámetros, sino la acumulación continua de trayectorias experimentales, interfaces de dispositivos, experiencias de fracaso y la red de ejecución entre laboratorios.

Como dijo Jin Yongcheng, las miles de vías de señalización y los mecanismos de reacción llenos de incógnitas dentro del organismo son fascinantes. 'Cuán rica es la biología, cuán hermoso es el futuro de la IA para la Ciencia.'

Explorar los misterios de la vida con la inteligencia de la IA, el vasto océano estelar de estos talentos de Oxford, acaba de comenzar.

Este artículo proviene del WeChat público 'Xinzhiyuan' (新智元), autor: Xinzhiyuan; editor: Aeneas KingHZ

Trending Cryptos

Related Questions

Q¿Qué es GeneLLM y por qué se lo denomina el 'DeepSeek biológico' de China?

AGeneLLM es un modelo de lenguaje de gran tamaño (LLM) multómico desarrollado por Jindu Biotech. Es el primer modelo multómico del mundo entrenado directamente con datos ómicos brutos (como secuencias de ARN sin procesar). Se lo llama el 'DeepSeek biológico' de China porque, al igual que DeepSeek revolucionó los LLM generales con innovaciones algorítmicas, GeneLLM representa un avance fundamental para China en el campo de los modelos base de ciencias de la vida, permitiendo que la IA comprenda múltiples 'lenguajes' y el 'sistema' completo de la vida.

Q¿Cómo funciona GeneLLM para 'predecir la próxima información vital', de manera similar a como un LLM predice el siguiente token?

AGeneLLM utiliza los cuatro nucleótidos del ARN (A, U, G, C) como tokens básicos. En lugar de texto, procesa fragmentos de secuencias de ARN (de ~150 pb) dividiéndolos en 'tokens de vida' usando una ventana deslizante de 7 nucleótidos (7-mer). Luego, emplea una arquitectura Transformer para predecir el siguiente nucleótido en una secuencia, aprendiendo directamente de las señales biológicas brutas sin depender de anotaciones genéticas o etiquetas humanas predefinidas.

Q¿Qué es BioFord Harness y cómo aborda el 'último kilómetro' de la IA para la Ciencia (AI4S)?

ABioFord Harness es una infraestructura desarrollada por Jindu Biotech que conecta la IA con el laboratorio físico. Su objetivo es superar la brecha entre el diseño de experimentos por IA y su ejecución real en laboratorios con equipos diversos y complejos. Traduce la intención científica en instrucciones ejecutables para distintos dispositivos, gestiona la programación y los recursos, maneja excepciones y hace que los resultados y datos del experimento (incluyendo fallos) vuelvan al sistema para optimizar el ciclo de aprendizaje (DBTL: Diseñar-Construir-Probar-Aprender).

Q¿Quiénes son los fundadores de Jindu Biotech y cuál es su visión para la empresa?

ALos fundadores son cuatro exalumnos de la Universidad de Oxford: Jin Yongcheng (CEO, doctor en Bioingeniería), Deng Siwei (doctor en Biología), Sha Lei (investigador en Informática, excompañero de Luo Fuli de Xiaomi) y Zhou Tianyao (experto en implementación de productos). Su visión es construir un 'sistema operativo inteligente' para las ciencias de la vida, definiendo un nuevo paradigma de investigación donde la IA pueda comprender la vida y automatizar el ciclo de descubrimiento científico, haciendo que la investigación sea predecible, escalable y accesible.

QSegún el artículo, ¿cuál es la principal ventaja competitiva (o 'foso defensivo') de Jindu Biotech en el campo de la IA para la Ciencia?

ASu principal ventaja competitiva no es el poder de cómputo o el tamaño del modelo, sino la acumulación de datos del mundo real y la infraestructura de ejecución. Esto incluye: trayectorias experimentales, interfaces con una amplia gama de equipos de laboratorio, datos de experimentos fallidos (extremadamente valiosos para el aprendizaje) y una red de ejecución que puede operar en laboratorios existentes. Estos activos, derivados de cerrar el 'último kilómetro' entre el modelo y el laboratorio, son difíciles y costosos de replicar.

Related Reads

Robotic GPT-3 Moment Shakes Silicon Valley: Zero Lines of Code, Learns Instantly, with Investments from Jensen Huang and Fei-Fei Li

Generalist AI's newly released robot foundation model GEN-1.5 is being hailed as the "GPT-3 moment" for embodied AI. The model demonstrates remarkable one-shot and few-shot learning capabilities in physical manipulation tasks. By watching a single 3-12 second demonstration video (physical prompting) without any training or code, the robot can attempt the task with a 59% average success rate across 10 tasks. With just 5 minutes of demonstration data and minimal fine-tuning (10 gradient steps), the success rate jumps to 83%. The most significant breakthrough is the emergence of spontaneous, improvisational problem-solving abilities not present in the training data. For instance, after learning to sweep blocks with a brush, the robot can adapt to use a banana similarly or switch to a completely new "scoop-and-pour" strategy when given a dustpan. Other emergent behaviors include removing obstacles, correcting errors, and spontaneously sorting objects. These capabilities stem from over 8 months of large-scale pre-training on physical interaction data, suggesting the existence of a Scaling Law for embodied intelligence—where model generalization improves with more data and training time. This approach drastically reduces the cost and expertise needed to teach robots new skills, potentially democratizing robot programming. The release coincides with a surge in the humanoid robotics sector, marked by events like the World Robot Conference and significant investments. While the demonstrated tasks are still relatively simple, the scaling trend and emergent behaviors point toward a future where general-purpose robot "brains" could be easily adapted to various hardware "bodies," reshaping the industry's competitive landscape.

marsbit1h ago

Robotic GPT-3 Moment Shakes Silicon Valley: Zero Lines of Code, Learns Instantly, with Investments from Jensen Huang and Fei-Fei Li

marsbit1h ago

Trading

Spot

Hot Articles

What is SONIC

Sonic: Pioneering the Future of Gaming in Web3 Introduction to Sonic In the ever-evolving landscape of Web3, the gaming industry stands out as one of the most dynamic and promising sectors. At the forefront of this revolution is Sonic, a project designed to amplify the gaming ecosystem on the Solana blockchain. Leveraging cutting-edge technology, Sonic aims to deliver an unparalleled gaming experience by efficiently processing millions of requests per second, ensuring that players enjoy seamless gameplay while maintaining low transaction costs. This article delves into the intricate details of Sonic, exploring its creators, funding sources, operational mechanics, and the timeline of significant events that have shaped its journey. What is Sonic? Sonic is an innovative layer-2 network that operates atop the Solana blockchain, specifically tailored to enhance the existing Solana gaming ecosystem. It accomplishes this through a customised, VM-agnostic game engine paired with a HyperGrid interpreter, facilitating sovereign game economies that roll up back to the Solana platform. The primary goals of Sonic include: Enhanced Gaming Experiences: Sonic is committed to offering lightning-fast on-chain gameplay, allowing players and developers to engage with games at previously unattainable speeds. Atomic Interoperability: This feature enables transactions to be executed within Sonic without the need to redeploy Solana programmes and accounts. This makes the process more efficient and directly benefits from Solana Layer1 services and liquidity. Seamless Deployment: Sonic allows developers to write for Ethereum Virtual Machine (EVM) based systems and execute them on Solana’s SVM infrastructure. This interoperability is crucial for attracting a broader range of dApps and decentralised applications to the platform. Support for Developers: By offering native composable gaming primitives and extensible data types - dining within the Entity-Component-System (ECS) framework - game creators can craft intricate business logic with ease. Overall, Sonic's unique approach not only caters to players but also provides an accessible and low-cost environment for developers to innovate and thrive. Creator of Sonic The information regarding the creator of Sonic is somewhat ambiguous. However, it is known that Sonic's SVM is owned by the company Mirror World. The absence of detailed information about the individuals behind Sonic reflects a common trend in several Web3 projects, where collective efforts and partnerships often overshadow individual contributions. Investors of Sonic Sonic has garnered considerable attention and support from various investors within the crypto and gaming sectors. Notably, the project raised an impressive $12 million during its Series A funding round. The round was led by BITKRAFT Ventures, with other notable investors including Galaxy, Okx Ventures, Interactive, Big Brain Holdings, and Mirana. This financial backing signifies the confidence that investment foundations have in Sonic’s potential to revolutionise the Web3 gaming landscape, further validating its innovative approaches and technologies. How Does Sonic Work? Sonic utilises the HyperGrid framework, a sophisticated parallel processing mechanism that enhances its scalability and customisability. Here are the core features that set Sonic apart: Lightning Speed at Low Costs: Sonic offers one of the fastest on-chain gaming experiences compared to other Layer-1 solutions, powered by the scalability of Solana’s virtual machine (SVM). Atomic Interoperability: Sonic enables transaction execution without redeployment of Solana programmes and accounts, effectively streamlining the interaction between users and the blockchain. EVM Compatibility: Developers can effortlessly migrate decentralised applications from EVM chains to the Solana environment using Sonic’s HyperGrid interpreter, increasing the accessibility and integration of various dApps. Ecosystem Support for Developers: By exposing native composable gaming primitives, Sonic facilitates a sandbox-like environment where developers can experiment and implement business logic, greatly enhancing the overall development experience. Monetisation Infrastructure: Sonic natively supports growth and monetisation efforts, providing frameworks for traffic generation, payments, and settlements, thereby ensuring that gaming projects are not only viable but also sustainable financially. Timeline of Sonic The evolution of Sonic has been marked by several key milestones. Below is a brief timeline highlighting critical events in the project's history: 2022: The Sonic cryptocurrency was officially launched, marking the beginning of its journey in the Web3 gaming arena. 2024: June: Sonic SVM successfully raised $12 million in a Series A funding round. This investment allowed Sonic to further develop its platform and expand its offerings. August: The launch of the Sonic Odyssey testnet provided users with the first opportunity to engage with the platform, offering interactive activities such as collecting rings—a nod to gaming nostalgia. October: SonicX, an innovative crypto game integrated with Solana, made its debut on TikTok, capturing the attention of over 120,000 users within a short span. This integration illustrated Sonic’s commitment to reaching a broader, global audience and showcased the potential of blockchain gaming. Key Points Sonic SVM is a revolutionary layer-2 network on Solana explicitly designed to enhance the GameFi landscape, demonstrating great potential for future development. HyperGrid Framework empowers Sonic by introducing horizontal scaling capabilities, ensuring that the network can handle the demands of Web3 gaming. Integration with Social Platforms: The successful launch of SonicX on TikTok displays Sonic’s strategy to leverage social media platforms to engage users, exponentially increasing the exposure and reach of its projects. Investment Confidence: The substantial funding from BITKRAFT Ventures, among others, emphasizes the robust backing Sonic has, paving the way for its ambitious future. In conclusion, Sonic encapsulates the essence of Web3 gaming innovation, striking a balance between cutting-edge technology, developer-centric tools, and community engagement. As the project continues to evolve, it is poised to redefine the gaming landscape, making it a notable entity for gamers and developers alike. As Sonic moves forward, it will undoubtedly attract greater interest and participation, solidifying its place within the broader narrative of blockchain gaming.

2.4k Total ViewsPublished 2024.04.04Updated 2024.12.03

What is SONIC

What is $S$

Understanding SPERO: A Comprehensive Overview Introduction to SPERO As the landscape of innovation continues to evolve, the emergence of web3 technologies and cryptocurrency projects plays a pivotal role in shaping the digital future. One project that has garnered attention in this dynamic field is SPERO, denoted as SPERO,$$s$. This article aims to gather and present detailed information about SPERO, to help enthusiasts and investors understand its foundations, objectives, and innovations within the web3 and crypto domains. What is SPERO,$$s$? SPERO,$$s$ is a unique project within the crypto space that seeks to leverage the principles of decentralisation and blockchain technology to create an ecosystem that promotes engagement, utility, and financial inclusion. The project is tailored to facilitate peer-to-peer interactions in new ways, providing users with innovative financial solutions and services. At its core, SPERO,$$s$ aims to empower individuals by providing tools and platforms that enhance user experience in the cryptocurrency space. This includes enabling more flexible transaction methods, fostering community-driven initiatives, and creating pathways for financial opportunities through decentralised applications (dApps). The underlying vision of SPERO,$$s$ revolves around inclusiveness, aiming to bridge gaps within traditional finance while harnessing the benefits of blockchain technology. Who is the Creator of SPERO,$$s$? The identity of the creator of SPERO,$$s$ remains somewhat obscure, as there are limited publicly available resources providing detailed background information on its founder(s). This lack of transparency can stem from the project's commitment to decentralisation—an ethos that many web3 projects share, prioritising collective contributions over individual recognition. By centring discussions around the community and its collective goals, SPERO,$$s$ embodies the essence of empowerment without singling out specific individuals. As such, understanding the ethos and mission of SPERO remains more important than identifying a singular creator. Who are the Investors of SPERO,$$s$? SPERO,$$s$ is supported by a diverse array of investors ranging from venture capitalists to angel investors dedicated to fostering innovation in the crypto sector. The focus of these investors generally aligns with SPERO's mission—prioritising projects that promise societal technological advancement, financial inclusivity, and decentralised governance. These investor foundations are typically interested in projects that not only offer innovative products but also contribute positively to the blockchain community and its ecosystems. The backing from these investors reinforces SPERO,$$s$ as a noteworthy contender in the rapidly evolving domain of crypto projects. How Does SPERO,$$s$ Work? SPERO,$$s$ employs a multi-faceted framework that distinguishes it from conventional cryptocurrency projects. Here are some of the key features that underline its uniqueness and innovation: Decentralised Governance: SPERO,$$s$ integrates decentralised governance models, empowering users to participate actively in decision-making processes regarding the project’s future. This approach fosters a sense of ownership and accountability among community members. Token Utility: SPERO,$$s$ utilises its own cryptocurrency token, designed to serve various functions within the ecosystem. These tokens enable transactions, rewards, and the facilitation of services offered on the platform, enhancing overall engagement and utility. Layered Architecture: The technical architecture of SPERO,$$s$ supports modularity and scalability, allowing for seamless integration of additional features and applications as the project evolves. This adaptability is paramount for sustaining relevance in the ever-changing crypto landscape. Community Engagement: The project emphasises community-driven initiatives, employing mechanisms that incentivise collaboration and feedback. By nurturing a strong community, SPERO,$$s$ can better address user needs and adapt to market trends. Focus on Inclusion: By offering low transaction fees and user-friendly interfaces, SPERO,$$s$ aims to attract a diverse user base, including individuals who may not previously have engaged in the crypto space. This commitment to inclusion aligns with its overarching mission of empowerment through accessibility. Timeline of SPERO,$$s$ Understanding a project's history provides crucial insights into its development trajectory and milestones. Below is a suggested timeline mapping significant events in the evolution of SPERO,$$s$: Conceptualisation and Ideation Phase: The initial ideas forming the basis of SPERO,$$s$ were conceived, aligning closely with the principles of decentralisation and community focus within the blockchain industry. Launch of Project Whitepaper: Following the conceptual phase, a comprehensive whitepaper detailing the vision, goals, and technological infrastructure of SPERO,$$s$ was released to garner community interest and feedback. Community Building and Early Engagements: Active outreach efforts were made to build a community of early adopters and potential investors, facilitating discussions around the project’s goals and garnering support. Token Generation Event: SPERO,$$s$ conducted a token generation event (TGE) to distribute its native tokens to early supporters and establish initial liquidity within the ecosystem. Launch of Initial dApp: The first decentralised application (dApp) associated with SPERO,$$s$ went live, allowing users to engage with the platform's core functionalities. Ongoing Development and Partnerships: Continuous updates and enhancements to the project's offerings, including strategic partnerships with other players in the blockchain space, have shaped SPERO,$$s$ into a competitive and evolving player in the crypto market. Conclusion SPERO,$$s$ stands as a testament to the potential of web3 and cryptocurrency to revolutionise financial systems and empower individuals. With a commitment to decentralised governance, community engagement, and innovatively designed functionalities, it paves the way toward a more inclusive financial landscape. As with any investment in the rapidly evolving crypto space, potential investors and users are encouraged to research thoroughly and engage thoughtfully with the ongoing developments within SPERO,$$s$. The project showcases the innovative spirit of the crypto industry, inviting further exploration into its myriad possibilities. While the journey of SPERO,$$s$ is still unfolding, its foundational principles may indeed influence the future of how we interact with technology, finance, and each other in interconnected digital ecosystems.

429 Total ViewsPublished 2024.12.17Updated 2024.12.17

What is $S$

What is AGENT S

Agent S: The Future of Autonomous Interaction in Web3 Introduction In the ever-evolving landscape of Web3 and cryptocurrency, innovations are constantly redefining how individuals interact with digital platforms. One such pioneering project, Agent S, promises to revolutionise human-computer interaction through its open agentic framework. By paving the way for autonomous interactions, Agent S aims to simplify complex tasks, offering transformative applications in artificial intelligence (AI). This detailed exploration will delve into the project's intricacies, its unique features, and the implications for the cryptocurrency domain. What is Agent S? Agent S stands as a groundbreaking open agentic framework, specifically designed to tackle three fundamental challenges in the automation of computer tasks: Acquiring Domain-Specific Knowledge: The framework intelligently learns from various external knowledge sources and internal experiences. This dual approach empowers it to build a rich repository of domain-specific knowledge, enhancing its performance in task execution. Planning Over Long Task Horizons: Agent S employs experience-augmented hierarchical planning, a strategic approach that facilitates efficient breakdown and execution of intricate tasks. This feature significantly enhances its ability to manage multiple subtasks efficiently and effectively. Handling Dynamic, Non-Uniform Interfaces: The project introduces the Agent-Computer Interface (ACI), an innovative solution that enhances the interaction between agents and users. Utilizing Multimodal Large Language Models (MLLMs), Agent S can navigate and manipulate diverse graphical user interfaces seamlessly. Through these pioneering features, Agent S provides a robust framework that addresses the complexities involved in automating human interaction with machines, setting the stage for myriad applications in AI and beyond. Who is the Creator of Agent S? While the concept of Agent S is fundamentally innovative, specific information about its creator remains elusive. The creator is currently unknown, which highlights either the nascent stage of the project or the strategic choice to keep founding members under wraps. Regardless of anonymity, the focus remains on the framework's capabilities and potential. Who are the Investors of Agent S? As Agent S is relatively new in the cryptographic ecosystem, detailed information regarding its investors and financial backers is not explicitly documented. The lack of publicly available insights into the investment foundations or organisations supporting the project raises questions about its funding structure and development roadmap. Understanding the backing is crucial for gauging the project's sustainability and potential market impact. How Does Agent S Work? At the core of Agent S lies cutting-edge technology that enables it to function effectively in diverse settings. Its operational model is built around several key features: Human-like Computer Interaction: The framework offers advanced AI planning, striving to make interactions with computers more intuitive. By mimicking human behaviour in tasks execution, it promises to elevate user experiences. Narrative Memory: Employed to leverage high-level experiences, Agent S utilises narrative memory to keep track of task histories, thereby enhancing its decision-making processes. Episodic Memory: This feature provides users with step-by-step guidance, allowing the framework to offer contextual support as tasks unfold. Support for OpenACI: With the ability to run locally, Agent S allows users to maintain control over their interactions and workflows, aligning with the decentralised ethos of Web3. Easy Integration with External APIs: Its versatility and compatibility with various AI platforms ensure that Agent S can fit seamlessly into existing technological ecosystems, making it an appealing choice for developers and organisations. These functionalities collectively contribute to Agent S's unique position within the crypto space, as it automates complex, multi-step tasks with minimal human intervention. As the project evolves, its potential applications in Web3 could redefine how digital interactions unfold. Timeline of Agent S The development and milestones of Agent S can be encapsulated in a timeline that highlights its significant events: September 27, 2024: The concept of Agent S was launched in a comprehensive research paper titled “An Open Agentic Framework that Uses Computers Like a Human,” showcasing the groundwork for the project. October 10, 2024: The research paper was made publicly available on arXiv, offering an in-depth exploration of the framework and its performance evaluation based on the OSWorld benchmark. October 12, 2024: A video presentation was released, providing a visual insight into the capabilities and features of Agent S, further engaging potential users and investors. These markers in the timeline not only illustrate the progress of Agent S but also indicate its commitment to transparency and community engagement. Key Points About Agent S As the Agent S framework continues to evolve, several key attributes stand out, underscoring its innovative nature and potential: Innovative Framework: Designed to provide an intuitive use of computers akin to human interaction, Agent S brings a novel approach to task automation. Autonomous Interaction: The ability to interact autonomously with computers through GUI signifies a leap towards more intelligent and efficient computing solutions. Complex Task Automation: With its robust methodology, it can automate complex, multi-step tasks, making processes faster and less error-prone. Continuous Improvement: The learning mechanisms enable Agent S to improve from past experiences, continually enhancing its performance and efficacy. Versatility: Its adaptability across different operating environments like OSWorld and WindowsAgentArena ensures that it can serve a broad range of applications. As Agent S positions itself in the Web3 and crypto landscape, its potential to enhance interaction capabilities and automate processes signifies a significant advancement in AI technologies. Through its innovative framework, Agent S exemplifies the future of digital interactions, promising a more seamless and efficient experience for users across various industries. Conclusion Agent S represents a bold leap forward in the marriage of AI and Web3, with the capacity to redefine how we interact with technology. While still in its early stages, the possibilities for its application are vast and compelling. Through its comprehensive framework addressing critical challenges, Agent S aims to bring autonomous interactions to the forefront of the digital experience. As we move deeper into the realms of cryptocurrency and decentralisation, projects like Agent S will undoubtedly play a crucial role in shaping the future of technology and human-computer collaboration.

1.1k Total ViewsPublished 2025.01.14Updated 2025.01.14

What is AGENT S

Discussions

Welcome to the HTX Community. Here, you can stay informed about the latest platform developments and gain access to professional market insights. Users' opinions on the price of S (S) are presented below.

活动图片