Seis días después del lanzamiento de ChatGPT Salud, OpenAI es superado en su propio Benchmark de salud
Resumen: En enero de 2026, OpenAI lanzó ChatGPT Salud para responder preguntas médicas, pero solo seis días después, la empresa china Baichuan Intelligence superó a OpenAI en su propia prueba médica HealthBench con su nuevo modelo Baichuan-M3. El modelo M3 obtuvo 65.1 puntos, el mejor resultado global, con una tasa de alucinaciones de solo 3.5%, la más baja del sector.
Baichuan utilizó una técnica de aprendizaje por refuerzo consciente de los hechos (Fact Aware RL) para mejorar la precisión médica y reducir errores. Además, creó su propia prueba SCAN-bench para evaluar diagnósticos completos, donde M3 superó incluso a médicos humanos en algunos casos, gracias a su conocimiento multidisciplinario y paciencia en la recopilación de información.
La empresa ahora ofrece M3 en su producto Baixing para usuarios y médicos, con respuestas adaptadas a cada perfil. Baichuan se enfoca en aplicaciones médicas serias, como oncología, priorizando la precisión científica sobre áreas menos definidas como la salud mental. El CEO Wang Xiaochuan ve el AI médico como clave para mejorar el acceso a la salud y avanzar hacia la AGI.
marsbit01/14 02:36