6 Hari Setelah Rilis ChatGPT Health, OpenAI Tersalip di Benchmark Kesehatan Miliknya Sendiri
Hanya 6 hari setelah OpenAI meluncurkan ChatGPT Health, Baichuan AI dari China mengungguli model terbaru OpenAI (GPT-5.2 High) dalam benchmark kesehatan HealthBench yang dirilis oleh OpenAI sendiri. Model Baichuan-M3 mencetak skor 65,1 dan mencapai tingkat halusinasi terendah (3,5%) tanpa alat pencarian eksternal.
Kunci keberhasilannya terletak pada teknologi Fact Aware RL (Reinforcement Learning) yang memadukan penalaran medis dengan kontrol fakta, menghindari respons ambigu atau berisiko. Baichuan juga mengembangkan SCAN-bench, benchmark yang mensimulasi proses diagnosis lengkap, di mana M3 bahkan mengungguli dokter manusia dalam beberapa aspek karena kemampuan lintas disiplin yang lebih baik.
Baichuan kini fokus pada pengembangan produk konsumen yang serius dalam bidang medis, seperti onkologi, bukan hanya konsultasi psikologis. Mereka percaya bahwa AI dapat meningkatkan akses layanan kesehatan berkualitas dan suatu hari nanti membangun model matematika kehidupan yang mendekati AGI.
marsbit01/14 02:35