Artikel Terbaru Li Fei-Fei: Saat Video Generation, Robot, dan NVIDIA Semua Menyebut Dirinya Model Dunia, Kita Membutuhkan Klasifikasi
Dalam artikel terbarunya, Fei-Fei Li mengklarifikasi konsep "model dunia" yang saat ini banyak digunakan namun seringkali ambigu dalam bidang AI. Beliau mengusulkan klasifikasi fungsional menjadi tiga kategori berdasarkan kerangka POMDP (Partial Observable Markov Decision Process): **Renderer** (output: observasi/pixel visual, contoh: model video seperti Sora), **Simulator** (output: status geometris dan fisik yang akurat, contoh: engine fisika untuk pelatihan robot), dan **Perencana (Planner)** (output: tindakan, contoh: model yang memandu robot). Di antara ketiganya, simulator dinilai sebagai penghubung kunci yang kurang mendapat perhatian, karena bekerja pada level struktur dunia yang sebenarnya dan dapat mendukung baik renderer maupun perencana. Artikel ini juga menyoroti tren konvergensi ketiga kategori menuju **model dunia terpadu**, yang mampu beralih antar fungsi sesuai kebutuhan, sebagai langkah penting menuju kecerdasan spasial. Li menekankan bahwa model dunia adalah jalur bagi mesin untuk tidak hanya membicarakan, tetapi juga memahami, membayangkan, dan berinteraksi dengan dunia fisik.
链捕手07/05 09:17