# Artikel Terkait Simulator

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "Simulator", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

Artikel Terbaru Li Feifei: Saat Video Generation, Robot, dan NVIDIA Mengaku Sebagai Model Dunia, Kita Membutuhkan Taksonomi

Artikel ini membahas konsep "world model" (model dunia) dalam kecerdasan buatan (AI) yang saat ini banyak digunakan dengan makna berbeda-beda. Fei-Fei Li mengusulkan taksonomi fungsional untuk mengklarifikasi kekacauan ini. Berdasarkan siklus interaksi agen-dunia dalam POMDP (Partially Observable Markov Decision Process), ia mengategorikan model dunia menjadi tiga jenis berdasarkan outputnya: 1. **Renderer (Perender):** Menghasilkan **observasi**, khususnya piksel yang ditujukan untuk mata manusia. Contohnya adalah model video seperti Sora atau sistem interaktif seperti Genie yang menghasilkan gambar berdasarkan input. Fokus utamanya adalah kesetiaan visual, bukan akurasi fisik. 2. **Simulator (Simulator):** Menghasilkan **state (keadaan)**, yaitu representasi dunia yang akurat secara geometri, fisika, dan dinamika. Simulator berfungsi sebagai landasan struktural untuk perhitungan, digunakan oleh profesional (arsitek, desainer) dan program komputer (robot, kendaraan otonom) untuk pelatihan dan pengujian. Contohnya adalah platform seperti NVIDIA Omniverse. 3. **Planner (Perencana):** Menghasilkan **tindakan**. Model ini menentukan langkah selanjutnya yang harus diambil sebuah agen berdasarkan observasi dan tujuan. Ini menutup lingkaran persepsi-aksi. Contohnya adalah model visi-bahasa-aksi (VLA) dan model aksi dunia (World Action Models). Artikel menyoroti bahwa **simulator adalah kunci penghubung** yang paling penting namun kurang mendapat perhatian publik. Simulator bekerja pada tingkat geometri dan fisika yang mendasarinya, sehingga pemahamannya dapat diproyeksikan ke dalam piksel (untuk renderer) atau prediksi konsekuensi tindakan (untuk planner). Tren terpenting saat ini adalah peleburan batas antara ketiga kategori ini, didorong oleh kesadaran bahwa pengetahuan dasar tentang dunia yang dibutuhkan adalah sama. Tujuan akhirnya adalah model dunia terpadu yang dapat beralih di antara rendering, simulasi, dan perencanaan sesuai kebutuhan. Perkembangan ini mendorong kemajuan menuju kecerdasan spasial, di mana mesin tidak hanya memahami bahasa tentang dunia, tetapi juga dapat memahami, membayangkan, bernalar, dan berinteraksi dengan dunia fisik itu sendiri.

marsbit07/05 09:28

Artikel Terbaru Li Feifei: Saat Video Generation, Robot, dan NVIDIA Mengaku Sebagai Model Dunia, Kita Membutuhkan Taksonomi

marsbit07/05 09:28

Tim Fei-Fei Li Memperjelas Konsep 'Model Dunia', Sora Hanya Bisa Disebut Sebagai Renderer

Tim World Labs dan Profesor Stanford Li Fei-Fei menerbitkan analisis konseptual berjudul "Fungsional Taxonomy of World Models". Artikel tersebut menyatakan bahwa istilah "model dunia" telah menjadi salah satu konsep terpenting namun paling disalahgunakan di bidang AI. Pemicu kebingungan ini adalah keberagaman sistem yang disebut "model dunia". OpenAI's Sora disebut "world simulator", tetapi hanya menghasilkan video yang realistis secara visual. Tesla menggunakan "model dunia" untuk memprediksi pergerakan objek di FSD, sementara perusahaan robotika menggunakannya untuk mengevaluasi konsekuensi tindakan. Padahal, ketiganya memiliki tujuan teknis yang sangat berbeda. Berdasarkan kerangka Partially Observable Markov Decision Process (POMDP), tim mengusulkan klasifikasi fungsional yang membagi sistem "model dunia" menjadi tiga proyeksi: Renderer, Simulator, dan Planner. * **Renderer (seperti Sora, Genie 3):** Fokus pada generasi piksel yang realistis secara visual. Input adalah representasi keadaan, output adalah gambar/video. Tidak menjamin keakuratan fisik. * **Simulator (seperti NVIDIA Omniverse):** Fokus pada prediksi keadaan fisik selanjutnya secara akurat. Input adalah keadaan saat ini dan tindakan, output adalah keadaan berikutnya yang dapat dihitung untuk analisis teknis. Data 3D berkualitas untuk pelatihannya sangat langka. * **Planner (seperti model VLA):** Fokus pada keputusan tindakan. Input adalah data observasi dan instruksi tujuan, output adalah tindakan selanjutnya yang harus dijalankan. Artikel ini menyimpulkan bahwa Sora, sesuai dengan klasifikasi ini, adalah Renderer, bukan "model dunia" yang utuh karena tidak dapat memprediksi perubahan keadaan berdasarkan input tindakan. Klarifikasi ini penting untuk menghindari kesalahan teknis, memberikan kejelasan bagi investor, dan menetapkan tolok ukur yang jelas di kalangan akademisi.

marsbit06/04 03:19

Tim Fei-Fei Li Memperjelas Konsep 'Model Dunia', Sora Hanya Bisa Disebut Sebagai Renderer

marsbit06/04 03:19

活动图片