Model Gambar Generatif 'Mangga' Zuck Kalah Telak dari GPT Image 2, Tanpa Diajari, Ia Belajar Sendiri Cara Revisi
Meta Labs (MSL) meluncurkan model generasi gambar terbarunya, Muse Image dengan nama kode "Mango". Model ini menempati peringkat kedua dalam arena perbandingan Arena AI, di bawah GPT Image 2 dari OpenAI. Keunggulan utamanya bukan hanya pada kualitas gambar, tetapi pada kemampuannya sebagai *agent* yang dapat berpikir dan merevisi karyanya sendiri. Muse Image mampu mencari informasi online untuk referensi, menghasilkan kode untuk elemen seperti QR code, dan—yang paling mencolok—melakukan koreksi mandiri setelah gambar dibuat, sebuah perilaku yang muncul sendiri selama pelatihan.
Model ini terintegrasi erat dengan ekosistem Meta. Pengguna dapat menyebut (@) nama pengguna Instagram publik untuk memasukkan wajah orang tersebut ke dalam gambar yang dibuat, sebuah fitur yang menimbulkan pertanyaan privasi karena diaktifkan secara default. Muse Image juga terhubung dengan model bahasa Muse Spark ("Alpukat"), memungkinkan pembuatan konten yang lebih kompleks seperti game web. Untuk video, Meta memperkenalkan Muse Video yang masih dalam pratinjau, menduduki peringkat ketiga di Arena.
Kekuatan utama Meta terletak pada distribusi. Muse Image sudah diintegrasikan ke Meta AI, Instagram, WhatsApp, dan akan menyusul ke platform lainnya, menjangkau miliaran pengguna. Setiap gambar yang dihasilkan dilengkapi watermark digital "Content Seal" untuk identifikasi. Dengan strategi ini, Meta tidak hanya bersaing pada kualitas model, tetapi juga pada kemudahan akses dan integrasi AI ke dalam kehidupan digital sehari-hari.
marsbit07/08 10:42