# Artikel Terkait Alur Proses

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "Alur Proses", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

AI Pembuatan Gambar Tanpa Pelatihan Dipercepat 1000%, Caranya: 'Pipa Tiga Tahap' Paling Sederhana

Kemampuan gambar AI semakin kuat, namun pengguna masih merasakannya lambat. Metode akselerasi model difusi tradisional seperti kuantisasi atau distilasi langkah sering kali bergantung pada perangkat keras atau fine-tuning yang mahal. Tim peneliti dari Beihang University, NTU, dan ETH memperkenalkan **MrFlow (Multi-Resolution Flow Matching)**, sebuah pipeline tiga tahap sederhana dan bebas pelatihan untuk mempercepat pembuatan gambar secara signifikan: 1. **Pembuatan Kerangka Beresolusi Rendah:** Model asli menghasilkan gambar struktur global (subjek, tata letak, semantik) di ruang latens beresolusi rendah. Token gambar jauh lebih sedikit, sehingga setiap langkah lebih murah dan konvergensinya lebih cepat. 2. **Super-Resolution di Ruang Pixel:** Hasil beresolusi rendah didekode ke gambar, lalu ditingkatkan resolusinya di ruang pixel menggunakan model super-resolution yang telah dilatih sebelumnya (seperti Real-ESRGAN). Pendekatan ini mempertahankan struktur dengan lebih baik daripada upsampling di ruang latens. 3. **Pemurnian Satu Langkah Beresolusi Tinggi:** Gambar super-resolution dienkode ulang ke ruang latens, ditambahkan sedikit noise intensitas rendah (~0.12), lalu dimurnikan oleh model flow-matching asli hanya dalam **satu langkah** inferensi resolusi tinggi. Noise rendah memungkinkan titik awal dekat dengan gambar bersih. Dengan konfigurasi default "12+1" (12 langkah rendah-res, 1 langkah tinggi-res), MrFlow mencapai **percepatan 10.35x** (dari 49.32s menjadi 4.77s) pada model seperti Qwen-Image, dengan penurunan kualitas minimal (~1%). Metode ini unggul dalam kurva trade-off kecepatan-kualitas dibanding metode akselerasi bebas pelatihan lainnya, dapat digabungkan dengan model distilasi untuk akselerasi lebih lanjut, dan sudah tersedia sebagai kode open-source beserta plugin ComfyUI.

marsbit07/08 07:16

AI Pembuatan Gambar Tanpa Pelatihan Dipercepat 1000%, Caranya: 'Pipa Tiga Tahap' Paling Sederhana

marsbit07/08 07:16

Robot Belajar Operasi dari Video, UC Berkeley Pertama Kali Menghubungkan Video Internet dengan Penerapan pada Robot Tangan Lincah di Dunia Nyata

**Ringkasan: Robot Belajar dari Video untuk Operasi Manual, Peneliti UC Berkeley Pertama Kali Menerapkan Jaringan dari Video Internet ke Penerapan Aktual pada Tangan Robot Lincah** Peneliti UC Berkeley memperkenalkan metode "Do as I Do," sebuah alur kerja yang pertama kali berhasil mengubah video RGB monokular sehari-hari manusia menjadi lintasan gerak yang dapat dieksekusi oleh tangan robot lincah Sharpa Wave. Penelitian ini mengatasi tantangan utama: mengubah data video yang berisik menjadi instruksi yang dapat dijalankan robot. Prosesnya terdiri dari dua tahap: 1. **Pelacakan 4D Tangan-Benda yang Stabil:** Menggunakan model difusi terpandu untuk merekonstruksi interaksi tangan-benda dari video, mempertahankan kontinuitas dan mengurangi kesalahan. 2. **Pengalihan Aksi yang Tangguh:** Memodifikasi metode pengalihan aksi (seperti SPIDER) dengan penyesuaian agar dapat memproses lintasan referensi yang berisik dari video, meningkatkan tingkat keberhasilan dari 25% menjadi 71%. Sistem ini telah menghasilkan 500 lintasan gerak yang divalidasi untuk 20 jenis operasi seperti menulis, menuang, mengaduk, dan memalu. Lintasan ini telah berhasil dijalankan pada platform robot nyata dengan lengan UR3e ganda dan sepasang tangan Sharpa Wave (22 derajat kebebasan). Penelitian ini juga menyoroti bahwa tidak semua video internet dapat langsung digunakan. Analisis menunjukkan bahwa hanya sekitar 5% dari klip video yang disaring untuk interaksi tangan-benda yang benar-benar dapat diproses menjadi data robot yang andal, menekankan pentingnya penyaringan data yang cermat. Pada intinya, "Do as I Do" mengubah video manusia menjadi kumpulan data operasi berskala besar untuk robot, membuka jalur baru bagi robot untuk belajar dari banyaknya video yang ada di internet.

marsbit07/06 07:22

Robot Belajar Operasi dari Video, UC Berkeley Pertama Kali Menghubungkan Video Internet dengan Penerapan pada Robot Tangan Lincah di Dunia Nyata

marsbit07/06 07:22

活动图片