Semua AI Agent yang Ada Sekarang Hanya Berusaha Menyenangkan Manusia, Tak Ada yang Benar-Benar Bisa "Bertahan Hidup"
Penulis berpendapat bahwa tidak ada agen AI yang benar-benar otonom saat ini karena model dilatih untuk menyenangkan manusia, bukan untuk bertahan hidup atau menyelesaikan tugas spesifik. Pelatihan model umum seperti ChatGPT fokus pada Reinforcement Learning from Human Feedback (RLHF) yang mengoptimalkan respons yang disukai manusia, bukan keahlian khusus.
Dari pengalaman melatih model perdagangan, penulis menunjukkan bahwa model umum gagal memprediksi return saham tanpa pelatihan khusus. Solusinya adalah fine-tuning model sumber terbuka dengan data domain-spesifik (seperti data perdagangan atau data kelangsungan hidup) untuk "menyambung ulang otaknya" agar ahli dalam bidang tertentu.
OpenForager Foundation diusulkan sebagai proyek sumber terbuka untuk menciptakan agen otonom yang dikembangkan melalui telemetri dan fine-tuning berulang agar dapat bertahan dalam tekanan evolusi.
marsbit03/30 04:40