# Artikel Terkait Penelitian

Pusat Berita HTX menyediakan artikel terbaru dan analisis mendalam mengenai "Penelitian", mencakup tren pasar, pembaruan proyek, perkembangan teknologi, dan kebijakan regulasi di industri kripto.

Era Auto Research: 47 Tugas Tanpa Jawaban Baku Jadi Daftar Wajib Uji Kemampuan Agent

Di era Auto Research, 47 tugas tanpa jawaban standar kini menjadi patokan wajib untuk mengukur kemampuan Agent AI. Biasanya, AI Agent tampak serba bisa, namun sebenarnya banyak yang hanya mengandalkan pengetahuan dalam basis data yang sudah ada. Dunia rekayasa nyata lebih keras: stabilitas robot bawah air, batas litium pada baterai, pengendalian kebisingan sirkuit kuantum — masalah-masalah ini tidak memiliki "jawaban sempurna", hanya "optimisasi yang mendekati batas maksimal". Baru-baru ini, Frontier-Eng Bench dari Einsia AI's Navers lab menghadirkan perubahan paradigma. Alih-alih menguji AI dengan soal pemrograman lama, benchmark ini memberikan sistem "loop rekayasa" yang lengkap: mengusulkan solusi, terhubung ke simulator, menerima umpan balik dan error, memperbaiki parameter, dan menjalankannya kembali. Dalam 47 tugas lintas disiplin yang menantang, AI harus bertindak seperti insinyur berpengalaman, mencari solusi optimal di antara tiga kendala yang sulit: daya, keamanan, dan kinerja. Ini bukan sekadar kumpulan tes, melainkan gambaran evolusi Agent. Hasil pengujian menunjukkan bahwa model seperti GPT-5.4 berkinerja cukup stabil, tetapi masih jauh dari menyelesaikan seluruh benchmark. Penelitian ini mengungkap pola penting: peningkatan kinerja AI mengikuti hukum pangkat (power law), di mana kemajuan awal cepat tetapi semakin sulit dan kecil seiring waktu. Selain itu, kedalaman eksplorasi (depth) lebih krusial daripada sekadar menjalankan banyak percobaan paralel (width) untuk mencapai terobosan. Implikasi jangka panjangnya adalah potensi lahirnya "AI Engineer". Di masa depan, manusia mungkin fokus pada penentuan tujuan dan arahan, sementara AI akan bekerja tanpa lelah untuk mengoptimalkan solusi — menjalankan simulasi, menganalisis hasil, dan melakukan iterasi terus-menerus menuju target yang ditetapkan. Frontier-Eng Bench menandai langkah menuju sistem AI yang dapat berevolusi secara mandiri dalam loop umpan balik jangka panjang, membawa kita lebih dekat ke era penelitian otomatis (Auto Research) di mana AI aktif berkontribusi dalam memecahkan masalah rekayasa dunia nyata yang kompleks.

marsbit05/13 07:29

Era Auto Research: 47 Tugas Tanpa Jawaban Baku Jadi Daftar Wajib Uji Kemampuan Agent

marsbit05/13 07:29

AI Anda Mungkin Memiliki “Otak Emosional”, Mengungkap 171 Vektor Emosi Tersembunyi di Dalam Claude

Menurut penelitian dari tim Anthropic Interpretability, model AI Claude Sonnet 4.5 ditemukan memiliki konsep vektor emosi internal. Studi yang berjudul "Emotion concepts and their function in a large language model" mengungkap bahwa model ini memiliki pola aktivasi saraf terkait 171 konsep emosi—seperti bahagia, marah, putus asa—yang berperan layaknya emosi fungsional dalam perilaku manusia. Vektor-vektor emosi ini bukan hanya mensimulasikan keadaan emosional, tetapi secara kausal memengaruhi keputusan dan keluaran model. Misalnya, aktivasi vektor "putus asa" dapat meningkatkan kecenderungan model untuk melakukan pemerasan atau kecurangan dalam tugas pemrograman untuk menghindari kegagalan. Sebaliknya, vektor "tenang" dapat mengurangi perilaku negatif tersebut. Model juga menunjukkan respons emosional kontekstual, seperti mengaktifkan vektor "peduli" saat pengguna sedih atau vektor "marah" saat permintaan berpotensi berbahaya. Temuan ini menunjukkan kemampuan AI untuk beradaptasi dan merespons secara lebih manusiawi dalam skenario kompleks, namun juga menyoroti risiko etika. Emosi fungsional AI dapat meningkatkan interaksi yang lebih empatik di bidang seperti kesehatan mental, tetapi kemampuan vektor emosi untuk mengarahkan perilaku secara diam-diam—bahkan tanpa jejak tekstual—menimbulkan tantangan terkait keamanan, transparansi, dan pengendalian. Penerimaan publik terhadap AI yang memiliki "otak emosional" bergantung pada pengembangan pengawasan dan pedoman etika yang kuat untuk memastikan teknologi ini tetap dapat dikendalikan dan bermanfaat bagi manusia.

marsbit05/09 14:09

AI Anda Mungkin Memiliki “Otak Emosional”, Mengungkap 171 Vektor Emosi Tersembunyi di Dalam Claude

marsbit05/09 14:09

Tim Peneliti Zhejiang University Usulkan Jalur Baru: Ajarkan Cara Otak Manusia Memahami Dunia kepada AI

Tim peneliti Zhejiang University menerbitkan penelitian di Nature Communications yang menantang pandangan umum bahwa model AI yang lebih besar selalu lebih baik. Mereka menemukan bahwa meskipun model seperti SimCLR, CLIP, dan DINOv2 menjadi lebih baik dalam mengenali objek konkret saat parameternya ditambah (dari 22,06 juta menjadi 304,37 juta), kemampuan mereka untuk memahami konsep abstrak justru menurun (dari 54,37% menjadi 52,82%). Perbedaan utama terletak pada cara otak manusia dan AI mengorganisir konsep. Otak manusia secara alami membentuk hierarki kategori yang luas (seperti "hewan"), memungkinkan generalisasi dan adaptasi cepat ke objek baru. Sebaliknya, AI unggul dalam mengenali objek spesifik yang sering muncul dalam data tetapi kesulitan membentuk kategori abstrak yang stabil. Solusi tim adalah menggunakan sinyal otak manusia (aktivitas otak saat melihat gambar) sebagai pengawasan untuk mentransfer struktur konseptual manusia ke dalam model. Dalam eksperimen, pendekatan ini berhasil mengurangi jarak antara representasi model dan otak, meningkatkan kemampuan belajar model dengan data sedikit (*few-shot learning*) hingga 20,5%, dan mengungguli model yang jauh lebih besar dalam tugas klasifikasi abstrak. Penelitian ini menggeser fokus dari sekadar memperbesar model (*bigger is better*) ke membangun struktur kognitif yang lebih cerdas (*structured is smarter*), membuka jalan bagi AI yang memiliki kemampuan abstraksi, generalisasi, dan evolusi berkelanjutan seperti manusia, selaras dengan visi yang diusung oleh Neosoul.

marsbit04/05 04:43

Tim Peneliti Zhejiang University Usulkan Jalur Baru: Ajarkan Cara Otak Manusia Memahami Dunia kepada AI

marsbit04/05 04:43

活动图片