5 Tahun Lalu Dituding 'Nonsense' oleh Profesor MIT, PPT Ini Memprediksi Inti Pikiran OpenAI o1 dan o3

marsbitОпубликовано 2026-08-17Обновлено 2026-08-17

Введение

Kisah ini berpusat pada Giambattista Parascandolo, seorang peneliti utama di OpenAI yang fokus pada model penalaran. Pada tahun 2020, saat melamar posisi profesor di MIT, presentasinya tentang penggunaan GPT untuk penalaran justru dicap sebagai "nonsense" atau omong kosong oleh sebagian besar komite profesor. Presentasi yang kontroversial itu membahas tiga arah penelitian masa depan: 1. **Penalaran Terbuka (Open-ended Reasoning)**: Ide bahwa model AI harus dapat mengalokasikan lebih banyak waktu dan komputasi untuk memikirkan masalah yang sulit, terus memperbaiki jawabannya. Konsep ini sangat mirip dengan perluasan komputasi pada waktu inferensi (reasoning-time computation) yang digunakan model seperti OpenAI o1 dan o3 saat ini. 2. **Bahasa sebagai Wadah Penalaran**: Mengusulkan penggunaan pengetahuan bahasa dari model seperti GPT untuk membantu dalam perencanaan dan penalaran tugas-tugas kompleks, misalnya dalam lingkungan *reinforcement learning*. Ini mengantisipasi teknik seperti *chain-of-thought* dan alur kerja *agent*. 3. **Sistem yang Dapat Belajar dan Memodifikasi Diri**: Visi di mana agen AI dapat secara aktif mengatur ulang tugas, membuat skenario *counterfactual*, dan bahkan membaca atau memodifikasi aktivasi serta bobot jaringannya sendiri untuk belajar lebih efektif. Parascandolo, yang memulai karir risetnya tentang generalisasi dan perencanaan, bergabung dengan OpenAI pada 2021 setelah menyelesaikan PhD. Di sana, ia terlibat dalam pengembangan GPT-4 dan kem...

Lingkaran AI tidak kekurangan gosip.

Tokoh utama kali ini bernama Giambattista Parascandolo, peneliti penting di bidang model penalaran OpenAI.

Tahun 2020, dia mengikuti wawancara untuk posisi profesor di MIT, memberikan presentasi tentang penggunaan GPT untuk penalaran. Hasilnya, sebagian besar profesor di panel wawancara mencap arah penelitian ini sebagai "nonsense" (omong kosong).

https://x.com/turingbook/status/2084003612687249836?s=20

Pria ini langsung berani buka kartu, menuliskan pengalaman ini di halaman pribadinya, dan melampirkan tautan presentasi dan slide dari tahun itu.

https://sites.google.com/view/giambattista-parascandolo/home

Laporan yang Dicap "Omong Kosong" Itu, Berisi Apa?

Situs web MIT menunjukkan, tema presentasi ini adalah bagaimana jaringan saraf tiruan dapat melampaui distribusi pelatihan, memperoleh kemampuan generalisasi dan perencanaan yang lebih mendekati manusia.

Parascandolo percaya, manusia mampu menggabungkan kembali pengetahuan yang ada, mengidentifikasi invarian kunci, membangun model abstrak, dan menyelesaikan perencanaan jangka panjang. Jaringan saraf tiruan masih memiliki ruang peningkatan yang besar dalam aspek-aspek ini.

Di akhir laporan, dia mengajukan tiga arah penelitian di masa depan: penalaran terbuka dalam jaringan saraf, derajat kebebasan yang belum dieksplorasi dalam jaringan saraf tiruan, serta penggunaan bahasa sebagai wahana penalaran dalam pembelajaran penguatan, untuk meningkatkan efisiensi sampel.

Konsep paling kunci di antaranya adalah "penalaran terbuka".

Parascandolo mendefinisikannya sebagai: model dapat mengalokasikan lebih banyak waktu dan komputasi, terus-menerus memperbaiki jawaban. Semakin sulit masalahnya, model seharusnya berpikir beberapa langkah lebih banyak, dan mengubah komputasi tambahan menjadi hasil yang lebih baik.

Ini terdengar sangat mirip dengan perluasan komputasi saat penalaran hari ini.

Transformer standar saat itu memiliki kedalaman jaringan yang tetap, jumlah komputasi maju yang dialami setiap token pada dasarnya ditentukan, sementara tingkat kesulitan masalah tidak memiliki hubungan stabil dengan panjang masukan. Sebuah masalah bisa sangat panjang, tetapi jawabannya sederhana. Masalah lain mungkin hanya satu kalimat, tetapi memerlukan beberapa putaran dekomposisi dan verifikasi.

RNN tampaknya lebih cocok untuk tugas semacam ini. Ia dapat berjalan berulang kali, secara teori mampu mendapatkan waktu berpikir sepanjang apapun. Namun, kurva yang ditunjukkan Parascandolo dalam PPT menunjukkan, RNN biasanya hanya berkinerja terbaik di sekitar jumlah langkah penalaran yang pernah dilihat selama pelatihan, melanjutkan penambahan siklus justru dapat menurunkan akurasi.

Ini berarti, menambah jumlah komputasi hanyalah langkah pertama, model juga harus belajar bagaimana memanfaatkan komputasi ini.

Perencanaan multi-langkah paling efektif saat itu banyak bergantung pada kontrol prediktif model dan pencarian pohon Monte Carlo. Jaringan saraf bertanggung jawab untuk memprediksi lingkungan atau mengevaluasi nilai, algoritma pencarian eksternal bertanggung jawab untuk mengembangkan jalur masa depan. Parascandolo berharap lebih jauh mengintegrasikan kemampuan penalaran jangka panjang ke dalam jaringan saraf.

Gagasannya yang kedua adalah membuat bahasa menjadi wahana penalaran.

Parascandolo memberi contoh dengan game klasik "Montezuma's Revenge". Sebuah Agen pembelajaran penguatan yang dilatih dari nol perlu mencoba banyak kombinasi keadaan dan aksi, banyak tindakan yang benar itu sendiri tidak rumit, yang benar-benar kurang dari Agen adalah penilaian tentang "perilaku apa yang lebih masuk akal".

GPT telah menyerap banyak pengetahuan dunia dari teks, bahasa dapat membantu model menggambarkan lingkungan, memahami tujuan, memecah tugas dan menghasilkan rencana tingkat tinggi, juga dapat menyempitkan rentang pencarian secara signifikan.

Ditempatkan di hari ini, pemikiran ini mudah mengingatkan pada rantai pikiran, perencanaan bahasa, dan alur kerja Agen.

Arah ketiga yang diajukan Parascandolo adalah, sistem kecerdasan buatan dapat mereset tugas, kembali ke keadaan apa pun dalam ingatan, membangun skenario kontrafaktual, juga dapat menyesuaikan waktu, gravitasi, dan hasil observasi dalam simulator. Sistem bahkan dapat langsung membaca, menyalin, dan memodifikasi nilai aktivasi serta bobot jaringan sarafnya sendiri.

Ini setara dengan memasukkan proses pembelajaran itu sendiri ke dalam ruang operasi Agen. Ia dapat melakukan latihan yang disengaja, menghasilkan skenario pelatihan khusus, mentransfer pengetahuan yang ada, dan belajar kembali untuk lintasan yang gagal.

Dalam PPT lima tahun lalu, hampir menuliskan rute model penalaran hari ini.

Kami juga menggali blog yang dia tulis pada Juni 2021, judulnya adalah "Backpropagation, Evolusi, dan Kesalahan 'Dua Anjing'".

Blog ini terutama membantah pandangan "jaringan saraf membutuhkan data yang sangat banyak, sehingga tidak mirip otak manusia".

Parascandolo berpendapat, manusia hanya perlu melihat beberapa ekor anjing untuk belajar mengenali, tidak berarti tidak ada akumulasi pengalaman sebelumnya. Evolusi panjang telah mengendapkan pengalaman nenek moyang dalam berinteraksi dengan dunia, menjadi struktur dan bias induktif otak manusia.

Menurut perspektif ini, pelatihan awal skala besar jaringan saraf dapat dianalogikan dengan evolusi biologis, penyesuaian halus model dan pembelajaran kontekstual lebih mendekati pembelajaran individu sepanjang hidupnya. GPT-3 membaca teks jauh melebihi individu mana pun, tetapi pelatihan awalnya mengambil peran mengompresi pengalaman yang sangat besar, membentuk kemampuan pembelajaran yang efisien. Oleh karena itu, tidak dapat secara langsung membandingkan semua data pelatihan awal model, dengan sedikit sampel pembelajaran seseorang setelah lahir.

Pemahaman ini juga berarti, terus memperluas data dan daya komputasi masih mungkin membawa peningkatan yang nyata. Dia menganalogikan peran yang dimainkan keduanya, tidak menganggap mekanisme spesifik penurunan gradien sama dengan evolusi biologis.

Dari Mana Asal Pria Ini?

Pria ini cukup rendah hati, postingan terbaru di X masih berasal dari November 2024, saat itu dia sedang merekrut dua insinyur penelitian (RE) dan insinyur perangkat lunak (SWE) untuk o1.

Menurut halaman pribadinya, pengalaman penelitian Parascandolo selalu berkisar pada generalisasi, perencanaan, dan penalaran.

2017, dia memasuki Max Planck Institute for Intelligent Systems dan ETH Zurich untuk mengejar gelar doktor, dibimbing oleh Bernhard Schölkopf dan Thomas Hofmann, disertasi berfokus pada generalisasi OOD dalam pembelajaran mendalam.

Selama doktor, dia masing-masing melakukan magang di Google X di Mountain View dan DeepMind di London, yang pertama terlibat dalam penelitian desain otomatisasi pada simulator skala sangat besar, yang kedua terlibat dalam penelitian pencarian pohon Monte Carlo dengan pembagian.

September 2021 lulus doktor, dia langsung bergabung dengan OpenAI, awalnya masuk tim pembelajaran penguatan yang dipimpin John Schulman, kemudian beralih ke tim algoritma tempat Mark Chen berada, lalu bergabung dengan tim 🍓 (strawberry) yang dipimpin Jerry Tworek. Tim strawberry, adalah kode internal untuk proyek o1.

2023, dia terlibat dalam pengembangan GPT-4, dan membentuk tim baru yang terus meneliti penalaran. Kemudian terlibat dalam penelitian dasar OpenAI o1 dan o3, mendorong perluasan pemodelan hadiah, konstruksi lingkungan, dan algoritma penalaran umum. Sebagian deskripsi algoritma masih ditutupi dengan blok hitam olehnya hingga kini.

Wawancara tahun 2020 itu, Parascandolo tidak berhasil mendapatkan jabatan pengajar di MIT, dia pergi ke OpenAI.

Empat tahun kemudian, dia membantu membangun o1.

Hidup selalu penuh keajaiban.

Tautan Referensi:

https://x.com/giambattista92

https://sites.google.com/view/giambattista-parascandolo/home

https://gibipara92.github.io/2021/06/09/backprop-evolution-two-dogs.html

https://docs.google.com/presentation/d/1edd2GkAP31wNygaev3DO8gE1t2lgsx1z8TeVpBKqlYA/edit?slide=id.gc772610149_0_179#slide=id.gc772610149_0_179

Artikel ini berasal dari akun WeChat publik "机器之心" (ID:almosthuman2014), penulis: Yang Wen

Трендовые криптовалюты

Связанные с этим вопросы

QApa inti dari presentasi Giambattista Parascandolo yang sempat dicap sebagai 'nonsense' oleh panel profesor MIT?

APresentasi tersebut membahas tentang bagaimana jaringan saraf tiruan dapat melampaui distribusi pelatihan untuk mendapatkan kemampuan generalisasi dan perencanaan yang lebih mirip manusia. Parascandolo mengusulkan konsep 'reasoning terbuka', di mana model dapat mengalokasikan lebih banyak waktu dan komputasi untuk terus menyempurnakan jawaban, sebuah ide yang menjadi inti dari model reasoning seperti OpenAI o1 dan o3.

QApa saja tiga arah penelitian masa depan yang diusulkan Parascandolo dalam presentasinya?

ATiga arah penelitian tersebut adalah: 1) Reasoning terbuka dalam jaringan saraf, 2) Menggunakan bahasa sebagai wahana untuk reasoning dalam pembelajaran penguatan untuk meningkatkan efisiensi sampel, dan 3) Sistem AI yang dapat mengatur ulang tugas, mengonstruksi skenario kontrafaktual, dan bahkan memodifikasi nilai aktivasi serta bobot jaringannya sendiri.

QMengapa ide menggunakan bahasa sebagai wahana reasoning dianggap penting oleh Parascandolo?

AKarena bahasa, seperti yang telah diserap model seperti GPT dari teks, mengandung banyak pengetahuan dunia. Bahasa dapat membantu model mendeskripsikan lingkungan, memahami tujuan, memecah tugas, membuat rencana tingkat tinggi, dan secara signifikan mempersempit ruang pencarian, mirip dengan cara kerja 'chain-of-thought' atau alur kerja 'Agent' saat ini.

QBagaimana Parascandolo menganalogikan pelatihan besar-besaran model bahasa seperti GPT-3?

AParascandolo menganalogikan pelatihan besar-besaran (pre-training) model dengan proses evolusi biologis, yang mengompresi pengalaman luas leluhur menjadi struktur dan bias induktif. Sedangkan penyesuaian halus (fine-tuning) dan pembelajaran dalam konteks (in-context learning) lebih mirip dengan pembelajaran individu dalam satu masa hidup. Ini membantah klaim bahwa neural network tidak seperti otak manusia karena butuh data sangat banyak.

QApa peran Giambattista Parascandolo dalam pengembangan AI di OpenAI?

ASetelah bergabung dengan OpenAI pada tahun 2021, Parascandolo terlibat dalam pengembangan GPT-4 dan kemudian membentuk tim baru yang fokus pada penelitian reasoning. Dia berperan penting dalam penelitian dasar untuk model OpenAI o1 dan o3, dengan berkontribusi pada pemodelan imbalan, konstruksi lingkungan, dan perluasan algoritma reasoning umum.

Похожее

В биткоине на горизонте появляется золотой крест! Вот что это значит и что может произойти

Биткоин ($BTC) приближается к формированию паттерна «золотой крест», ключевого индикатора долгосрочного бычьего тренда, благодаря резкому росту, превысившему $72 000 (рост более 12% за неделю). Курс уже торгуется выше 200-дневной простой скользящей средней (SMA), которая находится на уровне около $69 005. «Золотой крест» возникает, когда 50-дневная SMA пересекает 200-дневную SMA снизу вверх. Если BTC продолжит рост и это пересечение произойдет, паттерн официально сформируется, что в техническом анализе считается сигналом усиления восходящего тренда. Удержание цены выше 200-дневной SMA, которая является важным индикатором долгосрочного направления рынка, может указывать на смену общей рыночной структуры в пользу бычьего тренда. Падение ниже этого уровня, напротив, может свидетельствовать об ослаблении бычьих настроений.

cryptonews.ru49 мин. назад

В биткоине на горизонте появляется золотой крест! Вот что это значит и что может произойти

cryptonews.ru49 мин. назад

Илон Маск и компания X делают шаг в сторону криптовалют! Намечается новая эра платежей! Вот подробности

Социальная платформа X Илона Маска рассматривает возможность выплаты вознаграждений создателям контента в стейблкоинах, в первую очередь в USDC. Согласно данным источников, ведутся соответствующие переговоры. Решение пока не принято, и детали срока реализации неизвестны. Если план будет осуществлен, это позволит авторам по всему миру получать быстрые цифровые платежи. Эксперты видят в этом альтернативу традиционным системам, особенно для трансграничных расчетов. Интерес X к стейблкоинам во многом связан с их скоростью и низкой стоимостью для международных переводов. В отчете также отмечается, что другая компания Маска, SpaceX, уже использует стейблкоины для платежей Starlink в некоторых странах. Хотя план X еще не утвержден окончательно, его рассмотрение рассматривается как сигнал к потенциально более широкому использованию стейблкоинов в повседневных цифровых платежах.

cryptonews.ru2 ч. назад

Илон Маск и компания X делают шаг в сторону криптовалют! Намечается новая эра платежей! Вот подробности

cryptonews.ru2 ч. назад

Криптоинвестор потерял 1010 эфиров на устаревшем сайте Tornado Cash

Криптоинвестор понес значительные потери, перейдя на устаревший домен Tornado Cash по старой закладке в браузере. Как сообщают аналитики Wu Blockchain, этот домен, который команда миксера не смогла продлить после санкций OFAC в 2022 году, был перехвачен злоумышленниками. Они развернули фишинговый сайт, имитирующий оригинальный интерфейс. Полагая, что взаимодействует с настоящим сервисом, жертва предоставила мошенникам доступ к своему кошельку, в результате чего было похищено 1010 ETH. Средства были выведены небольшими траншами в течение 12 часов. В общей сложности, по данным экспертов, за последний год с помощью этого поддельного сайта было украдено около 4000 ETH у различных пользователей. При этом сам протокол Tornado Cash продолжает функционировать через децентрализованные каналы, такие как IPFS и ENS. В отдельном сообщении специалисты Bitdefender предупредили о новой схеме мошенников, распространяющих вредоносную программу Lumma Stealer для кражи криптоактивов под видом пиратских копий фильма "Одиссея" Кристофера Нолана.

cryptonews.ru2 ч. назад

Криптоинвестор потерял 1010 эфиров на устаревшем сайте Tornado Cash

cryptonews.ru2 ч. назад

Аналитики: MiCA не вызвал заметного глобального оттока из USDT

Аналитики констатируют, что ограничения для стейблкоина USDT на регулируемых европейских площадках в рамках MiCA не привели к значительному глобальному оттоку из актива. Данные Artemis Analytics и исследование экономистов из LUISS University и University of Surrey показывают, что не произошло заметного сокращения предложения USDT или массовой миграции ликвидности между блокчейнами. В Европе на отдельных биржах доля конкурирующего стейблкоина USDC действительно выросла, но на глобальном уровне совокупные рыночные доли и объемы торгов основных стейблкоинов почти не изменились. USDT сохранил лидерство по капитализации, которая на конец июля составила около $183 млрд. Основная ончейн-активность с USDT продолжает расти в регионах за пределами ЕС, например, в Латинской Америке, где цифровые доллары все чаще используются для платежей и переводов, а не только как инструмент сбережения. Таким образом, MiCA повлиял на выбор активов внутри регулируемой европейской юрисдикции, но не вызвал структурных сдвигов на мировом рынке.

cryptonews.ru2 ч. назад

Аналитики: MiCA не вызвал заметного глобального оттока из USDT

cryptonews.ru2 ч. назад

Торговля

Спот

Популярные статьи

Как купить CORE

Добро пожаловать на HTX.com! Мы сделали приобретение CORE (CORE) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки CORE (CORE).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение CORE (CORE)После приобретения вами CORE (CORE) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля CORE (CORE)С легкостью торгуйте CORE (CORE) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

802 просмотров всегоОпубликовано 2024.03.29Обновлено 2026.06.02

Как купить CORE

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на CORE (CORE) представлены ниже.

活动图片