Презентация 5-летней давности, названная профессором MIT «чушью», предсказала основные идеи OpenAI o1 и o3

marsbitОпубликовано 2026-08-17Обновлено 2026-08-17

Введение

5 лет назад Giамбаттиста Параскандоло, ныне ключевой исследователь OpenAI, во время собеседования на профессорскую должность в MIT представил доклад о рассуждениях в GPT. Большинство профессоров назвали его идеи «бессмыслицей». Однако в своей презентации он фактически предсказал основные направления развития современных моделей рассуждений, таких как OpenAI o1 и o3. Параскандоло предложил три ключевые идеи. Первая — «открытое рассуждение», где модель может выделять больше времени и вычислений для сложных задач, улучшая ответ с каждым шагом (аналог современных методов расширения вычислений во время вывода). Вторая — использование языка как носителя рассуждений для планирования и структурирования мышления в задачах, подобно цепочке мыслей или работе агентов. Третья — предоставление ИИ-системам возможности манипулировать своим внутренним состоянием, создавать контринтуитивные сценарии и целенаправленно обучаться на ошибках, что расширяет пространство для самоулучшения. Автор также отмечал в своем блоге, что предобучение больших нейросетей на огромных данных аналогично эволюционному накоплению опыта, что формирует способность к эффективному обучению на малых данных, подобно человеческому мозгу. Не получив позицию в MIT, Параскандоло присоединился к OpenAI, где впоследствии участвовал в разработке GPT-4, а затем и в фундаментальных исследованиях для моделей o1 и o3, воплотив свои ранние идеи в жизнь. Эта история подчеркивает, как опережающие время идеи могут быть отвергнуты, но...

В мире ИИ всегда хватает слухов.

На этот раз в центре внимания — Джамбаттиста Параскандоло, ключевой исследователь в направлении моделей логического вывода OpenAI.

В 2020 году он проходил собеседование на должность профессора в MIT, где представил доклад об использовании GPT для логического вывода. Большинство профессоров комитета назвали это направление «чушью» (nonsense).

https://x.com/turingbook/status/2084003612687249836?s=20

Парень не постеснялся вынести это на всеобщее обозрение, описав данный опыт на своей личной странице и приложив ссылки на описание доклада и слайды того времени.

https://sites.google.com/view/giambattista-parascandolo/home

О чём же был тот доклад, названный «чушью»?

Согласно информации на сайте MIT, тема доклада заключалась в том, как искусственным нейронным сетям выйти за пределы обучающего распределения и получить способности к обобщению и планированию, более близкие к человеческим.

Параскандоло считал, что люди способны рекомбинировать имеющиеся знания, выявлять ключевые инварианты, строить абстрактные модели и выполнять долгосрочное планирование. Искусственные нейронные сети всё ещё имеют большой потенциал для роста в этих аспектах.

В конце доклада он предложил три направления для будущих исследований: открытое логическое рассуждение в нейронных сетях, ещё не изученные степени свободы в искусственных нейронных сетях, а также использование языка в качестве носителя рассуждений в обучении с подкреплением для повышения эффективности использования данных.

Ключевой концепцией среди них было «открытое логическое рассуждение».

Параскандоло определил его так: модель может тратить больше времени и вычислительных ресурсов, постоянно улучшая ответ. Чем сложнее задача, тем больше шагов рассуждения должна сделать модель, и дополнительные вычисления должны преобразовываться в лучший результат.

Это уже очень напоминает сегодняшнее расширение вычислений во время логического вывода.

В то время стандартный Transformer имел фиксированную глубину сети, объём прямого прохода для каждого токена был в основном предопределён, но сложность задачи не имела устойчивой связи с длиной входных данных. Задача может быть длинной, а ответ — простым. Другая задача может состоять из одного предложения, но требовать многоэтапного разбора и проверки.

RNN (рекуррентные нейронные сети) выглядели более подходящими для таких задач. Они могут работать циклически и теоретически получать любое время на размышление. Однако кривые, представленные Параскандоло в презентации, показали, что RNN обычно показывают наилучшие результаты только вблизи количества шагов рассуждения, встречавшихся во время обучения. Дальнейшее увеличение циклов может даже снизить точность.

Это означало, что увеличение объёма вычислений — лишь первый шаг; модель также должна научиться использовать эти вычисления.

В то время наиболее эффективное многошаговое планирование в значительной степени опиралось на прогнозирующее управление моделью и поиск по дереву Монте-Карло. Нейронная сеть отвечала за предсказание среды или оценку ценности, а внешний алгоритм поиска — за развёртывание будущих путей. Параскандоло хотел глубже интегрировать способность к долгосрочному логическому выводу в нейронную сеть.

Его вторая идея заключалась в том, чтобы сделать язык носителем рассуждений.

Параскандоло привёл в пример классическую игру «Montezuma’s Revenge». Агент обучения с подкреплением, обученный с нуля, должен пробовать множество комбинаций состояний и действий. Многие правильные действия сами по себе не сложны, агенту же не хватает суждения о том, «какое поведение более разумно».

GPT уже усвоило огромные знания о мире из текстов. Язык может помочь модели описывать среду, понимать цели, декомпозировать задачи и генерировать планы высокого уровня, а также значительно сузить область поиска.

Сегодня эта идея легко ассоциируется с цепочкой мыслей, языковым планированием и рабочими процессами агентов.

Третье направление, предложенное Параскандоло, заключалось в том, что системы искусственного интеллекта могут сбрасывать задачи, возвращаясь к любому сохранённому состоянию в памяти, конструировать контрфактуальные сценарии, а также регулировать время, гравитацию и наблюдения в симуляторе. Системы могут даже напрямую считывать, копировать и изменять собственные активации и веса нейронной сети.

Это эквивалентно включению самого процесса обучения в операционное пространство агента. Он может заниматься целенаправленной практикой, генерировать специальные обучающие сценарии, переносить имеющиеся знания и переобучаться на неудачных траекториях.

В презентации пятилетней давности почти прописан сегодняшний путь развития моделей логического вывода.

Мы также раскопали его запись в блоге от июня 2021 года под названием «Обратное распространение, эволюция и заблуждение о «двух собаках».

Эта запись в основном опровергает мнение, что «нейронным сетям нужно огромное количество данных, поэтому они не похожи на человеческий мозг».

Параскандоло считал, что тот факт, что человек, увидев несколько собак, может научиться их распознавать, не означает отсутствия предшествующего опыта. Длительная эволюция осела в структуре человеческого мозга и индуктивных смещениях как опыт взаимодействия предков с миром.

Согласно этой точке зрения, масштабное предобучение нейронных сетей можно уподобить биологической эволюции, а тонкая настройка моделей и обучение в контексте ближе к обучению в течение жизни отдельной особи. GPT-3 прочитало текстов больше, чем любой человек, но его предобучение взяло на роль сжатия огромного опыта и формирования эффективной способности к обучению. Поэтому нельзя напрямую сравнивать все данные предобучения модели с небольшим количеством обучающих примеров одного человека после рождения.

Такое понимание также означает, что дальнейшее увеличение данных и вычислительной мощности всё ещё может привести к значительному улучшению. Он проводил аналогию по выполняемой роли, а не утверждал, что градиентный спуск и биологическая эволюция имеют одинаковые конкретные механизмы.

Что это за парень?

Этот парень довольно скромен: его последний пост в X датирован ноябрём 2024 года, когда он нанимал двух инженеров-исследователей (RE) и инженеров-программистов (SWE) для o1.

Согласно его личной странице, исследования Параскандоло всегда вращались вокруг обобщения, планирования и логического вывода.

В 2017 году он поступил в аспирантуру Института интеллектуальных систем Общества Макса Планка и Швейцарской высшей технической школы Цюриха (ETH Zurich), где его научными руководителями были Бернхард Шёлькопф и Томас Хофманн. Диссертация была посвящена OOD-обобщению в глубоком обучении.

Во время докторантуры он проходил стажировки в Google X в Маунтин-Вью и в DeepMind в Лондоне, участвуя соответственно в исследованиях по автоматизированному дизайну на сверхкрупных симуляторах и в исследованиях по поиску по дереву Монте-Карло с разделением и властвованием.

Получив докторскую степень в сентябре 2021 года, он сразу присоединился к OpenAI, первоначально войдя в команду обучения с подкреплением под руководством Джона Шульмана, затем перейдя в алгоритмическую команду Марка Чена, а затем присоединившись к команде 🍓 (клубники) под руководством Джерри Творека. Команда «Клубника» была внутренним кодовым названием проекта o1.

В 2023 году он участвовал в разработке GPT-4 и сформировал новую команду, продолжившую исследования в области логического вывода. Позже участвовал в фундаментальных исследованиях OpenAI o1 и o3, продвигая моделирование вознаграждений, построение среды и масштабирование алгоритмов общего логического вывода. Часть описаний алгоритмов до сих пор скрыта им чёрными прямоугольниками.

В том собеседовании 2020 года Параскандоло не получил профессорскую должность в MIT. Он ушёл в OpenAI.

Четыре года спустя он помог построить o1.

Жизнь полна удивительных совпадений.

Ссылки:

https://x.com/giambattista92

https://sites.google.com/view/giambattista-parascandolo/home

https://gibipara92.github.io/2021/06/09/backprop-evolution-two-dogs.html

https://docs.google.com/presentation/d/1edd2GkAP31wNygaev3DO8gE1t2lgsx1z8TeVpBKqlYA/edit?slide=id.gc772610149_0_179#slide=id.gc772610149_0_179

Статья из официального аккаунта WeChat «Machine Heart» (ID:almosthuman2014), автор: Ян Вэнь

Трендовые криптовалюты

Связанные с этим вопросы

QКакая идея в презентации Giambattista Parascandolo была названа «nonsense» профессорами MIT?

AИдея использования GPT для рассуждений и её дальнейшее развитие, включая концепцию «открытого рассуждения», были названы профессорами MIT «чепухой».

QЧто такое «открытое рассуждение» по определению Parascandolo?

A«Открытое рассуждение» — это способность модели тратить больше времени и вычислительных ресурсов для постоянного уточнения ответа. Чем сложнее задача, тем больше шагов мышления должна сделать модель, преобразуя дополнительные вычисления в лучший результат.

QКак Parascandolo предлагал использовать язык в качестве носителя рассуждений?

AОн предлагал использовать язык (например, знания, усвоенные GPT из текстов) для описания среды, понимания целей, декомпозиции задач и генерации высокоуровневых планов. Это помогает сузить пространство поиска, что сегодня напоминает цепочки мыслей и языковое планирование.

QКакое сравнение Parascandolo проводил в своём блоге 2021 года относительно обучения нейронных сетей?

AОн сравнивал масштабное предварительное обучение нейросетей с биологической эволюцией (накопление опыта предков), а тонкую настройку и обучение в контексте — с индивидуальным обучением в течение жизни человека.

QНад какими ключевыми проектами в OpenAI работал Giambattista Parascandolo после прихода в компанию?

AОн участвовал в разработке GPT-4, а затем в фундаментальных исследованиях для моделей рассуждений o1 и o3, работая над расширением алгоритмов, моделированием вознаграждений и созданием сред в команде «🍓» (клубника), которая была внутренним названием проекта o1.

Похожее

Уолл-стрит, утренний отчет: Рост прибыли S&P достиг 30-летнего максимума, Nvidia стала шестым по величине акционером SpaceX

Еженедельный обзор Уолл-стрит: прибыль S&P 500 демонстрирует рекордный рост за 30 лет; NVIDIA становится шестым по величине акционером SpaceX. На фоне неожиданного снижения розничных продаж в США в июле и мягких данных по инфляции рынки снизили вероятность повышения ставки ФРС в сентябре, что поддержало краткосрочные казначейские облигации. Однако геополитические риски (инциденты в Ормузском проливе, санкции против Ирана) и рекордные аукционы долгосрочных гособлигаций (например, 20-летних на $16 млрд) удерживают доходности долгосрочных бумаг на многолетних максимумах. Прибыль компаний индекса S&P 500 во втором квартале выросла на 31%, что является самым высоким показателем с 1992 года (без учета периодов восстановления после рецессий). Рост прибылей способствовал снижению оценок, что считается здоровой коррекцией. В то же время устойчивость капитальных затрат на ИИ ставится под сомнение на фоне роста стоимости финансирования. На рынках акций наблюдалась сильная диверсификация внутри секторов. Резко выросли акции компаний, связанных с памятью (SanDisk, Micron) и оптическими коммуникациями (Applied Optoelectronics), а также AMD. При этом бумаги Broadcom и ряда других полупроводниковых компаний упали из-за опасений по поводу кредитных рисков, связанных с финансированием аренды вычислительных мощностей ИИ. NVIDIA впервые раскрыла крупные пакеты акций SpaceX (около $21 млрд, став шестым акционером) и Intel. На предстоящей неделе ключевыми событиями станут: протокол заседания ФРС США (уточнение настроений по ставкам), аукцион 20-летних казначейских облигаций, данные по экспорту из Южной Кореи (индикатор спроса на полупроводники) и серия корпоративных отчетов по всему миру (Alibaba, Walmart, AMD и др.). Также пройдут крупные отраслевые мероприятия, такие как Саммит по ИИ в Сеуле и Всемирная конференция робототехники в Пекине.

marsbit22 мин. назад

Уолл-стрит, утренний отчет: Рост прибыли S&P достиг 30-летнего максимума, Nvidia стала шестым по величине акционером SpaceX

marsbit22 мин. назад

BTC консолидируется в боковом диапазоне, на дневном графике HYPE установился отскок|Приглашенный анализ

Ключевые моменты недельного обзора рынка: * **Биткоин (BTC):** Находится в фазе коррекции на дневном таймфрейме. Ключевой уровень поддержки — зона $60,950–$61,500. Пока цена удерживается выше, вероятны сценарии: продолжение коррекционной волны c к цели $67,300 или консолидация в диапазоне $60,950–$65,500 с последующим ростом. Пробитие поддержки может привести к повторному тестированию дна. * **Стратегия:** Внимание на поведение у поддержки $60,950–$61,500. Краткосрочные тактики включают пробные покупки у поддержки (сценарий B) или продажи при затухании роста у сопротивления $69,500–$71,000 (сценарий A). Среднесрочная модель указывает на преобладание медведей. * **HYPE:** После отскока от поддержки $50–$52 подтвержден дневной рост. Текущая задача — закрепиться выше сопротивления $58–$58.5 на 4-часовом таймфрейме для формирования импульсной волны. Неудача приведет к продолжению бокового движения. * **Стратегия:** Для держателей лонгов — перенос стопа в безубыток. Для новых позиций — рассмотрение покупок при уверенном прорыве $58.5–$60 с жестким управлением риском. **Важно:** Весь анализ — частное мнение для ведения торгового журнала, не является инвестиционной рекомендацией. Рынки волатильны, необходима динамическая адаптация стратегий и строгая дисциплина управления рисками (стоп-лоссы, перенос стопов по мере роста прибыли).

marsbit25 мин. назад

BTC консолидируется в боковом диапазоне, на дневном графике HYPE установился отскок|Приглашенный анализ

marsbit25 мин. назад

AI-вычислительная мощь: "токсин высоких ставок" для мирового капитала?

За последние недели скорректированные с учетом инфляции показатели стоимости заимствований в основных экономиках мира достигли многолетних максимумов. Ключевой фактор — взрывной рост выпуска облигаций компаниями, занимающимися развитием инфраструктуры искусственного интеллекта, такими как Alphabet, Amazon и Meta, которые только в этом году привлекли около 220 млрд долларов. Одновременно правительства многих стран сохраняют высокие уровни бюджетного дефицита. Этот масштабный спрос на капитал приводит к росту реальных доходностей государственных облигаций, которые являются базой для скорректированных на инфляцию затрат на заимствования. Например, 30-летняя реальная доходность в США приблизилась к 3%, что является самым высоким показателем за 18 лет. Аналогичная тенденция наблюдается в Великобритании и Германии. Рост реальных доходностей теоретически снижает привлекательность акций, предлагая инвесторам более высокую гарантированную доходность, а также уменьшая текущую стоимость будущих денежных потоков компаний. Пока что фондовый рынок демонстрирует устойчивость благодаря сильным корпоративным прибылям, однако эксперты предупреждают о рисках. Если технологические гиганты истощат свои денежные резервы и станут более зависимы от долгового рынка, высокие ставки могут начать оказывать на них серьезное давление. Кроме того, сохраняющиеся высокие реальные процентные ставки в конечном итоге могут заставить как компании, так и домохозяйства сокращать инвестиции и расходы, что создаст угрозу для экономического роста. Многие аналитики полагают, что структурные факторы, стоящие за ростом доходностей, такие как высокие бюджетные расходы и прекращение программ покупки активов центральными банками, остаются в силе, и поэтому давление может сохраниться.

marsbit26 мин. назад

AI-вычислительная мощь: "токсин высоких ставок" для мирового капитала?

marsbit26 мин. назад

Ни AI, ни выкупа акций, но скупой JD.com всё ещё держится?

Китайская интернет-компания JD.com представила финансовые результаты за второй квартал 2026 года, которые можно охарактеризовать как стабильные, но не впечатляющие. Выручка группы сократилась на 3% в годовом исчислении, составив около 346,4 млрд юаней, что соответствует ожиданиям рынка на фоне общего замедления потребительских расходов в Китае. Несмотря на падение выручки, операционная прибыль группы, скорректированная на определённые статьи, достигла 54,8 млрд юаней, немного превысив консенсус-прогноз Bloomberg. Ключевой бизнес, JD Retail, столкнулся со снижением выручки на 4,7%, при этом прибыль сегмента также уменьшилась примерно на 3%. Хотя рентабельность бизнеса незначительно выросла, рост маржи, по-видимому, достиг предела. Вызывают беспокойство темпы роста продаж товаров повседневного спроса и доходов от рекламы, которые значительно замедлились, что ставит под вопрос потенциал будущего ускорения роста выручки JD Retail. Прибыльность группы в целом поддержало сокращение убытков в подразделении новых бизнесов (куда входят доставка еды и зарубежные операции), хотя общий объём убытков остаётся высоким — почти 99 млрд юаней. Несмотря на снижение маркетинговых расходов, компания продолжает активно инвестировать в исследования и разработки. JD.com заметно сократила программу обратного выкупа акций в первой половине года, и, в отличие от конкурентов, не делает крупных инвестиций в ИИ-инфраструктуру. Вместо этого свободный денежный поток направляется в краткосрочные финансовые инструменты, что может разочаровать инвесторов, ожидающих повышенного вознаграждения акционеров. В перспективе восстановление бизнеса JD.com будет зависеть от улучшения макроэкономической среды и динамики потребления в Китае во второй половине года, а также от того, сможет ли компания контролировать убытки новых бизнесов. Несмотря на отсутствие ярких драйверов роста, JD.com остаётся относительно защищённой компанией в секторе электронной коммерции благодаря своей сфокусированной бизнес-модели. Однако текущая сдержанная политика в отношении акционеров ослабляет инвестиционную привлекательность компании в краткосрочной перспективе.

marsbit35 мин. назад

Ни AI, ни выкупа акций, но скупой JD.com всё ещё держится?

marsbit35 мин. назад

Торговля

Спот

Популярные статьи

Как купить CORE

Добро пожаловать на HTX.com! Мы сделали приобретение CORE (CORE) простым и удобным. Следуйте нашему пошаговому руководству и отправляйтесь в свое крипто-путешествие.Шаг 1: Создайте аккаунт на HTXИспользуйте свой адрес электронной почты или номер телефона, чтобы зарегистрироваться и бесплатно создать аккаунт на HTX. Пройдите удобную регистрацию и откройте для себя весь функционал.Создать аккаунтШаг 2: Перейдите в Купить криптовалюту и выберите свой способ оплатыКредитная/Дебетовая Карта: Используйте свою карту Visa или Mastercard для мгновенной покупки CORE (CORE).Баланс: Используйте средства с баланса вашего аккаунта HTX для простой торговли.Третьи Лица: Мы добавили популярные способы оплаты, такие как Google Pay и Apple Pay, для повышения удобства.P2P: Торгуйте напрямую с другими пользователями на HTX.Внебиржевая Торговля (OTC): Мы предлагаем индивидуальные услуги и конкурентоспособные обменные курсы для трейдеров.Шаг 3: Хранение CORE (CORE)После приобретения вами CORE (CORE) храните их в своем аккаунте на HTX. В качестве альтернативы вы можете отправить их куда-либо с помощью перевода в блокчейне или использовать для торговли с другими криптовалютами.Шаг 4: Торговля CORE (CORE)С легкостью торгуйте CORE (CORE) на спотовом рынке HTX. Просто зайдите в свой аккаунт, выберите торговую пару, совершайте сделки и следите за ними в режиме реального времени. Мы предлагаем удобный интерфейс как для начинающих, так и для опытных трейдеров.

794 просмотров всегоОпубликовано 2024.03.29Обновлено 2026.06.02

Как купить CORE

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на CORE (CORE) представлены ниже.

活动图片