Математик за 24 часа опроверг доказанную OpenAI гипотезу! «ИИ доказал каждое утверждение, но оно уже не имеет отношения к исходной гипотезе»

marsbitОпубликовано 2026-08-04Обновлено 2026-08-04

Введение

OpenAI объявил, что их новая модель ИИ опровергла гипотезу жесткости Конна, представив в Lean 4 формальное доказательство на 37 000 строк, которое прошло автоматическую проверку. Однако математик Дж. Л. Нильсен из Университета Канзаса проанализировал код и показал, что построенный ИИ контрпример на самом деле не удовлетворяет исходным условиям гипотезы (условиям ICC и свойства (T)). Проблема заключалась не в логических ошибках проверки, а в том, что формально корректное доказательство относилось к объекту, не соответствующему заявленной формулировке гипотезы. Этот случай подчеркивает ключевой недостаток автоматизированной проверки: системы вроде Lean гарантируют лишь формальную правильность доказательства относительно заданных утверждений, но не могут оценить, соответствуют ли эти утверждения изначальному замыслу исследователя. Таким образом, гипотеза Конна остается открытой, а необходимость содержательной экспертизы результатов ИИ сохраняется.

OpenAI заявила, что её новейшая модель ИИ решила 10 мировых проблем, включая опровержение гипотезы жёсткости Конна.

На следующий день появилась статья-ответ от человека: контрпример, предложенный ИИ, несостоятелен.

Автор — Дж. Л. Нильсен из Центра топологической физики Канзасского университета. Он проследил с начала до конца 37 000 строк кода на Lean 4, опубликованного OpenAI, сопоставил каждый объект с его математическим прототипом и в итоге указал на два независимых пути неудачи.

Конкретный процесс доказательства нам, обычным людям, не совсем понятен, пусть ИИ и математики сражаются на своём уровне.

Но этот случай показывает, что проверка результатов научных исследований ИИ людьми по-прежнему критически важна.

Что такое гипотеза жёсткости Конна

Гипотеза жёсткости Конна говорит о следующем.

Математически можно сопоставить группе алгебраическую структуру. Иногда две разные на вид группы порождают совершенно одинаковые структуры.

Конн около 1980 года выдвинул предположение: при условии, что группа удовлетворяет двум дополнительным условиям, такая ситуация невозможна — если структуры одинаковы, то и группы должны быть одинаковыми.

Эти два дополнительных условия — одно называется ICC, другое — свойство (T) Каждана.

Другими словами, чтобы опровергнуть эту гипотезу, нужно привести пример двух групп, удовлетворяющих обоим условиям, но имеющих разное строение.

Новая модель OpenAI поступила так: сконструировала две неизоморфные группы, которые порождают одинаковые алгебры, и представила доказательство того, что обе группы удовлетворяют ICC и свойству (T).

Весь аргумент был записан в виде 37 000 строк кода на Lean 4, проверенных ядром Lean строка за строкой, с приложением пояснительного документа о том, как были построены эти группы.

Нильсен указывает: одна из групп, сконструированных ИИ, на самом деле не удовлетворяет дополнительным условиям — ни ICC, ни свойству (T).

Есть три возможных причины:

свойство (T) в коде не точно соответствует исходному определению Каждана; или доказательство верно лишь частично, но было распространено на всю группу; либо группа в коде вообще не соответствует описанию в пояснительном документе.

37 000 строк, построчное сопоставление

Чтобы проверить этот вывод, Нильсен проделал ещё более трудоёмкую работу.

Опубликованный код представляет собой единый файл, имена из исходных модулей на ранних этапах в нём отсутствуют.

Он составил таблицу соответствий, указав для каждого математического объекта его имя и номер строки в новом коде:

группа коцепей над нулём находится на строке 13700, скрученная группа — на строке 14069, доказательство изоморфизма двух алгебр — на строке 36712, основная теорема — на строке 36954.

Он также проследил всю цепочку рассуждений, доказывающую ICC в коде. Эта цепочка начинается со строки 31430, передаётся слой за слоем и, наконец, формирует заключение на строке 31610.

Проблема, указанная Нильсеном, заключается в том, что эти леммы имеют дело с объектами, полученными после дуализирующего преобразования, а не с исходной группой, содержащей центральный элемент, и поэтому они напрямую не охватывают ключевые элементы.

Вопрос о том, выполняются ли они для каждого элемента конкретной группы, которая в итоге попадает в теорему, зависит от того, как соединяются две части конструкции.

Это показывает, что проблема в «том, что нужно доказать», а не в «правильности доказательства». Lean отвечает только за проверку последнего.

Относительно другой скрученной группы Нильсен настроен сдержанно. Он говорит, что не проверял независимо по коду, удовлетворяет ли она ICC, и признаёт, что леммы в коде, возможно, действительно доказывают это, но это не меняет вывода: одно из условий уже не выполнено.

Он также записал свои два контраргумента в виде кода на Lean, который компилируется в Lean 4.32.2.

Машина проверяет форму, а не смысл

В последнем разделе статьи это событие помещается в более широкий контекст.

Ядро Lean гарантирует лишь то, что доказательство формально безупречно, но не отвечает за то, действительно ли оно доказывает исходное утверждение.

Здесь можно прямо процитировать Теренса Тао: проверяющее доказательство — это само формальное утверждение, а не его соответствие намерению, поэтому проверку человеком нельзя полностью заменить.

Подобные инциденты уже случались ранее.

Аудит пяти часто используемых наборов тестов для Lean выявил 4833 случая, включая контрпримеры, пустые теоремы и ненадёжные аксиомы, которые все прошли машинную проверку. В итоге люди сконструировали контрпримеры и обнаружили, что само доказываемое утверждение было неверным.

В работе по формализации статистической теории обучения наиболее опасная ситуация описывается как «не неудачное доказательство, а успешное доказательство неверного утверждения».

Исследования в области тензорных сетей также фиксировали аналогичные явления: система выдавала доказательство, формально совершенно правильное, но доказывающее утверждение более слабое, чем ожидалось.

Нильсен пишет, что, возможно, формализация OpenAI правильно установила каждое из своих заявленных заключений. Но то, что она не установила и что ядро Lean не может проверить, — это связь этих заключений с исходной формулировкой гипотезы.

Человек, читая гипотезу, видит предпосылки. Помощник в доказательствах, получив заключение, которое не удовлетворяет предпосылкам, всё равно проверит любое утверждение о нём.

Гипотеза жёсткости Конна по-прежнему остаётся открытой.

Адрес статьи:

https://philarchive.org/archive/NIEWTCv17

Ссылки:

[1]https://openai.com/index/ten-advances-in-mathematics/

[2]https://github.com/openai/ten-proofs/blob/main/ConnesRigidity.lean

Статья из WeChat-аккаунта «Квантовый бит», автор: Мэн Чэнь

Трендовые криптовалюты

Связанные с этим вопросы

QКаково было главное утверждение работы Нильсена, опровергающее результат OpenAI о гипотезе Конна?

AГлавное утверждение Нильсена заключалось в том, что один из групп, сконструированных ИИ-моделью OpenAI, не удовлетворяет критическим условиям гипотезы Конна, а именно не является группой ICC и не обладает свойством (T). Таким образом, контрпример недействителен, и сама гипотеза не была опровергнута.

QКакое фундаментальное ограничение систем формальной проверки доказательств, таких как Lean, подчеркивается в статье?

AСтатья подчеркивает, что системы формальной проверки (например, Lean) гарантируют только формальную корректность доказательства, то есть отсутствие логических ошибок в цепочке рассуждений. Однако они не проверяют, соответствует ли доказываемое утверждение первоначальной формулировке теоремы или замыслу автора. Возможна ситуация, когда система успешно проверяет доказательство, но это доказательство относится к другому, более слабому утверждению, нежели исходная гипотеза.

QКакую практическую работу проделал Нильсен для своего анализа 37 000 строк кода OpenAI?

AНильсен составил подробную таблицу соответствия, чтобы сопоставить каждый математический объект в скомпилированном, однофайловом коде OpenAI с его исходным определением и указать номер строки. Это позволило ему проследить цепочку рассуждений, например, доказательство свойства ICC, и определить, что оно применяется не к исходной группе, а к преобразованному объекту, что и привело к ошибке.

QКакие три возможные причины ошибки в доказательстве OpenAI перечисляет Нильсен?

AНильсен перечисляет три возможности: 1) Формальное определение свойства (T) в коде могло не точно соответствовать оригинальному определению Каждана. 2) Доказательство могло быть верным только для части группы, но было ошибочно применено ко всей группе. 3) Группа, представленная в коде, могла структурно отличаться от группы, описанной в сопроводительной документации.

QКакой общий вывод о роли человека в проверке результатов, полученных с помощью ИИ, делает статья?

AСтатья делает вывод, что человеческая экспертиза остается критически важной для проверки научных результатов, полученных с помощью ИИ. Системы формальной верификации, такие как Lean, не могут заменить математика, который понимает смысл, контекст и намерения, стоящие за формальными утверждениями. Необходим тщательный содержательный анализ, чтобы убедиться, что доказанный формальный результат действительно соответствует исходной научной проблеме.

Похожее

72-часовой обратный отсчет: сможет ли Закон CLARITY «чудесным образом» пройти в Сенате до ухода на каникулы?

**Автор: Blockchain Knight** Сенат США обнародовал повестку недели, но законопроект CLARITY в неё не вошел. Официальные летние каникулы Сената начинаются 7 августа, так что на рассмотрение проекта осталось всего около 72 часов. Процедурные барьеры в Сенате высоки: для прекращения прений требуется подпись 16 сенаторов, а для последующего голосования — 60 голосов. У республиканцев только 53 голоса, поэтому необходимо привлечь как минимум 7 демократов, что является основной причиной задержки проекта на два месяца. Ключевые разногласия касаются этических положений, запрещающих высокопоставленным чиновникам выпускать или спонсировать цифровые активы до 2029 года. Демократы считают, что в текущей редакции есть лазейки, не охватывающие существующие активы и интересы семей. Белый дом пока официально не отреагировал на доработанный проект. Ещё одной спорной темой остаются вознаграждения за стейблкоины. Банки опасаются оттока средств, в то время как криптокомпании видят в этом защиту банков от конкуренции. Компромиссный вариант допускает вознаграждения за транзакции, стейкинг и активность на платформах. Согласно данным Polymarket, вероятность принятия законопроекта к 2026 году упала до 31%. Инвесткомпания Bernstein предупреждает, что отсутствие прогресса до каникул может вызвать распродажи на рынке. Если процедурное голосование не начнётся на этой неделе, рассмотрение отложится до сентября, когда повестка будет ещё более загружена в преддверии промежуточных выборов. Если маловероятное событие — принятие законопроекта — всё же произойдёт, рыночная реакция может быть значительной. Трудности с продвижением этого законопроекта лишь подчёркивают его потенциальное влияние на индустрию.

marsbit2 мин. назад

72-часовой обратный отсчет: сможет ли Закон CLARITY «чудесным образом» пройти в Сенате до ухода на каникулы?

marsbit2 мин. назад

По данным федеральных властей, агент ФБР, занимавшийся поимкой шпионов, похитил криптовалюту на сумму 1 млн долларов у своего собственного подозреваемого

Агент ФБР Патрик Яроч арестован по обвинению в хищении криптовалюты на сумму около 1 млн долларов у подозреваемого в шпионаже. В ходе расследования по национальной безопасности он получил доступ к сид-фразам (секретным словам для восстановления) криптокошельков иностранного объекта. Используя свой служебный доступ, Яроч перевел средства на контролируемые им счета. Расследование началось после того, как 28 июля Яроч сам обратился к сотруднику Минюста и признался в «очень неудачных решениях». ФБР уволило его, а следователи отследили средства через биржу Kraken и протокол кредитования Suilend. Большая часть средств была возвращена под контроль государства. В ходе расследования также выяснилось, что Яроч планировал переезд в Португалию, обсуждал в ChatGPT жизнь на пенсии в Европе и совершил несколько нераскрытых зарубежных поездок. Он отрицал намерение перевести криптовалюту за границу, утверждая, что поездка была для посещения друзей. Дело передано в федеральный суд. Личность иностранного шпиона и страна его происхождения не раскрываются.

cryptonews.ru3 мин. назад

По данным федеральных властей, агент ФБР, занимавшийся поимкой шпионов, похитил криптовалюту на сумму 1 млн долларов у своего собственного подозреваемого

cryptonews.ru3 мин. назад

Компания Tether обогнала Казахстан по закупкам золота в первой половине 2026 года

Tether сообщила в августе 2026 года о доведении своих физических золотых резервов до 150 тонн. За первое полугодие компания закупила 27,1 тонны золота, что, по её сравнению с данными World Gold Council, позволило бы ей занять третье место в мире по объёму чистых закупок за этот период, опередив Казахстан и уступив только Польше и Китаю. Около 22 тонн из резервов обеспечивают токен XAU₮ (Tether Gold), спрос на который вырос почти на 9,5% во втором квартале 2026 года даже на фоне падения цены золота. Наращивание золотых резервов рассматривается как диверсификация для компании, основной бизнес которой — выпуск стейблкоина USDT. Хотя сравнение с центральными банками носит маркетинговый характер, масштаб закупок Tether сопоставим с действиями отдельных государств. Активность компании вписывается в общий тренд роста спроса на золото со стороны центральных банков, стремящихся сократить зависимость от доллара.

cryptonews.ru5 мин. назад

Компания Tether обогнала Казахстан по закупкам золота в первой половине 2026 года

cryptonews.ru5 мин. назад

Джордж Сантос урегулировал спор с Комиссией по торговле товарными фьючерсами (CFTC) в связи с торговлей на собственном рынке Kalshi

Бывший конгрессмен США Джордж Сантос урегулировал дело с Комиссией по торговле товарными фьючерсами (CFTC). Комиссия обвинила его в манипуляции рынком, связанным с контрактом на платформе Kalshi о его присутствии на выступлении президента Трампа с обращением "О положении страны". Сантос должен вернуть $17 569.98, заплатить штраф $17 500 и не торговать на биржах под надзором CFTC три года. Расследование показало, что в феврале Сантос публично обсуждал поездку на мероприятие, что повышало цену контрактов "Да" (на его присутствие), и продал их с прибылью. Затем, когда его рейс и поезд были отменены (о чём он не сообщил публично), он начал покупать контракты "Нет". Не явившись на выступление, он закрыл эту позицию с прибылью более $14 000. CFTC квалифицировала его действия как манипуляцию рынком. Сантос согласился на урегулирование, не признавая выводов комиссии, и, по словам его адвоката, выбрал его вместо долгого суда. Платформа Kalshi, обнаружившая манипуляции, заморозила его счёт и предоставила данные CFTC. Это урегулирование является единственным подтверждённым федеральным действием по данному делу.

cryptonews.ru7 мин. назад

Джордж Сантос урегулировал спор с Комиссией по торговле товарными фьючерсами (CFTC) в связи с торговлей на собственном рынке Kalshi

cryptonews.ru7 мин. назад

«Казино Лобби» стало причиной судебного иска в Нью-Йорке против компании Kalshi, утверждает генеральный директор Мансур

Платформа прогнозных рынков Kalshi столкнулась с судебным иском от штата Нью-Йорк, который может привести к многомиллиардным обязательствам. Генеральный директор компании Тарек Мансур заявил в эфире CNBC, что за исковыми требованиями стоит давление со стороны традиционных игорных организаций, опасающихся конкуренции со стороны растущих рынков прогнозов. Власти Нью-Йорка, подавшие иск 31 июля, приравнивают контракты Kalshi к азартным играм, обвиняя платформу в работе без лицензии и предоставлении доступа несовершеннолетним. Компании грозят штрафы и требования о возмещении убытков. Мансур отверг обвинения, подчеркнув, что Kalshi легально работает под надзором Комиссии по торговле товарными фьючерсами (CFTC). Он также отметил, что закрытие платформы в штате затронет миллион клиентов, которые в 2026 году заработали на Kalshi почти 200 миллионов долларов. Глава CFTC Майкл Селиг раскритиковал действия прокурора Нью-Йорка, заявив, что комиссия будет отстаивать свою юрисдикцию в этом вопросе.

cryptonews.ru8 мин. назад

«Казино Лобби» стало причиной судебного иска в Нью-Йорке против компании Kalshi, утверждает генеральный директор Мансур

cryptonews.ru8 мин. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片