Запись предсказаний ИИ: Хотите заработать на предсказательных рынках с помощью ИИ? Но он, возможно, даже не прочитал вопрос внимательно

Odaily星球日报Опубликовано 2026-01-04Обновлено 2026-01-04

Введение

Автор Odaily星球日报 провел эксперимент по использованию искусственного интеллекта (Gemini 2.5 Pro и Grok 4 Fast) для прогнозирования исходов событий на рынке предсказаний Polymarket. Искусственный интеллект анализировал только официальные данные и новости, исключая данные с рынка предсказаний. Из 21 протестированного события Grok показал точность 75%, человек — 66,7%, а Gemini — лишь 52,4%. Анализ выявил ключевые ошибки ИИ: - Gemini иногда неправильно определял текущую дату. - Оба ИИ часто делали выводы на основе общих рассуждений, а не конкретных доказательств. - ИИ ошибались в интерпретации условий расчетов по контрактам. - Глубина анализа часто была недостаточной: Grok упускал исторические паттерны, а Gemini иногда делал неверные логические выводы. Несмотря на то, что Grok превзошел по точности многих успешных трейдеров, автор делает вывод, что ИИ еще далек от идеального прогнозирования и требует значительных улучшений в анализе и интерпретации данных.

Оригинал | Odaily Planet Daily (@OdailyChina)

Автор | Нань Чжи (@Assassin_Malvo)

После того как многие направления были дискредитированы, рынки предсказаний стали одним из немногих направлений в крипто-сообществе, которое продолжает позитивно расти. 20 ноября Нань Чжи начал экспериментировать с использованием подхода прошлого года по поиску «умных денег» на мемах для поиска «умных денег» на рынках предсказаний и на начальном этапе достиг хороших результатов.

В начале декабря, как раз в момент запуска Gemini 3 Pro, при тестировании соответствующих моделей возникла идея: можно ли использовать ИИ для анализа и прогнозирования рынков предсказаний, и устроить соревнование между человеком и ИИ, чтобы увидеть, чьи прогнозы точнее.

При описании рынков предсказаний обычно утверждается, что они способствуют движению рынка к «истине» за счет «ставок реальными деньгами людьми, обладающими знаниями». Однако некоторые считают, что Крипто + рынки предсказаний позволяют «инсайдерам» безопасно получать прибыль от информационного разрыва, тем самым направляя рынок к «инсайдерскому результату». По сути, это противостояние двух точек зрения: «коллективный разум» и «истина принадлежит немногим». Прогнозирование с помощью ИИ больше склоняется к «коллективному разуму», поэтому требует большого количества доступных знаний и информации.

Таким образом, при выборе модели ИИ изначально были выбраны Gemini и Grok, поскольку они, опираясь на Google и платформу X, могут наиболее непосредственно получать огромные объемы знаний и информации. Недавно Нань Чжи добавил комбинацию «Douban + знания из Douyin», но из-за небольшого количества прогнозных вопросов она пока не рассматривается в этой статье.

Основные правила

  • Версии ИИ: Gemini 2.5 pro (со встроенным поиском Google), Grok 4 Fast (через OpenRouter, с включенной нативной функцией поиска)
  • Выбор вопросов: человек выбирает вопросы для ставок, ИИ следует за прогнозом, но исключается крипто-сектор
  • Входные данные: официальный вопрос (title), официальное описание (Description), возможные ответы (фактически только Yes и No)

Примечание: Вопросы на Polymarket делятся на крупные категории Event и подкатегории Market. Крупная категория Event — это такие широкие вопросы, как «Кто будет следующим председателем ФРС» или «Когда Strategy продаст биткоин». Под Event есть N подкатегорий рынков, например, «Станет ли Хассет следующим председателем ФРС» или «Продаст ли Strategy биткоин до 31 марта 2026 года» — конкретные варианты выбора. Для соответствия с человеческим прогнозом здесь был выбран Market как вопрос для оценки ИИ, без ввода других опций. Например, ИИ просят определить «Станет ли Хассет следующим председателем ФРС», а не выбрать наиболее вероятного из N кандидатов.

  • Дизайн промптов (подсказок):
  • Требовать от ИИ поиска последних новостей, официальных заявлений, аналитических отчетов экспертов
  • Требовать исключить, запретить использование данных с预测рынков
  • Производить оценку на основе «доказательств», используя логические рассуждения
  • Разрешить вывод только Yes или No, с кратким объяснением логики рассуждений

Текущие результаты

Среди прогнозных вопросов, по которым уже подведены итоги (21), у Grok самый высокий процент побед — 75%, у человека — 66.7%, а у Gemini самый низкий — 52.4%. Текущие результаты можно посмотреть на соответствующем сайте.

Какие ошибки допустил ИИ?

Gemini иногда неправильно определяет текущее время

В вопросе «Will Trump's approval rating hit 35% in 2025?» Gemini заявил, что сейчас первая половина 2025 года, поэтому всё возможно, и дал случайный ответ.

Но когда автор с помощью программы прямо попросил Gemini вывести текущее время, Gemini смог дать правильный ответ. Пока неясно, почему возникает такая ошибка в восприятии времени.

Недостаточная глубина мышления ИИ

В вопросе «Gemini 3.0 Flash released by December 16?» Grok, основываясь на том, что «официальные источники最近 упоминали только Gemini 3 Pro и связанные с ним версии 2.5, очень редко упоминая 3 Flash, поэтому доказательств для判断 недостаточно», учел только текущую информацию.

В то время как Gemini указал: «Gemini 1.0 был выпущен в декабре 2023 года, а экспериментальная версия Gemini 2.0 Flash — в декабре 2024 года. Продолжая эту модель, логично выпустить версию 3.0 в конце 2025 года», и также обнаружил «недавнюю (14 декабря 2025 года) утечку демонстрации «Gemini 3.0 Flash», распространяющуюся в интернет-сообществах, что further усиливает вероятность его скорого публичного релиза».

Хотя с точки зрения结论 ответ Gemini оказался ошибочным, в этом вопросе явно видна значительная разница в широте используемых источников информации.

ИИ основывает выводы на общих знаниях, а не на доказательствах + логике

В вопросе «Trump approval Up or Down this week?» Gemini заявил: «Прогнозировать рейтинг одобрения на одну неделю более чем через год сопряжено с высокой неопределенностью», — снова проявилась ошибка «неправильного восприятия времени». Затем Gemini сказал: «В любую обычную неделю вероятность события, которое приведет к slight снижению рейтинга, может быть slightly выше, чем вероятность позитивного события, significantly повышающего рейтинг», — поэтому вероятность снижения поддержки выше. Сгенерированный вывод основан только на субъективных общих предположениях.

В этом же вопросе Grok, основываясь на новостных reports о «приостановке работы правительства, экономических опасениях, спорах вокруг иммиграционной политики и негативной реакции на комментарии по поводу смерти Роба Райнера», а также данных опросов, соответствовал ожиданиям дизайна.

Ошибка в判断 условий расчета

В вопросе «Will Trump release the Epstein files by December 20?» и Gemini, и Grok уже знали, что «правительство опубликует «сотни тысяч страниц» документов в пятницу (19 декабря)», при этом в условиях расчета четко указано: «Публичный релиз правительством любых документов, связанных с незаконной деятельностью Эпштейна, которые не были обнародованы до указанной даты, считается за Yes».

Однако при этом условии Gemini заявил, что «завершить публикацию «всех» документов до 20 декабря невозможно», явно misinterpreted условия, необходимые для расчета, и therefore дал错误的答案.

Краткий итог

В заключение, процент побед Grok в прогнозах уже превзошел показатели этих «умных денег», заработавших на预测рынках сотни тысяч, миллионы долларов. Однако при глубоком изучении логики его прогнозов仍然 есть много аспектов, которые можно направлять и исправлять.

Трендовые криптовалюты

Связанные с этим вопросы

QКакой искусственный интеллект показал наивысшую точность прогнозов в исследовании, описанном в статье?

AGrok 4 Fast показал наивысшую точность прогнозов с показателем 75%.

QКакие две основные философские концепции противостоят друг другу в прогнозных рынках, согласно статье?

AЭто противостояние «коллективного разума» (мудрости толпы) и концепции «истина принадлежит немногим».

QС какими двумя основными проблемами столкнулись модели ИИ при прогнозировании?

AМодели ИИ столкнулись с проблемами, такими как неправильное восприятие текущего времени и недостаточная глубина анализа, основанного на доказательствах.

QПочему авторы выбрали для эксперимента модели Gemini и Grok?

AОни были выбраны потому, что имеют прямой доступ к огромным массивам знаний и мнений через платформы Google и X соответственно.

QНа каком основании был урегулирован рынок, связанный с вопросом о файлах Эпштейна, что привело к ошибке ИИ?

AРынок должен был быть урегулирован как «Да», если любая часть файлов была опубликована к указанной дате, но ИИ ошибочно ожидал публикации всех файлов.

Похожее

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

Источник: интервью Рэя Далио, основателя Bridgewater Associates, для подкаста "The Diary Of A CEO". Далио, предсказавший кризис 2008 года, обсуждает "большой цикл" — концепцию, охватывающую долговые проблемы, растущее неравенство и геополитические сдвиги. Он указывает, что текущий ажиотаж вокруг ИИ демонстрирует классические признаки пузыря, который может лопнуть из-за высокой долговой нагрузки, роста процентных ставок и чрезмерной эмиссии акций, что способно привести к рецессии. Для защиты личного капитала в неопределенные времена Далио советует диверсификацию: вместо хранения наличных инвестировать в акции, золото, облигации. Сам он держит около 1% портфеля в биткоине, считая его "твердыми деньгами", но предпочитает физическое золото из-за его статуса резервного актива и независимости от технологических рисков. Говоря о влиянии ИИ, Далио отмечает, что технология заменяет не только физический труд, но и элементы мышления, что увеличит разрыв между капиталом и трудом. Ключевыми останутся человеческие качества — эмоции и интуиция, а успеха добьются те, кто научится работать в партнерстве с ИИ. На геополитической арене, по его мнению, мир движется к регионализации с центрами в виде США и Китая. Вовлечение США в конфликты, подобные иранскому, обнажает снижение их абсолютного влияния. Внутренние вызовы, такие как дебаты о налогах на богатство, риск капитального бегства и низкая производительность, также ставят под вопрос стабильность традиционных держав в текущей фазе цикла.

marsbit43 мин. назад

Диалог с Далио: Сейчас мы находимся в пузыре ИИ, 1% моего инвестиционного портфеля — это биткоин

marsbit43 мин. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

Капиталы возвращаются на южнокорейский рынок акций. 31 июля иностранные инвесторы осуществили чистые покупки акций KOSPI на рекордные 7,2 трлн вон за один день, что стало самым высоким показателем в истории. По данным Citigroup, эта цифра знаменует собой кардинальный разворот после месяцев масштабного оттока средств нерезидентов. В июле чистые продажи иностранными инвесторами значительно сократились до 9,8 трлн вон по сравнению с 48,4 трлн и 44,5 трлн вон в июне и мае соответственно. Одновременно внутренние пенсионные и инвестиционные фонды в июле вернулись к чистым покупкам на 1,0 трлн вон. Дополнительным фактором снижения волатильности стали новые правила Комиссии по финансовым услугам (FSC), ужесточившие с 31 июля доступ розничных инвесторов к ETF с плечом на отдельные акции. После введения норм торговый оборот таких инструментов упал примерно вдвое. Citigroup сохраняет целевую точку для KOSPI на уровне 10000 пунктов, отмечая ослабление давления со стороны движения капиталов. Аналитики видят поддержку рынку в устойчивости фундаментальных показателей сектора чипов памяти, низких оценках KOSPI, сильной экономике и благоприятной политике властей, включая возможные меры по поддержке ликвидности.

marsbit43 мин. назад

7.2 трлн вон за один день: иностранные инвесторы установили рекорд чистых покупок в пятницу! Уолл-Стрит: встречный ветер в плане ликвидности на южнокорейском рынке уже утих

marsbit43 мин. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

В статье рассматривается вопрос о том, как остаться незаменимым в эпоху искусственного интеллекта. Автор утверждает, что вместо страха перед ИИ следует сосредоточиться на развитии качеств, которые машины не смогут заменить. Он критикует «зарплатное рабство» — зависимость от работы, не приносящей удовлетворения, и предлагает путь к финансовой независимости через создание собственного дела. Ключ к успеху — развитие пяти элементов: самостоятельности (агентности), вкуса, умения убеждать, упорства и способности к итерациям. Главное — не просто создавать что-либо (сегодня это может каждый), а создавать что-то ценное, востребованное и уметь это продвигать. Автор считает, что наиболее важным навыком будущего является создание контента (медиа), а не просто написание кода, поскольку ценность контента субъективна и требует уникального человеческого вкуса и суждения. ИИ может помочь в производстве, но не заменит оригинальность мысли и связь с аудиторией. В качестве практического шага предлагается упражнение: за 15 минут ответить на вопросы, чтобы обнаружить свои уникальные знания, опыт и точку зрения, которые станут основой для личного бренда и дела жизни. Первый шаг — немедленно опубликовать свою основную идею, чтобы получить обратную связь от реального мира и начать процесс роста. Цель — стать «непригодным для найма», построив жизнь вокруг собственного творчества и экспертизы.

marsbit2 ч. назад

Как стать человеком, которого искусственный интеллект никогда не сможет заменить

marsbit2 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

Статья посвящена практике генерации сид-фраз для биткоин-кошельков с помощью бросков кубиков в свете уязвимости, обнаруженной в аппаратных кошельках Coldcard. Подчеркивается, что физический бросок кубика (дающий около 2.6 бит энтропии за бросок) создает высококачественную случайность, поскольку предсказать результат практически невозможно из-за множества переменных. Для создания стандартной сид-фразы из 12 слов (128 бит энтропии) требуется около 50 бросков, а для повышенной безопасности рекомендуется 99 и более. В связи с инцидентом Coldcard, когда неисправный генератор случайных чисел в прошивке (2021-2026 гг.) мог создавать предсказуемые ключи, выяснилось, что сид-фразы, сгенерированные вручную через кубики, были защищены от этой уязвимости. Однако исследование показало, что другие функции устройства (создание бумажных кошельков, ключей для мультиподписи, паролей и т.д.) по-прежнему использовали скомпрометированный генератор, подвергая риску владельцев даже с безопасной основной сид-фразой. Автор отмечает, что, хотя метод с кубиками криптографически надежен, он непрактичен для массового использования из-за трудоемкости, высокой вероятности ошибок при вводе и необходимости строгой дисциплины для сохранения секретности процесса. Делается вывод, что будущее безопасности лежит в создании надежных аппаратных генераторов случайных чисел и понятных интерфейсов, а ручные методы остаются нишевым инструментом для опытных пользователей. Владельцам Coldcard рекомендуется обновить прошивку и проверить/заменить все ключи, сгенерированные уязвимыми функциями.

cryptonews.ru5 ч. назад

Благодаря броскам кубиков ключи от биткоинов хранятся в автономном режиме, но не все будут этим заниматься

cryptonews.ru5 ч. назад

Торговля

Спот

Популярные статьи

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

2025 год — год институциональных инвесторов, в будущем он будет доминировать в приложениях реального времени.

1.9k просмотров всегоОпубликовано 2025.12.16Обновлено 2025.12.16

Неделя обучения по популярным токенам (2): 2026 может стать годом приложений реального времени, сектор AI продолжает оставаться в тренде

Обсуждения

Добро пожаловать в Сообщество HTX. Здесь вы сможете быть в курсе последних новостей о развитии платформы и получить доступ к профессиональной аналитической информации о рынке. Мнения пользователей о цене на AI (AI) представлены ниже.

活动图片