Оригинал | Odaily Planet Daily (@OdailyChina)
Автор | Нань Чжи (@Assassin_Malvo)

После того как многие направления были дискредитированы, рынки предсказаний стали одним из немногих направлений в крипто-сообществе, которое продолжает позитивно расти. 20 ноября Нань Чжи начал экспериментировать с использованием подхода прошлого года по поиску «умных денег» на мемах для поиска «умных денег» на рынках предсказаний и на начальном этапе достиг хороших результатов.
В начале декабря, как раз в момент запуска Gemini 3 Pro, при тестировании соответствующих моделей возникла идея: можно ли использовать ИИ для анализа и прогнозирования рынков предсказаний, и устроить соревнование между человеком и ИИ, чтобы увидеть, чьи прогнозы точнее.
При описании рынков предсказаний обычно утверждается, что они способствуют движению рынка к «истине» за счет «ставок реальными деньгами людьми, обладающими знаниями». Однако некоторые считают, что Крипто + рынки предсказаний позволяют «инсайдерам» безопасно получать прибыль от информационного разрыва, тем самым направляя рынок к «инсайдерскому результату». По сути, это противостояние двух точек зрения: «коллективный разум» и «истина принадлежит немногим». Прогнозирование с помощью ИИ больше склоняется к «коллективному разуму», поэтому требует большого количества доступных знаний и информации.
Таким образом, при выборе модели ИИ изначально были выбраны Gemini и Grok, поскольку они, опираясь на Google и платформу X, могут наиболее непосредственно получать огромные объемы знаний и информации. Недавно Нань Чжи добавил комбинацию «Douban + знания из Douyin», но из-за небольшого количества прогнозных вопросов она пока не рассматривается в этой статье.
Основные правила
- Версии ИИ: Gemini 2.5 pro (со встроенным поиском Google), Grok 4 Fast (через OpenRouter, с включенной нативной функцией поиска)
- Выбор вопросов: человек выбирает вопросы для ставок, ИИ следует за прогнозом, но исключается крипто-сектор
- Входные данные: официальный вопрос (title), официальное описание (Description), возможные ответы (фактически только Yes и No)
Примечание: Вопросы на Polymarket делятся на крупные категории Event и подкатегории Market. Крупная категория Event — это такие широкие вопросы, как «Кто будет следующим председателем ФРС» или «Когда Strategy продаст биткоин». Под Event есть N подкатегорий рынков, например, «Станет ли Хассет следующим председателем ФРС» или «Продаст ли Strategy биткоин до 31 марта 2026 года» — конкретные варианты выбора. Для соответствия с человеческим прогнозом здесь был выбран Market как вопрос для оценки ИИ, без ввода других опций. Например, ИИ просят определить «Станет ли Хассет следующим председателем ФРС», а не выбрать наиболее вероятного из N кандидатов.
- Дизайн промптов (подсказок):
- Требовать от ИИ поиска последних новостей, официальных заявлений, аналитических отчетов экспертов
- Требовать исключить, запретить использование данных с预测рынков
- Производить оценку на основе «доказательств», используя логические рассуждения
- Разрешить вывод только Yes или No, с кратким объяснением логики рассуждений
Текущие результаты
Среди прогнозных вопросов, по которым уже подведены итоги (21), у Grok самый высокий процент побед — 75%, у человека — 66.7%, а у Gemini самый низкий — 52.4%. Текущие результаты можно посмотреть на соответствующем сайте.

Какие ошибки допустил ИИ?
Gemini иногда неправильно определяет текущее время
В вопросе «Will Trump's approval rating hit 35% in 2025?» Gemini заявил, что сейчас первая половина 2025 года, поэтому всё возможно, и дал случайный ответ.
Но когда автор с помощью программы прямо попросил Gemini вывести текущее время, Gemini смог дать правильный ответ. Пока неясно, почему возникает такая ошибка в восприятии времени.
Недостаточная глубина мышления ИИ
В вопросе «Gemini 3.0 Flash released by December 16?» Grok, основываясь на том, что «официальные источники最近 упоминали только Gemini 3 Pro и связанные с ним версии 2.5, очень редко упоминая 3 Flash, поэтому доказательств для判断 недостаточно», учел только текущую информацию.
В то время как Gemini указал: «Gemini 1.0 был выпущен в декабре 2023 года, а экспериментальная версия Gemini 2.0 Flash — в декабре 2024 года. Продолжая эту модель, логично выпустить версию 3.0 в конце 2025 года», и также обнаружил «недавнюю (14 декабря 2025 года) утечку демонстрации «Gemini 3.0 Flash», распространяющуюся в интернет-сообществах, что further усиливает вероятность его скорого публичного релиза».
Хотя с точки зрения结论 ответ Gemini оказался ошибочным, в этом вопросе явно видна значительная разница в широте используемых источников информации.
ИИ основывает выводы на общих знаниях, а не на доказательствах + логике
В вопросе «Trump approval Up or Down this week?» Gemini заявил: «Прогнозировать рейтинг одобрения на одну неделю более чем через год сопряжено с высокой неопределенностью», — снова проявилась ошибка «неправильного восприятия времени». Затем Gemini сказал: «В любую обычную неделю вероятность события, которое приведет к slight снижению рейтинга, может быть slightly выше, чем вероятность позитивного события, significantly повышающего рейтинг», — поэтому вероятность снижения поддержки выше. Сгенерированный вывод основан только на субъективных общих предположениях.
В этом же вопросе Grok, основываясь на новостных reports о «приостановке работы правительства, экономических опасениях, спорах вокруг иммиграционной политики и негативной реакции на комментарии по поводу смерти Роба Райнера», а также данных опросов, соответствовал ожиданиям дизайна.
Ошибка в判断 условий расчета
В вопросе «Will Trump release the Epstein files by December 20?» и Gemini, и Grok уже знали, что «правительство опубликует «сотни тысяч страниц» документов в пятницу (19 декабря)», при этом в условиях расчета четко указано: «Публичный релиз правительством любых документов, связанных с незаконной деятельностью Эпштейна, которые не были обнародованы до указанной даты, считается за Yes».
Однако при этом условии Gemini заявил, что «завершить публикацию «всех» документов до 20 декабря невозможно», явно misinterpreted условия, необходимые для расчета, и therefore дал错误的答案.
Краткий итог
В заключение, процент побед Grok в прогнозах уже превзошел показатели этих «умных денег», заработавших на预测рынках сотни тысяч, миллионы долларов. Однако при глубоком изучении логики его прогнозов仍然 есть много аспектов, которые можно направлять и исправлять.








