Предсказания плей-офф Чемпионата мира: Насколько отличаются разные уровни ИИ?

Odaily星球日报Опубликовано 2026-07-02Обновлено 2026-07-02

Введение

Кубок мира: насколько различны прогнозы разных ИИ в плей-офф? В ходе нынешнего Кубка мира Odaily Planet Daily перед каждым матчем плей-офф запрашивал прогнозы у различных ИИ-моделей (ChatGPT, Grok, Qwen, DeepSeek, Gemini, Claude), а затем сравнивал их с реальными результатами. Наиболее запоминающимся стал точный прогноз DeepSeek и Gemini в матче Нидерланды – Марокко. Обе модели предсказали ничью в основное время и победу Марокко в серии пенальти, что полностью совпало с реальным исходом (1:1, 3:2 по пенальти). Gemini особенно точно описала сценарий матча. Grok и Qwen проявили себя как «специалисты по точному счету». Они верно предсказали конкретные результаты в нескольких матчах, где был явный фаворит: Канада 1:0 ЮАР, Бразилия 2:1 Япония, Норвегия 2:1 Кот-д’Ивуар. Их сила — в точном определении того, выиграет ли фаворит уверенно или с трудом. ChatGPT и Claude показали себя как «аналитики». Их прогнозы по итоговому счету часто были менее точны, но они регулярно верно указывали на потенциальные сложности для фаворитов и факторы, которые могут сделать матч напряженным (например, в матчах Бразилия – Япония или Англия – ДР Конго). Однако им не хватало решимости предсказать крупную сенсацию. Все модели единодушно ошиблись в матче Германия – Парагвай, предрекая легкую победу немцев. Ни одна не учла способность Парагвая затянуть матч и вывести его в серию пенальти, где Германия и проиграла. Вывод: не существует одной «самой точной» модели. У каждой свои сильные стороны: DeepSeek...

Оригинал | Odaily星球日报(@OdailyChina)

Автор | Asher(@Asher_ 0210)

Перед каждым матчем Чемпионата мира я прошу ИИ сделать прогноз, и почти каждая модель говорит обстоятельно, с множеством деталей.

Одни обсуждают стоимость команд, другие разбирают данные группового этапа, третьи анализируют травмы и тактику, а некоторые напрямую дают сценарий счёта, дополнительного времени и пенальти. На первый взгляд, ChatGPT, Grok, Qianwen, DeepSeek, Gemini, Claude — все хорошо разбираются в футболе.

Но как пользователю рынка прогнозов, меня на самом деле волнует не то, какая модель говорит полнее, а какая из них более заслуживает доверия.

По мере того как чемпионат мира вступает в стадию плей-офф, Odaily星球日报 с первого матча перед каждой игрой задаёт примерно одинаковые вопросы разным моделям ИИ, а после матча сверяет с реальным результатом — какие модели лишь похоже анализируют, а какие действительно заранее уловили ход матча.

На данный момент в завершившихся матчах плей-офф Канада в концовке обыграла ЮАР со счётом 1:0, Бразилия с трудом победила Японию 2:1, Германия была выбита Парагваем после серии пенальти, и Нидерланды также пали от пенальти Марокко. В матче Бельгия — Сенегал игра завершилась со счётом 2:2, затем в дополнительное время произошёл разворот, что в полной мере продемонстрировало непредсказуемость плей-офф.

DeepSeek и Gemini предсказали Марокко и стали легендами

Самым запоминающимся на данный момент остаётся прогноз DeepSeek и Gemini на матч Нидерланды против Марокко. Перед этой игрой было легко ошибиться в выборе стороны — Нидерланды сильнее на бумаге, состав у них более сбалансированный, многие модели понимали, что с Марокко будет непросто, но в итоге всё же больше верили, что Нидерланды пройдут.

Сильная сторона DeepSeek и Gemini заключается в том, что они не остановились на шаге «игра будет упорной», а прописали дальнейший сценарий. Gemini перед игрой напрямую дал прогноз: 1:1 в основное время, победа Марокко по пенальти. В итоге матч действительно закончился 1:1, и в конце Марокко выбило Нидерланды со счётом 3:2 по пенальти. Они не просто угадали исход, но и в основном попали в то, как игра дойдёт до пенальти и кто в итоге победит.

Прогноз Gemini на матч Нидерланды — Марокко

DeepSeek тоже был близок. Он считал, что счёт в основное время, скорее всего, будет 1:1 или 0:0, игра может затянуться до дополнительного времени или даже пенальти, и склонялся к тому, что Марокко пройдёт благодаря защите и контратакам.

Прогноз Deepseek на матч Нидерланды — Марокко

После этого матча значимость DeepSeek и Gemini резко возросла. Особенно Gemini — на этот раз это было похоже не на предматчевый прогноз, а на то, что они заранее видели сценарий игры.

Grok и Qianwen стабильно угадывали точный счёт, их стабильность оказалась сильнее, чем ожидалось

Помимо яркого выступления DeepSeek и Gemini в матче с Марокко, Grok и Qianwen тоже проявили себя. Их самая сильная сторона в том, что в играх с относительно ясным фаворитом они не только правильно определяли проходящую команду, но и давали прогноз счёта, близкий к финальному результату.

Матч ЮАР — Канада тому пример. Перед игрой большинство моделей ИИ болели за Канаду, но разногласия были в том, легко ли Канада победит. Grok перед матчем дал прогноз 1:0 в пользу Канады, Qianwen также прогнозировал победу с минимальным счётом. В итоге Канада действительно прошла благодаря всего одному голу, и не получилось ожидаемого крупного счёта.

Прогноз Qianwen на матч ЮАР — Канада

Бразилия — Япония тоже похожий случай. Большинство моделей ИИ считали Бразилию сильнее, но вопрос был в том, сможет ли Япония удержать игру. И Grok, и Qianwen прогнозировали счёт 2:1, в итоге матч действительно закончился со счётом 2:1 в пользу Бразилии. Они угадали не просто «Бразилия победит», а то, что Япония сможет доставить Бразилии достаточно проблем.

В матче Кот-д'Ивуар — Норвегия они тоже попали достаточно точно. Понять, что Норвегия с Холанном пройдёт, несложно, но физическая игра и фланговые атаки Кот-д'Ивуара также не позволят матчу стать односторонним. И Grok, и Qianwen прогнозировали победу Норвегии 2:1, и финальный счёт попал именно в этот «сценарий».

Прогноз Gork на матч Кот-д'Ивуар — Норвегия

Преимущество Grok и Qianwen в том, что они видят матчи фаворитов более детально. Они не написали заранее большой сценарий с вылетом Нидерландов от Марокко, но в матчах с Канадой, Бразилией, Норвегией, Францией они довольно точно определяли фаворита и возможный счёт. Другими словами, они не обязательно лучше всех ловят сенсации, но хорошо умеют определить, пройдёт ли фаворит легко или с трудом одержит победу.

У ChatGPT не так много точных счётов, но анализ хода игры довольно точен

ChatGPT не предсказал, как Gemini, победу Марокко по пенальти над Нидерландами, и не угадал, как Grok и Qianwen, несколько точных счётов подряд. Но его преимущество в том, что во многих матчах, где перед игрой казалось, что у фаворита преимущество, ChatGPT заметнее напоминал, что игра может быть не такой лёгкой.

Матч Бразилия — Япония тому пример. ChatGPT прогнозировал проход Бразилии, но не описывал игру как лёгкую прогулку для Бразилии, а упоминал, что прессинг, подвижность и дисциплина Японии доставят Бразилии неудобства, и у Японии даже будет шанс забить первой или сравнять счёт. Кот-д'Ивуар — Норвегия тоже похожий случай: ChatGPT прогнозировал проход Норвегии, но заранее говорил, что это будет нелёгкая игра, физическая борьба, фланговые атаки и способность Кот-д'Ивуара к быстрым переходам создадут проблемы.

Кроме того, в матче плей-офф Англия — Демократическая Республика Конго ChatGPT тоже не просто написал о крупной победе Англии, а считал, что игра может быть скучной, ДР Конго будет использовать низкий блок защиты, чтобы замедлить темп. В итоге Англия прошла, но победа далась нелегко.

Прогноз ChatGPT на матч Англия — Демократическая Республика Конго

Сильная сторона ChatGPT не в том, чтобы каждый раз точно предсказывать счёт, а в том, что он часто заранее может указать, в чём будет сопротивление. Он хорошо подходит для понимания игры, но не для тех, кто хочет увидеть только конечный счёт. Он может довольно точно описать процесс, но когда дело доходит до предсказания крупной сенсации, ему не хватает решительности.

Вылет Германии стал местом коллективного провала для моделей ИИ

Если в предыдущих матчах ещё можно было увидеть сильные стороны разных моделей, то матч Германия — Парагвай стал местом коллективного провала.

Перед игрой все модели ИИ были на стороне Германии. ChatGPT, Grok, Qianwen, Gemini, Claude — все поддерживали Германию, прогнозы счёта в основном были 2:0, 3:0 или 3:1. Причины тоже были одинаковыми: все считали, что Германия сильнее на бумаге, у неё лучше глубина состава и мощнее атака.

Но в итоге в этой игре случился провал. Модели ИИ недооценили способность Парагвая затянуть игру в грязь, Германия не смогла решить исход в основное время, не смогла переломить ситуацию в дополнительное время и в итоге была выбита Парагваем в серии пенальти.

Кто на данный момент самый точный?

Судя по завершившимся матчам плей-офф, начали проявляться особенности разных моделей.

У DeepSeek и Gemini самые яркие моменты. Они не только могут предсказать проход таких фаворитов, как Бразилия или Франция, но и в более сложных для определения сенсационных матчах дают ответы с высокой ценностью. В матче Нидерланды — Марокко их ключевое преимущество заключалось в смелости заранее прописать сценарий сенсации и пенальти для Марокко. Особенно Gemini, напрямую предсказавшая проход Марокко по пенальти, — этот матч действительно очень яркий.

Grok и Qianwen больше похожи на «игроков, угадывающих счёт». Они точно попали во множество конкретных счётов, особенно хорошо проявив себя в матчах с Канадой, Бразилией, Норвегией, Францией. Но проблема в том, что когда речь заходит о таких традиционных сильных командах, как Германия или Нидерланды, они в итоге склоняются к фавориту.

ChatGPT и Claude больше похожи на «аналитических игроков». Причины расписаны полно, направление в большинстве случаев недалеко от истины, они также могут предупредить о некоторых рисках дополнительного времени. Но проблема в том, что они часто видят, что игра будет сложной, но не решаются сделать вывод в пользу сенсации. Так было в матче Нидерланды — Марокко: они уже видели риски дополнительного времени и пенальти, но в итоге всё же больше поверили Нидерландам.

Поэтому, вместо того чтобы спешить спрашивать, какая модель лучше разбирается в футболе, лучше посмотреть, для каких сценариев каждая из них подходит.

Связанные с этим вопросы

QКакие модели ИИ наиболее точно предсказали матч Нидерланды против Марокко, включая серию пенальти?

AНаиболее точные предсказания матча Нидерланды против Марокко дали модели DeepSeek и Gemini. Gemini заранее спрогнозировала ничью 1:1 в основное время и победу Марокко в серии пенальти, что полностью совпало с реальным результатом. DeepSeek также предсказала высокую вероятность ничьей (1:1 или 0:0), дополнительное время/пенальти и склонялась к сенсационному выходу Марокко вперёд.

QКакие сильные стороны в предсказаниях демонстрировали модели Grok и Qwen (千问)?

AМодели Grok и Qwen проявили себя как «эксперты по точному счёту». Их сильная сторона — точное предсказание конкретных результатов в матчах с явным фаворитом. Например, они верно назвали счёт 1:0 в пользу Канады против ЮАР и 2:1 в пользу Бразилии против Японии. Они хорошо определяли, выиграет ли фаворит с разгромом или в тяжёлой борьбе, но были склонны переоценивать шансы традиционных сильных команд в потенциально сложных матчах.

QВ чём заключалась основная особенность прогнозов ChatGPT согласно статье?

AОсновная особенность прогнозов ChatGPT — детальный и точный анализ возможного хода матча, а не стремление угадать точный счёт. Модель часто верно указывала на факторы, которые усложнят игру фавориту (например, дисциплина и прессинг Японии против Бразилии, физическая мощь Кот-д'Ивуара против Норвегии). Однако её слабость заключалась в нерешительности: видя риски, она редко делала окончательный вывод в пользу аутсайдера, чаще всё же выбирая фаворита.

QКакой матч стал примером коллективной ошибки всех протестированных ИИ-моделей?

AКоллективной ошибкой всех протестированных ИИ-моделей (ChatGPT, Grok, Qwen, Gemini, Claude) стал матч Германия против Парагвая. Все модели единогласно предсказывали победу Германии с уверенным счётом (2:0, 3:0, 3:1), недооценив способность Парагвая перевести игру в жёсткое, оборонительное русло. В реальности матч закончился вничью в основное и дополнительное время, и Парагвай победил в серии пенальти.

QКакой итоговый вывод делает автор статьи относительно выбора ИИ-модели для прогнозов?

AАвтор делает вывод, что не существует одной «самой умной» модели. Выбор зависит от задачи: 1) Для предсказания возможных сенсаций и точного исхода сложных матчей — DeepSeek и Gemini. 2) Для точного предсказания счёта в матчах с фаворитом — Grok и Qwen. 3) Для глубокого понимания возможных сценариев и подводных камней в матче, даже если итоговый вывод не самый смелый — ChatGPT и Claude.

Похожее

Полный последний макроанализ Рэя Далио: купить больше золота и немного биткойна

В своей последней макроэкономической статье Рэй Далио анализирует долговую динамику государств, используя модель «большого цикла». Он описывает признаки надвигающегося долгового кризиса: рост расходов на обслуживание долга, дисбаланс между спросом и предложением гособлигаций, вынужденное смягчение денежно-кредитной политики и монетизацию долга. Далио отмечает, что США столкнутся с серьёзными проблемами из-за крупного дефицита бюджета и высокого уровня госдолга, а также предупреждает о рисках для Японии, Великобритании, ЕС и Китая. В качестве стратегии выхода он предлагает сократить дефицит бюджета до 3% ВВП за счёт баланса между сокращением расходов, увеличением налогов и снижением процентных ставок. Для инвесторов он рекомендует диверсифицировать портфель, сократить долю облигаций, а также добавить в него золото и небольшое количество биткоина в качестве защиты от обесценивания фиатных валют.

marsbit10 мин. назад

Полный последний макроанализ Рэя Далио: купить больше золота и немного биткойна

marsbit10 мин. назад

Попытки главы Минфина США обуздать доходность казначейских облигаций разожгли «валютные девальвационные сделки»! Золото достигло трёхмесячного максимума, биткоин за неделю взлетел более чем на 25%

Министр финансов США Джанет Йеллен предприняла попытку сдержать рост доходности долгосрочных казначейских облигаций, однако этот эффект оказался кратковременным. Вместо этого её действия спровоцировали ослабление доллара и резкий рост цен на золото и биткоин, что усилило логику торговли на обесценивание валюты. Основными драйверами этой динамики стали растущий дефицит бюджета США и структурное давление на долгосрочные процентные ставки, вызванное масштабными государственными заимствованиями и огромным спросом на капитал со стороны компаний, особенно в сфере ИИ. Биткоин за неделю вырос более чем на 25%, достигнув $78 000, а золото обновило трёхмесячный максимум. Корреляция между биткоином и золотом находится на самом высоком уровне со времён пандемии, укрепляя восприятие криптовалюты как инструмента хеджирования. Эксперты отмечают, что действия Казначейства могут повлиять на ликвидность, но не способны подавить фундаментальные факторы, такие как инфляция и спрос на капитал. Рэй Далио из Bridgewater рекомендовал инвесторам сокращать вложения в облигации и увеличивать долю золота и биткоина на фоне рисков долгового кризиса. Хотя повествование о торговле на обесценивание привлекательно, некоторые аналитики сомневаются в устойчивости текущего роста, указывая на отсутствие новых катализаторов. Внимание рынка теперь приковано к отчёту Nvidia и предстоящему симпозиуму в Джексон-Хоуле, где станет ясно, смогут ли прибыли компаний ИИ продолжать поддерживать рынки и будут ли действия ФРС согласованы с желанием Вашингтона сохранять низкие процентные ставки.

华尔街日报2 ч. назад

Попытки главы Минфина США обуздать доходность казначейских облигаций разожгли «валютные девальвационные сделки»! Золото достигло трёхмесячного максимума, биткоин за неделю взлетел более чем на 25%

华尔街日报2 ч. назад

Александр Шохин: бизнесу нужна ставка ниже 10% и доллар на уровне 90–95 рублей

Глава Российского союза промышленников и предпринимателей Александр Шохин вновь высказался за возможное использование "нерыночных" инструментов для удержания курса рубля в заданном коридоре, чтобы избежать чрезмерной волатильности. Ранее он уже отмечал, что текущий курс сложно назвать полностью рыночным. Шохин обозначил целевые ориентиры для бизнеса к концу 2026 года: ключевая ставка Банка России на уровне 12%, инфляция 4-5% и курс доллара в районе 90-95 рублей. При этом комфортным для инвестиций бизнес видит снижение ставки ниже 10%. Он подчеркивает прямую связь между стабильностью валюты, уровнем ставки, инфляцией и готовностью компаний инвестировать в новые проекты. Исторически валютный коридор в России уже применялся в 1995-1998 годах, но его удержание требовало значительных резервов и завершилось резким расширением границ во время кризиса. Вопрос о конкретных механизмах и источниках интервенций для поддержания такого коридора в текущих условиях остается открытым.

cryptonews.ru4 ч. назад

Александр Шохин: бизнесу нужна ставка ниже 10% и доллар на уровне 90–95 рублей

cryptonews.ru4 ч. назад

Поезд к Биткоину уже ушёл со станции? Пользовательский индикатор перестал подавать сигналы!

Рост цены биткоина вывел индикатор AHR999 из зоны «покупки на спаде» (значение ниже 0,45), где он находился примерно 82 дня — с 29 мая по 19 августа. После недавнего повышения стоимости BTC индикатор достиг отметки 0,5073 и вернулся в зону средней долларовой стоимости (DCA), которая находится в диапазоне от 0,45 до 1,20 и считается областью для устойчивых покупок. Индикатор AHR999 помогает долгосрочным инвесторам, использующим стратегию постепенного накопления, оценивать относительную дешевизну или дороговизну рынка, анализируя краткосрочную доходность и отклонение цены от расчетной стоимости. Исторически значения ниже 0,45 интерпретируются как «покупка на спаде», от 0,45 до 1,20 — как зона для планомерных покупок, а выше 1,20 — как область относительно высокой цены. При этом индикатор не является прямым сигналом к действиям на рынке.

cryptonews.ru4 ч. назад

Поезд к Биткоину уже ушёл со станции? Пользовательский индикатор перестал подавать сигналы!

cryptonews.ru4 ч. назад

Торговля

Спот
活动图片