Десятки миллионов ошибок в час: исследование раскрывает «иллюзию точности» AI-поиска Google

marsbitОпубликовано 2026-04-13Обновлено 2026-04-13

Введение

Автор: Клод, Deep Chao TechFlow Согласно совместному исследованию The New York Times и стартапа Oumi, функция AI Overviews (ИИ-сводки) в Google Search демонстрирует точность около 91%. Однако, учитывая масштаб Google (5 триллионов запросов в год), это означает, что система ежечасно генерирует десятки миллионов ошибочных ответов — более 57 миллионов. Проблема усугубляется тем, что даже когда ответ верен, более половины (56% для Gemini 3) цитируемых источников не подтверждают выводы, сделанные ИИ. Часто используются низкокачественные источники, такие как Facebook и Reddit. Еще одной серьёзной проблемой является уязвимость к манипуляциям. Тест BBC показал, что ложная информация из намеренно сфабрикованной статьи начала появляться в ответах ИИ менее чем за 24 часа. Google оспаривает методологию исследования, заявляя о «серьёзных недостатках», включая использование другого ИИ (HallOumi) для оценки и нереалистичные тестовые запросы. Внутренние тесты Google показывают, что их модель Gemini 3 вне поисковой системы имеет уровень ошибок в 28%, но компания утверждает, что интеграция с поиском значительно повышает её точность.

Автор: Клод, Deep Chao TechFlow

Глубинный обзор: Совместное тестирование The New York Times и AI-стартапа Oumi показало, что точность функции AI-анонсов (AI Overviews) в поиске Google составляет около 91%. Однако с учётом масштаба Google, обрабатывающего 5 триллионов поисковых запросов в год, это означает, что ежечасно генерируются десятки миллионов ошибочных ответов. Что ещё серьёзнее, даже при правильных ответах более половины ссылок на источники не подтверждают выводы.

Google в беспрецедентных масштабах поставляет пользователям недостоверную информацию, и большинство об этом даже не подозревает.

Согласно The New York Times, AI-стартап Oumi по её заказу провёл оценку точности функции AI Overviews от Google с использованием отраслевого стандартного теста SimpleQA, разработанного OpenAI. Тестирование охватило 4326 поисковых запросов и проводилось в два этапа: в октябре прошлого года (на движке Gemini 2) и в феврале этого года (после обновления до Gemini 3). Результаты показали, что точность Gemini 2 составила около 85%, а Gemini 3 повысила её до 91%.

91% звучит неплохо, но в масштабах Google это выглядит иначе. Google обрабатывает около 5 триллионов поисковых запросов в год. При 9% уровне ошибок AI Overviews ежечасно генерирует более 57 миллионов неточных ответов, что приближается к 1 миллиону в минуту.

Ответ верный, но источник ошибочен

Беспокойнее, чем точность, является проблема «отрыва» источников цитирования.

Данные Oumi показывают, что во времена Gemini 2 в 37% правильных ответов существовала проблема «необоснованного цитирования», когда прикреплённые к AI-анонсу ссылки не подтверждали предоставленную информацию. После обновления до Gemini 3 этот показатель не снизился, а подскочил до 56%. Иными словами, модель, давая правильные ответы, всё хуже «делает домашнюю работу».

Вопрос генерального директора Oumi Маноса Кукумидиса бьёт в самую суть: «Даже если ответ правильный, откуда ты знаешь, что он правильный? Как ты это проверишь?»

Массовое цитирование AI Overviews низкокачественных источников усугубляет эту проблему. Oumi обнаружила, что Facebook и Reddit являются вторым и четвёртым по частоте источниками цитирования для AI Overviews. Среди неточных ответов Facebook цитировался в 7% случаев, что выше, чем 5% в точных ответах.

Фальшивая статья журналиста BBC «отравила» систему за 24 часа

Ещё один серьёзный недостаток AI Overviews — чрезвычайная лёгкость манипулирования.

Один журналист BBC провёл тест с помощью намеренно сфабрикованной фальшивой статьи, и менее чем за 24 часа AI-анонс Google начал представлять содержащуюся в ней ложную информацию как факт для пользователей.

Это означает, что любой, кто понимает механизм работы системы, может «отравить» AI-результаты поиска, публикуя ложный контент и накручивая его трафик. Пресс-секретарь Google Нед Адрианс в ответ на это заявил, что AI-функция поиска построена на тех же механизмах ранжирования и безопасности, что и блокировка спама, и что «большинство примеров в тесте — это нереалистичные запросы, которые люди на самом деле не ищут».

Возражение Google: проблемы в самом тесте

Google выдвинула ряд претензий к исследованию Oumi. Пресс-секретарь компании назвал это исследование «имеющим серьёзные недостатки»,理由包括: сам эталонный тест SimpleQA содержит неточную информацию; Oumi использовала собственную AI-модель HallOumi для оценки другой AI, что могло внести дополнительную погрешность; содержание теста не отражает реальное поведение пользователей при поиске.

Внутреннее тестирование Google также показало, что при самостоятельной работе Gemini 3 вне框架 поиска Google доля ложных выводов достигает 28%. Но Google подчеркивает, что AI Overviews, используя систему поискового ранжирования, повышает точность и работает лучше, чем модель сама по себе.

Однако, как указывает PCMag, возникает логический парадокс: если ваш довод в защиту — «отчёт, указывающий на неточность нашего AI, сам использует возможно неточный AI», то это вряд ли усилит доверие пользователей к точности вашего продукта.

Связанные с этим вопросы

QКакова точность функции AI Overviews в Google Поиске по данным тестирования?

AСогласно тестированию, проведенному компанией Oumi, точность AI Overviews составляет около 91% при использовании Gemini 3.

QСколько неточных ответов в час генерирует функция AI Overviews из-за масштабов Google?

AПри годовом объеме в 5 триллионов поисковых запросов и 9% уровне ошибок, AI Overviews генерирует более 57 миллионов неточных ответов в час.

QВ чем заключается проблема «необоснованных ссылок» в ответах AI Overviews?

AПроблема «необоснованных ссылок» означает, что ссылки, прилагаемые к ответам ИИ, не подтверждают предоставленную информацию. Эта проблема возросла с 37% до 56% после обновления до Gemini 3.

QКакие платформы часто цитируются в неточных ответах AI Overviews?

AFacebook и Reddit являются вторым и четвертым по частоте источниками цитирования. В неточных ответах Facebook цитируется в 7% случаев.

QКак Google ответил на критику точности AI Overviews?

AGoogle оспорил методы тестирования, заявив, что исследование имеет «серьезные недостатки», включая использование спорного бенчмарка SimpleQA и модели HallOumi от Oumi для оценки, что могло внести дополнительные ошибки.

Похожее

Конкуренты Биткоина не выдержали испытания: последний отчет раскрывает правду об альткоинах! «Лишь немногие альткоины оказались победителями!»

Ведущая криптовалюта Bitcoin в 2025 году установила новые рекорды, в то время как многие альткоины, включая Ethereum, показали более слабый рост. Согласно всеобъемлющему отчету Blockworks Research, лишь 1.7% альткоинов с капитализацией от $50 млн и 24-месячной историей в период с начала 2020 по июнь 2026 года смогли превзойти Bitcoin по доходности. Во время бычьего рынка 2020-2021 годов примерно треть альткоинов обогнала Bitcoin, однако успех 86% из них оказался временным — они потеряли более 90% стоимости после пика. Из 187 альткоинов, превзошедших Bitcoin в 2021 году, только $OKB сохранил это преимущество впоследствии. В целом, за период с 2020 по 2026 год лишь 22 альткоина (включая BNB, $OKB, Ethereum, Solana и Tron) показали лучшую доходность, чем Bitcoin. Исследование подчеркивает, что в долгосрочной перспективе Bitcoin превосходит подавляющее большинство альткоинов.

cryptonews.ru20 мин. назад

Конкуренты Биткоина не выдержали испытания: последний отчет раскрывает правду об альткоинах! «Лишь немногие альткоины оказались победителями!»

cryptonews.ru20 мин. назад

ОАЭ расширяют цифровые платежи: Dubai Duty Free интегрирует Crypto.com Pay

Дубайская Duty Free внедрила платежную систему Crypto.com Pay во всех своих магазинах в аэропортах и онлайн, что позволяет клиентам оплачивать покупки с помощью криптовалют. Доступно 30 цифровых валют, включая основные монеты и мем-токены, такие как Shiba Inu (SHIB). Платежи осуществляются через приложение Crypto.com с мгновенной конвертацией в дирхамы ОАЭ, что защищает от волатильности и обеспечивает мгновенные расчеты. Этот шаг соответствует стратегии Дубая по лидерству в области блокчейн-технологий и безналичных транзакций. Внедрение стало возможным после подписания меморандума о взаимопонимании в июле 2025 года и осуществляется в соответствии с регулированием Центрального банка ОАЭ. Crypto.com стал первым поставщиком услуг виртуальных активов в стране, получившим лицензию SVF. Платежное решение Crypto.com Pay теперь работает наравне с Apple Pay, Alipay и другими методами, способствуя достижению цели Дубая по доведению доли безналичных транзакций до 90% к концу 2026 года.

TheNewsCrypto25 мин. назад

ОАЭ расширяют цифровые платежи: Dubai Duty Free интегрирует Crypto.com Pay

TheNewsCrypto25 мин. назад

Кошелек Zeus приостановил работу после кибератаки, сообщает, что средства клиентов не пострадали

Кошелек Zeus Wallet, самокастодиальный кошелек для сети Bitcoin Lightning Network, отключил свою инфраструктуру после кибератаки в среду. Компания проводит аудит систем перед восстановлением сервисов. По заявлению основателя Zeus Эвана Калудиса, средства клиентов не пострадали, и нет доказательств воздействия на программное обеспечение нод Lightning. Атака была локализована в инфраструктуре Zeus и устранена в течение нескольких часов. Клиентам, чьи каналы Lightning Service Provider (LSP) закрылись во время инцидента, будут предоставлены новые каналы после возобновления работы. Характер атаки и сроки восстановления операций не раскрываются. Компания отметила, что этот случай усиливает её focus на разработке trusted execution environments (изолированных сред исполнения) и проекта Validating Lightning Signer (VLS) для укрепления инфраструктуры. Данный инцидент произошел после отключения Zeus функции обменов (swaps) в понедельник из-за решения сервиса Boltz приостановить работу.

cointelegraph40 мин. назад

Кошелек Zeus приостановил работу после кибератаки, сообщает, что средства клиентов не пострадали

cointelegraph40 мин. назад

Бытовая компания на фондовом рынке надеется на AI и полупроводники, чтобы перевернуть ситуацию

Еще одна публично-листинговая компания из сферы домашней обстановки резко подняла стоимость своих акций, выйдя на рынок полупроводников. С 21 июля по 6 августа акции PVC-производителя напольных покрытий Aili Home Furnishings выросли на 159.31%, достигнув 10 последовательных лимитов роста после объявления о планах приобрести контрольный пакет акций O'Connor, производителя тестового оборудования для накопителей. Эта сделка с перекрестным владением акциями и обязательствами по прибыли вызвала ажиотаж на рынке, несмотря на то, что основная деятельность Aili Home Furnishings слаба: в первом квартале 2026 года компания понесла убытки, а в первом полугодии прогнозируется чистый убыток до 40,5 млн юаней. Это не единичный случай. В 2025 году более 20 компаний с фондового рынка Китая объявили о выходе на рынок полупроводников, причем наибольшую долю среди них составляют предприятия из сектора домашней обстановки и строительных материалов. Такие компании, как ранее убыточный Meike Home Furnishings, "король пледов" Zhen'ai Meijia, производитель потолочных систем Fashilong и лидер в отделке Jin Tailang, испытали резкий рост стоимости акций после объявлений о слияниях и поглощениях или создании дочерних компаний в сферах ИИ, полупроводников или вычислительных мощностей. Эта тенденция к "кроссовер-выживанию" обусловлена стагнацией в основных отраслях из-за спада на рынке недвижимости, сокращения зарубежного спроса и тарифных барьеров. Вместо конкуренции на перенасыщенных рынках компании стремятся использовать трендовые концепции для роста стоимости акций. Однако, как показывает пример Jin Tailang, после того как ажиотаж утихает, цены на акции часто возвращаются к фундаментальным показателям. Окончательный успех приобретения Aili Home Furnishings также остается под вопросом, поскольку официальное соглашение еще не подписано. За шумихой на рынке стоит отчаянная борьба традиционных производителей за выживание, в то время как инвесторы должны сохранять осторожность в отношении спекулятивных пузырей.

marsbit49 мин. назад

Бытовая компания на фондовом рынке надеется на AI и полупроводники, чтобы перевернуть ситуацию

marsbit49 мин. назад

Сделка «Продаем Америку» возвращается: глобальный капитал переоценивает политические риски в Вашингтоне, доллар и казначейские облигации США в первых рядах

Возобновляется стратегия «продажи США»: глобальный капитал переоценивает политические риски Вашингтона, доллар и казначейские облигации оказываются под ударом. Сигналы из Вашингтона, включая смену стиля коммуникации главы ФРС, вмешательство Минфина США на валютный рынок для поддержки иены, расширение бюджетного дефицита и угрозы торговой войны, подрывают уверенность в американских активах. Доходность 30-летних казначейских облигаций превысила 5%, достигнув максимума с 2007 года, в то время как индекс доллара Bloomberg снизился примерно на 2% с июня. Инвесторы начинают учитывать политические риски, связанные с администрацией Трампа («премию Трампа»), в ценах на доллар и облигации. Хотя иностранные владения казначейскими облигациями выросли, а рынок акций обновляет рекорды, часть глобальных инвесторов на рынках облигаций и валют меняет позиции. Ключевые опасения: сможет ли ФРС под руководством Уорша эффективно контролировать инфляционные ожидания, и не отстанет ли она в цикле повышения ставок, что создаст дополнительное давление на длинный конец кривой доходности. Премия за срок по 30-летним облигациям достигла максимума с 2013 года. Вмешательство США в поддержку иены вызывает споры о структурных перспективах доллара. Хотя статус доллара как резервной валюты пока не оспаривается, эксперты отмечают, что приток иностранного капитала в казначейские облигации уже не поспевает за ростом госдолга США, что в перспективе может способствовать ослаблению доллара.

marsbit50 мин. назад

Сделка «Продаем Америку» возвращается: глобальный капитал переоценивает политические риски в Вашингтоне, доллар и казначейские облигации США в первых рядах

marsbit50 мин. назад

Торговля

Спот
活动图片