Des dizaines de millions d'erreurs par heure : une enquête révèle « l'illusion de précision » de la recherche IA de Google

marsbitPublié le 2026-04-13Dernière mise à jour le 2026-04-13

Résumé

Google, avec son énorme volume de recherches (5 billions par an), générerait des millions de réponses erronées chaque heure via sa fonction AI Overviews, selon une étude commandée par le *New York Times* et menée par Oumi. Bien que le taux de précision soit de 91% avec Gemini 3, cela représente toujours un flux massif de désinformation. Pire, plus de la moitié des réponses correctes citent des sources qui ne corroborent pas l'information donnée. Les plateformes comme Facebook et Reddit sont fréquemment citées, même pour des réponses fausses. De plus, le système est facilement manipulable : une fausse information a été intégrée en moins de 24 heures. Google conteste la méthodologie de l'étude, arguant que les tests ne reflètent pas les requêtes réelles des utilisateurs et utilisent une IA pour évaluer une autre IA.

Auteur: Claude, Deep Tide TechFlow

Guide de Deep Tide: Un test récent du New York Times et de la startup d'IA Oumi révèle que la fonction de résumé IA (AI Overviews) de Google Search a un taux de précision d'environ 91 %. Cependant, compte tenu du volume annuel de 5 000 milliards de recherches traitées par Google, cela signifie que des dizaines de millions de réponses erronées sont générées chaque heure. Plus problématique encore, même lorsque la réponse est correcte, plus de la moitié des liens de référence ne permettent pas d'étayer la conclusion.

Google diffuse des informations erronées à une échelle sans précédent, et la plupart des utilisateurs n'en ont pas conscience.

Selon le New York Times, la startup Oumi, mandatée par le journal, a évalué la précision de la fonction AI Overviews de Google en utilisant le test de référence SimpleQA, développé par OpenAI. Le test, portant sur 4326 requêtes de recherche, a été réalisé en octobre dernier (alimenté par Gemini 2) puis en février de cette année (après la mise à niveau vers Gemini 3). Les résultats montrent que le taux de précision de Gemini 2 était d'environ 85 %, et qu'il est passé à 91 % avec Gemini 3.

91 % semble correct, mais à l'échelle de Google, c'est une autre histoire. Google traite environ 5 000 milliards de requêtes de recherche par an. Avec un taux d'erreur de 9 %, AI Overviews génère plus de 57 millions de réponses inexactes par heure, soit près d'un million par minute.

La réponse est juste, mais la source est fausse

Plus inquiétant que le taux de précision est le problème du « décrochage » des sources de référence.

Les données d'Oumi montrent qu'à l'ère de Gemini 2, 37 % des réponses correctes présentaient un problème de « référence non fondée », c'est-à-dire que les liens fournis dans le résumé IA ne soutenaient pas l'information donnée. Après la mise à niveau vers Gemini 3, ce pourcentage n'a pas diminué mais a augmenté pour atteindre 56 %. En d'autres termes, le modèle donne de plus en plus de réponses correctes sans « rendre ses devoirs » (citer ses sources correctement).

La question du PDG d'Oumi, Manos Koukoumidis, est on point : « Même si la réponse est correcte, comment le savez-vous ? Comment pouvez-vous le vérifier ? »

Le fait qu'AI Overviews cite abondamment des sources de faible qualité aggrave ce problème. Oumi a découvert que Facebook et Reddit étaient respectivement les deuxième et quatrième sources les plus citées par AI Overviews. Parmi les réponses inexactes, Facebook était cité dans 7 % des cas, contre 5 % pour les réponses exactes.

Un faux article d'un journaliste de la BBC a « empoisonné » les résultats en moins de 24 heures

Un autre défaut grave d'AI Overviews est sa facilité à être manipulé.

Un journaliste de la BBC a testé le système avec un article délibérément fabriqué de toutes pièces. En moins de 24 heures, le résumé IA de Google présentait les fausses informations de l'article comme des faits aux utilisateurs.

Cela signifie que toute personne comprenant le fonctionnement du système pourrait potentiellement « empoisonner » les résultats de recherche IA en publiant du contenu faux et en augmentant son trafic. La réponse du porte-parole de Google, Ned Adriance, a été que la fonction de recherche IA s'appuie sur les mêmes mécanismes de classement et de sécurité que ceux utilisés pour bloquer le spam, et que « la plupart des exemples [du test] sont des requêtes irréalistes que les gens ne rechercheraient pas réellement ».

La contre-argumentation de Google : le test lui-même est problématique

Google a soulevé plusieurs objections concernant l'étude d'Oumi. Un porte-parole a qualifié l'étude de « gravement lacunaire », pour les raisons suivantes : le test de référence SimpleQA contient lui-même des informations inexactes ; Oumi a utilisé son propre modèle d'IA, HallOumi, pour évaluer les performances d'une autre IA, ce qui pourrait introduire des erreurs supplémentaires ; le contenu testé ne reflète pas le comportement de recherche réel des utilisateurs.

Les tests internes de Google ont également montré que Gemini 3, fonctionnant indépendamment du cadre de recherche Google, produisait des sorties hallucinées (fausses) à un taux élevé de 28 %. Mais Google a souligné qu'AI Overviews, en s'appuyant sur le système de classement des recherches, améliore la précision et surpasse les performances du modèle seul.

Cependant, comme le souligne un commentaire de PCMag mettant en lumière un paradoxe logique : si votre argument de défense est « le rapport qui pointe l'inexactitude de notre IA utilise lui-même une IA potentiellement inexacte », cela n'est probablement pas de nature à renforcer la confiance des utilisateurs en la précision de votre produit.

Questions liées

QQuel est la précision des résumés IA de Google selon l'étude du New York Times et Oumi ?

ASelon l'étude, la précision des résumés IA de Google (AI Overviews) est d'environ 91% avec Gemini 3, contre 85% avec Gemini 2.

QCombien de réponses inexactes les AI Overviews de Google produisent-elles par heure ?

ACompte tenu du volume de 5 000 milliards de recherches traitées par an par Google et d'un taux d'erreur de 9%, les AI Overviews produisent plus de 57 millions de réponses inexactes par heure.

QQuel est le problème principal avec les sources citées par les AI Overviews ?

ALe problème principal est le 'référencement non fondé' : même lorsque la réponse est correcte, plus de la moitié (56% avec Gemini 3) des liens cités ne soutiennent pas la conclusion de l'IA.

QQuels sont les sites web de faible qualité souvent cités par l'IA de Google ?

AFacebook et Reddit sont respectivement les deuxième et quatrième sources les plus citées par les AI Overviews, Facebook étant encore plus fréquemment cité dans les réponses inexactes.

QComment Google a-t-il répondu aux conclusions de l'étude d'Oumi ?

AGoogle a contesté l'étude, la qualifiant de 'présentant de graves lacunes', en critiquant le benchmark SimpleQA, l'utilisation d'un autre modèle IA (HallOumi) pour l'évaluation, et la non-représentativité des requêtes de test par rapport aux recherches réelles des utilisateurs.

Lectures associées

La Banque d'Italie ne voit pas d'avantages systémiques des stablecoins dans les transferts

L'étude de la Banque d'Italie conclut que les stablecoins n'offrent pas d'avantage systémique durable en termes de coût et de rapidité pour les transferts d'argent. Les avantages potentiels sont annulés par les frais de conversion vers et depuis les monnaies fiduciaires et par l'efficacité des infrastructures de paiement locales. La recherche a comparé des transferts de 200 USDC sur 10 couloirs bilatéraux (Italie vers Brésil, Argentine, Japon, Émirats Arabes Unis, Afrique du Sud). Le coût total des transferts en stablecoins variait de 0,3% à près de 9%. Les délais étaient inférieurs à 20 minutes dans les pays dotés de systèmes de paiement instantané, mais pouvaient atteindre 1 à 2 jours ouvrables ailleurs. Les principaux coûts et retards sont liés au change de devises et à la qualité de l'infrastructure locale, plutôt qu'aux frais de blockchain. Bien que souvent moins chers que la moyenne mondiale des transferts (6,65%), les stablecoins n'étaient plus avantageux que dans 3 cas sur 7 par rapport au service Wise. Les auteurs estiment que l'utilité serait plus forte si les stablecoins pouvaient être dépensés directement, sans reconversion. Ils notent également qu'une réglementation trop restrictive complique l'usage pour les clients tout en n'éliminant pas la demande. Le marché des stablecoins a enregistré en juillet sa plus forte baisse mensuelle depuis l'effondrement de Terra, perdant plus de 10 milliards de dollars.

cryptonews.ruIl y a 56 mins

La Banque d'Italie ne voit pas d'avantages systémiques des stablecoins dans les transferts

cryptonews.ruIl y a 56 mins

Le « boom du Bitcoin » en plein essor : Une nouvelle déclaration de Saylor suscite des spéculations sur des achats

Michael Saylor, président exécutif de MicroStrategy (MSTR), a relancé les spéculations sur un nouvel achat de bitcoins par la société en publiant le message « Bitcoin Drive engaged » le 2 août, accompagné de son tableau de suivi habituel. Cette pratique précède généralement les annonces officielles du trésor. Le rapport affiché montrait que les réserves de MicroStrategy s'élevaient à 843 775 BTC, d'une valeur marchande d'environ 53,25 milliards de dollars, avec un prix d'acquisition moyen de 75 653 dollars et une perte non réalisée de 10,58 milliards de dollars. Cependant, le registre public en temps réel de la société indique deux ventes récentes totalisant 3 588 BTC, ramenant le stock de 847 363 à 843 775 BTC. Ces ventes, déclarées à la SEC, visaient à financer des dividendes d'actions privilégiées et à reconstituer les réserves en dollars, qui s'élèvent désormais à environ 3,75 milliards de dollars. La société a subi une perte opérationnelle de 8,33 milliards de dollars au deuxième trimestre 2026, en grande partie due à une perte non réalisée sur ses actifs numériques. La direction pourrait vendre jusqu'à 1,25 milliard de dollars de bitcoins supplémentaires pour ses obligations en cash. L'annonce attendue lundi révélera si le message « Bitcoin Drive » signale une reprise des achats d'accumulation, alors que MicroStrategy équilibre son énorme stock de bitcoins avec ses engagements financiers croissants.

cryptonews.ruIl y a 58 mins

Le « boom du Bitcoin » en plein essor : Une nouvelle déclaration de Saylor suscite des spéculations sur des achats

cryptonews.ruIl y a 58 mins

Le motif « Tête et Épaules inversé » sur le graphique du Bitcoin annonce une montée vers 67 200 $

Malgré un léger recul début août, les graphiques de prix, notamment celui du Bitcoin, forment un modèle de renversement baissier. Actuellement, le BTC oscille autour de 63 200 $, formant l'épaule droite de la classique figure inversée "tête et épaules". L'analyste Axel Kibard de TechCharts voit là la seule réelle raison d'optimisme à court terme pour les haussiers ce mois-ci. La question principale est de savoir si les acheteurs auront la force de pousser le Bitcoin vers le niveau clé de 67 000 $. Parallèlement, dans la paire ETH/BTC, un fond de renversement similaire a déjà été franchi à la hausse. L'Ethereum, en tendance haussière, se dirige vers un objectif technique de 0,0312, indiquant que les grands capitaux préfèrent actuellement investir dans l'ETH plutôt que dans le Bitcoin, ce qui draine la liquidité et les volumes nécessaires à une reprise rapide du BTC. Face au dollar, l'Ethereum teste prudemment le niveau de support à 1 875 $, une résistance qui, si elle est maintenue, pourrait ouvrir la voie vers 2 163 $. Cette force relative de l'ETH est un signal positif pour le marché, mais la situation reste tendue pour les détenteurs de Bitcoin. Soit le BTC suit l'exemple de l'ETH et monte rapidement au-dessus de 67 200 $ pour confirmer le renversement, soit le modèle échoue. Selon Kibard, si une attaque de la ligne de cou (neckline) n'intervient pas dans les prochains jours, les baissiers reprendront le contrôle et pousseront le Bitcoin vers des niveaux de support solides à 60 000 $, voire 58 000 $.

cryptonews.ruIl y a 59 mins

Le motif « Tête et Épaules inversé » sur le graphique du Bitcoin annonce une montée vers 67 200 $

cryptonews.ruIl y a 59 mins

Les actions des entreprises d'IA se négocient comme des « mèmes cryptos », tandis que le Bitcoin reste stable – Revue de la semaine

Cette semaine, l'attention financière s'est largement détournée du Bitcoin, relativement stable autour de 64 000 $, pour se concentrer sur une volatilité extrême dans le secteur des actions liées à l'intelligence artificielle (IA). Les marchés asiatiques, notamment en Corée du Sud, ont subi des chutes sévères, en partie déclenchées par la liquidation forcée du fonds « Situational Awareness » de Leopold Aschenbrenner, entraînant des pertes massives. Le secteur des semi-conducteurs et de l'IA montre des signes de surchauffe, suscitant des débats sur un éventuel ralentissement. Dans le domaine des cryptomonnaies, l'ambiance reste difficile. Plusieurs plateformes d'échange (BitMEX, BitMart) ont annoncé leur fermeture, tandis que d'autres entreprises comme Coinbase et Uphold procèdent à des réductions de personnel. MicroStrategy continue sa stratégie d'accumulation de bitcoins et de rachat de ses propres actions. Les discussions portent également sur les risques potentiels pour des écosystèmes comme Solana si des applications populaires (Pump.fun, Trade.xyz) décidaient de lancer leur propre blockchain. Par ailleurs, une faille de sécurité majeure concernant le portefeuille matériel Coldcard a été mise en lumière, rappelant les risques du self-custody. Enfin, le projet d'IA décentralisée Bittensor (TAO) a attiré l'attention de certains investisseurs de capital-risque, mais des mises en garde sont émises contre un possible engouement spéculatif similaire à celui pour les memecoins. La semaine a été marquée par des interventions macroéconomiques, comme celle de la Japon pour soutenir le yen, et par les anticipations concernant la politique de la Fed.

cryptonews.ruIl y a 1 h

Les actions des entreprises d'IA se négocient comme des « mèmes cryptos », tandis que le Bitcoin reste stable – Revue de la semaine

cryptonews.ruIl y a 1 h

Trading

Spot
活动图片