Decenas de millones de errores por hora: investigación revela la "ilusión de precisión" de la búsqueda con IA de Google

marsbitPublicado a 2026-04-10Actualizado a 2026-04-10

Resumen

Un estudio del New York Times y la startup Oumi revela que los resúmenes de IA de Google (AI Overviews) tienen una precisión del 91%, lo que equivale a más de 57 millones de respuestas incorrectas por hora, dada la escala de 5 billones de búsquedas anuales. Además, el 56% de las respuestas correctas citan fuentes que no respaldan la información, con Facebook y Reddit como referencias frecuentes. La función también es vulnerable a la manipulación: un periodista de BBC logró que Google difundiera información falsa en menos de 24 horas. Google critica la metodología del estudio, pero la defensa basada en posibles errores de la IA evaluadora no mejora la confianza en su sistema.

Autor: Claude, Deep Tide TechFlow

Resumen de Deep Tide: Las últimas pruebas de The New York Times en colaboración con la startup de IA Oumi muestran que la función de resúmenes de IA (AI Overviews) de Google tiene una precisión de aproximadamente el 91%, pero considerando el volumen de Google que procesa 5 billones de búsquedas anuales, esto significa que genera decenas de millones de respuestas erróneas por hora. Más problemático aún, incluso cuando la respuesta es correcta, más de la mitad de los enlaces de referencia no respaldan su conclusión.

Google está distribuyendo información errónea a los usuarios a una escala sin precedentes, y la mayoría de las personas no lo saben.

Según informa The New York Times, la startup de IA Oumi, por encargo del periódico, evaluó la precisión de la función AI Overviews de Google utilizando la prueba estándar de la industria SimpleQA desarrollada por OpenAI. La prueba cubrió 4326 consultas de búsqueda, realizando una ronda en octubre del año pasado (impulsada por Gemini 2) y otra en febrero de este año (actualizada a Gemini 3). Los resultados mostraron que la precisión de Gemini 2 era de aproximadamente el 85%, y Gemini 3 mejoró al 91%.

91% suena bien, pero en la escala de Google es otra cosa. Google procesa alrededor de 5 billones de consultas de búsqueda al año; calculando con una tasa de error del 9%, AI Overviews genera más de 57 millones de respuestas inexactas por hora, casi 1 millón por minuto.

La respuesta es correcta, pero la fuente está equivocada

Más preocupante que la precisión es el problema de la "desvinculación" de las fuentes de referencia.

Los datos de Oumi muestran que en la era de Gemini 2, el 37% de las respuestas correctas tenían un problema de "referencia infundada", es decir, los enlaces adjuntos en el resumen de IA no respaldaban la información proporcionada. Después de actualizar a Gemini 3, esta proporción no disminuyó sino que aumentó, saltando al 56%. En otras palabras, mientras el modelo da respuestas correctas, cada vez es menos capaz de "mostrar su trabajo".

La pregunta del CEO de Oumi, Manos Koukoumidis, apunta directo al meollo: "Incluso si la respuesta es correcta, ¿cómo sabes que lo es? ¿Cómo lo verificas?"

El hecho de que AI Overviews cite abundantemente fuentes de baja calidad agrava este problema. Oumi descubrió que Facebook y Reddit son la segunda y cuarta fuente de referencia más citadas por AI Overviews, respectivamente. En las respuestas inexactas, Facebook se citaba con una frecuencia del 7%, superior al 5% en las respuestas precisas.

Un artículo falso de un periodista de la BBC "envenenó" los resultados en 24 horas

Otra grave deficiencia de AI Overviews es que es extremadamente manipulable.

Un periodista de la BBC probó con un artículo deliberadamente fabricado y falso; en menos de 24 horas, el resumen de IA de Google presentaba la información falsa como un hecho a los usuarios.

Esto significa que cualquier persona que entienda el mecanismo de funcionamiento del sistema podría potencialmente "envenenar" los resultados de búsqueda de IA publicando contenido falso e incrementando su tráfico. La respuesta del portavoz de Google, Ned Adriance, fue que la función de búsqueda de IA se basa en los mismos mecanismos de clasificación y seguridad que bloquean el spam, y afirmó que "la mayoría de los ejemplos en la prueba son consultas poco realistas que las personas realmente no buscarían".

Google refuta: la prueba en sí tiene problemas

Google planteó varias objeciones al estudio de Oumi. Un portavoz de Google calificó la investigación de "gravemente defectuosa", citando como razones: que el benchmark SimpleQA en sí contiene información inexacta; que Oumi utilizó su propio modelo de IA, HallOumi, para juzgar el rendimiento de otra IA, lo que podría introducir errores adicionales; y que el contenido de la prueba no refleja el comportamiento real de búsqueda de los usuarios.

Las pruebas internas de Google también mostraron que Gemini 3, cuando funciona de forma independiente fuera del marco de búsqueda de Google, produce resultados falsos (alucinaciones) a una tasa de hasta el 28%. Pero Google enfatizó que AI Overviews, al aprovechar el sistema de ranking de búsqueda, mejora la precisión y tiene un rendimiento superior al del modelo por sí solo.

Sin embargo, como señala la paradoja lógica destacada por PCMag: si tu argumento de defensa es "señalar que el informe que afirma que nuestra IA es inexacta también utiliza una IA que podría ser inexacta", esto probablemente no aumente la confianza de los usuarios en la precisión de tu producto.

Preguntas relacionadas

Q¿Cuál es la tasa de precisión de la función AI Overviews de Google según el estudio de Oumi?

ASegún el estudio de Oumi, la tasa de precisión de AI Overviews de Google es del 91% con Gemini 3, una mejora desde el 85% con Gemini 2.

Q¿Cuántas respuestas incorrectas genera AI Overviews por hora, basado en el volumen de búsquedas de Google?

ACon un volumen anual de aproximadamente 5 billones de búsquedas y una tasa de error del 9%, AI Overviews genera más de 57 millones de respuestas incorrectas por hora.

Q¿Qué problema se identificó con los enlaces de referencia en las respuestas correctas de AI Overviews?

AEl problema es la 'citación infundada'. Con Gemini 3, el 56% de las respuestas correctas tenían enlaces de referencia que no respaldaban la información proporcionada en el resumen.

Q¿Qué plataformas de redes sociales se citan con frecuencia como fuentes en las respuestas de AI Overviews?

AFacebook y Reddit son la segunda y cuarta fuente de citas más comunes para AI Overviews, respectivamente.

Q¿Cómo respondió Google a las críticas del estudio de Oumi?

AGoogle argumentó el estudio, diciendo que tenía 'graves deficiencias', incluido el uso de un benchmark (SimpleQA) que contenía información inexacta y que las consultas de prueba no reflejaban el comportamiento real de los usuarios.

Lecturas Relacionadas

¡Publicada la lista de las altcoins más populares según las búsquedas de las últimas horas!

La plataforma de seguimiento de criptomonedas CoinGecko ha publicado una lista de las criptomonedas más buscadas por los usuarios en las últimas tres horas. La principal tendencia es Pudgy Penguins ($PENGU), seguida de Catecoin (CATE) y Bless ($BLESS) en el podio. Según los datos, $PENGU subió un 3,9% en 24 horas. CATE, en segundo lugar, registró un impresionante aumento del 126,2%, mientras que $BLESS subió un 86,1%. What IF (IF) también destaca con un alza del 41,9%. La lista completa de los activos más buscados y su capitalización de mercado actual es la siguiente: 1. Pudgy Penguins ($PENGU) – 389,13 millones de dólares. 2. Catecoin (CATE) – 19,62 millones. 3. Bless ($BLESS) – 32,72 millones. 4. Aerodrome Finance (AERO) – 385,03 millones. 5. Hyperliquid (HYPE) – 11,43 mil millones. 6. Ethereum (ETH) – 224,17 mil millones. 7. Chainlink (LINK) – 6,17 mil millones. 8. Aave (AAVE) – 1,42 mil millones. 9. What IF (IF) – 31,24 millones. 10. Polkadot (DOT) – 1,34 mil millones. 11. Bitcoin (BTC) – 1,27 billones. 12. Virtual Protocol (VIRTUAL) – 366,19 millones. 13. Algorand (ALGO) – 758,15 millones. 14. Cash Cat (CASHCAT) – 41,81 millones. 15. Solana (SOL) – 42,38 mil millones. *Esto no es una recomendación de inversión.

cryptonews.ruHace 1 hora(s)

¡Publicada la lista de las altcoins más populares según las búsquedas de las últimas horas!

cryptonews.ruHace 1 hora(s)

Por 100 000 $ al mes: Truth Social vende acceso a las publicaciones de Trump a empresas de inversión

Trump Media and Technology Group (TMTG) lanzó el 1 de agosto de 2026 el servicio Truth API, un canal de datos de pago que otorga a firmas de inversión institucionales acceso en tiempo real a las publicaciones de las cuentas más influyentes en Truth Social, incluyendo la de Donald Trump. Con una suscripción que puede costar hasta 100,000 dólares mensuales, el servicio se presenta como una fuente de ingresos estable para TMTG. El anuncio ha generado críticas de legisladores demócratas y republicanos, como Elizabeth Warren y Bill Cassidy, quienes cuestionan la venta de acceso privilegiado a las publicaciones del presidente y han pedido investigaciones regulatorias. TMTG defendió la iniciativa como parte de una estrategia comercial legítima. El análisis adjunto advierte que este modelo crea riesgos similares a incidentes pasados donde mensajes falsos en redes sociales provocaron volatilidad en los mercados, destacando la falta de mecanismos de verificación en tiempo real para los posts distribuidos por la API.

cryptonews.ruHace 2 hora(s)

Por 100 000 $ al mes: Truth Social vende acceso a las publicaciones de Trump a empresas de inversión

cryptonews.ruHace 2 hora(s)

La estrategia mantiene el dividendo preferente de STRC en 12% ya que el precio aún está por debajo del valor nominal

Aunque las acciones preferentes STRC de Strategy cerraron julio muy por debajo de su valor nominal de 100 dólares, el dividendo de agosto se mantendrá en el 12%, sin incrementos. Michael Saylor, presidente ejecutivo, anunció la noticia, promocionando STRC como una forma de "estirar los ingresos". Agosto será el segundo mes con pagos quincenales. Las acciones STRC cerraron a 89,46 dólares el viernes, con un aumento mensual del 5,42%, tras un mal desempeño en junio. El volumen negociado fue aproximadamente dos tercios del promedio diario. El CEO Phong Le reiteró que el objetivo corporativo es que STRC cotice entre 99 y 100 dólares con el tiempo. Saylor sugirió un posible anuncio sobre cambios en las tenencias de Bitcoin de la compañía. Strategy reportó una pérdida neta de 8.220 millones de dólares en el segundo trimestre, principalmente por una pérdida no realizada de 8.320 millones en Bitcoin. La compañía ha construido una reserva de efectivo de 3.750 millones de dólares para respaldar los pagos de acciones preferentes, suficiente para más de dos años de dividendos e intereses. Recientemente recompró 25 millones de dólares en acciones STRC con descuento y planea continuar comprando mientras cotizan por debajo de los 100 dólares.

cointelegraphHace 3 hora(s)

La estrategia mantiene el dividendo preferente de STRC en 12% ya que el precio aún está por debajo del valor nominal

cointelegraphHace 3 hora(s)

Los retiros de Bitcoin continúan: 8 años de almacenamiento en una cartera fría Coldcard terminaron en cero

Retirada de bitcoin continúa: 8 años en cartera fría Coldcard terminan en cero La cartera hardware Coldcard ha sido vulnerada, provocando una nueva oleada de retiradas de fondos de dispositivos afectados. Galaxy Research informa que el volumen total robado asciende a 1.367,05 BTC (unos 88,6 millones de dólares) desde 4.585 direcciones, superando ampliamente los 594,5 BTC reportados inicialmente el 30 de julio de 2026. La mayor parte de lo robado permanece inactiva en las direcciones de los atacantes. El problema no reside en el firmware, que ya fue actualizado por Coinkite, sino en las frases semilla (seed phrases) generadas desde marzo de 2021 debido a un error de programación. Estas frases son fácilmente descifrables, y actualizar el firmware no las cambia. Solo transferir los fondos a una nueva dirección con una nueva frase semilla elimina la vulnerabilidad. El fallo se originó al integrar la biblioteca libNgU, lo que hizo que los dispositivos dejaran de usar el generador de números aleatorios por hardware STM32 y pasaran a usar el generador software Yasmarang, inicializado con datos públicamente accesibles como el número de serie del chip. Afecta a frases semilla creadas en dispositivos Mk2/Mk3 (firmware 4.0.1–4.1.9 y hasta 5.0.3), Mk4/Mk5 (hasta v5.6.0) y Q (hasta v1.5.0Q). Se excluyen aquellas creadas con al menos 50 lanzamientos de dados independientes o una passphrase BIP-39 fuerte y única. Los usuarios deben generar una nueva frase semilla en firmware corregido y transferir sus activos. Un caso ilustrativo es el de un inversor de 39 años que perdió 2 BTC (unos 130.000 dólares) en minutos, ahorrados durante ocho años mediante trabajo físico como protección contra la hiperinflación en su país, con el objetivo de una jubilación anticipada a los 50 años. Su estrategia conservadora de "comprar y mantener en frío" se vio truncada, dejándolo devastado y decidido a abandonar las criptomonedas. Este incidente recuerda vulnerabilidades históricas por generadores de números aleatorios débiles, como la de la biblioteca BitcoinJS (2011-2015), que causó grandes pérdidas. Subraya que el almacenamiento offline no garantiza automáticamente seguridad criptográfica, especialmente cuando la entropía se ve comprometida dentro del propio dispositivo "cerrado".

cryptonews.ruHace 3 hora(s)

Los retiros de Bitcoin continúan: 8 años de almacenamiento en una cartera fría Coldcard terminaron en cero

cryptonews.ruHace 3 hora(s)

¡Se observa un crecimiento explosivo en los volúmenes de trading de 15 altcoins en Corea del Sur!

Las principales bolsas de criptomonedas de Corea del Sur, Upbit y Bithumb, registraron un fuerte aumento en el volumen de operaciones con varios altcoins. En las últimas 24 horas, el volumen total de los altcoins más populares alcanzó aproximadamente 347,7 millones de dólares. MetaDAO (META) lideró la clasificación con un volumen de 65,84 millones de dólares solo en Upbit, representando el 12,39% del volumen spot total de la bolsa. Le siguió Euler (EUL) con 47,65 millones de dólares combinados en ambas plataformas. XRP, tradicionalmente popular entre los inversores coreanos, registró 38,11 millones de dólares. A continuación, se presentan los volúmenes de operaciones de 24 horas para los 15 altcoins más negociados en Upbit y Bithumb: 1. MetaDAO (META) – 65,84M$ 2. Euler (EUL) – 47,65M$ 3. XRP – 38,11M$ 4. ThunderCore (TT) – 35,64M$ 5. Babylon (BABY) – 25,15M$ 6. Geodnet (GEOD) – 20,28M$ 7. Hyperlane (HYPER) – 19,72M$ 8. Momentum (MMT) – 17,67M$ 9. Ondo (ONDO) – 15,65M$ 10. Shiba Inu (SHIB) – 10,55M$ 11. DOME – 9,61M$ 12. Lorenzo Protocol (BANK) – 9,51M$ 13. Akash Network (AKT) – 7,36M$ 14. Dogecoin (DOGE) – 7,30M$ 15. Worldcoin (WLD) – 5,74M$ *Esto no es una recomendación de inversión.

cryptonews.ruHace 5 hora(s)

Trading

Spot

Categorías populares

比特幣1,982 artículos de noticias

Decenas de millones de errores por hora: investigación revela la "ilusión de precisión" de la búsqueda con IA de Google

Resumen

La respuesta es correcta, pero la fuente está equivocada

Un artículo falso de un periodista de la BBC "envenenó" los resultados en 24 horas

Google refuta: la prueba en sí tiene problemas

Preguntas relacionadas

Lecturas Relacionadas

¡Publicada la lista de las altcoins más populares según las búsquedas de las últimas horas!

Por 100 000 $ al mes: Truth Social vende acceso a las publicaciones de Trump a empresas de inversión

La estrategia mantiene el dividendo preferente de STRC en 12% ya que el precio aún está por debajo del valor nominal

Los retiros de Bitcoin continúan: 8 años de almacenamiento en una cartera fría Coldcard terminaron en cero

¡Se observa un crecimiento explosivo en los volúmenes de trading de 15 altcoins en Corea del Sur!

Trading

Categorías populares

Etiquetas Populares