Google déclare officiellement la guerre

链捕手Publié le 2026-05-21Dernière mise à jour le 2026-05-21

Résumé

Lors du Google I/O 2026, Google a lancé une offensive agressive dans l'IA. Le géant a présenté trois nouveautés majeures : Gemini 3.5 Flash, un modèle rapide et performant surpassant son prédécesseur ; Gemini Omni Flash, un modèle vidéo multimodal à très faible latence pour l'interaction en temps réel ; et Spark, un assistant IA intégré au système Android 17 capable d'automatiser des tâches complexes. Google a également annoncé que Gemini a atteint 900 millions d'utilisateurs actifs mensuels, grâce à son intégration massive dans ses produits (Chrome, Android, Workspace). Pour accélérer l'adoption, l'entreprise a drastiquement baissé ses prix, rendant son API considérablement moins chère que celles de ses concurrents. Cette stratégie repose sur ses avantages : un écosystème fermé (TPU, logiciel, matériel comme ses nouvelles lunettes connectées légères) et un flux de données utilisateur massif pour améliorer ses modèles. L'objectif est clair : dominer la nouvelle ère de l'IA en contrôlant l'ensemble de la chaîne (infrastructure, modèles, terminaux) et en rendant les modèles de base accessibles, forçant ainsi les pure players de l'IA à revoir leur modèle économique et challengant même Apple sur le futur de l'interaction homme-machine.

La conférence Google I/O 2026 pour les développeurs n'a laissé qu'une seule impression : l'audace.

Non seulement ils ont intégré de force des agents intelligents basés sur l'IA dans tous les principaux points d'accès aux flux : recherche, navigateur, téléphone, lunettes intelligentes, mais ils ont aussi dévoilé coup sur coup trois cartes maîtresses : Gemini 3.5 Flash, le modèle vidéo Omni et le nouvel assistant Spark.

Après avoir montré ses muscles, Sundar Pichai a même annoncé de manière ostentatoire que les utilisateurs actifs mensuels de Gemini avaient atteint 9 milliards, tout en officialisant une réduction significative des prix.

Le message ne pouvait être plus clair : Je suis meilleur, et moins cher.

Qu'est-ce que c'est, sinon une déclaration de guerre ?

01

La révélation la plus impressionnante de la conférence était sans aucun doute Gemini 3.5 Flash.

Normalement, "Pro" représente la puissance de base, "Flash" signifie léger et rapide.

En termes de paramètres du modèle, 3.5 Flash est effectivement plus petit que 3.1 Pro, mais ses performances sont en réalité supérieures dans presque tous les tests de référence en raisonnement et en codage :

Sur le test GSM8K de raisonnement mathématique complexe, 3.5 Flash a obtenu un score de 95,8 %, surpassant les 93,2 % de 3.1 Pro ; dans le test de génération de code SWE-bench (version complète), le taux de résolution de 3.5 Flash était de 38,4 %, dépassant largement les 32,1 % de 3.1 Pro...

Pourquoi ?

Selon le Gemini 3.5 Technical Report publié par DeepMind, deux technologies clés sont les plus importantes.

Distillation de connaissances extrême : Google n'a pas simplement entraîné Flash en augmentant la puissance de calcul, mais a utilisé "Gemini 3.5 Ultra", jamais divulgué auparavant, comme modèle enseignant pour une distillation de dimension réduite vers Flash.

Selon l'analyse du tweet du scientifique en chef de DeepMind, Jeff Dean, la proportion de fine-tuning de 3.5 Flash sur des ensembles de données de chaînes de raisonnement de haute qualité a augmenté de 400 % par rapport à la génération précédente.

Cela signifie qu'il a hérité du "cerveau logique" des très grands modèles, et non d'une "base de connaissances" apprise par cœur.

Nouvelle architecture MoE (Modèle de Mélange d'Experts) : Dans 3.5 Flash, Google a adopté des réseaux d'experts à granularité plus fine.

Les MoE traditionnels peuvent n'avoir que 8 ou 16 experts, n'en activant que 1-2 à la fois, ce qui suffit pour supporter des modèles à l'échelle de milliers de milliards de paramètres.

Selon l'analyse du mémorandum d'investissement dans l'infrastructure IA 2026 de a16z, 3.5 Flash utilise 256 micro-experts, activant les 4 plus efficaces à chaque inférence.

C'est pourquoi, tout en maintenant un très faible nombre de paramètres activés, il peut couvrir un espace de caractéristiques multimodales extrêmement vaste.

Sur l'indicateur TTFT (Time to First Token), 3.5 Flash a atteint moins de 65 millisecondes.

Un clignement d'œil humain prend 100-150 millisecondes.

En termes simples, lorsqu'il fonctionne en tant qu'agent intelligent, du point de vue physiologique humain, il est impossible de percevoir une quelconque pause.

Pour les développeurs ayant besoin d'invoquer fréquemment des outils, de réflexion multi-tours et d'une latence extrêmement faible, c'est la base parfaite pour un super agent.

Ce n'est qu'en s'appuyant sur une optimisation technique aussi poussée qu'il est possible d'établir une domination dans le "déploiement côté terminal" dans un environnement hautement concurrentiel.

Premièrement, le modèle multimodale natif Gemini Omni Flash.

Omni signifie omniscient, en référence à l'ancien GPT-4o. Rien qu'au nom, on ressent l'intensité de la compétition.

Au moins en termes de performances, Gemini Omni Flash a beaucoup plus le droit d'utiliser le caractère "o" que GPT-4o.

Les premiers Sora ou Gemini 1.5 étaient essentiellement des assemblages hétéroclites, convertissant la parole en texte, puis le texte en vision.

Mais le Omni publié cette fois est un véritable alignement multimodal natif de bout en bout. Il peut non seulement comprendre de manière native la cohérence temporelle et les lois physiques dans une vidéo, mais sa latence est également passée de la moyenne du secteur de 400-600 millisecondes à 120 millisecondes.

Un exemple de la conférence : un utilisateur portant une caméra remplit un verre d'eau. Omni peut dire "Stop, stop, stop !" 0,5 seconde avant que le verre ne déborde.

Ce type d'inférence en temps réel sur l'état physique du monde réel semble simple, mais il est très significatif : L'IA passe d'un chatbot à l'écran à un outil d'assistance dans le monde réel.

Même s'il n'en est qu'à ses débuts.

Deuxièmement, l'assistant intelligent Spark.

Selon des informations divulguées dans une interview de The Verge avec le vice-président de l'ingénierie Android, Spark se voit attribuer un contrôle natif des API au niveau du système d'exploitation Android 17.

En termes simples, les processus complexes qui nécessitaient auparavant d'ouvrir de nombreuses applications peuvent désormais être entièrement gérés simplement en donnant un ordre à Spark. Il peut même envoyer des messages, organiser des e-mails, résumer des agendas, suivre des pages web, identifier des frais cachés sur les factures, traiter des documents par lots, etc., en fonction de votre ton et de vos préférences...

En d'autres termes, avec un assistant IA, nous n'aurons plus vraiment besoin d'applications. Toute opération complexe sera simplifiée en une seule commande.

Troisièmement, les lunettes intelligentes.

Pourquoi encore des lunettes ?

Du moins aux yeux de Google, l'accès transparent à la vue et à l'ouïe est l'hôte ultime des grands modèles multimodaux.

Ces lunettes n'ont aucun design tape-à-l'œil et se concentrent entièrement sur les capacités pratiques :

Des lentilles à guide d'ondes Micro-OLED couleur pesant seulement 4 grammes, avec un taux de transparence atteignant 85 % ;

Équipées d'une puce Gemini allégée développée en interne, avec une latence d'inférence locale ≤12 ms, permettant une traduction en temps réel, une reconnaissance d'images, une analyse de scène sans connexion internet ;

Intégration native avec l'agent intelligent Spark, synchronisant les données du téléphone et du cloud, offrant des services personnalisés comme des rappels d'agenda, des traductions en temps réel, des alertes environnementales.

En un mot, il s'agit de franchir l'écran du téléphone et intégrer l'agent intelligent dans la perspective de première personne de l'humain grâce aux lunettes.

Le contenu est tellement dense que Google semble avoir utilisé toutes ses cartes maîtresses d'un coup, annonçant au marché une vérité :

Sans point d'entrée, un algorithme n'est rien.

L'ère de l'augmentation des paramètres des grands modèles et des comparaisons de performances est révolue. Les fournisseurs de modèles purs n'ont plus de barrières. L'avenir est une guerre quadridimensionnelle "terminal + cloud + écosystème + matériel".

Intégrer l'IA dans la suite complète de services, c'est en fait remodeler toute la logique de distribution du trafic internet : passer de "l'utilisateur recherche/clique activement" à "l'agent intelligent IA distribue activement des services".

Pour la grande majorité des développeurs et des PME, c'est une excellente nouvelle, car la puissance de calcul et les modèles sous-jacents deviennent extrêmement bon marché, permettant de se concentrer sur l'innovation au niveau applicatif.

Mais les autres concurrents, eux, doivent probablement vouloir jurer à haute voix en ce moment.

02

Lorsque Sundar Pichai a annoncé avec désinvolture sur scène que "les utilisateurs actifs mensuels de Gemini ont officiellement dépassé les 9 milliards", cela a créé un certain émoi dans l'audience.

9 milliards, plus que la somme de tous les MAU des concurrents américains.

Comment est-ce possible ?

La réponse est simple et brutale : Intégration de force.

Google n'a pas besoin de dépenser en publicité pour attirer des utilisateurs comme le feraient des sociétés d'IA indépendantes. Il suffit d'ajouter une icône à côté de la barre d'adresse du navigateur Chrome, d'intégrer un raccourci d'appel dans la barre de navigation inférieure des 3 milliards de téléphones Android, de diffuser une mise à jour complète dans Google Workspace...

Le coût d'acquisition est essentiellement nul.

Plus crucial encore, dans les mois à venir, les regards que les 9 milliards d'utilisateurs actifs porteront sur les produits avec leurs lunettes intelligentes, les logiques qu'ils corrigeront en traitant des tâches avec Spark, et les interactions avec le modèle visuel Omni généreront d'énormes quantités de données de rétroaction de haute qualité, multimodales et du monde réel, qui deviendront toutes des nutriments pour nourrir Gemini 4.

C'est une barrière extrêmement solide : Plus le modèle est performant -> plus il y a d'utilisateurs -> plus il génère de données -> le modèle devient encore plus performant.

Pour renforcer rapidement cette boucle, Google déclare directement la guerre des prix à tous ses concurrents : le forfait AI Ultra passe de 249,99 $/mois à 99,9 $/mois.

3.5 Flash voit son prix pour 1 million de tokens en entrée baisser à 0,02 $, et pour 1 million de tokens en sortie à 0,08 $.

Quel prix miraculeux !

À titre de comparaison, le prix moyen des modèles de niveau équivalent dans le secteur est respectivement de 0,15-0,2 $ et 0,6-1 $.

Sundar Pichai a fait le calcul : les principaux clients traitent environ 1 billion de tokens par jour. En transférant 80 % de la charge de travail vers Gemini 3.5 Flash pendant un an, cela peut économiser plus de 10 milliards de dollars.

Pourquoi peut-il se permettre de vendre l'IA à un prix dérisoire ?

Le plus grand atout est : l'infrastructure de puissance de calcul intégrée verticalement.

Des géants comme OpenAI, Anthropic, bien qu'impressionnants, sont essentiellement des "locataires de puissance de calcul", devant l'acheter auprès de Microsoft, Amazon, qui eux-mêmes paient Nvidia.

Google possède ses propres TPU, et avec l'efficacité d'activation sparse extrême de MoE de 3.5 Flash, il a compressé les coûts de calcul à l'extrême.

Il peut parfaitement utiliser son avantage d'actifs lourds pour mener une guerre de prix à bas coût contre les simples entreprises d'algorithmes.

La logique est claire.

Les grands modèles de base se banalisent rapidement. Comme l'eau et l'électricité, avez-vous déjà vu une entreprise d'eau générer des profits faramineux ?

Google ne craint pas que le modèle de base en lui-même ne soit pas rentable, car il peut récupérer l'argent via la publicité sur les recherches, les services cloud et les commissions de l'écosystème Android.

Mais pour ceux dont la survie dépend de la vente d'API de grands modèles, comme OpenAI, Anthropic, Cohere, Mistral, c'est impossible.

Les investisseurs doivent probablement vouloir demander à Sam Altman : "Le prix de l'API de Google n'est qu'un dixième du vôtre, et ses performances sont meilleures. Expliquez-moi comment votre modèle économique peut être viable ?"

La structure concurrentielle de plusieurs secteurs entrera donc dans une phase d'évolution accélérée.

Les fournisseurs d'IA doivent rapidement trouver des sources de calcul moins chères ou se lancer dans la fabrication de puces.

Ensuite, Apple, qui travaille encore à huis clos.

La combinaison lunettes intelligentes + modèle vidéo Omni + intégration native au niveau système Spark menace sans aucun doute l'iPhone.

Selon le rapport de prévision de tendances des produits électroniques grand public de Macquarie : Dans les trois prochaines années, la part du temps d'interaction sans écran basé sur la vision/la parole devrait passer de 8 % actuellement à 35 %.

Si les utilisateurs s'habituent à effectuer leurs tâches quotidiennes et divertissements avec des lunettes et la voix, le temps d'utilisation des écrans sera nécessairement fortement réduit.

Si Apple ne parvient pas à proposer des dispositifs portables suffisamment impressionnants pour contre-attaquer (Vision Pro est trop lourd et cher, destiné à rester un jouet pour une minorité), son monopole sur les points d'entrée de l'ère mobile sera mis à rude épreuve comme jamais auparavant.

Ce n'est pas une évolution, c'est une révolution.

Google a lancé un défi à tous ses concurrents avec trois armes : la technologie, le flux et le prix.

À ce stade, y a-t-il encore quelqu'un pour se moquer de sa soi-disant maladie de grande entreprise ?

Cryptos en tendance

Questions liées

QQuels sont les trois principaux produits AI présentés par Google lors de l'événement I/O 2026 et quelle est leur signification stratégique ?

ALors du Google I/O 2026, trois produits AI majeurs ont été présentés : Gemini 3.5 Flash (un modèle léger mais performant), Gemini Omni Flash (un modèle vidéo multimodal natif) et l'assistant AI Spark (intégré au niveau du système Android). Leur signification stratégique est de démontrer la supériorité technique de Google, de saturer tous ses points d'entrée utilisateur (recherche, navigateur, mobile, lunettes) avec des agents IA, et de déclencher une guerre des prix pour consolider son avantage et son écosystème.

QComment Google a-t-il réussi à atteindre 9 milliards d'utilisateurs actifs mensuels pour Gemini, et pourquoi ce chiffre est-il si important ?

AGoogle a atteint 9 milliards d'utilisateurs actifs mensuels (MAU) pour Gemini en l'intégrant de force dans tous ses produits phares (Chrome, Android, Google Workspace) avec un coût d'acquisition quasi nul. Ce chiffre est crucial car il dépasse largement les concurrents, crée un formidable effet de réseau et génère un flux massif de données du monde réel pour affiner continuellement les modèles, renforçant ainsi une boucle vertueuse et une barrière à l'entrée très solide.

QQuelles sont les deux principales innovations techniques derrière les performances du modèle Gemini 3.5 Flash selon l'article ?

ASelon l'article, les deux innovations techniques clés derrière les performances de Gemini 3.5 Flash sont : 1) Un 'distillation de connaissances extrême' utilisant un modèle enseignant 'Gemini 3.5 Ultra' non divulgué pour transférer une logique de raisonnement avancée. 2) Une nouvelle architecture MoE (Mixture of Experts) utilisant 256 experts microscopiques, n'en activant que 4 par inférence, ce qui permet une grande efficacité et une faible latence (TTFT ≤65 ms).

QEn quoi la stratégie de tarification agressive de Google pour ses API AI constitue-t-elle une menace pour ses concurrents comme OpenAI ?

ALa stratégie de tarification agressive de Google (ex. : Gemini 3.5 Flash à un dixième du prix des concurrents) constitue une menace existentielle pour des concurrents comme OpenAI car elle remet en question leur modèle économique basé sur la vente d'API. Grâce à son infrastructure de calcul intégrée (TPU) et à son écosystème diversifié, Google peut se permettre de vendre l'IA à perte ou à prix coûtant et se rémunérer ailleurs, contrairement aux entreprises d'IA 'pures' qui dépendent de la rentabilité de leurs API.

QSelon l'article, comment les nouveaux produits AI de Google (lunettes, Omni, Spark) menacent-ils la position dominante d'Apple avec l'iPhone ?

ALes nouveaux produits AI de Google menacent la domination de l'iPhone en proposant un paradigme post-écran. La combinaison des lunettes intelligentes (interaction visuelle/vocale en continu), du modèle vidéo Omni (compréhension du monde physique) et de l'assistant Spark (contrôle natif du système) pourrait déplacer une part significative des interactions utilisateurs hors de l'écran du téléphone. Si les utilisateurs adoptent ces interfaces sans écran, la valeur et le temps d'utilisation de l'iPhone pourraient diminuer, défiant le monopole d'Apple sur l'entrée mobile.

Lectures associées

Pause à connotation de faucon : QCP Capital fait le point sur la réunion de la Fed et l'état du marché des cryptomonnaies

QCP Capital souligne que la décision apparemment neutre de la Fed de maintenir les taux (3,50–3,75%) avait en réalité un ton plus hawkish, avec trois votes pour une hausse. Les marchés ont révisé leurs anticipations. Bitcoin, après une chute à 63 000$, se stabilise autour de 64 000$. La croissance US ralentit (PIB à +1,5%) tandis que l'inflation (PCE à 3,7%) reste tenace, liant la politique future aux données sur l'emploi. Les marchés asiatiques ont connu une forte volatilité, le KOSPI sud-coréen bondissant de 17,9% après un repli, soulignant le lien avec la liquidité crypto. Sur le marché des options crypto, l'incertitude à court terme a diminué post-Fed, mais la demande de protection (skew) reste forte pour les contrats à long terme, indiquant des craintes macroéconomiques persistantes. Bitcoin termine juillet positivement, montrant une résilience relative malgré des flux ETF irréguliers et des résultats d'entreprises mitigés (Coinbase). La stabilité actuelle du marché crypto contraste avec l'absence de tendance claire. Les prochains événements clés incluent les données d'emploi US, le symposium de Jackson Hole (27-29 août) et la réunion de la Fed en septembre. L'analyse note que la prochaine source de volatilité pourrait venir de la Banque du Japon plutôt que de la Fed.

cryptonews.ruIl y a 6 mins

Pause à connotation de faucon : QCP Capital fait le point sur la réunion de la Fed et l'état du marché des cryptomonnaies

cryptonews.ruIl y a 6 mins

Prévision du prix du Solana en août 2026 : les 19 millions de dollars de Morgan Stanley et 330 000 commerçants coréens pourront-ils permettre au SOL de franchir le triangle ?

Solana (SOL) s'échange à 73,59 $, en phase de consolidation au sommet d'un triangle technique. La résolution directionnelle est imminente, avec des résistances clés aux EMA 20/50 jours (75,33-76,01 $) et au niveau Fibonacci 0,382 (74,79 $). Un franchissement haussier pourrait viser le cluster Fibonacci 0,5/EMA 100 jours à 79,27 $. Les supports se situent à 69,25 $ (Fibonacci 0,236) et 60,29 $ (le creux de juin). Deux catalyseurs institutionnels majeurs émergent pour août : 1. **MSOL de Morgan Stanley** : Le nouvel ETF spot a attiré 19,06 millions $ en un jour, le plus grand afflux quotidien depuis mai, démontrant une forte demande institutionnelle. 2. **Partenariat KSNET (Corée du Sud)** : Un protocole d'accord vise à intégrer Solana Pay au réseau de 330 000 commerçants de KSNET (traitant ~4 milliards $ mensuels). Deux pistes sont explorées : paiements traditionnels et transactions autonomes pilotées par IA (x402). Historiquement, août est un mois volatil pour SOL, pouvant générer des gains importants dans des conditions macroéconomiques favorables. **Scénarios pour août 2026 :** * **Haussier** : Rupture du triangle vers le haut, soutenue par les flux de MSOL et l'optimisme réglementaire (CLARITY Act), visant 79,27 $ et au-delà. * **Baissier** : Rupture vers le bas du triangle, repli vers 69,25 $, si l'enthousiasme pour MSOL s'estompe et dans un contexte de risque macroéconomique accru.

cryptonews.ruIl y a 26 mins

Prévision du prix du Solana en août 2026 : les 19 millions de dollars de Morgan Stanley et 330 000 commerçants coréens pourront-ils permettre au SOL de franchir le triangle ?

cryptonews.ruIl y a 26 mins

Trading

Spot

Articles tendance

Comment acheter WAR

Bienvenue sur HTX.com ! Nous vous permettons d'acheter WAR (WAR) de manière simple et pratique. Suivez notre guide étape par étape pour commencer votre parcours crypto.Étape 1 : Création de votre compte HTXUtilisez votre adresse e-mail ou votre numéro de téléphone pour ouvrir un compte sur HTX gratuitement. L'inscription se fait en toute simplicité et débloque toutes les fonctionnalités.Créer mon compteÉtape 2 : Choix du mode de paiement (rubrique Acheter des cryptosCarte de crédit/débit : utilisez votre carte Visa ou Mastercard pour acheter instantanément WAR (WAR).Solde :utilisez les fonds du solde de votre compte HTX pour trader en toute simplicité.Prestataire tiers :pour accroître la commodité d'utilisation, nous avons ajouté des modes de paiement populaires tels que Google Pay et Apple Pay.P2P :tradez directement avec d'autres utilisateurs sur HTX.OTC (de gré à gré) : nous offrons des services personnalisés et des taux de change compétitifs aux traders.Étape 3 : stockage de vos WAR (WAR)Après avoir acheté vos WAR (WAR), stockez-les sur votre compte HTX. Vous pouvez également les envoyer ailleurs via un transfert sur la blockchain ou les utiliser pour trader d'autres cryptos.Étape 4 : tradez des WAR (WAR)Tradez facilement WAR (WAR) sur le marché Spot de HTX. Il vous suffit d'accéder à votre compte, de sélectionner la paire de trading, d'exécuter vos trades et de les suivre en temps réel. Nous offrons une expérience conviviale aux débutants comme aux traders chevronnés.

585 vues totalesPublié le 2024.12.11Mis à jour le 2026.06.02

Comment acheter WAR

Discussions

Bienvenue dans la Communauté HTX. Ici, vous pouvez vous tenir informé(e) des derniers développements de la plateforme et accéder à des analyses de marché professionnelles. Les opinions des utilisateurs sur le prix de WAR (WAR) sont présentées ci-dessous.

活动图片