Le 19 mai, au Shoreline Amphitheatre, Google a déroulé sa vision de l'IA pour l'année. On attendait Gemini Omni et Android 17, la firme a donc tenu parole, avec deux annonces qui résument bien sa stratégie, un nouveau modèle multimodal et une gamme 3.5 plus rapide. Trois semaines plus tard, le moment est venu de faire le point sur le poids de Google dans une course que se disputent aussi Anthropic et OpenAI.
Gemini Omni, générer dans n'importe quelle modalité
Gemini Omni est la grosse nouveauté du keynote. Il s'agit d'une nouvelle famille de modèles pensée pour créer à partir de n'importe quelle entrée, en commençant par la vidéo. L'idée est de fusionner l'intelligence de Gemini avec les meilleurs modèles de média génératif, pour produire une sortie dans n'importe quelle modalité à partir de n'importe quelle source. La vidéo est disponible dès maintenant, l'image et le texte suivront progressivement.

Le premier modèle de la famille, Gemini Omni Flash, est déjà accessible. On peut l'essayer dans l'application Gemini, dans Google Flow et sur YouTube Shorts, avec un déploiement vers les développeurs et les entreprises via API prévu dans les semaines qui viennent. Google ne se contente pas d'annoncer son produit, il met l'outil entre les mains du grand public le jour même, ce qui reste sa marque de fabrique.
Gemini 3.5 Flash et Pro, la nouvelle gamme

En parallèle, Google a lancé Gemini 3.5 Flash, présenté comme le premier d'une série qui combine intelligence de pointe et capacité d'action.
Le modèle revendique des performances dignes des gros modèles flagship à la vitesse d'un Flash, surpassant Gemini 3.1 Pro sur les benchmarks de code et d'agentique. Il devient le modèle par défaut du mode IA de la recherche, partout dans le monde. La version supérieure, Gemini 3.5 Pro, est pour l'instant utilisée en interne et doit être déployée courant juin.
La vraie force de Google, l'ubiquité
Au-delà des modèles, l'atout maître de Google reste sa capacité de distribution. La firme revendiquait déjà 750 millions d'utilisateurs Gemini sur ses produits, la stratégie n'a pas changé, faire de Gemini une couche système présente partout, dans Android, dans la recherche, dans Workspace, sur Google TV, dans les voitures. Le symbole le plus parlant reste le choix d'Apple, qui a retenu Gemini pour piloter le nouveau Siri. Pendant qu'Anthropic et OpenAI se battent sur les benchmarks, Google joue une autre partie, celle de l'omniprésence.

Au final, le tableau de la mi-2026 se précise. Anthropic tient le haut du pavé sur le code et le travail concret avec Opus 4.8, OpenAI prépare sa riposte sans encore l'avoir sortie, Google avance sur deux fronts, le multimodal avec Omni et la distribution de masse. Aucun des trois ne domine sur tous les terrains à la fois, c'est précisément ce qui rend cette course à l'IA folle à suivre. Le prochain rendez-vous sera sans doute la disponibilité complète de Gemini 3.5 Pro, attendue ce mois-ci.




