
Famille de modèles développée par Google DeepMind, née de la fusion en 2023 des équipes de Google Brain et de DeepMind. Elle est diffusée à la fois dans les produits grand public de Google, dans son offre pour développeurs et dans sa plateforme d'entreprise.
Le 21 juillet 2026, Google a publié Gemini 3.6 Flash et Gemini 3.5 Flash-Lite, sans faire suivre la gamme Pro. Le laboratoire met en avant l'efficacité plutôt que la puissance brute : 3.6 Flash consomme environ 17 % de jetons de sortie en moins que la version précédente, pour un tarif inférieur, tandis que Flash-Lite vise l'automatisation à très haut volume où la latence prime.
S'y ajoute Omni Flash, un modèle vidéo capable de produire des séquences à partir de texte, d'image, de vidéo ou de son, et d'en retoucher les plans. Une génération 4 a été évoquée sans date de sortie.
9 versions suivies · depuis 2023 · 20 faits reliés
Multimodal · Contexte long · Coût par jeton · Intégration Google
Volume, latence faible, et tâches multimodales incluant la vidéo.
Option à faible latence et faible coût, pensée pour l'automatisation à très haut volume.
Priorité à l'efficacité : environ 17 % de jetons de sortie en moins que la 3.5 Flash, à tarif inférieur.
Le plus avancé : raisonnement, multimodal, contexte 1M tokens.
Génération 3 : raisonnement et multimodal renforcés, déployée le jour même dans la recherche Google.
Modèle pensant par défaut, longtemps en tête des classements d'évaluation en aveugle.
Pensé pour l'ère agentique : sorties natives image et audio, usage d'outils, prototypes Astra et Mariner.
Un million de jetons de contexte grâce à une architecture à experts : l'analyse d'heures de vidéo ou de bases de code entières.
Premier modèle nativement multimodal de Google DeepMind, du téléphone au centre de données ; il succède à Bard et PaLM 2.
Version rapide et économique de la génération 3.1.
Relié automatiquement aux articles Factae qui mentionnent Gemini. Chaque fait renvoie vers ses sources d'origine.