Actualité · Modèles IA

Gemini 3.8 Flash : Google sort son troisième modèle Flash en six semaines, et le travailleur de la gamme

3 septembre 2026 · 5 min de lecture

Illustration aquarelle d'un petit robot astronaute violet travaillant tard à un établi, avec un calendrier aux trois pages arrachées et un second robot examinant un mur de pierre, symbolisant le modèle workhorse Gemini 3.8 Flash et sa variante Cyber

Google a sorti Gemini 3.8 Flash le 2 septembre 2026. C'est le troisième modèle Flash en six semaines, après 3.6 Flash fin juillet et 3.7 Flash mi-août. Et cette fois, le pitch de Google est clair : 3.8 Flash est un modèle qui travaille plus pour raisonner plus longtemps, au prix d'un Flash.

En parallèle, Google lance Gemini 3.8 Flash Cyber, une variante spécialisée en cybersécurité qui trouve des vulnérabilités de façon autonome. L'équipe Chrome Security a obtenu 2,6 fois plus de correctifs valides qu'avec les meilleurs modèles commerciaux plus grands. L'équipe Cloud Vulnerability Research a trouvé une vulnérabilité critique en moins de 2 heures, là où ce travail prend d'habitude des mois.

Ce que 3.8 Flash change

Google le dit directement : les gains de 3.8 Flash viennent d'un choix de conception. Le modèle "travaille plus". Sur les tâches complexes, il fait plus d'étapes de raisonnement et appelle les outils de façon itérative. Conséquence : il consomme plus de tokens que 3.7 Flash sur ces tâches, mais il arrive à des résultats qui approchent les frontier.

Pour les workloads où l'efficacité compte plus que la performance, Google garde 3.7 Flash disponible. Le prix est le même pour les deux : 0,75 dollar par million de tokens en entrée, 3,75 en sortie, jusqu'au 31 décembre 2026.

Les chiffres que Google publie :

BenchmarkCe que ça mesureRésultat
DeepSWE v1.1Ingénierie logicielle long-horizonSurpasse la plupart des frontier
HLE-VerifiedRaisonnement multi-étapes (STEM, humanités, domaines pro)54,9%
Vals Finance Agent V2Analyse financière agentiqueSurpasse 3.7 Flash et autres frontier
Harvey's Legal Agent BenchmarkRaisonnement juridique agentiqueSurpasse 3.7 Flash et autres frontier

Le point sur l'OSWorld-2.0, qui mesure la capacité à utiliser un ordinateur de façon agentique : 3.8 Flash progresse par rapport à 3.7 Flash, mais reste loin derrière Claude Opus. Aucun modèle Google n'est bon sur ce test pour l'instant.

Le rythme des sorties Flash

Six semaines, trois modèles. Fin juillet : 3.6 Flash. Mi-août : 3.7 Flash. Début septembre : 3.8 Flash. Google a accéléré sa cadence de sortie à un modèle Flash toutes les trois semaines.

Ce rythme sert deux objectifs. D'abord, garder la pression face à OpenAI et Anthropic qui sortent aussi à cadence rapide. Ensuite, gagner du temps sur Gemini 3.5 Pro, annoncé à l'I/O 2026 mais pas encore disponible. Google aurait retardé 3.5 Pro parce que ses performances en code ne matchaient pas la concurrence. Les modèles Flash, plus rapides à produire, maintiennent la présence commerciale pendant que le Pro mûrit.

La knowledge cutoff de 3.8 Flash est mars 2026 pour certains domaines, janvier 2025 pour d'autres. Google ne précise pas lesquels.

La variante Cyber : 3.8 Flash Cyber

3.8 Flash Cyber remplace 3.5 Flash Cyber. Elle est accessible via le programme Fairwind de Google, un programme d'accès restreint pour les autorités gouvernementales, les opérateurs d'infrastructures critiques et les maintainers de plateformes. Google vérifie tous les candidats.

Sur CyberGym, le benchmark standard de découverte de vulnérabilités, 3.8 Flash Cyber surpasse 3.5 Flash Cyber et les frontier plus grands. Sur un benchmark interne couvrant 20 langages de programmation, le modèle dépasse 70% de taux de succès.

Sur CWE-Bench, qui mesure la capacité à produire des correctifs, 3.8 Flash Cyber atteint 47,2% en pass@1, contre 47,8% pour le meilleur frontier, pour un coût bien inférieur. Google précise avoir privilégié la réparation des vulnérabilités sur les capacités offensives comme l'exploitation.

Trois retours terrain :

  • L'équipe Chrome Security a obtenu 2,6 fois plus de correctifs valides qu'avec les meilleurs modèles commerciaux plus grands.
  • Wiz rapporte +7,5 à 9,7% de recall sur son benchmark interne de penetration testing, pour 2,3 à 5,2 fois moins cher.
  • L'équipe Cloud Vulnerability Research a trouvé une vulnérabilité critique fondamentale en moins de 2 heures.

3.8 Flash Cyber a aussi des garde-fous réduits en cybersécurité, ce qui explique l'accès restreint. Le modèle de base, 3.8 Flash, garde ses protections contre le misuse en CBRN et en cyber offensif, conformément au Frontier Safety Framework de Google. Google signale aussi une amélioration de la robustesse face au prompt injection, mesurée par Gray Swan.

Un exemple chez Maisons&Mobilia

Pierre, dev chez Maisons&Mobilia (M&M, enseigne de meubles fictive), fait tourner un agent IA qui fait de la revue de code sur le codebase de l'équipe. L'agent tourne sur 3.7 Flash parce que c'est rapide et pas cher.

Avec 3.8 Flash, Pierre a deux options. S'il passe sur 3.8 Flash, l'agent va raisonner plus longtemps sur les revues complexes. Sur un bug subtil dans la logique de gestion des stocks, le modèle fera plus d'étapes, appellera plus d'outils, et aura plus de chances de le trouver. Le coût par revue augmente en tokens, mais le prix par token est le même. Si Pierre veut limiter la consommation, il règle l'effort sur Low ou Medium et obtient des performances proches de 3.7 Flash pour moins de tokens.

La limite : sur OSWorld-2.0, 3.8 Flash n'est pas encore au niveau de Claude Opus pour les tâches d'utilisation d'ordinateur. Si l'agent de Pierre doit naviguer dans une interface pour tester un parcours utilisateur, 3.8 Flash galère toujours.

Côté Cyber : M&M n'a pas accès à 3.8 Flash Cyber parce que c'est réservé au programme Fairwind. Si Pierre veut de la détection de vulnérabilités autonome sur son codebase, il doit attendre l'ouverture du programme ou utiliser les garde-fous standard de 3.8 Flash, qui peuvent identifier des vulnérabilités dans le code mais avec des limitations.

Comment y accéder

3.8 Flash est disponible dès maintenant pour les abonnés Google AI Pro et Ultra dans l'app Gemini, AI Mode dans Google Search, et Gemini dans Google Sheets. Les développeurs peuvent l'utiliser dans Google AI Studio, le Gemini API, Google Antigravity, Android Studio et Stitch. Les entreprises y accèdent via Gemini Enterprise.

3.8 Flash Cyber est accessible via le programme Fairwind, sur candidature. Google cible les autorités gouvernementales, les opérateurs d'infrastructures critiques et les maintainers de plateformes.

Ce que ça change si tu apprends l'IA

Trois notions à retenir.

  1. Effort réglable : un modèle IA n'est pas figé. 3.8 Flash peut travailler plus ou moins selon le niveau d'effort choisi (Low, Medium, High). Plus d'effort, plus de tokens, plus de raisonnement. C'est un paramètre produit, pas une capacité cachée. Comprendre ce réglage, c'est savoir doser le coût et la qualité d'un appel IA.

  2. Cadence de sortie : trois modèles Flash en six semaines, c'est un rythme mensuel. Les versions sont incrémentales. 3.6, 3.7, 3.8 : chaque sortie apporte des gains mesurables mais pas de rupture. Les vrais sauts de génération viendront avec le 3.5 Pro, pas encore disponible. Suivre les sorties Flash, c'est suivre l'itération continue.

  3. Séparation accès civil et cyber : Google sort le même modèle de base en deux versions. 3.8 Flash pour tout le monde, avec des garde-fous. 3.8 Flash Cyber pour les défenseurs vérifiés, avec des garde-fous réduits en cybersécurité. C'est le même modèle, pas le même produit. La distinction se joue au niveau de l'accès, pas de la technologie.

La compétence pratique : savoir choisir entre un modèle Flash et un frontier. Si ta tâche demande du raisonnement long et du code, 3.8 Flash peut suffire pour une fraction du coût. Si elle demande de naviguer dans une interface ou d'utiliser un ordinateur de façon agentique, les frontier font mieux pour l'instant.

Aller plus loin

Pour comprendre comment un agent IA utilise des outils et enchaîne des étapes, notre article sur comment fonctionne un agent IA pose les bases du tool use et de l'orchestration. Pour voir les garde-fous à mettre en place quand un agent accède à tes données, le guide sur les garde-fous des agents IA détaille le moindre privilège et le human in the loop. Et pour t'entraîner à ces notions en 5 minutes par jour, l'app saisir.ai propose des modules interactifs sur les agents, le raisonnement et le tool use, en français, sans coder.

Sources

Questions fréquentes

C'est quoi Gemini 3.8 Flash ?
Gemini 3.8 Flash est un modèle IA de Google sorti le 2 septembre 2026. C'est le troisième modèle Flash en six semaines. Google le décrit comme son 'workhorse' : il consomme plus de tokens pour raisonner plus longtemps sur les tâches complexes, ce qui le rapproche des frontier sur le code, les tâches agentiques et le raisonnement multi-étapes, au prix d'un Flash (0,75 dollar par million de tokens en entrée, 3,75 en sortie).
Quelle est la différence entre Gemini 3.8 Flash et Gemini 3.7 Flash ?
3.8 Flash apporte des gains sur le code (DeepSWE), le raisonnement (HLE-Verified 54,9%) et les tâches agentiques spécialisées (finance, droit). 3.7 Flash reste disponible pour les workloads où l'efficacité prime. Les deux modèles ont le même prix, mais 3.8 Flash peut consommer plus de tokens sur les tâches complexes parce qu'il raisonne plus.
C'est quoi Gemini 3.8 Flash Cyber ?
C'est une variante de 3.8 Flash spécialisée en cybersécurité, disponible via le programme Fairwind de Google. Elle trouve des vulnérabilités de façon autonome et génère des correctifs. L'équipe Chrome Security a obtenu 2,6 fois plus de correctifs valides qu'avec les meilleurs modèles commerciaux plus grands. Elle a trouvé une vulnérabilité critique en moins de 2 heures.
Gemini 3.8 Flash est-il gratuit ?
Pour les développeurs, 3.8 Flash est accessible via Google AI Studio gratuitement pour tester. Pour les consommateurs, il faut un abonnement Google AI Pro ou Ultra pour l'utiliser dans l'app Gemini, AI Mode dans Google Search et Gemini dans Google Sheets. Le prix API est de 0,75 dollar par million de tokens en entrée et 3,75 en sortie (prix introductif jusqu'au 31 décembre 2026).
Pourquoi Google sort un Flash toutes les trois semaines ?
Google a accéléré son rythme de sortie : 3.6 Flash fin juillet, 3.7 Flash mi-août, 3.8 Flash début septembre. Les modèles Flash sont plus rapides et moins chers à produire que les Pro, et ce rythme permet à Google de garder la cadence face à OpenAI et Anthropic tout en repoussant la sortie du 3.5 Pro, annoncé à l'I/O 2026 mais pas encore disponible.

Termes du glossaire