Gemini 3.8 Flash est le troisième modèle Flash publié par Google en six semaines, dévoilé le 2 septembre 2026 aux côtés d’une variante dédiée à la cybersécurité, Gemini 3.8 Flash Cyber. Google annonce un score de 54,9 % sur HLE-Verified et un tarif d’introduction inchangé à 0,75 dollar par million de tokens en entrée — mais dès le lendemain de sa sortie, un fil de discussion sur le forum officiel des développeurs Google évoquait déjà une possible régression par rapport à la version précédente.
Key Takeaways
- Sorti le 2 septembre 2026, troisième modèle Flash en six semaines après 3.6 Flash (21 juillet) et 3.7 Flash (mi-août).
- Bâti sur la base de 3.7 Flash, pas un nouveau modèle de fond : le gain vient surtout d’un raisonnement plus poussé (plus de tokens de réflexion).
- Score HLE-Verified de 54,9 %, contre 53,6 % pour 3.7 Flash.
- Tarif d’introduction inchangé jusqu’au 31 décembre 2026 : 0,75 $ / million de tokens en entrée, 3,75 $ en sortie (doublera ensuite).
- Variante Cyber : 47,2 % sur CWE-Bench (quasi au niveau du meilleur modèle frontière, 47,8 %), 2,6 fois plus de correctifs valides que les concurrents selon l’équipe sécurité de Chrome, et détection d’un bug vieux de 13 ans dans Chromium.
- Vitesse élevée (~280 tokens/seconde selon Artificial Analysis) mais temps de réflexion initial long (13,3 secondes avant le premier token).
- Retours développeurs contrastés : bon rapport vitesse/prix salué, mais une accusation de régression et d’hallucinations par rapport à 3.7 Flash relayée dès le 3 septembre sur le forum officiel Google.
Table des matières
- Qu’est-ce que Gemini 3.8 Flash et sa variante Cyber ?
- Quels sont les scores officiels de Gemini 3.8 Flash ?
- Combien coûte Gemini 3.8 Flash et comment se compare-t-il à la concurrence ?
- Que disent les développeurs qui l’utilisent depuis une semaine ?
- Faut-il basculer vers Gemini 3.8 Flash ?
- Sources
Qu’est-ce que Gemini 3.8 Flash et sa variante Cyber ?
Gemini 3.8 Flash a été dévoilé par Google le 2 septembre 2026, comme troisième itération de la famille Flash en seulement six semaines, après 3.6 Flash (21 juillet) et 3.7 Flash (mi-août). Contrairement à ce que son nom pourrait suggérer, il ne s’agit pas d’un modèle entraîné depuis zéro : Google construit 3.8 Flash sur la base de 3.7 Flash, et le fait « travailler plus dur » en lui laissant consommer davantage de tokens de raisonnement avant de répondre.
Le modèle gère un contexte allant jusqu’à 1 048 576 tokens (soit environ 1 million) en entrée, pour une sortie plafonnée à 64 000 tokens, avec quatre niveaux de raisonnement configurables (minimal, low, medium, high). Il est multimodal : texte, image, audio, vidéo et PDF. Sa variante Cyber, elle, cible spécifiquement la cybersécurité défensive — détection de vulnérabilités et correctifs automatiques — et n’est accessible qu’à des « défenseurs de confiance » via le programme Fairwind de Google (gouvernements, opérateurs d’infrastructures critiques, partenaires cybersécurité).
Quels sont les scores officiels de Gemini 3.8 Flash ?
Sur son blog officiel, Google communique un nombre limité de scores chiffrés directement comparés à 3.7 Flash :
| Benchmark | Gemini 3.8 Flash | Gemini 3.7 Flash |
|---|---|---|
| HLE-Verified (Humanity’s Last Exam) | 54,9 % | 53,6 % |
| Vals Finance Agent V2 | Supérieur (score non chiffré) | — |
| Harvey’s Legal Agent Benchmark | Supérieur (score non chiffré) | — |
| DeepSWE v1.1 | « dépasse la plupart des modèles frontière plus grands » | — |
D’autres scores, plus détaillés, circulent via des analyses indépendantes (eesel.ai, DataCamp) qui reprennent et complètent les données du blog Google : Terminal-Bench 2.1 à 90,8 % (contre 81,6 % pour 3.7 Flash), τ³-bench Banking à 38,1 % (contre 30,9 %), et SWE-Bench Pro à 61,6 % (contre 60,4 %). Ces chiffres n’étant pas directement vérifiables sur les pages officielles de Google au moment de la rédaction, ils doivent être considérés comme indicatifs plutôt que définitifs.
Sur l’indice composite indépendant Artificial Analysis, Gemini 3.8 Flash (high) obtient un score de 47, classé 17ᵉ sur 196 modèles évalués — loin derrière les modèles frontière les plus chers, mais cohérent avec son positionnement de modèle rapide et économique plutôt que de modèle de pointe.
Gemini 3.8 Flash Cyber : un modèle dédié à la cybersécurité défensive
| Benchmark | Score | Comparaison |
|---|---|---|
| CWE-Bench (correctif automatique, pass@1) | 47,2 % | vs 47,8 % pour le meilleur modèle frontière |
| Détection de vulnérabilités (20 langages) | > 70 % | Benchmark interne Google |
| Équipe sécurité Chrome | 2,6x plus de correctifs valides | vs meilleurs modèles commerciaux concurrents |
| Wiz (pentest interne) | +7,5 à +9,7 points de rappel | à un coût 2,3 à 5,2 fois inférieur |
Google indique que l’équipe sécurité de Chrome a utilisé le modèle pour repérer un bug vieux de 13 ans dans Chromium — un exemple concret que Google met en avant pour justifier l’accès restreint de cette variante.
Combien coûte Gemini 3.8 Flash et comment se compare-t-il à la concurrence ?
Le tarif d’introduction reste identique à celui de 3.7 Flash jusqu’au 31 décembre 2026 : 0,75 dollar par million de tokens en entrée, 3,75 dollars en sortie. Passé cette date, les tarifs doublent (1,50 $ / 7,50 $). Le cache de contexte est facturé 0,50 dollar par million de tokens et par heure, et Google offre 5 000 requêtes de recherche gratuites par mois, tous modèles Gemini 3.x confondus.
Face à GPT-6 Astra, sorti la même semaine, l’écart de prix est important : selon Artificial Analysis, Astra (high) coûte environ 7,70 dollars par million de tokens contre 0,58 dollar pour Gemini 3.8 Flash, soit un rapport d’environ 1 à 13 en faveur de Google — mais Astra devance nettement Gemini sur l’indice d’intelligence composite (53 contre 47). Face à Claude Fable 5.1, sorti la veille, l’écart de prix est encore plus marqué (10 $ / 50 $ par million de tokens, soit 13 fois le tarif de Gemini), pour un score d’intelligence plus élevé mais une absence de gestion voix/vidéo. Le positionnement de Gemini 3.8 Flash reste donc clairement celui du rapport qualité/prix, face à des concurrents plus chers mais plus capables sur les tâches agentiques exigeantes.
Que disent les développeurs qui l’utilisent depuis une semaine ?
Ce qui revient positivement : plusieurs développeurs soulignent que Gemini 3.8 Flash approche les performances de modèles frontière bien plus chers sur des tâches de code et d’agents, au même prix que 3.7 Flash. Un développeur a rapporté sur X avoir recréé un site interactif en 3D en 1 minute 52 pour un coût quasi nul. Le modèle est également disponible dans GitHub Copilot et dans Google Antigravity, où il est salué pour ses bonnes performances sur des tâches de terminal complexes et sa capacité à se rattraper après un échec. Un fil Hacker News souligne aussi de bonnes performances hors code : planification de voyage, recherche factuelle, analyse de documents, avec un avantage lié à son intégration native à Maps et Search.
Ce qui revient négativement : un fil publié sur le forum officiel des développeurs Google, intitulé « Gemini Flash 3.8 hallucination, and regression from 3.7 », a circulé dès le 3 septembre — un jour après le lancement — avant d’être supprimé par son auteur ; un fil connexe s’interroge sur la manière dont un tel problème a pu passer inaperçu avant la mise en production. Plusieurs utilisateurs rapportent aussi que le modèle génère davantage de tokens que prévu pour « réfléchir », ce qui gonfle la facture réelle malgré un tarif par token plus bas — cohérent avec la mesure indépendante d’Artificial Analysis (temps avant premier token de 13,3 secondes, contre environ 3 secondes pour la médiane des modèles). Un commentateur Hacker News signale même un cas où le modèle a codé en dur la mention « 60 FPS » dans une animation sans que la performance réelle ne le justifie.
Une accusation de régression relayée dès le lendemain du lancement
Le point le plus surprenant de cette semaine de retours est la rapidité avec laquelle une suspicion de régression a émergé : moins de 24 heures après la sortie, des développeurs questionnaient déjà la qualité de 3.8 Flash par rapport à 3.7 Flash sur le forum officiel de Google. La tonalité générale reste toutefois plus proche d’une « mise à jour incrémentale solide » que d’un rejet massif — la presse spécialisée elle-même a résumé le lancement comme un rappel de la présence de Google dans la course, plutôt qu’une avancée majeure.
Faut-il basculer vers Gemini 3.8 Flash ?
- Si le budget est la priorité : le rapport qualité/prix reste excellent face à GPT-6 Astra ou Claude Fable 5.1, à condition de surveiller la consommation réelle de tokens de raisonnement.
- Si vous étiez déjà sur 3.7 Flash : testez d’abord vos cas d’usage critiques avant de migrer en production, le temps de vérifier que la suspicion de régression signalée ne vous concerne pas.
- Pour des tâches de sécurité défensive : la variante Cyber n’est accessible qu’aux organisations éligibles au programme Fairwind — inutile d’espérer y accéder sans un profil gouvernemental ou infrastructure critique.
- Pour des tâches multimodales générales (documents, vidéo, planification) : les retours restent globalement positifs, en particulier grâce à l’intégration native aux outils Google.
Quand Gemini 3.8 Flash est-il sorti ?
Gemini 3.8 Flash a été dévoilé par Google le 2 septembre 2026, aux côtés de sa variante Gemini 3.8 Flash Cyber, dédiée à la cybersécurité défensive.
Combien coûte Gemini 3.8 Flash ?
Le tarif d’introduction, valable jusqu’au 31 décembre 2026, est de 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie, identique à celui de Gemini 3.7 Flash.
Gemini 3.8 Flash est-il meilleur que GPT-6 Astra ?
GPT-6 Astra devance Gemini 3.8 Flash sur l’indice d’intelligence composite Artificial Analysis (53 contre 47), mais Gemini est environ 13 fois moins cher à l’usage et génère les tokens beaucoup plus rapidement.
Qu’est-ce que Gemini 3.8 Flash Cyber ?
C’est une variante spécialisée en cybersécurité défensive, capable de détecter des vulnérabilités et de proposer des correctifs automatiques, réservée aux organisations éligibles au programme Fairwind de Google.
Y a-t-il eu des problèmes signalés après le lancement de Gemini 3.8 Flash ?
Dès le lendemain du lancement, un fil du forum officiel des développeurs Google évoquait une possible régression et des hallucinations par rapport à Gemini 3.7 Flash, avant d’être supprimé par son auteur.
Sources
- Google (2 septembre 2026). « Gemini 3.8 Flash and 3.8 Flash Cyber ». blog.google
- Google DeepMind. « Gemini Flash — fiche modèle ». deepmind.google
- Google. « Programme Fairwind ». blog.google
- The Register (2 septembre 2026). « With Gemini 3.8 Flash, Google reminds everyone it’s still in the race ». theregister.com
- Artificial Analysis (2026). Comparatif GPT-6 Astra vs Gemini 3.8 Flash. artificialanalysis.ai
- Hacker News (2026). Discussion communautaire sur Gemini 3.8 Flash. news.ycombinator.com
- GitHub Changelog (3 septembre 2026). « Gemini 3.8 Flash is now available in GitHub Copilot ». github.blog
Chiffres vérifiés le 8 septembre 2026. Les benchmarks non confirmés directement sur les pages officielles Google (Terminal-Bench 2.1, τ³-bench Banking, SWE-Bench Pro) proviennent d’analyses tierces et sont signalés comme tels dans le texte.

