Gemini 3.8 Flash expliqué : double sortie Google 2026 et Fairwind

Google a livré le 2 septembre le Flash public et le Flash Cyber filtré par Fairwind. L’enjeu : un noyau, deux enveloppes d’accès — pas un autre classement vide.

Le 2 septembre 2026, Google a présenté Gemini 3.8 Flash et Gemini 3.8 Flash Cyber : deux variantes sur un même noyau, séparées par l’enveloppe de sécurité, pas par la taille. Billet officiel de Tulsee Doshi et Raluca Ada Popa (Google DeepMind).

C’est la troisième sortie Flash en six semaines, trois semaines après 3.7 Flash. Le Flash public garde le tarif d’introduction de 3.7. Flash Cyber n’est pas sur une grille : il passe par le nouveau programme Fairwind vers des défenseurs habilités. MarkTechPost a résumé : un noyau, deux enveloppes d’accès.

Ce qui est sorti Évals du Flash public Fairwind Cyber

Deux variantes, un noyau

Google indique que les deux versions partagent la même intelligence de fond, raffinée par de longues boucles agentiques. Une part des gains en code et en raisonnement est attribuée à un entraînement dur en cybersécurité. Les poids restent fermés ; pas de chemin self-hébergé.

01

Gemini 3.8 Flash

Cheval de trait public : génie logiciel, agents, raisonnement multi-étapes. API Gemini, AI Studio, Antigravity, Android Studio, Gemini Enterprise, application Gemini pour Pro / Ultra.

02

Gemini 3.8 Flash Cyber

Découverte de vulnérabilités et correctifs automatiques. Mitigations cyber plus souples, donc pas vendu sur l’API publique.

03

Fairwind

Priorité aux autorités, aux opérateurs d’infrastructures critiques et aux mainteneurs logiciels. La note Fairwind associe aussi le modèle à CodeMender pour trouver, vérifier, corriger.

Lire les chiffres du Flash public

  1. 1

    La grille

    Même tarif d’intro que 3.7 Flash : 0,75 $ / million de jetons en entrée, 3,75 $ en sortie jusqu’au 31 décembre 2026. Au 1er janvier 2027 : 1,50 / 7,50 $.

  2. 2

    Les scores dans le texte

    HLE-Verified : 54,9 %. DeepSWE v1.1, Vals Finance Agent V2 et Harvey Legal Agent sont des victoires relatives ; pas de scores absolus dans l’annonce.

  3. 3

    Il « travaille plus dur »

    Sur les tâches complexes : plus d’étapes de raisonnement et d’appels d’outils ; un effort élevé peut brûler plus de jetons. Google : rester sur 3.7 si le calcul est la contrainte. MarkTechPost : MINIMAL n’est pas accepté sur 3.8.

54.9%
HLE-Verified (Flash public)
0.75
Intro entrée $ / 1 M jetons
47.2%
CWE-Bench pass@1 (Cyber)

Flash Cyber : trouver, puis corriger

Google dit avoir priorisé la correction sur l’exploitation. Sur CyberGym : niveau frontière face à 3.5 Flash Cyber et à de plus gros modèles, sans chiffre absolu. Un banc interne sur 20 langages annonce un taux de succès supérieur à 70 %.

Poste Chiffre public Lecture
CWE-Bench (Collinear) 47,2 % pass@1 contre 47,8 % d’un modèle frontière en tête Affirmation Pareto, pas la première place
Chrome Security 2,6× plus de correctifs justes que les meilleurs modèles commerciaux plus gros Chiffre d’une équipe Google
Pentest interne Wiz +7,5–9,7 points de rappel à un coût 2,3–5,2× plus bas Banc partenaire, pas un classement public

Phrase de Google : 3.8 Flash travaille plus dur — plus d’étapes de raisonnement et d’appels d’outils itératifs, parfois plus de jetons à effort élevé.

Même noyau, autre enveloppe
La scission porte sur les mitigations et le public autorisé, pas sur deux fichiers de poids. Le Flash public bloque CBRN et l’offense cyber ; les mitigations cyber de Cyber sont plus souples, d’où le filtrage.
Corriger plutôt qu’exploiter
Le texte insiste sur les correctifs et la validation, pas le développement d’exploits. Cloud Vulnerability Research dit avoir trouvé une faille fondationnelle critique en moins de deux heures, un travail habituellement de plusieurs mois.
Poids fermés
MarkTechPost : pas de self-hébergement ni d’on-prem. Fenêtre de contexte 1 048 576 jetons ; sortie max. 65 536.

Quand l’équipe veut un seul croquis

Ensuite il manque souvent un dessin : tarif et HLE publics, CWE-Bench de Cyber, porte Fairwind. Pas de suite de réunion. Ouvrez tidemeet ou voyez créer un espace. Flagship fermé de la même semaine : Claude Fable 5.1 ; autre protocole d’éval du même labo : enclave en double aveugle DeepMind.

# axe
flash-public → fairwind-cyber → no-self-host

Questions

Est-ce le même sujet que l’article DeepMind en double aveugle ?

Non. Cet autre texte porte sur un protocole d’évaluation. Ici, le split produit du 2 septembre : Flash public et Flash Cyber filtré par Fairwind.

Qui peut utiliser Flash Cyber ?

Pas à la grille publique. Google réserve Fairwind aux États, opérateurs d’infrastructures critiques et mainteneurs, au cas par cas.

3.8 est-il toujours moins cher que 3.7 ?

Le prix unitaire d’intro est le même, mais Google admet que le modèle travaille plus dur et peut consommer plus de jetons à effort élevé. Garder 3.7 Flash si le calcul est serré.

Quel lien avec un outil de réunion temporaire ?

Aucun lien produit. Pour un seul croquis des deux enveloppes, voir outils de réunion temporaires.

Créer un espace gratuit