Skip to main content

Gemini 3.6 Flash, Flash-Lite, Flash Cyber : trois modèles, un point où Google bat Claude

Google a mis en ligne trois nouveaux modèles Gemini le 21 juillet 2026, la veille des résultats trimestriels d'Alphabet. Prix et benchmarks mesurés d'un côté — et de l'autre, un chiffre inattendu : sur la détection de failles dans le moteur V8 de Chrome, l'agent CodeMender de Google devance Claude Opus 4.6.

Note Google 5/5 · +130 projets livrés en cumulé · réservez 30 min

Technique
Par Victor
10 min de lecture

Le 21 juillet 2026, Google a mis en ligne trois nouveaux modèles Gemini — 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber — la veille des résultats trimestriels d'Alphabet. La communication officielle met en avant la vitesse et le prix : moins cher, plus rapide, moins de tokens consommés. C'est vrai, et mesurable. Mais le détail le plus intéressant de cette sortie ne concerne ni la vitesse ni le prix : c'est un chiffre de détection de failles de sécurité où Google devance explicitement Claude Opus 4.6.

On a recoupé les chiffres sur le billet officiel de Google et sur les mesures indépendantes publiées le jour même (Artificial Analysis, SiliconANGLE, The Hacker News, the-decoder.com). Voici ce qui tient, ce qui reste à prouver, et ce que ça change pour vos arbitrages IA.

L'essentiel en 30 secondes

  • Trois modèles (disponibles le 21/07/2026) : Gemini 3.6 Flash, le cheval de bataille code/agents (1,50 $ / 7,50 $ par million de tokens, en baisse vs les 9 $ de sortie de l'ancien 3.5 Flash) ; 3.5 Flash-Lite, l'option haut débit (0,30 $ / 2,50 $) ; 3.5 Flash Cyber, un modèle sécurité à accès restreint.
  • 3.6 Flash progresse nettement sur le code : 49 % sur DeepSWE (vs 37 % pour 3.5 Flash), 83,0 % sur OSWorld-Verified (vs 78,4 %) — et 17 % de tokens de sortie en moins pour un résultat équivalent.
  • Le vrai chiffre de la sortie : dans l'agent de sécurité CodeMender, Flash Cyber a trouvé 55 failles uniques confirmées dans le moteur V8 de Chrome, contre 47 pour 3.5 Flash et 36 pour Claude Opus 4.6 — dont 10 qu'aucun des deux autres modèles n'avait détectées. Chiffre recoupé sur trois publications indépendantes.
  • Gemini 3.5 Pro et Gemini 4 ne sont pas sortis : Google les présente comme « en test » et « en pré-entraînement ». Toute spécification circulant ailleurs à leur sujet est une rumeur, pas une annonce officielle.

1. Le lineup : trois modèles, un vrai geste sur le prix

Contrairement aux sorties précédentes de Gemini, celle-ci ne touche pas le haut de gamme (Gemini 3 Pro reste en place, Gemini 3.5 Pro n'est toujours pas sorti). Google segmente sa gamme Flash en trois usages distincts, disponibles immédiatement via Google AI Studio, Android Studio, Google Antigravity, la Vertex API et l'app Gemini — 3.6 Flash a en plus rejoint GitHub Copilot le jour même.

Modèle Positionnement Entrée ($/M tokens) Sortie ($/M tokens)
Gemini 3.6 Flash Cheval de bataille : code, agents, tâches longues 1,50 $ 7,50 $ (vs 9 $ avant)
Gemini 3.5 Flash-Lite Haut débit, gros volumes, coût minimal 0,30 $ 2,50 $
Gemini 3.5 Flash Cyber Sécurité — accès restreint (gouvernements, partenaires) Non communiqué Non communiqué

Les trois modèles partagent une fenêtre de contexte d'1 million de tokens, en entrée multimodale (texte, image, audio, vidéo). Google indique aussi avoir renforcé les garde-fous « Frontier Safety » de 3.6 Flash sur les usages CBRN (chimique, biologique, radiologique, nucléaire) et cyber-offensifs — une mention qui, mise bout à bout avec le chiffre CodeMender plus bas, dessine une sortie où la sécurité est autant un argument produit qu'une précaution.

2. Gemini 3.6 Flash : moins de tokens, plus de précision sur le code

Les gains mesurés (source : billet officiel Google, benchmarks Artificial Analysis) portent surtout sur les tâches d'ingénierie logicielle et d'exécution agentique :

Benchmark 3.6 Flash 3.5 Flash (ancien)
DeepSWE (Datacurve) 49 % 37 %
MLE Bench 63,9 % 49,7 %
OSWorld-Verified 83,0 % 78,4 %
GDPval-AA v2 1421 1349

Le point le plus concret pour un budget d'entreprise : Google annonce jusqu'à 17 % de tokens de sortie en moins pour un résultat équivalent, et le prix en sortie baisse de 9 $ à 7,50 $ le million de tokens. Sur un usage quotidien d'agents de code ou de traitement documentaire, les deux effets se cumulent : moins de tokens facturés, à un tarif unitaire plus bas.

3. Gemini 3.5 Flash-Lite : le modèle des gros volumes

À 0,30 $ / 2,50 $ par million de tokens et environ 350 tokens/s mesurés par Artificial Analysis, Flash-Lite cible les tâches à volume élevé et faible complexité — tri d'e-mails, extraction de champs, classification. Les gains face à l'ancien 3.1 Flash-Lite sont nets : Terminal-Bench 2.1 passe de 31 % à 54 %, SWE-Bench Pro de 49,6 % à 54,2 %. Google a commencé à le déployer directement dans Google Search, un signal que ce palier est pensé pour tourner à très grande échelle.

4. CodeMender et Flash Cyber : le chiffre qui compte vraiment

C'est la partie la moins commentée de la sortie, et la plus intéressante. Flash Cyber alimente CodeMender, l'agent de sécurité de Google dont le workflow scan/verify/remediate couvre C/C++, Go, Java, Python, Ruby, Rust et TypeScript, avec Salesforce, Robinhood et Palo Alto Networks comme premiers testeurs cités. Sur le benchmark CyberGym, Flash Cyber atteint 83,2 %, à seulement deux points du GPT-5.5-Cyber d'OpenAI (85,6 %) — un score obtenu par un modèle nettement plus petit, en faisant travailler plusieurs instances de Flash Cyber en parallèle sur chaque rapport.

Mais le chiffre qui distingue vraiment cette sortie a été mesuré sur un cas réel : le moteur JavaScript V8 de Chrome. Sur ce code, réputé difficile à auditer, CodeMender a trouvé 55 failles uniques confirmées, contre 47 pour Gemini 3.5 Flash et 36 pour Claude Opus 4.6 — dont 10 failles qu'aucun des deux autres modèles n'avait repérées. Trois publications indépendantes (SiliconANGLE, Android Headlines, The Hacker News) rapportent le même chiffre le même jour, ce qui exclut une erreur de reprise isolée.

Pourquoi ce chiffre n'est pas un détail pour une PME

Flash Cyber reste en pilote fermé — gouvernements et partenaires triés sur le volet, pas d'accès API public à ce jour. Aucune PME ne va l'utiliser directement demain matin. Ce qui compte, c'est le signal : les grands fournisseurs de modèles investissent maintenant autant dans la détection de vulnérabilités que dans la vitesse d'exécution. Si votre feuille de route IA inclut un audit de code ou un projet touchant à des données sensibles, c'est un argument de plus pour ne jamais improviser la sécurité applicative avec le modèle « par défaut » de votre outil du moment — le choix du modèle et le choix des garde-fous sont deux décisions séparées.

5. Le contexte : une cadence de sortie sous pression

Le timing n'est pas anodin : Google publie ces trois modèles la veille de ses résultats trimestriels, dans un contexte où la presse tech (SiliconANGLE, CNBC) souligne la pression des rivaux chinois sur la vitesse et l'efficacité des sorties de modèles occidentaux. Le porte-drapeau de la gamme, Gemini 3.5 Pro, n'est toujours pas sorti : Google le décrit comme « en test avec des partenaires », et the-decoder.com titre sans détour qu'il reste « perdu en entraînement » — cohérent avec plusieurs reports de date déjà relayés par la presse tech ces dernières semaines. Google confirme par ailleurs avoir démarré le pré-entraînement de Gemini 4, sans donner de calendrier.

Deux modèles annoncés, zéro date : à ce stade, tout article qui vous donnerait des spécifications précises sur Gemini 3.5 Pro ou Gemini 4 vous vend de la rumeur pour du fait. On ne le fera pas ici.

6. Ce que ça change concrètement pour vos projets

  • Le rapport coût/performance de Flash-Lite mérite un rechiffrage. À 0,30 $ / 2,50 $ le million de tokens et ~350 tokens/s, un cas d'usage de gros volume écarté l'an dernier pour son coût par requête peut redevenir rentable.
  • 3.6 Flash est un candidat sérieux pour les agents de code de production, avec un coût en baisse — mais un modèle a quelques heures d'existence publique : les retours d'usage réel en session longue restent à confirmer.
  • Le choix entre Gemini, Claude et GPT reste un arbitrage par tâche, pas un classement unique — c'est exactement ce qu'on détaille dans notre comparatif Claude vs ChatGPT vs Gemini, régulièrement mis à jour à chaque sortie majeure.
  • Et comme pour chaque sortie de modèle : la capacité brute d'un LLM ne vaut, en production, que ce que vaut la couche de gouvernance et de garde-fous construite autour. C'est le sujet sur lequel on est sollicités à chaque nouvelle sortie — Gemini, GPT ou Claude, la question n'est jamais « quel est le meilleur modèle » mais « quel modèle, pour quelle tâche, avec quel contrôle ».

Une réserve honnête pour finir : les trois modèles ont quelques heures d'existence publique au moment où cet article est écrit. Les benchmarks cités viennent de Google et d'Artificial Analysis ; ils reflètent des conditions de test standardisées, pas nécessairement votre cas d'usage. Nous mettrons cet article à jour si des mesures indépendantes complémentaires apparaissent.

Un modèle moins cher ne fait pas un projet plus sûr

On évalue avec vous quel modèle — Gemini, Claude, GPT ou autre — convient à votre cas d'usage, et surtout quels garde-fous rendent le projet déployable en production sans mauvaise surprise. Diagnostic gratuit, sans engagement.

Parler de votre projet IA →

Questions fréquentes

Quels sont les nouveaux modèles Gemini annoncés par Google ?

Google a lancé trois modèles le 21 juillet 2026 : Gemini 3.6 Flash (le cheval de bataille code et agents), Gemini 3.5 Flash-Lite (haut débit, gros volumes) et Gemini 3.5 Flash Cyber (sécurité, accès restreint aux gouvernements et partenaires de confiance). Aucun n'est un modèle "Pro" — Gemini 3.5 Pro n'est pas encore sorti.

Combien coûte Gemini 3.6 Flash ?

1,50 $ par million de tokens en entrée et 7,50 $ en sortie — en baisse par rapport aux 9 $ facturés en sortie sur l'ancien Gemini 3.5 Flash. Gemini 3.5 Flash-Lite est nettement moins cher : 0,30 $ / 2,50 $ par million de tokens, pour les tâches à volume élevé.

Qu'est-ce que CodeMender et pourquoi bat-il Claude Opus 4.6 ?

CodeMender est l'agent de sécurité de Google, propulsé par Gemini 3.5 Flash Cyber, avec un workflow scan/verify/remediate sur sept langages. Sur le moteur V8 de Chrome, il a trouvé 55 failles uniques confirmées contre 47 pour Gemini 3.5 Flash et 36 pour Claude Opus 4.6 (dont 10 qu'aucun des deux autres n'avait détectées) — un chiffre rapporté par plusieurs publications indépendantes le jour de la sortie.

Peut-on utiliser Gemini 3.5 Flash Cyber dès maintenant ?

Non. Flash Cyber est réservé à un programme pilote à accès restreint (gouvernements et partenaires de confiance via CodeMender), sans accès API public annoncé à ce jour. Gemini 3.6 Flash et 3.5 Flash-Lite, eux, sont disponibles immédiatement via Google AI Studio, Android Studio, Vertex API et l'app Gemini.

Quand sortent Gemini 3.5 Pro et Gemini 4 ?

Aucune date n'est confirmée. Google indique que Gemini 3.5 Pro est "en test avec des partenaires" et sera disponible "dès qu'il sera prêt", et que le pré-entraînement de Gemini 4 vient de démarrer. Toute spécification technique circulant ailleurs sur ces deux modèles reste une rumeur non confirmée par Google.

Sources des chiffres : billet officiel Google, "Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber" (blog.google, 21/07/2026), confirmé par deepmind.google, ai.google.dev et le changelog GitHub (github.blog, 21/07/2026) ; mesures de débit et benchmarks Artificial Analysis (artificialanalysis.ai, relevé du 21/07/2026) ; chiffre CodeMender sur V8 recoupé sur SiliconANGLE, Android Headlines et The Hacker News (21/07/2026) ; score CyberGym et contexte "Gemini 3.5 Pro" rapportés par the-decoder.com (21/07/2026). Les scores de benchmarks reflètent des conditions de test standardisées et peuvent différer des résultats observés sur un cas d'usage réel.

Prêt à intégrer l'IA dans vos processus ?

Audit IA gratuit. Nous identifions les cas d'usage les plus pertinents pour votre activité et vous accompagnons de A à Z.

Victor Gless-Krumhorn

Victor Gless-Krumhorn

Fondateur & Consultant IA — JAIKIN

Expert en implémentation IA et automatisation pour PME et ETI. Accompagne des entreprises en France, en Allemagne et en Suisse, de la cartographie des processus à la mise en production.

1 à 3 tâches automatisables identifiées — diagnostic gratuit

30 minutes avec un expert, un plan d'action écrit sous 24 h.

Devis sous 24 h