Trois modèles Gemini en une journée, et un que Google garde volontairement fermé

Trois modèles Gemini en une journée, et un que Google garde volontairement fermé
Google a dévoilé le 21 juillet 2026 trois modèles Gemini d'un seul coup. Efficacité, latence et sécurité du code, la firme vise désormais les agents IA en production plutôt que les records de benchmarks.

Dix-sept pour cent de tokens de sortie en moins, et jusqu’à 65 % sur certains tests. Le chiffre est tombé mardi sur le blog de Google, sous la signature de Tulsee Doshi, directrice produit senior. Deux mois seulement après Gemini 3.5 Flash, présenté à Google I/O en mai, Mountain View remet une pièce dans la machine avec trois annonces le même jour. Les deux premiers modèles sont déjà accessibles dans l’API Gemini via Google AI Studio et Android Studio, dans Gemini Enterprise et dans l’application Gemini.

Le modèle du quotidien consomme enfin moins

Google range Gemini 3.6 Flash dans la catégorie workhorse, le modèle à tout faire, celui qui encaisse le codage, la recherche documentaire et le multimodal sans faire exploser la facture. D’après l’Artificial Analysis Index cité par Google, il génère 17 % de tokens de sortie en moins que Gemini 3.5 Flash. Sur le benchmark DeepSWE de Datacurve, l’écart grimpe jusqu’à 65 %.

DeepSWE passe de 37 % à 49 %, MLE Bench de 49,7 % à 63,9 %, et la maîtrise de l’ordinateur mesurée par OSWorld-Verified monte de 78,4 % à 83 %. Google promet surtout moins de modifications de code non désirées et moins de boucles d’exécution, deux plaies bien connues des développeurs qui font tourner des agents en production.

Côté tarif, le million de tokens de sortie tombe autour de 6,60 € (10,50 $ CAD), contre environ 7,90 € (12,65 $ CAD) pour la génération précédente, d’après les grilles relayées par 9to5Google.

Flash-Lite mise tout sur la vitesse

Gemini 3.5 Flash-Lite joue une autre partition. Le modèle débite 350 tokens de sortie par seconde pour environ 2,20 € (3,50 $ CAD) le million de tokens générés. Google le destine aux flux à très gros volume, recherche agentique et traitement documentaire en tête.

Sa progression impressionne davantage que sa vitesse. Terminal-Bench 2.1 grimpe de 31 % à 54 %, GDM-MRCR v2 de 60,1 % à 72,2 %, et Google affirme qu’il dépasse même Gemini 3 Flash sur SWE-Bench Pro. Le modèle se déploie progressivement dans Google Search.

Flash Cyber reste sous clé

Le troisième modèle intrigue davantage qu’il ne rassure. Gemini 3.5 Flash Cyber, affiné pour repérer et corriger les vulnérabilités de code, tourne à l’intérieur de l’agent CodeMender. Google reconnaît le caractère à double usage de la technologie et réserve l’accès aux gouvernements et à des partenaires de confiance, dans un programme pilote fermé. Gizmodo y voit une prudence assumée plutôt qu’un coup d’éclat.

Gemini 3.5 Pro tourne encore chez des partenaires triés, et l’équipe a lancé son entraînement le plus ambitieux à ce jour pour Gemini 4. Le rythme ne ralentit pas.

Partagez maintenant !

Auteur Bertrand
Rédacteur web spécialisé dans le jeu vidéo, je contribue à Jeux.com depuis 2025 en rédigeant des articles d'actualité, des guides et des contenus optimisés pour le référencement. Mon objectif est de fournir une information claire, précise et engageante.
Scroll to Top