Les nouveaux modèles Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber débarquent pour révolutionner les agents IA. Moins chers, plus rapides et plus efficaces : la preuve par les chiffres.
DES MODÈLES CONÇUS POUR LES AGENTS IA EN PRODUCTION
Les développeurs qui construisent des agents IA en production réclament trois choses : une meilleure efficacité en tokens, une latence réduite et des performances fiables. La série Flash de Gemini répond exactement à ces besoins. Elle se positionne comme le compromis idéal entre efficacité et qualité pour faire tourner des workflows agentiques à grande échelle.
Ces nouveaux modèles s’appuient sur les retours des utilisateurs du Gemini 3.5 Flash, déjà en production. Leur objectif ? Pousser encore plus loin les capacités en programmation et en travail de connaissances, tout en améliorant l’efficacité des tokens.
GEMINI 3.6 FLASH : PLUS RAPIDE, PLUS ÉCONOMIQUE, PLUS PERFORMANT
Le Gemini 3.6 Flash hérite directement des retours des développeurs et clients sur le 3.5 Flash. Ses améliorations sont multiples : il consomme 17 % de tokens de sortie en moins que son prédécesseur, selon l’Artificial Analysis Index. Autre atout : il nécessite moins d’étapes de raisonnement et d’appels d’Outils pour accomplir des tâches complexes.
Ces gains d’efficacité s’accompagnent d’une baisse de prix. Le modèle coûte 1,50 $ par million de tokens en entrée et 7,50 $ par million en sortie, contre des tarifs plus élevés pour le 3.5 Flash. Résultat : les agents IA deviennent bien plus rentables à concevoir et à faire fonctionner.
DES PERFORMANCES QUI DÉPASSENT LE 3.5 FLASH DANS PLUSIEURS DOMAINES
Malgré ses gains d’efficacité, le 3.6 Flash améliore aussi ses résultats sur de nombreux cas d’usage. Par exemple, il permet d’analyser des données financières et des transcriptions avec plus de précision et de rapidité, grâce aux Agents Gérés sur AIS.
En matière de migration de code, il exécute des tâches avec une latence réduite et une meilleure qualité, en utilisant l’orchestration multi-agents sur AGY. Pour les workflows 3D, il aide à développer un extracteur de textures photographiques via l’application Canvas.
Avec AGY et l’éditeur hors ligne tldraw, il crée même des studios de thèmes interactifs, grâce à ses compétences en compréhension visuelle. Les clients confirment que le 3.6 Flash marque un progrès en termes de coût, de qualité et d’équilibre entre efficacité des tokens, précision et vitesse.
DES SÉCURITÉS RENFORCÉES POUR ÉVITER LES DÉTOURNEMENTS
Le 3.6 Flash intègre des protections avancées contre les détournements malveillants, notamment dans les domaines CBRN (Chimique, Biologique, Radiologique, Nucléaire) et les attaques cyber offensives. Ces mesures le rendent bien plus résistant aux jailbreaks. En parallèle, il a été entraîné pour limiter les refus d’usage légitimes.
GEMINI 3.5 FLASH-LITE : LE MODÈLE LE PLUS RAPIDE DE LA SÉRIE 3.5
Le Gemini 3.5 Flash-Lite est conçu pour les tâches à faible latence et les flux de travail où le débit est critique. Idéal pour les développeurs, il excelle dans les recherches agentiques et le traitement de documents.
Avec une vitesse de 350 tokens par seconde en sortie, mesurée par Artificial Analysis, il surpasse tous les autres modèles de la série 3.5. Son prix ? 0,30 $ par million de tokens en entrée et 2,50 $ par million en sortie. Il offre un rapport qualité-prix imbattable pour les charges de travail à haut débit en production.
UN MODÈLE POLYVALENT POUR LES AGENTS ET LE CODE
Le 3.5 Flash-Lite permet de faire évoluer efficacement les systèmes agentiques. Selon la charge de travail, les développeurs peuvent configurer le modèle pour privilégier la latence minimale et le coût réduit sur des tâches à haut volume, ou activer des niveaux de réflexion plus élevés pour traiter des sous-tâches multi-étapes. Il intègre désormais l’outil d’usage informatique pour soutenir ces tâches agentiques sur différentes interfaces.
Ses performances sont impressionnantes : 54 % contre 31 % sur Terminal-Bench 2.1, 72,2 % contre 60,1 % sur GDM-MRCR v2 et 1140 contre 642 sur GDPval-AA v2. Sur de nombreux benchmarks agentiques et de programmation, il dépasse même le 3 Flash, avec 54,2 % contre 49,6 % sur SWE-Bench Pro et 74,0 % contre 65,1 % sur OSWorld-Verified.
DES CAS D’USAGE CONCRETS QUI DÉMONTRENT SA PUISSANCE
En tant qu’agent principal aux côtés du 3.6 Flash, le 3.5 Flash-Lite génère instantanément 25 concepts de design web uniques et prêts à être explorés. Il peut aussi traduire et résumer des reçus grâce à sa compréhension multimodale, ou même créer un jeu en générant et itérant plusieurs options en un temps record.
Les premiers clients du 3.5 Flash-Lite soulignent son combo gagnant : rapidité, intelligence et coût maîtrisé, parfait pour faire évoluer les workflows agentiques et les tâches de traitement de données.
GEMINI 3.5 FLASH CYBER : L’ARME SECRÈTE CONTRE LES FAILLES DE SÉCURITÉ
Les modèles IA actuels détectent les vulnérabilités de sécurité plus vite que les systèmes ne parviennent à les corriger. Pour répondre à cette menace grandissante, il faut un outil capable de sécuriser les logiciels de manière à la fois performante et efficace. La série Flash est idéale pour détecter, valider et corriger les problèmes de sécurité dans le code à grande échelle.
Le Gemini 3.5 Flash Cyber s’appuie sur le 3.5 Flash et est spécialement optimisé pour trouver et corriger les vulnérabilités cyber à moindre coût. Dans CodeMender, où plusieurs agents 3.5 Flash Cyber travaillent ensemble pour produire un rapport combiné, le modèle atteint des performances compétitives sur le benchmark CyberGym.
DISPONIBILITÉ IMMÉDIATE POUR DEUX MODÈLES
Les modèles 3.6 Flash et 3.5 Flash-Lite sont disponibles dès aujourd’hui. Les développeurs sont invités à les tester et à partager leurs retours pour améliorer les prochaines versions de Gemini. Le 3.5 Pro est en cours de test avec des partenaires et devrait bientôt être accessible au grand public.
Pour s’inscrire à la newsletter ou recevoir des mises à jour, il suffit de fournir une adresse e-mail différente. Les informations personnelles seront utilisées conformément à la politique de confidentialité de Google. Il est possible de se désinscrire à tout moment.
- Google DeepMind
L'indépendance de CLODCO est votre garantie.
Pour que l'actualité de l'IA reste sans filtre et sans concession, votre soutien est indispensable. Votre contribution est le seul moteur de notre liberté éditoriale.
Soutenir CLODCO


