Le directeur senior de la gestion des produits chez Google, Tulsee Doshi, a publié le 21 juillet sur son blog officiel pour annoncer le lancement de Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, tous conçus spécifiquement pour des flux de travail d’agents IA. Par ailleurs, le préentraînement de Gemini 4 a déjà démarré.
Gemini 3.6 Flash est le modèle phare de la nouvelle série, avec des performances nettement améliorées dans l’écriture de code, les tâches de connaissances et les missions multimodales. Les capacités d’utilisation d’ordinateurs (OSWorld-Verified) atteignent 83,0 % ; d’après l’Artificial Analysis Index, l’usage des jetons en sortie est inférieur de 17 % à celui de la génération précédente. Lors des tests de référence tels que DeepSWE, la réduction peut aller jusqu’à 65 %.
Les outils d’utilisation d’ordinateurs (computer use tools) sont désormais intégrés directement à l’API Gemini et à l’offre entreprise, sans configuration supplémentaire. Côté tarification : 1,50 dollar pour chaque million de jetons en entrée, et 7,50 dollars pour chaque million de jetons en sortie.
Gemini 3.5 Flash-Lite est conçu pour les tâches à faible latence et à haut débit (comme la recherche par agents et le traitement de documents). Ses principales caractéristiques sont les suivantes :
Vitesse de sortie : 350 tokens/s
Tarification : 0,30 dollar pour chaque million de jetons en entrée, et 2,50 dollars pour chaque million de jetons en sortie
Niveaux de réflexion : prise en charge de thinking levels ajustables ; les développeurs peuvent basculer entre un mode de faible réflexion (adapté aux tâches à haute fréquence) et un mode de réflexion élevée (pour traiter des flux de travail d’agents sous-jacents complexes)
Performances aux tests : dépassement de la version standard de Gemini 3 Flash dans les évaluations à long contexte et pour le codage par agents
Gemini 3.5 Flash Cyber est un modèle dérivé de 3.5 Flash, ajusté (fine-tuned) et conçu pour des scénarios de cybersécurité axés sur la défense. Le modèle peut s’intégrer à une collaboration avec des systèmes multi-agents comme CodeMender pour produire rapidement des rapports consolidés, aidant les défenseurs à identifier et corriger des vulnérabilités de cybersécurité. En raison des risques liés à l’usage à double finalité des technologies concernées, l’accès à Gemini 3.5 Flash Cyber est actuellement strictement limité : il est réservé aux organismes gouvernementaux et aux partenaires de confiance, via des programmes pilotes, pour un accès limité.
Tulsee Doshi a annoncé dans un article de blog officiel daté du 21 juillet 2026 que Google a officiellement lancé les travaux de préentraînement de Gemini 4, et l’a décrit comme le plan « le plus ambitieux » de Google. En outre, Gemini 3.5 Pro est actuellement testé avec des partenaires ; après une diffusion plus large de Gemini 3.5 Pro, les progrès ultérieurs de Gemini 4 seront également communiqués au fur et à mesure. Le calendrier précis dépendra des annonces officielles de Google.
Les développeurs peuvent désormais accéder aux modèles Gemini 3.6 Flash et Gemini 3.5 Flash-Lite via des canaux tels que Gemini API.
D’après le blog officiel de Google, la tarification de Gemini 3.6 Flash est de 1,50 dollar pour chaque million de jetons en entrée et 7,50 dollars pour chaque million de jetons en sortie ; dans l’évaluation des capacités d’utilisation d’ordinateurs (OSWorld-Verified), le modèle atteint 83,0 %, et l’usage des jetons en sortie est réduit de 17 % par rapport à la version précédente (jusqu’à 65 % de réduction dans le benchmark DeepSWE).
La vitesse de sortie de Gemini 3.5 Flash-Lite atteint 350 jetons par seconde, et la tarification est de 0,30 dollar pour chaque million de jetons en entrée et 2,50 dollars pour chaque million de jetons en sortie ; le modèle prend en charge des thinking levels ajustables, adaptés aux tâches à faible latence comme la recherche par agents et le traitement de documents.
Gemini 3.5 Flash Cyber est actuellement limité à un accès limité réservé aux organismes gouvernementaux et aux partenaires de confiance via des programmes pilotes, et ce afin que Google prenne en compte le risque d’usage à double finalité des technologies liées à la cybersécurité ; la méthode de demande d’accès exacte dépendra des annonces officielles de Google.
Actualités associées
Google lance trois nouveaux modèles d’IA Gemini avec des coûts plus faibles
Google, AMD, et TSMC étendent leurs investissements dans l’IA malgré la volatilité du marché
Google développe Frozen v2, une puce d’IA, entraînant la hausse des actions d’Alphabet de 1,52 %
AMD lance la MI450 avec une mémoire supérieure à celle de Nvidia, et les actions de Samsung Electronics et de SK Hynix en profitent