Google a annoncé Gemini 4 Argon le 30 septembre 2026. Le modèle est d’abord déployé auprès d’un groupe de spécialistes de la cybersécurité de confiance, dans le cadre du programme Fairwind de l’entreprise. Argon est présenté comme un « modèle de pointe », capable de raisonner sur de très longs contextes et de gérer des tâches complexes en plusieurs étapes dans les domaines du code, de la finance, du droit et de la cybersécurité.
Le lancement s’accompagne d’une approche de sécurité par étapes. Google participe au processus américain d’accès volontaire aux modèles avant leur publication et renforce les garde-fous avant d’ouvrir le modèle aux développeurs, aux entreprises et au grand public. Les tarifs commencent à 2 $ par million de tokens en entrée et à 10 $ par million de tokens en sortie. Les tokens d’entrée mis en cache bénéficient d’une réduction de 95 %.
Comment en est-on arrivé là
La gamme Gemini a débuté avec les premiers modèles Flash, économiques et polyvalents. En juillet 2026, DeepMind a lancé son « entraînement préalable le plus ambitieux à ce jour » pour Gemini 4, avec l’objectif de créer un modèle bien plus grand que Gemini 3.5 Pro, qui n’a jamais été commercialisé. Des fuites avaient évoqué une immense fenêtre de contexte et des limites de sortie élevées, mais l’article officiel confirme désormais une fenêtre de sortie de 1 million de tokens, contre une limite de 64 K pour Gemini 3.8 Flash.
Selon Google, Argon alimente déjà des outils internes. Des ingénieurs indiquent que le modèle a contribué à libérer 300 TiB de mémoire dans les parcs de centres de données et à accélérer de 2,7 × un décodeur vidéo après une réécriture du code en Rust. Dans le cadre de travaux sur les algorithmes quantiques, Argon a réduit de 40 % un indicateur de goulot d’étranglement en quelques minutes.
Et maintenant ?
Après le projet pilote Fairwind, Google prévoit d’élargir l’accès aux clients payants de l’API et aux abonnés Google AI Ultra. L’entreprise continuera de recueillir des retours sur la sécurité, notamment au sujet des usages abusifs, des attaques par injection de prompt et de l’alignement. Des tests continus en équipe rouge et le renforcement des environnements isolés font partie de la feuille de route.
Pour le grand public, le changement le plus visible prendra la forme de nouvelles fonctionnalités d’IA dans Google Workspace, capables de rédiger des documents juridiques, de mener des analyses financières en plusieurs étapes ou de proposer des corrections de code. Ces fonctionnalités ne seront disponibles qu’après le déploiement élargi, dont la date n’est pas encore fixée.
Pourquoi c'est important
Pour les équipes de cybersécurité, Argon offre un assistant puissant capable de détecter et de corriger automatiquement les vulnérabilités logicielles, ce qui pourrait réduire les risques de fuite de données. Les développeurs et les entreprises pourront bientôt utiliser des assistants d’IA capables de traiter des bases de code bien plus volumineuses ou de longs documents juridiques sans avoir à découper le travail en une multitude de prompts courts. Le modèle étant toutefois encore en phase pilote limitée, la plupart des utilisateurs devront attendre l’ouverture plus large de l’API avant de constater un effet sur les prix ou les performances.