Google a annoncé le 30 septembre 2026 Gemini 4 Argon, son nouveau modèle frontier, via Koray Kavukcuoglu (SVP Google DeepMind et Chief AI Architect). Le déploiement commence par le programme Fairwind, réservé à des cyberdéfenseurs de confiance, avant une ouverture progressive aux clients API payants et aux abonnés Google AI Ultra. Prix d’introduction : 2 $ par million de tokens en entrée et 10 $ en sortie, avec les tokens d’entrée mis en cache à −95 %. Sources : blog.google, Engadget, SiliconANGLE.

Argon vise les workflows longs et complexes : ingénierie logicielle réelle, métiers d’entreprise (juridique, finance), et défense cyber. Google a clairement sauté l’étape Gemini 3.5 Pro pour concentrer l’effort sur cette génération 4, confirme Engadget. Côté garde-fous, la firme dit participer au processus volontaire américain d’accès pré-lancement et durcir encore les protections contre les usages offensifs (cyber, CBRN) avant une dispo large.
Fairwind, CWE-bench et 1 million de tokens en sortie
Hors équipes internes Google, seuls les membres Fairwind touchent Argon pour l’instant. Le programme, ouvert le 3 septembre avec Gemini 3.8 Flash Cyber, compte déjà plus de 650 organisations (CrowdStrike, Palo Alto Networks…), selon SiliconANGLE. Les défenseurs de confiance et les équipes Google reçoivent une version sans garde-fous cyber, capable de trouver, valider et corriger des failles. Sur CWE-bench v1, Argon égale la première place à 68 %, à égalité avec Grok 4.7 et GPT-6 Astra (Engadget / blog Google). Wiz, via Scan for Good, a déjà signalé une faille critique sur un logiciel de santé utilisé par des hôpitaux dans le monde, manquée par d’autres modèles frontier.
Pour soutenir ces trajectoires longues, Google porte la limite de tokens en sortie à 1 million (contre 64 000 sur les Gemini précédents). Engadget compare à environ 128 000 tokens en sortie pour GPT-6 Astra. Sur DeepSWE v1.1, Google affiche 77,9 % ; sur AutomationBench (Zapier), Argon est donné n°1 à 51,3 %.
2 $ / 10 $ en intro, benches Artificial Analysis
Le tarif d’appel (2 $/10 $) est une promo : après la période d’introduction, Google annonce 4 $ / 20 $ par million de tokens. Chez Artificial Analysis, Gemini 4 Argon (high) marque 53 à l’Intelligence Index, à égalité avec GPT-6 Astra (max), un point devant GPT-6.1 Sol, pour environ 60 % du coût par tâche aux prix promo (~1,99 $). Sur AA-Omniscience, le taux d’hallucination tombe à 15 %, le plus bas des modèles au-dessus de 45 à l’Index, contre 51 % pour Astra et 54 % pour Sol. Attention au sens du chiffre : Argon refuse plus souvent de répondre quand il ne sait pas ; sa précision brute reste autour de 50 %, sous Astra (~63 %).
En interne, des milliers de Googlers s’en servent déjà. Exemples cités : optimisation quantique (sous-routines battant une baseline publiée de 40 % en quelques minutes), agents qui ont libéré plus de 300 TiB de mémoire sur le parc de datacenters, et migrations C/C++ vers Rust jusqu’au noyau Zircon de Fuchsia (800 000+ lignes). Sur libgav1, le décodeur vidéo open source, le port Rust accéléré par Argon tourne 2,7× plus vite que le port précédent, sortie vidéo identique.
Pas de date ferme pour l’API grand public. La feuille de route reste : feedback Fairwind, renforcement des garde-fous (injection de prompts, désalignement, sandboxes), puis clients API payants et Google AI Ultra. Pour un modèle annoncé « frontier », le choix de commencer par la cyberdéfense, plutôt que par le chat grand public, dit aussi le niveau de prudence que Google veut afficher après les polémiques récentes sur Gemini.
Sources : Google (Koray Kavukcuoglu, 30 sept. 2026) ; Engadget (Mariella Moon, 1er oct. 2026) ; SiliconANGLE (Duncan Riley) ; Artificial Analysis.

