Gemini 3.8 Flash: le bourreau de travail de Google frôle les modèles frontière
Gemini 3.8 Flash est le modèle de travail de Google, conçu pour le développement logiciel au long cours, les agents autonomes et le raisonnement en plusieurs étapes dans les domaines pointus. Sorti le 2 septembre 2026, trois semaines après Gemini 3.7 Flash, il garde le tarif de lancement de son prédécesseur, soit 0,75 $ le million de tokens en entrée. Sur le banc d'essai DeepSWE v1.1, il devance la plupart des modèles frontière pourtant bien plus gros. Et côté langue, rien ne bloque, le modèle comprend et rédige le français sans accroc.
- Performances proches des modèles frontière pour un coût réduit
- Fenêtre d'un million de tokens, entrées audio et vidéo
- Gros progrès en code autonome sur DeepSWE v1.1
- Niveaux d'effort réglables pour maîtriser la consommation
- Consommation de tokens en hausse sur les tâches complexes
- Variante Cyber réservée à un programme d'accès restreint
- Modèle réservé aux abonnés payants dans l'application Gemini
Gemini 3.8 Flash découpe, vérifie et recommence jusqu'au résultat
Gemini 3.8 Flash avance par petites étapes de raisonnement, rappelle ses outils de façon itérative et vérifie son travail en cours de route, un comportement voulu pour les missions longues. Sa fenêtre de contexte atteint un million de tokens, avec du texte, des images, de l'audio et de la vidéo en entrée, pour 65 536 tokens en sortie. Vous lui confiez un dépôt entier, il lit, corrige, lance les tests et recommence jusqu'à ce que tout passe.
Cette obstination se voit sur les chiffres. Sur DeepSWE v1.1, une épreuve de génie logiciel de longue haleine, il grimpe à environ 71 % contre 65,3 % pour la version 3.7, et il signe 54,9 % sur HLE-Verified. Les agents IA autonomes restent son terrain de prédilection, Google citant aussi des gains sur des épreuves financières et juridiques comme Vals Finance Agent V2 ou le banc d'essai de Harvey.
Trois Flash en six semaines, et un jumeau taillé pour la cybersécurité
Google publie un nouveau modèle Flash toutes les trois semaines environ depuis fin juillet 2026, et Gemini 3.8 Flash constitue le troisième de la série. Le rythme donne presque le tournis, d'autant que le Gemini 3.5 Pro annoncé à l'I/O de mai 2026 se fait toujours attendre.
Le même jour, autre annonce. Gemini 3.8 Flash Cyber, réservé au programme Fairwind, chasse les failles de sécurité en autonomie. L'équipe de Chrome lui attribue 2,6 fois plus de correctifs corrects que des modèles commerciaux beaucoup plus gros, et Wiz rapporte un meilleur taux de détection en test d'intrusion pour un coût nettement inférieur.
| Modèle | Sortie | Ce qui change |
|---|---|---|
| Gemini 3.6 Flash | 21 juillet 2026 | Ouverture de la cadence rapprochée |
| Gemini 3.7 Flash | 13 août 2026 | Cap mis sur le code |
| Gemini 3.8 Flash | 2 septembre 2026 | Agents longue durée, analyse experte |
| Gemini 3.8 Flash Cyber | 2 septembre 2026 | Sécurité, accès restreint via Fairwind |
Gemini 3.8 Flash dans l'app, dans Sheets et via l'API
L'accès grand public passe par l'application Gemini, le mode IA de la recherche Google et Gemini dans Sheets, sur abonnement Google AI Pro ou Ultra. Les développeurs le trouvent dans l'API Gemini, Google AI Studio, Android Studio, Antigravity et Gemini Enterprise.
Reste la question du portefeuille. Le tarif de lancement reprend celui de la version 3.7, soit 0,75 $ le million de tokens en entrée et 3,75 $ en sortie, tokens de réflexion compris dans la facture (le détail se niche dans une note de bas de tableau chez Google). Ces montants doublent au 1er janvier 2027, tandis que le mode batch divise la note par deux. Avant de budgéter, un détour par la grille officielle s'impose, elle bouge au rythme des sorties.
Questions fréquentes
Gemini 3.8 Flash est-il gratuit ?
Non dans l'application Gemini, où sa sélection demande un abonnement Google AI Pro ou Ultra. Les développeurs paient l'API au volume de tokens, avec un tarif de lancement valable jusqu'au 31 décembre 2026. Google AI Studio reste le moyen le plus simple de l'essayer avant d'engager un budget.
Pourquoi Gemini 3.8 Flash consomme-t-il plus de tokens que 3.7 Flash ?
Parce qu'il travaille plus dur, selon les mots de Google. Sur les tâches complexes, il exécute des étapes de raisonnement supplémentaires et rappelle ses outils plusieurs fois, ce qui alourdit le coût par tâche d'environ 40 % malgré un prix au token identique. Vous pouvez abaisser son niveau d'effort, ou rester sur la version 3.7.
Qui peut utiliser Gemini 3.8 Flash Cyber ?
Seuls les gouvernements de confiance, les opérateurs d'infrastructures critiques et les mainteneurs de logiciels y accèdent, via le programme Fairwind créé pour l'occasion. Google encadre ainsi un modèle capable de découvrir des failles en autonomie, son équipe cloud ayant identifié une vulnérabilité critique en moins de deux heures, contre des mois de recherche en temps normal.
Quelle est la date de coupure des connaissances de Gemini 3.8 Flash ?
Mars 2026 pour les domaines les plus à jour, la fenêtre s'étalant de janvier 2025 à mars 2026 selon les spécialités. Pour des informations plus fraîches, le modèle s'appuie sur des outils externes comme la recherche web, facturés à part dans l'API.
Verdict : Pour faire tourner des agents de code ou d'analyse à longueur de journée sans payer le prix d'un modèle frontière, ce Flash est devenu un choix très solide, et les équipes déjà installées dans la galaxie Google en tireront le meilleur.
