Gemini 3.8 Flash : prix, accès et nouveautés du modèle Google
Gemini 3.8 Flash est disponible depuis le 2 septembre 2026 pour améliorer le codage, les tâches agentiques et le raisonnement complexe. Il succède à Gemini 3.7 Flash seulement trois semaines après son lancement. Le modèle vise surtout les développeurs et les usages professionnels, mais arrive aussi dans plusieurs services grand public payants. Un point mérite attention : il peut consommer davantage de tokens sur certaines tâches, ce qui peut augmenter la facture réelle.

À retenir
- Le tarif API introductif reste à 0,75 dollar en entrée et 3,75 dollars en sortie par million de tokens.
- La fenêtre de contexte peut atteindre 1 million de tokens.
- Le modèle est déjà proposé aux développeurs, entreprises et abonnés Google AI Pro et Ultra.
Gemini 3.8 Flash mise sur le codage et les agents
Le nouveau modèle est conçu pour avancer plus longtemps sur une tâche complexe. Il peut multiplier les étapes de raisonnement et les appels à des outils. Cette approche cible le développement logiciel, les agents autonomes et les workflows nécessitant plusieurs actions successives. L’annonce officielle détaille aussi des progrès sur les tâches spécialisées.
Le score publié atteint 54,9 % sur HLE-Verified, un benchmark de raisonnement multi-étapes. Ce résultat reste une évaluation présentée par le constructeur, pas un test indépendant applicable à tous les usages. Pour un développeur, l’intérêt principal tient davantage aux tâches longues et aux appels répétés d’outils. Les gains réels dépendront du code, des consignes et du niveau d’effort choisi.
Le prix par token ne raconte pas toute la facture
Le tarif API introductif ne change pas par rapport au modèle précédent. Il est annoncé à 0,75 dollar par million de tokens d’entrée et 3,75 dollars en sortie. Le 1er janvier 2027, ces montants doivent passer à 1,50 dollar et 7,50 dollars. Cette échéance compte pour les équipes qui calculent un coût d’exploitation sur plusieurs mois.
Un tarif identique par token ne garantit pourtant pas un coût identique par tâche. Le modèle peut générer davantage de tokens avec un niveau d’effort élevé. Une requête complexe peut donc coûter plus cher si elle multiplie le raisonnement ou les appels à des outils. Les équipes sensibles au budget peuvent réduire l’effort ou conserver Gemini 3.7 Flash pour certains traitements simples.
Où le nouveau modèle est déjà disponible
Les développeurs peuvent utiliser le modèle via Gemini API et Google AI Studio. Il est aussi intégré à Android Studio, Stitch et à l’environnement agentique Antigravity. Côté entreprises, l’accès passe également par Gemini Enterprise. Cette diffusion rapide en fait une brique de production, au-delà d’un simple chatbot de démonstration.
Pour le grand public, l’accès concerne les abonnés Google AI Pro et Ultra dans l’application Gemini, AI Mode et Google Sheets. Notre dossier sur les Aperçus IA Google en France replace AI Mode dans l’évolution récente du moteur de recherche. Les usages professionnels de Gemini éclairent aussi la place prise par l’IA dans le travail. L’accès réel dépend donc du service et de l’offre utilisée.
Une grande fenêtre de contexte, avec des limites à garder en tête
La fiche technique indique une fenêtre de contexte allant jusqu’à 1 million de tokens. La sortie texte maximale atteint 64 000 tokens. Le modèle accepte du texte, des images, de l’audio et de la vidéo. Cette capacité facilite l’analyse de gros volumes, sans garantir une réponse parfaite ni l’usage optimal de tout le contexte.
La fiche de modèle signale encore des hallucinations possibles, ainsi que des lenteurs ou des expirations occasionnelles. Elle précise aussi que la consommation peut augmenter aux niveaux d’effort élevés. Une validation humaine reste donc nécessaire pour le code, les décisions sensibles et les informations importantes. Cette prudence compte surtout dans les workflows automatisés, où une erreur peut se propager.
Gemini 3.8 Flash renforce surtout l’offre destinée aux tâches longues, au codage et aux agents. Son prix d’appel reste inchangé jusqu’à la fin de 2026, mais le coût réel dépend des tokens consommés. Les limites habituelles des modèles génératifs restent présentes. Pour les utilisateurs, le bon critère sera le rapport entre qualité, vitesse et facture sur leurs propres usages.
Gemini 3.8 Flash est-il gratuit ?
Pas dans tous ses usages. L’accès grand public annoncé concerne Google AI Pro et Ultra, tandis que l’API est facturée à la consommation.
Quelle est la taille de sa fenêtre de contexte ?
Elle peut atteindre 1 million de tokens, avec une sortie texte maximale de 64 000 tokens.
Faut-il remplacer Gemini 3.7 Flash immédiatement ?
Non. Le modèle précédent reste pris en charge lorsque l’efficacité ou la maîtrise des tokens prime.
