Google poursuit à un rythme soutenu le renouvellement de sa gamme d’intelligence artificielle avec Gemini 3.8 Flash. Lancé seulement trois semaines après Gemini 3.7 Flash, ce nouveau modèle mise sur de meilleures performances en programmation et en raisonnement, tout en conservant des tarifs nettement inférieurs à ceux des modèles haut de gamme concurrents.
Gemini 3.8 Flash arrive seulement trois semaines après son prédécesseur
Gemini 3.8 Flash constitue le troisième modèle Flash lancé par Google en l’espace de six semaines. La version 3.7 avait été dévoilée le 13 août, tandis que les modèles plus puissants de la gamme continuent de se faire attendre, notamment Gemini 3.5 Pro, annoncé en mai, et Gemini 4, toujours en cours d’entraînement.
Chez Google, l’appellation « Flash » désigne des modèles conçus pour privilégier la rapidité et la maîtrise des coûts. Ils sont notamment utilisés dans l’application Gemini et peuvent être intégrés à grande échelle par les développeurs via API.
Les modèles Pro sont, pour leur part, destinés aux tâches nécessitant davantage de capacités de raisonnement, au prix d’une consommation de ressources et d’un coût généralement plus élevés.
Des performances proches des modèles haut de gamme
Gemini 3.8 Flash réduit toutefois sensiblement l’écart entre ces deux catégories.
Sur DeepSWE, un benchmark évaluant la capacité d’une intelligence artificielle à résoudre de véritables problèmes rencontrés dans des logiciels, le nouveau modèle obtient un score de 73,7 %. Gemini 3.7 Flash atteignait 65 %.
Claude Opus 5 et GPT-5.6 Sol directement concurrencés
Ce résultat place Gemini 3.8 Flash à proximité immédiate de Claude Opus 5 d’Anthropic, crédité de 74 %, et devant GPT-5.6 Sol d’OpenAI, qui obtient 72,7 % selon les chiffres cités.
L’écart est également marqué sur Terminal-Bench, qui mesure la capacité d’un modèle à exécuter une succession de commandes dans un terminal afin d’accomplir une tâche. Gemini 3.8 Flash atteint 90,8 %, contre 81,6 % pour la génération précédente.
Artificial Analysis lui attribue par ailleurs un score de 59 sur son indice d’intelligence, soit trois points supplémentaires par rapport à Gemini 3.7 Flash et un niveau comparable à celui de GPT-5.6 Sol dans sa configuration la plus poussée.
Un tarif attractif, mais une consommation supérieure
Google facture Gemini 3.8 Flash 0,75 dollar par million de tokens en entrée et 3,75 dollars par million de tokens générés jusqu’à la fin de l’année. Les tarifs doivent ensuite doubler en janvier.
Même après cette augmentation annoncée, le positionnement tarifaire reste inférieur à celui de Claude Opus 5, facturé 5 dollars par million de tokens en entrée et 25 dollars en sortie selon les données mentionnées.
Cette comparaison doit néanmoins être nuancée. Gemini 3.8 Flash consacre davantage de ressources au raisonnement et produit environ 30 % de texte supplémentaire pour parvenir à ses réponses. Au total, une tâche complète peut ainsi coûter environ 40 % de plus qu’avec Gemini 3.7 Flash.
Google recommande donc de conserver la génération précédente lorsque la priorité absolue est de réduire les coûts.
Google déploie Gemini 3.8 Flash dans plusieurs services
Le nouveau modèle est immédiatement intégré à l’application Gemini pour les abonnés payants. Il doit également être disponible dans le mode IA du moteur de recherche Google ainsi que dans Google Sheets.
Cette intégration illustre la volonté du groupe américain d’étendre rapidement ses nouveaux modèles à ses services grand public et professionnels, dans un marché où les principaux acteurs multiplient les mises à jour.
Anthropic avait d’ailleurs présenté la veille Fable 5.1, un modèle qui adopte lui aussi une approche consistant à consacrer davantage de calcul et de génération à certaines réponses afin d’améliorer leur qualité.
Une version Cyber destinée aux infrastructures sensibles
Google accompagne également Gemini 3.8 Flash d’une déclinaison spécialisée baptisée Cyber.
Cette version est destinée aux États, aux opérateurs d’infrastructures et aux équipes chargées de la maintenance de logiciels dans le cadre d’un programme appelé Fairwind.
Selon les résultats communiqués, Gemini 3.8 Flash Cyber identifierait davantage de vulnérabilités dans du code écrit en langage C que GPT-5.6 Sol.
Une résistance renforcée aux injections de prompt
Le modèle résisterait également à 94,5 % des tentatives d’injection de prompt. Cette technique consiste à intégrer des instructions malveillantes ou trompeuses dans des contenus analysés par une intelligence artificielle afin de modifier son comportement ou de contourner ses règles.
Cette résistance constitue un enjeu particulièrement important pour les modèles déployés dans des environnements informatiques sensibles ou utilisés pour examiner automatiquement du code et des documents provenant de sources externes.
La gamme Flash brouille la frontière avec les modèles Pro
Avec Gemini 3.8 Flash, Google renforce une tendance déjà visible dans l’industrie : les modèles présentés comme rapides et économiques deviennent suffisamment performants pour rivaliser avec certaines solutions haut de gamme sur des tâches spécialisées.
Les résultats obtenus en programmation et dans l’utilisation d’un terminal placent notamment cette nouvelle génération très près de modèles beaucoup plus coûteux. En contrepartie, l’augmentation du temps de raisonnement et du volume de texte généré réduit une partie de l’avantage économique par rapport à Gemini 3.7 Flash.
Gemini 3.8 Flash confirme ainsi l’accélération de la compétition entre Google, Anthropic et OpenAI. Pour Google, le défi sera désormais de maintenir cet équilibre entre performances, rapidité et coût tout en clarifiant la place de ses futurs modèles Pro face à une gamme Flash devenue de plus en plus capable.

Damien Forest écrit pour Algerie Monde Infos sur l’actualité, la politique, l’économie, la technologie, le sport, le divertissement et le lifestyle. Il privilégie une information claire, fiable et accessible, en mettant l’accent sur les sujets et événements qui intéressent les lecteurs.
