{"slug": "gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour", "title": "Gemini 3.8 Flash vs 3.7 Flash : Nouveautés et faut-il mettre à jour ?", "summary": "Google released Gemini 3.8 Flash on September 2, 2026, three weeks after Gemini 3.7 Flash, with the same pricing and context window but improved reasoning and tool use. Benchmarks show modest gains over 3.7 Flash, such as a higher Artificial Analysis intelligence index (59 vs. 56) and a 12-point improvement on the τ³-Banking tool-use benchmark. Google says 3.8 Flash is its most intelligent Flash model, but 3.7 Flash remains fully supported, so migration is not urgent.", "body_md": "Google a lancé Gemini 3.8 Flash le 2 septembre 2026, trois semaines après Gemini 3.7 Flash et six semaines après 3.6 Flash. Le prix de lancement reste identique — 0,75 $ en entrée et 3,75 $ en sortie par million de jetons jusqu'au 31 décembre — tout comme le contexte d'un million de jetons et une vitesse annoncée comme similaire. La différence principale est le fonctionnement du modèle : raisonnement en étapes plus courtes, vérification de ses propres résultats et appels d'outils itératifs. Les scores progressent, mais chaque tâche peut consommer davantage de jetons.\n\n[Essayez Apidog dès aujourd’hui](https://apidog.com/?utm_source=dev.to&utm_medium=wanda&utm_content=n8n-post-automation)\n\nLa vraie question n'est donc pas de savoir si 3.8 Flash est meilleur — sur le papier, oui — mais si le gain de qualité justifie le coût supplémentaire pour votre charge de travail et si votre code supporte les changements d'API.\n\nGoogle indique que Gemini 3.7 Flash « reste entièrement pris en charge » et n'a annoncé aucune date de dépréciation. La migration n'est pas urgente.\n\n| Critère | Gemini 3.8 Flash | Gemini 3.7 Flash |\n|---|---|---|\n| ID du modèle | `gemini-3.8-flash` |\n`gemini-3.7-flash` |\n| Date de sortie | 2 septembre 2026 | 13 août 2026 |\n| Base | « Basé sur Gemini 3.7 Flash » | — |\n| Contexte / sortie maximale | 1 048 576 / 65 536 jetons | Identique |\n| Prix d'entrée jusqu'au 31 décembre 2026 | 0,75 $ / million | 0,75 $ / million |\n| Prix de sortie jusqu'au 31 décembre 2026 | 3,75 $ / million, réflexion incluse | 3,75 $ / million, réflexion incluse |\n| Prix standard à partir du 1er janvier 2027 | 1,50 $ / 7,50 $ | 1,50 $ / 7,50 $ |\n| Lecture du cache de contexte | 0,075 $ / million au lancement | Identique |\n| Traitement par lots | Réduction de 50 % | Identique |\n| Niveaux de réflexion |\n`low` , `medium` par défaut, `high`\n|\n`low` , `medium` , `high`\n|\n| Niveau minimal | Erreur de validation | Accepté, à mapper vers `low`\n|\n| Date limite de connaissance | Mars 2026 | Non précisée dans la documentation 3.8 |\n| Vitesse de sortie | Environ 300 jetons/s | Environ la même vitesse |\n| Indice d'intelligence Artificial Analysis | 59 | 56 |\n| Support | Version actuelle | Entièrement prise en charge |\n\nLes deux modèles partagent :\n\n`generateContent`\n\n.La vitesse est également proche. Google décrit 3.8 Flash comme ayant « le même prix que 3.7, et une vitesse similaire ». Artificial Analysis a mesuré 302,1 jetons de sortie par seconde au niveau `high`\n\n. Le temps avant le premier jeton était toutefois de 13,30 secondes, car le modèle raisonne avant de commencer à répondre.\n\nLe code existant fonctionne généralement après avoir remplacé l'identifiant du modèle par `gemini-3.8-flash`\n\n, sous réserve des changements majeurs décrits plus loin.\n\nGoogle présente 3.8 Flash comme « notre modèle Flash le plus intelligent », destiné notamment à l'ingénierie logicielle longue, aux agents autonomes et aux workflows d'entreprise complexes.\n\nSur les tâches difficiles, le modèle :\n\n| Benchmark | 3.8 Flash | 3.7 Flash | Écart |\n|---|---|---|---|\n| Agent financier Vals v2 | 61,4 % | 59,0 % | +2,4 |\n| HLE-Verified | 54,9 % | 53,6 % | +1,3 |\n| Benchmark de l'agent juridique Harvey | 10,0 % | 8,8 % | +1,2 |\n\nLes gains sont modestes mais constants. Dans ces trois benchmarks, 3.8 Flash dépasse aussi les modèles plus coûteux présentés dans le tableau de Google, notamment Claude Opus 5 et GPT-5.6 Sol.\n\nArtificial Analysis attribue un indice d'intelligence de 59 à 3.8 Flash au niveau `high`\n\n, contre 56 pour 3.7 Flash et 52 pour 3.6 Flash. Sur τ³-Banking, son benchmark d'utilisation d'outils, 3.8 Flash atteint 45 %, soit 12 points de plus que 3.7 Flash.\n\nPour les agents qui utilisent réellement des outils, ce résultat est probablement plus utile que l'indice général.\n\nGoogle affirme que 3.8 Flash accomplit « plus de trois fois plus de tâches que Gemini 3.7 Flash » dans les workflows longs et riches en documents.\n\nIl s'agit d'une évaluation interne, sans harnais public. Elle reste néanmoins cohérente avec la conception du modèle : davantage de vérifications peuvent réduire les erreurs dans une tâche composée de dizaines d'étapes.\n\nSur DeepSWE v1.1, Gemini 3.7 Flash a obtenu 65,3 %, contre 49,0 % pour 3.6 Flash. Google affirme que 3.8 Flash dépasse la plupart des grands modèles frontières pour une fraction du coût, mais le score exact n'est pas fourni dans le texte de la fiche modèle.\n\nLes résultats textuels de 3.8 Flash pour SWE-Bench Pro, Terminal-Bench et OSWorld ne sont pas publiés. Si ces benchmarks sont déterminants pour votre projet, mesurez-les sur votre propre dépôt ou attendez des évaluations indépendantes.\n\nGoogle signale un « bond significatif » sur les tests d'injection de prompt Gray Swan, sans publier de score global.\n\nLes écarts détaillés par rapport à 3.7 Flash sont les suivants :\n\nCe dernier résultat indique une légère hausse des refus excessifs.\n\n| Configuration | Coût par tâche | Temps par tâche |\n|---|---|---|\nGemini 3.7 Flash, `high`\n|\n0,40 $ | 2,2 min |\nGemini 3.8 Flash, `low`\n|\n0,24 $ | 0,8 min |\nGemini 3.8 Flash, `medium`\n|\n0,41 $ | Non publié |\nGemini 3.8 Flash, `high`\n|\n0,58 $ | 2,5 min |\n\nTrois conclusions pratiques :\n\n`high`\n\ncoûte environ 45 % de plus`high`\n\n, avec 14 % de temps réel supplémentaire.`medium`\n\ncoûte presque autant`high`\n\n.`low`\n\nest à la fois moins cher et plus rapideLe niveau de réflexion est donc le principal réglage pour arbitrer qualité, coût et latence.\n\n`thinking_level: \"minimal\"`\n\nn'est plus accepté\nGemini 3.8 Flash accepte uniquement :\n\n```\n{\n  \"thinkingLevel\": \"low\"\n}\n```\n\nLes valeurs disponibles sont :\n\n`low`\n\n;`medium`\n\n;`high`\n\n.Une configuration 3.7 utilisant `minimal`\n\nrenvoie désormais une erreur de validation. Mappez cette valeur vers `low`\n\navant la migration.\n\n`call_id`\n\net `name`\n\nAvec l'API Interactions, chaque `function_result`\n\ndoit contenir les deux champs :\n\n```\n{\n  \"type\": \"function_result\",\n  \"call_id\": \"call_123\",\n  \"name\": \"search_database\",\n  \"result\": {\n    \"items\": []\n  }\n}\n```\n\nAvec l'ancien endpoint `generateContent`\n\n, `functionResponse`\n\ndoit également renvoyer l'identifiant correspondant et le nom de la fonction.\n\nUn système qui renvoie uniquement les résultats indexés par le nom de la fonction peut échouer au deuxième tour d'une boucle d'outils.\n\nLe guide de migration recommande également de vérifier les points suivants :\n\n`temperature`\n\nà sa valeur par défaut, `1.0`\n\n;`thinking_level`\n\nplutôt qu'un entier `thinking_budget`\n\n;`candidate_count`\n\n;Ces règles ne sont pas toutes nouvelles avec 3.8, mais une base de code 3.7 qui les ignorait peut révéler ses problèmes lors du changement de modèle.\n\n| Charge de travail | Recommandation | Raisons |\n|---|---|---|\n| Agents multi-étapes avec appels d'outils | Migrer vers `medium` ou `high`\n|\n+12 points sur τ³-Banking et boucles d'outils itératives |\n| Extraction et révision de documents longs | Migrer | Le gain annoncé par Google cible précisément ce scénario |\n| Codage agentique | Migrer, puis mesurer | Les données textuelles DeepSWE sont encore incomplètes |\n| Agents financiers, juridiques et de recherche | Migrer | Les trois benchmarks publiés par Google sont favorables |\n| Classification, extraction et chat à gros volume | Rester sur 3.7 ou utiliser 3.8 en `low`\n|\nLe coût par tâche est prioritaire |\n| Endpoints utilisateur sensibles à la latence | Utiliser 3.8 en `low`\n|\n0,8 minute par tâche contre 2,2 minutes pour 3.7 en `high`\n|\nConfiguration utilisant `minimal`\n|\nMigrer d'abord le paramètre | Erreur de validation sans conversion vers `low`\n|\n| Pipelines batch au centime près | Rester sur 3.7 jusqu'à une nouvelle évaluation | 30 % de jetons de sortie supplémentaires peuvent augmenter la facture |\n\nEn résumé : plus la tâche est longue, difficile et agentique, plus le raisonnement supplémentaire de 3.8 justifie son coût. Pour les tâches courtes et répétitives, le niveau de réflexion et le coût par tâche comptent davantage que le score maximal.\n\nLes chiffres d'Artificial Analysis ne reflètent pas nécessairement votre application. Avant de changer le modèle en production, exécutez les mêmes prompts sur Gemini 3.7 Flash et Gemini 3.8 Flash.\n\nDans [Apidog](https://apidog.com/?utm_source=dev.to&utm_medium=wanda&utm_content=n8n-post-automation) :\n\n`GEMINI_API_KEY`\n\ncomme variable d'environnement ;`model`\n\ncomme variable de scénario ;`POST`\n\nvers l'endpoint suivant :\n\n```\nhttps://generativelanguage.googleapis.com/v1beta/models/{{model}}:generateContent\n```\n\nConfigurez l'en-tête `x-goog-api-key`\n\npour utiliser la variable d'environnement, puis utilisez le même corps pour les deux modèles :\n\n```\n{\n  \"contents\": [\n    {\n      \"parts\": [\n        {\n          \"text\": \"{{golden_prompt}}\"\n        }\n      ]\n    }\n  ],\n  \"generationConfig\": {\n    \"thinkingConfig\": {\n      \"thinkingLevel\": \"medium\"\n    }\n  }\n}\n```\n\nConstruisez ensuite un scénario en deux étapes :\n\n`model = gemini-3.7-flash`\n\n;`model = gemini-3.8-flash`\n\n.Ajoutez des assertions sur :\n\n`usageMetadata.candidatesTokenCount`\n\n;`usageMetadata.thoughtsTokenCount`\n\n;Utilisez un plafond correspondant à votre budget et exécutez le scénario sur 10 à 20 prompts de référence. Le rapport regroupera les réponses, les nombres de jetons et les résultats des assertions pour les deux modèles.\n\nUne fois les seuils validés, planifiez le scénario afin qu'une augmentation inattendue des jetons de réflexion fasse échouer un test au lieu d'augmenter silencieusement votre facture. Le plan gratuit d'Apidog couvre ce workflow.\n\nPas nécessairement. Google parle d'une vitesse « environ identique » et Artificial Analysis mesure environ 300 jetons par seconde au niveau `high`\n\n.\n\nLe temps total par tâche augmente toutefois avec le raisonnement supplémentaire : 2,5 minutes pour 3.8 Flash en `high`\n\n, contre 2,2 minutes pour 3.7 Flash en `high`\n\n. En `low`\n\n, 3.8 Flash descend à 0,8 minute.\n\nPas par jeton. Les deux modèles coûtent 0,75 $ en entrée et 3,75 $ en sortie jusqu'au 31 décembre 2026, puis 1,50 $ et 7,50 $.\n\nLe coût par tâche est différent : Artificial Analysis mesure 0,58 $ pour 3.8 Flash en `high`\n\n, contre 0,40 $ pour 3.7 Flash en `high`\n\n, principalement parce que 3.8 Flash produit environ 30 % de jetons supplémentaires.\n\nNon. Google indique que 3.7 Flash reste entièrement pris en charge et n'a communiqué aucune date de fin de vie.\n\nDeux éléments principaux :\n\n`thinking_level: \"minimal\"`\n\nrenvoie une erreur `400 INVALID_ARGUMENT`\n\n;`name`\n\n.Le reste de l'API Gemini 3 reste inchangé.\n\nLa progression 3.7 était plus marquée sur les données disponibles : DeepSWE est passé de 49,0 % à 65,3 %, tandis que l'indice Artificial Analysis est passé de 52 à 56.\n\nLe passage à 3.8 apporte trois points supplémentaires sur cet indice et modifie surtout la manière dont le modèle consomme les jetons. Consultez aussi [Gemini 3.6 Flash vs 3.5 Flash](https://apidog.com/fr/blog/gemini-3-6-flash-vs-gemini-3-5-flash?utm_source=dev.to&utm_medium=wanda&utm_content=n8n-post-automation) pour l'évolution précédente.\n\nMigrez vers Gemini 3.8 Flash si vos workflows sont agentiques, utilisent de nombreux outils ou traitent de longs documents. C'est dans ces scénarios que les benchmarks publiés montrent les gains les plus intéressants.\n\nPour les appels courts et répétitifs, restez sur 3.7 Flash ou utilisez 3.8 Flash en `low`\n\n. Dans tous les cas :\n\n`minimal`\n\nen `low`\n\n;", "url": "https://wpnews.pro/news/gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour", "canonical_source": "https://dev.to/antoine_laurentt/gemini-38-flash-vs-37-flash-nouveautes-et-faut-il-mettre-a-jour--56ce", "published_at": "2026-09-03 08:36:26+00:00", "updated_at": "2026-09-03 08:54:11.299126+00:00", "lang": "en", "topics": ["large-language-models", "artificial-intelligence", "ai-products", "ai-tools"], "entities": ["Google", "Gemini 3.8 Flash", "Gemini 3.7 Flash", "Artificial Analysis", "Claude Opus 5", "GPT-5.6 Sol"], "alternates": {"html": "https://wpnews.pro/news/gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour", "markdown": "https://wpnews.pro/news/gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour.md", "text": "https://wpnews.pro/news/gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour.txt", "jsonld": "https://wpnews.pro/news/gemini-3-8-flash-vs-3-7-flash-nouveautes-et-faut-il-mettre-a-jour.jsonld"}}