cd /news/artificial-intelligence/google-mise-sur-des-gemini-moins-che… · home topics artificial-intelligence article
[ARTICLE · art-73069] src=dev.to ↗ pub= topic=artificial-intelligence verified=true sentiment=· neutral

Google mise sur des Gemini moins chers, pas plus forts

Google released three new Gemini models on Tuesday, emphasizing cost reduction over raw performance. The Gemini 3.6 Flash model uses 17% fewer output tokens than its predecessor, lowering prices, while the high-end Gemini 3.5 Pro remains absent. Google's strategy focuses on efficiency and affordability, with the mid-range model outperforming the previous high-end model at a lower cost.

read4 min views1 publishedJul 25, 2026

L'essentiel

Google a dévoilé mardi trois nouveaux Gemini, et son argument tient en deux mots : moins cher. Dix-sept pour cent de tokens de sortie en moins sur son modèle de travail, un prix au million revu à la baisse, des agents qui coûtent moins à chaque tâche. Pendant ce temps, le modèle haut de gamme que tout le secteur attendait, Gemini 3.5 Pro, reste introuvable. Ce contraste raconte mieux la stratégie de Google que n'importe quel classement.

Le chiffre vient de l'Artificial Analysis Index, un agrégateur de benchmarks indépendant, et il mesure une chose précise : le volume de tokens de sortie (les unités de texte que le modèle génère) que 3.6 Flash consomme pour accomplir une même tâche, comparé à 3.5 Flash. Moins de tokens produits, ce sont moins d'étapes de raisonnement et moins d'appels d'outils, donc une facture qui fond.

Google pousse le curseur plus loin sur certains cas : jusqu'à 65 % d'économie sur DeepSWE, un banc d'essai de programmation. À 1,50 $ le million de tokens en entrée et 7,50 $ en sortie, 3.6 Flash coûte moins que le 3.5 Flash qu'il remplace, et il dépasse au passage l'ancien 3.1 Pro sur les benchmarks. Autrement dit, le milieu de gamme d'aujourd'hui enterre le haut de gamme d'hier, pour beaucoup moins cher. Voilà le produit d'appel.

Réduire la verbosité sans perdre en qualité, c'est l'exploit revendiqué, et les chiffres avancés vont dans ce sens. Sur DeepSWE, la précision passe de 37 à 49 %. Sur MLE Bench, qui évalue le travail de recherche en apprentissage automatique, de 49,7 à 63,9 %. OSWorld-Verified, qui teste la capacité à piloter un ordinateur, grimpe de 78,4 à 83 %. Le score de travail intellectuel GDPval-AA v2 monte de 1 349 à 1 421 points. La fonction Computer Use, qui laisse le modèle manipuler navigateur et bureau, devient un outil intégré côté client dans l'API Gemini.

Reste que ces gains se mesurent contre les Gemini précédents, pas contre la concurrence. Google reconnaît lui-même que ses modèles restent derrière les meilleurs des laboratoires américains et chinois. Logan Kilpatrick, de l'équipe technique, l'a assumé sur X face aux critiques : l'objectif affiché était l'efficacité, la fiabilité et le coût, et la performance a progressé en chemin. Traduction : Google ne cherchait pas à reprendre la première place cette fois-ci.

La logique du coût se décline sur les deux autres modèles. Gemini 3.5 Flash-Lite vise le débit : 350 tokens par seconde selon l'Artificial Analysis Index, à 0,30 $ le million en entrée et 2,50 $ en sortie. Sa cible, ce sont les tâches répétitives à fort volume, tri de tickets, extraction de données, là où chaque centime par requête compte. Il dépasse même l'ancien 3 Flash, pourtant plus gros, sur plusieurs bancs d'essai agentiques ; son score Terminal-Bench 2.1 bondit de 31 à 54 % face à son prédécesseur direct.

Le troisième, 3.5 Flash Cyber, joue une partition à part. Bâti sur 3.5 Flash et affiné pour la sécurité logicielle, il alimente CodeMender, l'agent de correction de code de Google DeepMind. Son intérêt tient précisément à son coût : CodeMender l'appelle jusqu'à cinq fois pour un seul rapport, multipliant les passages sur une base de code là où un gros modèle unique deviendrait vite prohibitif. Sur le benchmark CyberGym, cette approche a confirmé 55 vulnérabilités uniques dans le moteur JavaScript V8 de Chrome, soit davantage que les 36 relevées par Claude Opus 4.6, et dix d'entre elles avaient échappé à tous les autres modèles. Mais ce modèle ne sera pas ouvert : Google le réserve d'abord aux gouvernements et partenaires de confiance, au titre du double usage de la cybersécurité.

Le plus parlant, c'est ce que Google n'a pas livré. Gemini 3.5 Pro reste « en test chez des partenaires » et sortira « dès qu'il sera prêt », formule qui ne trompe personne. Dans le même souffle, l'entreprise annonce avoir lancé son « run de pré-entraînement le plus ambitieux » pour Gemini 4 et se dit « enthousiasmée par les progrès ». Empiler ces deux messages autour d'un modèle phare absent, cela ressemble moins à une feuille de route qu'à une gestion de l'attente.

Le signal tient dans l'ordre des priorités. Un géant qui aligne trois modèles économiques avant de dévoiler son sommet vise d'abord les déploiements massifs : ces milliers d'agents en production dont chaque appel pèse sur la note finale. C'est là, dans les budgets des entreprises qui passent l'IA à l'échelle, que se jouera la prochaine manche, bien plus que sur un point de pourcentage en tête de tableau.

Mon avis

La manœuvre ressemble à une nouvelle norme, et je ne la lis pas comme un aveu de faiblesse. Sortir trois modèles bon marché en gardant son flagship au chaud, c'est déplacer le terrain : la valeur d'un modèle d'agent ne se mesure plus à la ligne du haut d'un classement, mais en dollars par tâche accomplie. Google l'assume à demi-mot, et ses rivaux suivront avant la fin de l'année. Parce qu'on ne facture pas un benchmark, on facture des tokens.

── more in #artificial-intelligence 4 stories · sorted by recency
── more on @google 3 stories trending now
sponsored brought to you by zahid.host 4,200+ EU-deployed projects
reading about agents? ship yours in a single git push.

Run your AI side-project on zahid.host

EU-based hosting, git-push deploys, automatic HTTPS, no cold starts. Free tier with a custom domain — perfect for shipping the agent you just read about.

$git push zahid main
Live at https://your-agent.zahid.host
Get free account → Pricing
from €0/mo · no card required
LIVE [news/google-mise-sur-des-…] indexed:0 read:4min 2026-07-25 ·