Actu

Gemini 3.7 Flash remplace 3.6 Flash seulement trois semaines après son lancement

17 août 2026

Par Pierre Crochart

Illustration
©Google

Face à une concurrence chinoise ultra-agressive, Google mise sur la rentabilité avec Gemini 3.7 Flash, un modèle rapide et bon marché, alors que son fleuron « Pro » est encore aux abonnés absents.

Introduction

Google est à la croisée des chemins. Alors que les tensions entre les régulateurs et les Big Tech s’intensifient, la firme de Mountain View tente de réaffirmer sa domination sur le marché de l’IA générative. La stratégie actuelle vise à privilégier l’efficacité industrielle et le volume à la recherche de la puissance brute. En lançant une version intermédiaire ultracompétitive, seulement trois semaines après la précédente, Google cherche à sécuriser ses parts de marché face à des rivaux qui jouent moins sur l’innovation, mais davantage sur une guerre d’usure tarifaire.

Le choix de la vitesse et de l’efficience

Trois semaines seulement après la sortie de la version 3.6, Google a déployé Gemini 3.7 Flash en fin de semaine dernière. Ce modèle est décrit par l’entreprise comme son « modèle de travail le plus intelligent » pour le code et les agents. Les chiffres avancés par le groupe sont impressionnants : une progression de 43,6 % sur le benchmark FrontierCode 1.1 et un bond de performances sur le test DeepSWE (passant de 49 % à 65,3 %). En plus de ces gains techniques, Google propose une stratégie de prix d’appel agressive jusqu’au 31 décembre 2026, réduisant de moitié le coût des tokens par rapport à la version précédente.

Cette décision stratégique révèle une mutation profonde de la dynamique de marché. Google semble avoir accepté que la course au « modèle de pointe » (le fameux Gemini Pro, promis en mai dernier et toujours porté disparu) est une bataille coûteuse et complexe. En se concentrant sur le modèle Flash, la firme cherche à dominer le segment de l’IA dite de « commodity » : des tâches répétitives, de l’automatisation de flux de travail et du développement de code.

Pour l’utilisateur·ice, cette évolution se traduit par une IA qualifiée de plus « disciplinée ». Google souligne que le 3.7 Flash s’adapte mieux aux blocages et suit les instructions avec une plus grande fidélité, réduisant ainsi le nombre de tentatives ratées pour une tâche donnée. Le modèle est déjà disponible en France dans l’application Gemini.

Un modèle à bas coût pour contrer les avancées chinoises

Au-delà de la simple fiche technique, le déploiement de Gemini 3.7 Flash s’inscrit dans un contexte de pressions extrêmes. Le marché de l’IA est désormais une arène où les acteurs chinois, comme DeepSeek ou Alibaba (Qwen), dictent les règles du prix avec des tarifs parfois cinq fois inférieurs à ceux de Google. Face à cette menace, Google utilise son avantage structurel – le contrôle total de la chaîne de production, de l’entraînement aux puces – pour tenter de maintenir ses marges tout en cassant les prix.

Cette réorientation survient alors que la division DeepMind (qui pilote l’IA chez Google) traverse une période de turbulences majeure. Le départ de cadres historiques et la transition de direction vers Koray Kavukoglu suggèrent une restructuration interne pour prioriser les produits « prêts pour le marché ». Par ailleurs, l’absence de Gemini 3.5 Pro et les rumeurs sur les travaux en cours pour Gemini 4 indiquent que Google préfère parfois sacrifier un lancement intermédiaire pour assurer la solidité de ses futurs modèles de rupture, tout en maintenant le flux de revenus avec ses modèles pensés pour les entreprises déjà acquises à ses services.

À lire aussi

Article rédigé par

Journaliste