
Tech • IA • Robotique
Google a lancé Gemini 3.7 Flash seulement trois semaines après 3.6 Flash, misant sur de meilleures performances en code et en agents à moindre coût, alors que la concurrence IA se déplace des capacités brutes vers le coût et la vitesse.
Gemini 3.7 Flash est arrivé le 13 août, seulement trois semaines après Gemini 3.6 Flash le 21 juillet. Google DeepMind le présente comme son meilleur modèle généraliste à ce jour, avec des améliorations visant surtout le code, l’usage d’outils et les workflows agentiques, plutôt que la culture générale ou les maths.
Sur Frontier Code 1.1 Main, 3.7 Flash a obtenu 43.6%, contre 34.4% pour 3.6 Flash. Sur DeepSWE 1.1, qui mesure des tâches plus longues d’ingénierie logicielle, il est passé d’environ 49% à 65.3%, signalant des gains très rapides en codage de type production sur une courte période.
Les plus gros gains viennent des tests centrés sur l’exécution. Sur Terminal Bench 2.1, 3.7 Flash a atteint 85.8% contre 78.0% pour 3.6; sur Terminal Bench 3.0, il est monté de 5.4% à 14.9%; sur Automation Bench, de 17.0% à 30.4%; et sur OS World 2.0, de 33.8% à 47.9%. L’objectif est d’achever des tâches en plusieurs étapes, pas seulement de fournir une bonne première réponse.
Google affirme que le modèle construit de façon plus complète des applications web avec moins de prompts, reconstitue des interfaces à partir de captures d’écran ou d’images, et garde un système de design cohérent sur des constructions plus longues. Sur Web Arena, sa note est passée de 1,538 Elo à 1,588.
Sur l’Artificial Analysis Intelligence Index, Gemini 3.7 Flash a obtenu 56, proche de Claude Sonnet 5 à 55 et de GPT 5.6 Terra à 57. En code, 3.7 Flash a battu les deux sur Frontier Code 1.1, même si GPT 5.6 Terra restait devant sur DeepSWE 1.1 avec 69.6% et sur Terminal Bench 3.0 avec 20.8%.
Jusqu’au 31 décembre 2026, 3.7 Flash est facturé $0.75 par million de tokens en entrée et $3.75 par million de tokens en sortie, soit la moitié du prix initial de 3.6 Flash. À partir du 1er janvier 2027, les tarifs doivent revenir à $1.50 en entrée et $7.50 en sortie. Cette remise vise à gagner des parts sur les charges agentiques, où les coûts de tokens et d’appels d’outils peuvent vite grimper.
Le modèle a été intégré à Gemini Spark dès son lancement pour les abonnés AI Pro et Ultra dans plus de 160 pays et régions. Il est aussi disponible via l’API Gemini, Google AI Studio, Android Studio et des plateformes d’agents d’entreprise, avec des cas d’usage centrés sur les actions Google Workspace comme combiner des fichiers, rédiger des e-mails et mettre à jour des documents projet.
La sortie suit une importante restructuration chez Google DeepMind le 5 août. Demis Hassabis est passé de directeur général à président et chief scientist d’Alphabet, tandis que Koray Kavukcuoglu a repris les opérations quotidiennes et dirige désormais la R&D de Gemini. Sundar Pichai détiendrait l’autorité finale de décision, soulignant la pression pour accélérer les progrès du modèle phare.
Malgré les mises à jour rapides de Flash, il n’y a toujours pas de date publique pour Gemini 3.5 Pro. Google avait indiqué en juillet que 3.5 Pro était en test chez des partenaires et que Gemini 4 suivait son pré-entraînement le plus ambitieux à ce jour. L’absence de nouveau calendrier attire l’attention alors que les rivaux accélèrent sur d’autres fronts.
OpenAI a présenté Ultrafast, un nouveau niveau de service API pour GPT 5.6 Soul qui délivrerait jusqu’à 750 tokens de sortie par seconde, soit environ 14 fois la vitesse normale, grâce aux puces wafer-scale de Cerebras. De son côté, DeepSeek a lancé V4 Pro 0813 à $1.32 par million de tokens en entrée et $3.96 en sortie, nettement au-dessus du prix de V4 Flash, tout en cherchant à monétiser de meilleures capacités agentiques.
La compétition actuelle entre modèles d’IA se définit de plus en plus par la capacité à fournir des agents performants au meilleur coût et à la meilleure vitesse, pas seulement par le benchmark le plus élevé. Gemini 3.7 Flash montre que Google pousse fortement sur ce terrain économique et opérationnel, tandis que les questions autour de ses modèles phares retardés restent ouvertes.
Explique-moi