Google dévoile Gemini 3.7 Flash et casse les prix… mais le modèle Pro est porté disparu
Google a-t-il renoncé à la course au meilleur modèle d’intelligence artificielle ?
En mai, sur la scène de Google I/O, l’entreprise annonçait Gemini 3.5 Flash et promettait Gemini 3.5 Pro pour le mois suivant. Trois mois plus tard, le modèle n’est toujours pas là. Entre-temps, plusieurs échéances ont été manquées et plusieurs médias rapportent que le modèle ne satisfait pas les critères internes de Google, en particulier sur le code et la fiabilité.
On peut ajouter à cette situation le départ de grands cadors : le 5 août, Jeff Dean a quitté Google pour cofonder Discovery Loop et Demis Hassabis a abandonné la direction opérationnelle de Google DeepMind pour devenir président du laboratoire et Chief Scientist d’Alphabet, laissant les commandes à Koray Kavukcuoglu.
C’est dans ce contexte particulier que Google a annoncé le 13 août Gemini 3.7 Flash , présenté comme son « modèle de travail le plus intelligent » pour le code et les agents. Un modèle rapide, meilleur que la plupart de ses concurrents sur plusieurs tâches, et surtout beaucoup moins cher.
Gemini 3.7 Flash arrive trois semaines après Gemini 3.6 Flash et serait le résultat direct des retours des développeurs et d’améliorations algorithmiques selon Google. La fiche technique du modèle indique qu’il est basé sur Gemini 3.6 Flash et renvoie à celle de son prédécesseur pour le matériel, le logiciel, les limitations connues et la méthodologie d’évaluation.
Les gains annoncés par Google, tous mesurés face à Gemini 3.6 Flash, sont néanmoins conséquents :
Côté caractéristiques, on reste sur une fenêtre de contexte d’un million de tokens et 64 000 tokens en sortie. Mais le vrai argument de Google est ailleurs : jusqu’au 31 décembre 2026, Gemini 3.7 Flash est facturé 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie, soit la moitié du prix de lancement de Gemini 3.6 Flash. Google applique d’ailleurs ce nouveau tarif rétroactivement à 3.6 Flash. Au 1 er janvier 2027, on passera à 1,50 dollar et 7,50 dollars.
Google ne revendique pas d’avoir le meilleur modèle en maths, en raisonnement pur ou sur les tâches les plus difficiles, mais revendique le meilleur rapport entre l’intelligence, la vitesse et le coût pour le travail quotidien : générer du code qui fonctionne du premier coup, piloter des agents sur plusieurs étapes, lire des documents. Google insiste d’ailleurs sur la discipline du modèle, qui « s’adapte mieux aux blocages, clarifie l’intention quand c’est nécessaire et suit les instructions avec plus de fidélité » , ce qui réduirait le nombre de tentatives ratées et donc la facture finale.
Aujourd’hui, le modèle haut de gamme actuel de Google reste Gemini 3.1 Pro… mais même Google ne le recommande pas. L’entreprise dit que 3.7 Flash est meilleur dans quasiment tout : le modèle Pro est obsolète.
La sortie de Gemini 3.5 Pro semble désormais écartée. Google aurait mis le modèle en pause pour se concentrer directement sur Gemini 4 , dont l’entreprise a confirmé qu’il était en pré-entraînement.
5News a agrégé ce résumé depuis le flux public du média. L'article complet, avec tout le contexte, est sur www.numerama.com — le contenu appartient à Numerama.