IA & Machine Learning Article original TECH ACTU

Gemini 3.5 Pro : pourquoi Google repousse encore son modele phare

Jean-Paul Lesein 5 min de lecture 20 vues
Gemini 3.5 Pro : pourquoi Google repousse encore son modele phare

Le 17 juillet 2026 devait marquer le lancement de Gemini 3.5 Pro. La date est passee sans annonce : le modele phare de Google reste en preview limitee sur Vertex AI, sans benchmark officiel, avec une fenetre desormais evoquee pour aout. En cause, selon plusieurs sources dont Bloomberg : des performances decevantes sur le code et l'efficacite en tokens, qui le placeraient derriere Claude Fable 5 et GPT-5.6. Pendant ce temps, Gemini 3.5 Flash, deja disponible, tire son epingle du jeu.

Le 17 juillet 2026 devait etre le grand jour de Gemini 3.5 Pro. La date est passee, et il ne s'est rien passe. Cinq jours plus tard, le modele phare de Google reste coince dans une preview limitee sur Vertex AI, sans model card, sans benchmark officiel, sans prix definitif. Pour un lancement cense repositionner Google face a OpenAI et Anthropic, le silence est assourdissant. Et il en dit long.

Un lancement fantome

Reprenons le fil. Apres avoir manque une premiere fenetre en juin, Google avait laisse filtrer une cible au 17 juillet pour la disponibilite generale de Gemini 3.5 Pro. Cette date est desormais derriere nous, et le modele n'est toujours pas accessible au grand public.

Concretement, au 22 juillet, les pages publiques de l'API Gemini listent toujours gemini-3.5-flash et gemini-3.1-pro-preview, mais aucun identifiant gemini-3.5-pro en disponibilite generale. Sur le classement public d'Arena (ex-LMArena), on retrouve gemini-3-pro, gemini-3.1-pro-preview et deux variantes de Flash, mais pas la moindre trace d'une entree 3.5 Pro.

Une nouvelle fenetre est desormais evoquee pour le mois d'aout. J'insiste sur le conditionnel : a ce stade, tout post qui vous annonce une date ferme, un prix definitif ou des scores de benchmark precis pour Gemini 3.5 Pro extrapole a partir des chiffres de Flash. Ce ne sont pas des mesures, ce sont des paris.

Le vrai probleme, c'est le code

Pourquoi ce retard a repetition ? La reponse, remontee par plusieurs sources dont Bloomberg, est plus interessante que le calendrier lui-meme : Google n'arrive pas a hisser Gemini 3.5 Pro au niveau attendu sur le code.

Fin juin, les equipes de DeepMind auraient mis a jour les donnees d'entrainement pour tenter d'ameliorer specifiquement les competences de programmation du modele. Le resultat aurait ete, selon les termes rapportes, decevant. Google a alors fait un choix radical : abandonner la base existante et reconstruire le modele quasiment de zero.

Les retours des premiers testeurs vont dans le meme sens. Gemini 3.5 Pro serait en retrait par rapport a Claude Fable 5 et GPT-5.6 sur le raisonnement avance, le code et les taches a long horizon, avec en prime des soucis d'efficacite en tokens, autrement dit il consomme trop pour ce qu'il produit. Pour un modele premium, c'est un double handicap : moins bon et plus cher a faire tourner.

Ce que le modele promet quand meme

Il ne faudrait pas peindre un tableau uniquement noir. Sur le papier, la fiche technique reconstruite de Gemini 3.5 Pro reste ambitieuse.

Le modele viserait une fenetre de contexte de 2 millions de tokens, soit le double du million de Gemini 2.5 Pro et de Flash. Pour qui travaille sur de gros depots de code ou de longs corpus documentaires, cette capacite a ingerer un contexte massif d'un seul tenant reste un argument fort.

Il embarquerait aussi une couche de raisonnement baptisee Deep Think, pensee pour les problemes logiques multi-etapes, ainsi que des capacites de workflow autonome permettant d'enchainer des taches de code multi-fichiers et des appels d'outils avec peu de supervision. Sur le principe, Deep Think est la reponse de Google au raisonnement etendu facon o3 d'OpenAI.

Le bemol arrive avec la facture : l'acces a Deep Think serait reserve a l'abonnement Ultra a 250 dollars par mois. Le raisonnement profond, chez Google comme ailleurs, se paie au prix fort.

Pendant ce temps, Flash avance

L'ironie de la situation, c'est que la ou le vaisseau amiral patine, le reste de la flotte navigue plutot bien. Gemini 3.5 Flash est deja disponible et delivre, de l'avis general, d'excellents resultats en code et en workflows agentiques, avec sa fenetre d'un million de tokens.

Google a meme decline une variante Flash Cyber, un modele leger oriente cybersecurite, cense trouver, valider et corriger des vulnerabilites plus vite et a moindre cout. C'est le genre de brique verticale qui, sans faire la une, peut vraiment changer la donne dans une equipe securite.

Ce contraste est parlant : Google sait clairement livrer des modeles rapides et specialises. C'est sur le haut de gamme generaliste, la ou se joue la bataille de prestige face a Claude et GPT, que la marche est la plus haute a franchir.

Ce que ca change pour choisir un modele aujourd'hui

Si vous devez arbitrer un choix de modele cette semaine pour une equipe ou un produit, ne construisez rien sur une promesse de Gemini 3.5 Pro. Tant qu'il n'y a ni model card, ni benchmark independant, ni disponibilite generale, ce modele n'existe pas pour votre feuille de route, il existe pour votre veille.

Le paysage mesurable, lui, est clair a date : GPT-5.6 mene sur des tests comme Terminal-Bench, tandis que Claude Opus 4.8 et Fable 5 dominent les evaluations de code agentique type SWE-bench Verified. Si votre besoin immediat est le code autonome, c'est aujourd'hui de ce cote qu'il faut regarder.

Et si votre coeur penche vers l'ecosysteme Google, la reponse pragmatique tient en un mot : Flash. Disponible, competent, moins cher, il couvre deja une large part des usages reels sans exiger d'attendre un lancement qui glisse de mois en mois.

Mon avis

Ce que je retiens de cet episode, ce n'est pas que Google est en difficulte, l'entreprise a les moyens et le talent pour recoller. Ce que je retiens, c'est que meme un geant avec des ressources quasi illimitees bute sur le meme mur que tout le monde : le code fiable et efficient en tokens.

Repousser un lancement plutot que sortir un modele en retrait, c'est en realite une decision plus saine qu'il n'y parait. Je prefere de loin un Gemini 3.5 Pro qui arrive en aout et tient ses promesses a un modele bacle sorti a la date prevue pour cocher une case marketing. Reste que, dans une industrie ou les concurrents publient benchmarks et model cards le jour du lancement, le silence prolonge de Google finit par ressembler a un aveu. Rendez-vous en aout, et cette fois on l'espere pour de bon.

Partager cet article

À lire aussi en IA & Machine Learning