Les nouveaux modèles Gemini Flash de Google sont conçus pour une IA qui s'auto-exécute

Les Gemini 3.6 Flash et 3.5 Flash-Lite de Google DeepMind promettent une IA plus rapide et moins chère. Voici ce que cela signifie pour les applications et les jeux que vous utilisez réellement.

AI2Day Newsdesk· 3 min read
Photoreal editorial shot of a sleek modern data centre corridor at night, rows of server racks glowing with soft blue and amber light, faint reflections on poli
Share

Points clés

  • Google DeepMind a annoncé Gemini 3.6 Flash et Gemini 3.5 Flash-Lite le jour du lancement, visant à exécuter des agents IA à l'échelle.
  • Selon Google, 3.6 Flash utilise 17 % de jetons de sortie en moins que 3.5 Flash sur l'indice Artificial Analysis, à 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie.
  • Gemini 3.5 Flash-Lite fonctionne à 350 jetons de sortie par seconde, au prix de 0,30 $ par million de jetons d'entrée et 2,50 $ par million de jetons de sortie.
  • Sur le repère OSWorld-Verified, qui teste la capacité d'une IA à utiliser un vrai ordinateur, 3.6 Flash a obtenu 83,0 % contre 78,4 % pour 3.5 Flash.
  • Google DeepMind a confirmé que la pré-formation a commencé sur Gemini 4, son prochain modèle phare.

Google vient de changer discrètement les chiffres pour quiconque construit une IA qui fait les choses à votre place.

Le jour du lancement, Google DeepMind a déployé deux nouvelles versions de sa famille Gemini : Gemini 3.6 Flash et Gemini 3.5 Flash-Lite. Gemini est la gamme de modèles IA de Google, les cerveaux logiciels derrière les chatbots et, de plus en plus, les agents IA (des programmes qui exécutent des tâches multi-étapes en votre nom, comme réserver un voyage ou corriger du code).

Le gros titre n'est pas un modèle monstre plus grand et plus intelligent. C'est le contraire. Ce sont les chevaux de trait.

Pourquoi une personne ordinaire devrait-elle se soucier d'un modèle d'IA moins cher ?

Parce que le prix et la vitesse sont ce qui détermine si la démo intelligente que vous avez vue l'année dernière apparaît réellement dans les applications que vous utilisez.

Exécuter un grand modèle d'IA coûte de l'argent à chaque fois qu'il répond. Ce coût est mesuré en jetons, qui sont simplement des chunks de texte que le modèle lit et écrit. Google indique que Gemini 3.6 Flash utilise 17 % de jetons de sortie en moins que le 3.5 Flash précédent pour faire le même travail, selon l'indice Artificial Analysis indépendant. Sur un test de codage appelé DeepSWE, l'économie a atteint 65 %.

En termes clairs : le modèle divague moins et va droit au but plus rapidement. Cela réduit la facture pour l'entreprise qui construit votre application, ce qui rend des fonctionnalités comme un compagnon IA en jeu ou un bot de service client intelligent financièrement possibles.

La tarification s'élève à 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie. Un million de jetons représente environ 750 000 mots.

Le petit frère pourrait être la vraie histoire

Gemini 3.5 Flash-Lite est le petit et rapide. Google le chronomètre à 350 jetons de sortie par seconde, au prix de 0,30 $ par million de jetons d'entrée et 2,50 $ par million de jetons de sortie.

Cette vitesse est importante pour tout ce qui doit sembler instantané. Pensez à un adversaire IA dans un jeu qui doit réagir en temps réel, ou à un outil de traitement de documents qui traite des milliers de factures toute la nuit.

Sur Terminal-Bench 2.1, un test qui mesure la capacité d'une IA à commander une ligne de commande informatique, Flash-Lite a grimpé de 31 % à 54 %. Sur OSWorld-Verified, qui demande à l'IA d'opérer réellement un bureau comme le ferait un humain, il a atteint 74 %.

Les deux nouveaux modèles incluent désormais « l'utilisation informatique » comme outil intégré. Cela signifie que l'IA peut cliquer sur des boutons, remplir des formulaires et déplacer un curseur sans qu'un développeur ne le configure manuellement.

Et la sécurité ?

Google affirme que 3.6 Flash est livré avec des mesures de protection renforcées contre les abus dans les scénarios chimiques, biologiques, radiologiques, nucléaires et de cybercriminalité. Il a également été entraîné à refuser moins de demandes inoffensives, une plainte courante avec les versions antérieures de Gemini qui disaient parfois non à des questions ennuyeuses et quotidiennes.

Il y a aussi un cousin spécialiste. Gemini 3.5 Flash Cyber alimente CodeMender, l'agent de Google qui chasse les failles de sécurité dans le code logiciel.

Que se passe-t-il ensuite ?

Gemini 3.5 Pro, le plus grand modèle phare, est toujours en test avec les partenaires. Et Google a confirmé le bit intéressant à la fin : la pré-formation a commencé sur Gemini 4.

Pour les joueurs, les développeurs et tous ceux qui attendent des fonctionnalités d'IA qui ne coûtent pas une fortune à exécuter, la direction est claire. La frontière fait les gros titres. Les modèles Flash sont expédiés.

© 2026 AI2Day