Gemini 3.1 Flash-Lite

2026-03-03 · Éditeur : Google · Domaine : Intelligence Artificielle

Google lance Gemini 3.1 Flash-Lite, son modèle le plus rapide et le moins cher de la génération 3, à 0,25 USD par million de tokens en entrée, pour la traduction, la classification et le temps réel.

Ce qui change

  • Optimisé pour les tâches à fort volume et faible latence (traduction, classification).
  • Débit annoncé de 363 tokens par seconde dans la model card.
  • Gain net sur Gemini 2.5 Flash-Lite en raisonnement, multimodal et code.
  • Modèle basé sur Gemini 3 Pro d'après sa fiche.

Google lance Gemini 3.1 Flash-Lite, son modèle le plus rapide et le moins cher de la génération 3, à 0,25 USD par million de tokens en entrée, pour la traduction, la classification et le temps réel. ### Ce qui change - Optimisé pour les tâches à fort volume et faible latence (traduction, classification). - Débit annoncé de 363 tokens par seconde dans la model card. - Gain net sur Gemini 2.5 Flash-Lite en raisonnement, multimodal et code. - Modèle basé sur Gemini 3 Pro d'après sa fiche. ### Caractéristiques - Contexte : jusqu'à 1 million de tokens ; sortie jusqu'à 64 000 tokens. - Modalités : texte, images, audio et vidéo en entrée, texte en sortie. - Disponibilité : API Gemini (AI Studio) et Vertex AI ; version GA le 7 mai 2026. - Identifiant API : gemini-3.1-flash-lite (préversion : gemini-3.1-flash-lite-preview). ### Tarifs | Élément | Prix (USD / 1M tokens) | |---|---| | Entrée (texte, image, vidéo) | 0,25 | | Entrée audio | 0,50 | | Sortie | 1,50 | Batch : 0,125 en entrée et 0,75 en sortie (page tarifs actuelle). ### Benchmarks | Benchmark (scores publiés par l'éditeur) | 3.1 Flash-Lite | 2.5 Flash | GPT-5 mini | |---|---|---|---| | GPQA Diamond | 86,9 % | 82,8 % | 82,3 % | | MMMU-Pro | 76,8 % | 66,7 % | 74,1 % | | Humanity's Last Exam (sans outils) | 16,0 % | 11,0 % | 16,7 % | | LiveCodeBench | 72,0 % | 62,6 % | 80,4 % | | MMMLU | 88,9 % | 86,6 % | 84,9 % | ### À retenir Un palier bas coût pour les traitements massifs (classification, traduction, extraction), à comparer à 2.5 Flash-Lite qui reste moins cher mais nettement moins performant.

Liens

Tags : LLM, Google, Gemini, Flash-Lite, Faible coût