Gemini 2.5 Flash (mise à jour du 20 mai)

2025-05-20 · Éditeur : Google · Domaine : Intelligence Artificielle

À Google I/O, Google publie une version améliorée de Gemini 2.5 Flash, plus performante sur le raisonnement, le multimodal, le code et le contexte long, tout en consommant 20 à 30 % de tokens en moins.

Ce qui change

  • Amélioration sur les benchmarks de raisonnement, multimodalité, code et contexte long.
  • Consommation de tokens réduite de 20 à 30 % dans les évaluations de Google.
  • Disponible pour tous dans l'application Gemini ; disponibilité générale annoncée pour début juin.
  • Nouveautés de la famille 2.5 : résumés de raisonnement (thought summaries), budgets de réflexion étendus à 2.5 Pro, prise en charge de MCP dans l'API et le SDK.
  • Deep Think, mode de raisonnement renforcé pour 2.5 Pro, présenté en test.

À Google I/O, Google publie une version améliorée de Gemini 2.5 Flash, plus performante sur le raisonnement, le multimodal, le code et le contexte long, tout en consommant 20 à 30 % de tokens en moins. ### Ce qui change - Amélioration sur les benchmarks de raisonnement, multimodalité, code et contexte long. - Consommation de tokens réduite de 20 à 30 % dans les évaluations de Google. - Disponible pour tous dans l'application Gemini ; disponibilité générale annoncée pour début juin. - Nouveautés de la famille 2.5 : résumés de raisonnement (thought summaries), budgets de réflexion étendus à 2.5 Pro, prise en charge de MCP dans l'API et le SDK. - Deep Think, mode de raisonnement renforcé pour 2.5 Pro, présenté en test. ### Caractéristiques - Identifiant : `gemini-2.5-flash-preview-05-20` (arrêté le 18 novembre 2025). - Disponibilité : Google AI Studio, Vertex AI, application Gemini. - Le modèle stable `gemini-2.5-flash` (17 juin) correspond à cette version. ### Tarifs Voir la fiche « Gemini 2.5 Flash (disponibilité générale) » : la version stable, identique à cette préversion, est facturée 0,30 USD en entrée et 2,50 USD en sortie par million de tokens. ### Benchmarks Aucun score chiffré dans le texte du billet pour Flash. Pour 2.5 Pro Deep Think : 84,0 % sur MMMU (score publié par l'éditeur). ### À retenir Étape intermédiaire vers la version stable de Flash : le modèle est déjà celui qui sera déployé en production quelques semaines plus tard.

Liens

Tags : LLM, Google, Gemini, Flash, Google I/O