Gemini 2.5 Flash (aperçu)
2025-04-17 · Éditeur : Google · Domaine : Intelligence Artificielle
Google lance en préversion Gemini 2.5 Flash, son premier modèle de raisonnement hybride : le raisonnement s'active ou se désactive et un budget de réflexion permet d'arbitrer entre qualité, coût et latence.
Ce qui change
- Premier modèle Gemini entièrement hybride : raisonnement activable ou non selon la requête.
- Budget de réflexion réglable de 0 à 24 576 tokens (paramètre d'API ou curseur dans AI Studio) ; à 0, le coût et la latence restent proches de 2.0 Flash avec de meilleures performances.
- Amélioration majeure du raisonnement par rapport à Gemini 2.0 Flash, tout en gardant vitesse et coût.
- Positionné par Google comme le meilleur rapport qualité-prix de sa gamme.
Google lance en préversion Gemini 2.5 Flash, son premier modèle de raisonnement hybride : le raisonnement s'active ou se désactive et un budget de réflexion permet d'arbitrer entre qualité, coût et latence. ### Ce qui change - Premier modèle Gemini entièrement hybride : raisonnement activable ou non selon la requête. - Budget de réflexion réglable de 0 à 24 576 tokens (paramètre d'API ou curseur dans AI Studio) ; à 0, le coût et la latence restent proches de 2.0 Flash avec de meilleures performances. - Amélioration majeure du raisonnement par rapport à Gemini 2.0 Flash, tout en gardant vitesse et coût. - Positionné par Google comme le meilleur rapport qualité-prix de sa gamme. ### Caractéristiques - Disponibilité : API Gemini via Google AI Studio et Vertex AI. - Identifiant : `gemini-2.5-flash-preview-04-17` (arrêté le 15 juillet 2025 après le passage en version stable). - Le contexte de 1 million de tokens et la sortie de 65 536 tokens sont ceux de la version stable actuelle (documentation API). ### Tarifs Le tarif de la préversion figure dans une image du billet, non extraite. La grille a été simplifiée à la sortie de la version stable (17 juin 2025) : suppression de la différence entre prix avec et sans réflexion, voir la fiche « Gemini 2.5 Flash (disponibilité générale) ». ### Benchmarks Aucun score chiffré dans le texte du billet (comparaisons en graphiques). ### À retenir L'introduction du budget de réflexion devient la norme de la gamme : elle permet de piloter finement le coût des agents et des traitements par lot.
Liens
Tags : LLM, Google, Gemini, Flash, Raisonnement