Gemini 2.0 Flash (disponibilité générale)

2025-02-05 · Éditeur : Google · Domaine : Intelligence Artificielle

Google rend Gemini 2.0 Flash généralement disponible dans l'API Gemini, Google AI Studio et Vertex AI, avec des limites de débit plus élevées et une tarification simplifiée.

Ce qui change

  • Passage de l'expérimental à la disponibilité générale : le modèle peut servir des applications en production.
  • Contexte de 1 million de tokens, entrée multimodale, sortie texte à l'annonce (image et audio en sortie annoncés pour les mois suivants).
  • Utilisation native d'outils (recherche, exécution de code).
  • Tarification simplifiée : un seul prix par type d'entrée, sans distinction entre contextes courts et longs comme sur Gemini 1.5 Flash.

Google rend Gemini 2.0 Flash généralement disponible dans l'API Gemini, Google AI Studio et Vertex AI, avec des limites de débit plus élevées et une tarification simplifiée. ### Ce qui change - Passage de l'expérimental à la disponibilité générale : le modèle peut servir des applications en production. - Contexte de 1 million de tokens, entrée multimodale, sortie texte à l'annonce (image et audio en sortie annoncés pour les mois suivants). - Utilisation native d'outils (recherche, exécution de code). - Tarification simplifiée : un seul prix par type d'entrée, sans distinction entre contextes courts et longs comme sur Gemini 1.5 Flash. ### Caractéristiques - Fenêtre de contexte : 1 048 576 tokens en entrée, 8 192 en sortie (documentation API). - Modalités en entrée : audio, images, vidéo, texte. - Date de coupure des connaissances : août 2024 (documentation API). - Disponibilité : API Gemini (AI Studio), Vertex AI, application Gemini. - Identifiant API : `gemini-2.0-flash` (version `gemini-2.0-flash-001`). ### Tarifs | Modèle | Entrée (USD / 1M tokens) | Sortie (USD / 1M tokens) | |---|---|---| | Gemini 2.0 Flash | 0,10 (AI Studio, texte/image/vidéo, confirmé le 25 février) | 0,40 (non revérifié dans une source officielle) | Le billet du 25 février 2025 confirme l'entrée à 0,10 USD par million de tokens, soit 33 % de moins que l'ancienne grille. ### Benchmarks Le billet présente un tableau de comparaison avec Gemini 1.5 en image, sans chiffres exploitables dans le texte. Aucun score repris ici. ### À retenir Le « cheval de trait » de la génération 2.0 devient utilisable en production avec un coût par token réduit, ce qui en fait la base des premiers déploiements d'agents sur l'API Gemini.

Liens

Tags : LLM, Google, Gemini, Flash, Disponibilité générale