Gemini 2.5 Pro Experimental

2025-03-25 · Éditeur : Google · Domaine : Intelligence Artificielle

Google lance Gemini 2.5 Pro Experimental, premier modèle de la famille 2.5 : un modèle de raisonnement classé premier de LMArena, fort en code, en mathématiques et en sciences, avec 1 million de tokens de contexte.

Ce qui change

  • Modèle « thinking » : il raisonne avant de répondre, capacité désormais intégrée à tous les futurs modèles Gemini.
  • Premier de LMArena avec une marge importante, et état de l'art en mathématiques et sciences (GPQA, AIME 2025) sans techniques coûteuses de vote majoritaire.
  • Gros progrès en code par rapport à la génération 2.0 : applications web, agents, transformation et édition de code.
  • Contexte de 1 million de tokens (2 millions annoncés), entrée texte, audio, image, vidéo et dépôts de code.

Google lance Gemini 2.5 Pro Experimental, premier modèle de la famille 2.5 : un modèle de raisonnement classé premier de LMArena, fort en code, en mathématiques et en sciences, avec 1 million de tokens de contexte. ### Ce qui change - Modèle « thinking » : il raisonne avant de répondre, capacité désormais intégrée à tous les futurs modèles Gemini. - Premier de LMArena avec une marge importante, et état de l'art en mathématiques et sciences (GPQA, AIME 2025) sans techniques coûteuses de vote majoritaire. - Gros progrès en code par rapport à la génération 2.0 : applications web, agents, transformation et édition de code. - Contexte de 1 million de tokens (2 millions annoncés), entrée texte, audio, image, vidéo et dépôts de code. ### Caractéristiques - Contexte : 1 048 576 tokens en entrée, 65 536 en sortie (documentation API actuelle). - Date de coupure des connaissances : janvier 2025 (documentation API). - Disponibilité : Google AI Studio et application Gemini (abonnés Advanced) ; Vertex AI ensuite. - Identifiant : `gemini-2.5-pro-exp-03-25`. Version payante `gemini-2.5-pro-preview-03-25` le 4 avril 2025. ### Tarifs | Version | Entrée (USD / 1M tokens) | Sortie (USD / 1M tokens) | |---|---|---| | Aperçu payant du 4 avril, prompts jusqu'à 200 000 tokens | 1,25 | 10 | | Aperçu payant, prompts de plus de 200 000 tokens | 2,50 | 15 | Version expérimentale gratuite avec limites de débit réduites. Les tarifs de l'aperçu payant ont été relevés par Simon Willison le 4 avril, ils sont identiques à ceux du modèle stable. ### Benchmarks | Benchmark | Score | |---|---| | Humanity's Last Exam (sans outils) | 18,8 % | | SWE-bench Verified (agent personnalisé) | 63,8 % | Scores publiés par l'éditeur. Les résultats GPQA et AIME 2025 figurent dans le billet sous forme de graphique. ### À retenir Le modèle qui replace Google en tête des classements de raisonnement, base de la gamme Pro utilisée en production pendant tout 2025.

Liens

Tags : LLM, Google, Gemini, Pro, Raisonnement