Gemini 3 Deep Think (mise à niveau majeure)

2026-02-12 · Éditeur : Google · Domaine : Intelligence Artificielle

Google met à jour Gemini 3 Deep Think, son mode de raisonnement spécialisé pour la science, la recherche et l'ingénierie, avec de nouveaux records sur ARC-AGI-2 et Humanity's Last Exam.

Ce qui change

  • Mise à niveau conçue avec des scientifiques et chercheurs, pour des problèmes aux données incomplètes et sans réponse unique.
  • Meilleurs résultats en mathématiques, programmation compétitive, physique et chimie (niveau médaille d'or aux parties écrites des olympiades de physique et de chimie 2025).
  • Usage appliqué : passage d'un croquis à un fichier imprimable en 3D, revue de preuves mathématiques.
  • Pour la première fois, accès à Deep Think via l'API Gemini, sur demande dans un programme d'accès anticipé.

Google met à jour Gemini 3 Deep Think, son mode de raisonnement spécialisé pour la science, la recherche et l'ingénierie, avec de nouveaux records sur ARC-AGI-2 et Humanity's Last Exam. ### Ce qui change - Mise à niveau conçue avec des scientifiques et chercheurs, pour des problèmes aux données incomplètes et sans réponse unique. - Meilleurs résultats en mathématiques, programmation compétitive, physique et chimie (niveau médaille d'or aux parties écrites des olympiades de physique et de chimie 2025). - Usage appliqué : passage d'un croquis à un fichier imprimable en 3D, revue de preuves mathématiques. - Pour la première fois, accès à Deep Think via l'API Gemini, sur demande dans un programme d'accès anticipé. ### Caractéristiques - Disponibilité : application Gemini (abonnés Google AI Ultra) et API Gemini en accès anticipé. - Fenêtre de contexte, sortie maximale, coupure des connaissances et identifiant API : non communiqués dans le billet. - Mode de raisonnement de la famille Gemini 3, non un modèle distinct listé dans les tarifs publics. ### Tarifs Tarif non communiqué à l'annonce (accès API sur demande). ### Benchmarks | Benchmark (scores publiés par l'éditeur) | Gemini 3 Deep Think | |---|---| | Humanity's Last Exam (sans outils) | 48,4 % | | ARC-AGI-2 (vérifié ARC Prize) | 84,6 % | | Codeforces (Elo) | 3455 | | CMT-Benchmark (physique théorique) | 50,5 % | ### À retenir Un mode de raisonnement long réservé aux abonnés Ultra et à quelques entreprises, utile pour évaluer les limites du raisonnement scientifique ; l'accès API reste restreint.

Liens

Tags : LLM, Google, Gemini, Deep Think, Raisonnement