Grok 3 et Grok 3 mini

2025-02-19 · Éditeur : xAI · Domaine : Intelligence Artificielle

xAI présente Grok 3, son modèle phare entraîné sur le supercalculateur Colossus, et Grok 3 mini, une variante de raisonnement économique, avec les modes Think et DeepSearch.

Ce qui change

  • Grok 3 est présenté comme entraîné avec dix fois plus de calcul que les modèles précédents de l'état de l'art, selon xAI.
  • Deux modèles de raisonnement en bêta : Grok 3 (Think) et Grok 3 mini (Think), entraînés par apprentissage par renforcement, avec un raisonnement visible pouvant durer de quelques secondes à plusieurs minutes.
  • DeepSearch, premier agent de xAI, combine raisonnement et recherche sur Internet.
  • Grok 3 mini vise les tâches STEM qui demandent moins de connaissances générales.

xAI présente Grok 3, son modèle phare entraîné sur le supercalculateur Colossus, et Grok 3 mini, une variante de raisonnement économique, avec les modes Think et DeepSearch. ### Ce qui change - Grok 3 est présenté comme entraîné avec dix fois plus de calcul que les modèles précédents de l'état de l'art, selon xAI. - Deux modèles de raisonnement en bêta : Grok 3 (Think) et Grok 3 mini (Think), entraînés par apprentissage par renforcement, avec un raisonnement visible pouvant durer de quelques secondes à plusieurs minutes. - DeepSearch, premier agent de xAI, combine raisonnement et recherche sur Internet. - Grok 3 mini vise les tâches STEM qui demandent moins de connaissances générales. ### Caractéristiques - Fenêtre de contexte annoncée : 1 million de tokens (huit fois plus que les modèles précédents de xAI). La limite de l'API à sa sortie était de 131 072 tokens selon un agrégateur tiers. - Modalités : texte et image en entrée (MMMU et EgoSchema publiés). - Disponibilité à l'annonce : Grok.com et X pour les abonnés Premium et Premium+ (Think et DeepSearch d'abord pour Premium+). API annoncée « dans les semaines à venir ». - Date de coupure des connaissances : non communiquée dans l'annonce. ### Tarifs Tarif non communiqué à l'annonce (voir la fiche « Grok 3 dans l'API xAI » pour l'API). ### Benchmarks Scores publiés par l'éditeur. | Benchmark | Grok 3 (Think) | Grok 3 mini (Think) | |---|---|---| | AIME 2025 (cons@64) | 93,3 % | non communiqué ici | | AIME 2024 | non communiqué ici | 95,8 % | | GPQA Diamond | 84,6 % | non communiqué ici | | LiveCodeBench | 79,4 % | 80,4 % | | Chatbot Arena (Elo) | 1402 | non communiqué | ### À retenir Première génération xAI orientée raisonnement, avec un agent de recherche intégré. Les modèles étaient encore en cours d'entraînement à l'annonce, et l'accès API n'est venu qu'ensuite.

Liens

Tags : LLM, xAI, Grok, Grok 3, Raisonnement