Grok 4.1

2025-11-17 · Éditeur : xAI · Domaine : Intelligence Artificielle

xAI déploie Grok 4.1 pour tous les utilisateurs de grok.com, X et des applications mobiles, avec une personnalité plus cohérente, plus d'intelligence émotionnelle et moins d'hallucinations.

Ce qui change

  • Amélioration du style, de la personnalité et de l'alignement par apprentissage par renforcement, avec des modèles de raisonnement agentiques utilisés comme modèles de récompense.
  • Déploiement silencieux du 1er au 14 novembre 2025 : Grok 4.1 est préféré dans 64,78 % des comparaisons aveugles face au modèle précédent en production.
  • Réduction du taux d'hallucination sur les requêtes de recherche d'information (évaluation sur trafic réel et FActScore).
  • Deux modes : Grok 4.1 (sans réflexion) et Grok 4.1 Thinking.

xAI déploie Grok 4.1 pour tous les utilisateurs de grok.com, X et des applications mobiles, avec une personnalité plus cohérente, plus d'intelligence émotionnelle et moins d'hallucinations. ### Ce qui change - Amélioration du style, de la personnalité et de l'alignement par apprentissage par renforcement, avec des modèles de raisonnement agentiques utilisés comme modèles de récompense. - Déploiement silencieux du 1er au 14 novembre 2025 : Grok 4.1 est préféré dans 64,78 % des comparaisons aveugles face au modèle précédent en production. - Réduction du taux d'hallucination sur les requêtes de recherche d'information (évaluation sur trafic réel et FActScore). - Deux modes : Grok 4.1 (sans réflexion) et Grok 4.1 Thinking. ### Caractéristiques - Disponibilité : grok.com, X, iOS, Android ; sélection « Grok 4.1 » dans le sélecteur de modèle ou mode Auto. - Contexte, sortie maximale, date de coupure et identifiant API : non communiqués dans le billet (les modèles API arrivent avec Grok 4.1 Fast). ### Tarifs Tarif non communiqué à l'annonce (usage dans les applications). ### Benchmarks Scores publiés par l'éditeur. | Benchmark | Résultat | |---|---| | LMArena Text Arena, Grok 4.1 Thinking | 1er, 1483 Elo | | LMArena Text Arena, Grok 4.1 (sans réflexion) | 2e, 1465 Elo | | Grok 4 (rang de comparaison) | 33e | Des scores EQ-Bench3 et Creative Writing v3 sont cités mais seulement en graphiques. ### À retenir Une mise à jour centrée sur la qualité conversationnelle et la fiabilité factuelle plutôt que sur le raisonnement pur.

Liens

Tags : LLM, xAI, Grok, Grok 4.1