Mistral Small 3

2025-01-30 · Éditeur : Mistral AI · Domaine : Intelligence Artificielle

Mistral AI publie Mistral Small 3, un modèle de 24 milliards de paramètres optimisé pour la latence, sous licence Apache 2.0, présenté comme comparable à Llama 3.3 70B tout en étant plus de 3 fois plus rapide.

Ce qui change

  • Retour à la licence Apache 2.0 pour la gamme Small, avec checkpoints pré-entraîné et instruction-tuned.
  • Architecture avec moins de couches que ses concurrents pour réduire le temps par passe avant : 150 tokens/s annoncés.
  • Ni entraînement par RL ni données synthétiques : conçu comme base pour des modèles de raisonnement dérivés.
  • Cibles : assistants conversationnels rapides, appels de fonctions à faible latence, fine-tuning métier, inférence locale.

Mistral AI publie Mistral Small 3, un modèle de 24 milliards de paramètres optimisé pour la latence, sous licence Apache 2.0, présenté comme comparable à Llama 3.3 70B tout en étant plus de 3 fois plus rapide. ### Ce qui change - Retour à la licence Apache 2.0 pour la gamme Small, avec checkpoints pré-entraîné et instruction-tuned. - Architecture avec moins de couches que ses concurrents pour réduire le temps par passe avant : 150 tokens/s annoncés. - Ni entraînement par RL ni données synthétiques : conçu comme base pour des modèles de raisonnement dérivés. - Cibles : assistants conversationnels rapides, appels de fonctions à faible latence, fine-tuning métier, inférence locale. ### Caractéristiques - 24 milliards de paramètres ; contexte de 32k tokens (documentation et fiche Hugging Face). - Texte uniquement ; langues : anglais, français, allemand, espagnol, italien, chinois, japonais, coréen, portugais, néerlandais, polonais, entre autres. - Licence : Apache 2.0. - Disponibilité : La Plateforme, Hugging Face, Ollama, Kaggle, Together AI, Fireworks AI, IBM watsonx ; NVIDIA NIM, SageMaker, Groq, Databricks et Snowflake annoncés. - Identifiants API : `mistral-small-latest`, `mistral-small-2501` (retiré le 30/11/2025). ### Tarifs | Modèle | Entrée (USD / M tokens) | Sortie (USD / M tokens) | |---|---|---| | Mistral Small 25.01 | 0,1 | 0,3 | Tarif relevé sur la page technologie de Mistral archivée le 3 février 2025. ### Benchmarks Scores publiés par l'éditeur (fiche Hugging Face, modèle instruct) : | Benchmark | Mistral Small 3 | |---|---| | MMLU-Pro (5-shot CoT) | 66,3 % | | GPQA Main (CoT 5-shot) | 45,3 % | | HumanEval | 84,8 % | | MATH | 70,6 % | | IFEval | 82,9 % | L'annonce cite aussi plus de 81 % de précision sur MMLU (modèle de base). ### À retenir Un modèle ouvert et léger, exploitable sur un seul GPU ou un poste 32 Go quantifié, adapté aux usages internes où la latence et la maîtrise des données comptent.

Liens

Tags : LLM, Mistral, Small, Open Source, Apache 2.0