Mistral Small 4
2026-03-16 · Éditeur : Mistral AI · Domaine : Intelligence Artificielle
Mistral AI lance Mistral Small 4, un modèle open source Apache 2.0 de 119 milliards de paramètres (6 milliards actifs) qui réunit instruction, raisonnement, vision et agents de code dans un seul modèle.
Ce qui change
- Premier modèle Mistral à unifier Magistral (raisonnement), Pixtral (multimodal) et Devstral (codage agentique).
- Paramètre reasoning_effort (none ou high) pour choisir entre réponses rapides et raisonnement approfondi.
- Architecture mixture d'experts : 128 experts, 4 actifs par token.
- Latence de bout en bout réduite de 40 % et débit multiplié par 3 par rapport à Mistral Small 3 (configurations optimisées).
Mistral AI lance Mistral Small 4, un modèle open source Apache 2.0 de 119 milliards de paramètres (6 milliards actifs) qui réunit instruction, raisonnement, vision et agents de code dans un seul modèle. ### Ce qui change - Premier modèle Mistral à unifier Magistral (raisonnement), Pixtral (multimodal) et Devstral (codage agentique). - Paramètre reasoning_effort (none ou high) pour choisir entre réponses rapides et raisonnement approfondi. - Architecture mixture d'experts : 128 experts, 4 actifs par token. - Latence de bout en bout réduite de 40 % et débit multiplié par 3 par rapport à Mistral Small 3 (configurations optimisées). ### Caractéristiques - Paramètres : 119B au total, 6B actifs par token (8B avec plongements et couche de sortie). - Contexte : 256k tokens. Entrées texte et image. Sortie maximale et coupure : non communiquées. - Licence : Apache 2.0. - Disponibilité : API Mistral, AI Studio, Hugging Face, NVIDIA NIM, vLLM, llama.cpp, SGLang, Transformers. - Infrastructure minimale : 4 GPU HGX H100, 2 HGX H200 ou 1 DGX B200. ### Tarifs | Élément | USD par million de tokens | |---|---| | Entrée | 0,15 | | Sortie | 0,60 | Ces tarifs proviennent d'un guide tiers (Serenities AI), pas du billet officiel, qui ne les mentionne pas. ### Benchmarks | Mesure | Résultat | |---|---| | AA LCR (avec raisonnement) | 0,72 pour 1,6K caractères de sortie | | LiveCodeBench | supérieur à GPT-OSS 120B avec 20 % de sortie en moins | Scores publiés par l'éditeur (présentés en graphiques, valeurs partielles). ### À retenir Un seul modèle ouvert couvre chat, raisonnement, vision et code, ce qui simplifie l'auto-hébergement pour les entreprises qui exigent la maîtrise de leurs données.
Liens
Tags : LLM, Mistral, Small, Open Source, Multimodal, Raisonnement