Comparatif LLM

Mistral Small 4 (119B) en déploiement local

Mistral AI 🇫🇷 · sortie mars 2026 · licence Apache 2.0

Généraliste Raisonnement Vision Code Config Pro
Taille 119 Md MoE : 6,5 Md actifs par token
VRAM estimée ≈ 80 Go modèle en Q4 + cache KV
Contexte 1M tokens
Français ●●● Excellent

Ce qu'il faut retenir

Le modèle unifié de Mistral : raisonnement, multimodal et code agentique dans un seul MoE (6,5 Md actifs), avec un contexte d'un million de tokens. Excellent en français, éditeur européen. Le choix souveraineté par excellence.

Licence et usage commercial

Apache 2.0 : usage commercial libre, sans restriction.

Sur quelle machine ?

Mistral Small 4 (119B) demande ≈ 80 Go de VRAM : le modèle chargé en quantisation Q4, plus la marge du cache KV, qui grandit avec la longueur des conversations et le nombre d'utilisateurs simultanés. Il faut donc 2 RTX PRO 5000 Blackwell 72 Go dans un Lenovo ThinkStation P8, soit notre configuration Pro, prévue pour jusqu'à 100 utilisateurs et au-delà. Ce dimensionnement est un ordre de grandeur. Nous ne partons jamais de la machine : nous cadrons vos usages, nous en déduisons le modèle, puis la configuration qui le fait tourner, et nous validons par un test sur vos données réelles.

Popularité Hugging Face : 75 261 téléchargements le mois dernier, 419 likes.

Déployer Mistral Small 4 (119B) chez vous ?

Nous installons ce modèle sur une configuration Pro dans vos locaux, connecté à vos documents et vos outils. Audit gratuit, sans engagement.

Demander un audit gratuit