Mistral Small 3 (24B)
Mistral Small 3 est le modèle 24B de Mistral AI : excellent en français, rapide, et taillé pour le chat, l'extraction et le RAG. Fleuron open-weight européen pour le local.
Caractéristiques principales
Variantes disponibles
| Quantization | Taille | RAM requise | VRAM requise | Vitesse | HuggingFace |
|---|---|---|---|---|---|
| Q4_K_M | 14.3 Go | 18 Go | 15 Go | ~26 tok/s |
Installation
Ollama
La méthode la plus simple pour lancer Mistral Small 3 (24B) en local.
ollama run mistral-small:24b Pas encore installé ? Voir le guide Ollama
LM Studio
Interface graphique pour exécuter Mistral Small 3 (24B) sans ligne de commande.
- Télécharger et ouvrir LM Studio
- Aller dans l'onglet Discover
- Rechercher Mistral Small 3 (24B)
- Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
- Charger le modèle et démarrer un chat
llama.cpp
Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.
# Télécharger le modèle GGUF (exemple Q4_K_M)
huggingface-cli download \
mistralai/Mistral-Small-3-(24B) \
--include "*.Q4_K_M.gguf" \
--local-dir ./models/mistral-small-3 Compatible avec votre machine ?
Scannez votre configuration matérielle pour savoir si Mistral Small 3 (24B) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.