DeepSeek R1 Distill 70B
Distillation 70B de DeepSeek R1 (base Llama) : le meilleur raisonnement DeepSeek exécutable en local, sur gros GPU 48 Go ou Mac haut de gamme.
Caractéristiques principales
Variantes disponibles
| Quantization | Taille | RAM requise | VRAM requise | Vitesse | HuggingFace |
|---|---|---|---|---|---|
| Q4_K_M | 43 Go | 48 Go | 42 Go | ~12 tok/s | HuggingFace → |
Installation
Ollama
La méthode la plus simple pour lancer DeepSeek R1 Distill 70B en local.
ollama run deepseek-r1:70b Pas encore installé ? Voir le guide Ollama
LM Studio
Interface graphique pour exécuter DeepSeek R1 Distill 70B sans ligne de commande.
- Télécharger et ouvrir LM Studio
- Aller dans l'onglet Discover
- Rechercher DeepSeek R1 Distill 70B
- Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
- Charger le modèle et démarrer un chat
llama.cpp
Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.
# Télécharger le modèle GGUF (exemple Q4_K_M)
huggingface-cli download \
deepseek-ai/DeepSeek-R1-Distill-70B \
--include "*.Q4_K_M.gguf" \
--local-dir ./models/deepseek-r1-70b Fichiers GGUF disponibles sur HuggingFace
Compatible avec votre machine ?
Scannez votre configuration matérielle pour savoir si DeepSeek R1 Distill 70B peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.