deepseek 70B params Restreint

DeepSeek R1 Distill 70B

Raisonnement Code Chat

Distillation 70B de DeepSeek R1 (base Llama) : le meilleur raisonnement DeepSeek exécutable en local, sur gros GPU 48 Go ou Mac haut de gamme.

Caractéristiques principales

Paramètres 70B params
RAM min (Q4) 48 Go
Contexte 128K tokens
Famille deepseek
Année 2025
Use cases Raisonnement, Code, Chat

Variantes disponibles

Quantization Taille RAM requise VRAM requise Vitesse HuggingFace
Q4_K_M 43 Go 48 Go 42 Go ~12 tok/s HuggingFace →

Installation

Ollama

La méthode la plus simple pour lancer DeepSeek R1 Distill 70B en local.

ollama run deepseek-r1:70b

Pas encore installé ? Voir le guide Ollama

LM Studio

Interface graphique pour exécuter DeepSeek R1 Distill 70B sans ligne de commande.

  1. Télécharger et ouvrir LM Studio
  2. Aller dans l'onglet Discover
  3. Rechercher DeepSeek R1 Distill 70B
  4. Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
  5. Charger le modèle et démarrer un chat

Voir le guide LM Studio

llama.cpp

Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.

# Télécharger le modèle GGUF (exemple Q4_K_M) huggingface-cli download \ deepseek-ai/DeepSeek-R1-Distill-70B \ --include "*.Q4_K_M.gguf" \ --local-dir ./models/deepseek-r1-70b

Fichiers GGUF disponibles sur HuggingFace

Compatible avec votre machine ?

Scannez votre configuration matérielle pour savoir si DeepSeek R1 Distill 70B peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.

Scanner ma machine →

Modèles similaires