qwen 32B params Open Source
Alibaba Qwen3 32B
Chat Code Raisonnement Multilingue
Qwen3 32B est un modèle dense haut de gamme, très solide en raisonnement et en code, pour les GPU 24 Go et les Mac à mémoire unifiée.
Caractéristiques principales
Paramètres 32B params
RAM min (Q4) 24 Go
Contexte 128K tokens
Famille qwen
Année 2025
Use cases Chat, Code, Raisonnement, Multilingue
Variantes disponibles
| Quantization | Taille | RAM requise | VRAM requise | Vitesse | HuggingFace |
|---|---|---|---|---|---|
| Q4_K_M | 20 Go | 24 Go | 21 Go | ~22 tok/s | HuggingFace → |
Installation
Ollama
La méthode la plus simple pour lancer Alibaba Qwen3 32B en local.
ollama run qwen3:32b Pas encore installé ? Voir le guide Ollama
LM Studio
Interface graphique pour exécuter Alibaba Qwen3 32B sans ligne de commande.
- Télécharger et ouvrir LM Studio
- Aller dans l'onglet Discover
- Rechercher Alibaba Qwen3 32B
- Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
- Charger le modèle et démarrer un chat
llama.cpp
Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.
# Télécharger le modèle GGUF (exemple Q4_K_M)
huggingface-cli download \
Qwen/Alibaba-Qwen3-32B \
--include "*.Q4_K_M.gguf" \
--local-dir ./models/qwen3-32b Fichiers GGUF disponibles sur HuggingFace
Compatible avec votre machine ?
Scannez votre configuration matérielle pour savoir si Alibaba Qwen3 32B peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.