Alibaba Qwen3 30B-A3B (MoE)
Qwen3 30B-A3B est un modèle Mixture-of-Experts : 30B de paramètres au total mais seulement 3B actifs par token, ce qui le rend rapide tout en offrant la qualité d'un gros modèle. Excellent sur station de travail.
Caractéristiques principales
Variantes disponibles
| Quantization | Taille | RAM requise | VRAM requise | Vitesse | HuggingFace |
|---|---|---|---|---|---|
| Q4_K_M | 18 Go | 22 Go | 18 Go | ~55 tok/s | HuggingFace → |
Installation
Ollama
La méthode la plus simple pour lancer Alibaba Qwen3 30B-A3B (MoE) en local.
ollama run qwen3:30b Pas encore installé ? Voir le guide Ollama
LM Studio
Interface graphique pour exécuter Alibaba Qwen3 30B-A3B (MoE) sans ligne de commande.
- Télécharger et ouvrir LM Studio
- Aller dans l'onglet Discover
- Rechercher Alibaba Qwen3 30B-A3B (MoE)
- Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
- Charger le modèle et démarrer un chat
llama.cpp
Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.
# Télécharger le modèle GGUF (exemple Q4_K_M)
huggingface-cli download \
Qwen/Alibaba-Qwen3-30B-A3B-(MoE) \
--include "*.Q4_K_M.gguf" \
--local-dir ./models/qwen3-30b-a3b Fichiers GGUF disponibles sur HuggingFace
Compatible avec votre machine ?
Scannez votre configuration matérielle pour savoir si Alibaba Qwen3 30B-A3B (MoE) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.