OpenAI gpt-oss 20B (MoE)
gpt-oss 20B est le modèle open-weight d'OpenAI : architecture Mixture-of-Experts optimisée MXFP4 qui tient dans 16 Go de RAM. Fort en raisonnement, agents et usage général.
Caractéristiques principales
Variantes disponibles
| Quantization | Taille | RAM requise | VRAM requise | Vitesse | HuggingFace |
|---|---|---|---|---|---|
| MXFP4 | 13 Go | 16 Go | 14 Go | ~50 tok/s | HuggingFace → |
Installation
Ollama
La méthode la plus simple pour lancer OpenAI gpt-oss 20B (MoE) en local.
ollama run gpt-oss:20b Pas encore installé ? Voir le guide Ollama
LM Studio
Interface graphique pour exécuter OpenAI gpt-oss 20B (MoE) sans ligne de commande.
- Télécharger et ouvrir LM Studio
- Aller dans l'onglet Discover
- Rechercher OpenAI gpt-oss 20B (MoE)
- Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
- Charger le modèle et démarrer un chat
llama.cpp
Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.
# Télécharger le modèle GGUF (exemple Q4_K_M)
huggingface-cli download \
openai/OpenAI-gpt-oss-20B-(MoE) \
--include "*.Q4_K_M.gguf" \
--local-dir ./models/gpt-oss-20b Fichiers GGUF disponibles sur HuggingFace
Compatible avec votre machine ?
Scannez votre configuration matérielle pour savoir si OpenAI gpt-oss 20B (MoE) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.