gpt-oss 20B params Restreint

OpenAI gpt-oss 20B (MoE)

Chat Code Raisonnement

gpt-oss 20B est le modèle open-weight d'OpenAI : architecture Mixture-of-Experts optimisée MXFP4 qui tient dans 16 Go de RAM. Fort en raisonnement, agents et usage général.

Caractéristiques principales

Paramètres 20B params
RAM min (Q4) 16 Go
Contexte 128K tokens
Famille gpt-oss
Année 2025
Use cases Chat, Code, Raisonnement

Variantes disponibles

Quantization Taille RAM requise VRAM requise Vitesse HuggingFace
MXFP4 13 Go 16 Go 14 Go ~50 tok/s HuggingFace →

Installation

Ollama

La méthode la plus simple pour lancer OpenAI gpt-oss 20B (MoE) en local.

ollama run gpt-oss:20b

Pas encore installé ? Voir le guide Ollama

LM Studio

Interface graphique pour exécuter OpenAI gpt-oss 20B (MoE) sans ligne de commande.

  1. Télécharger et ouvrir LM Studio
  2. Aller dans l'onglet Discover
  3. Rechercher OpenAI gpt-oss 20B (MoE)
  4. Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
  5. Charger le modèle et démarrer un chat

Voir le guide LM Studio

llama.cpp

Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.

# Télécharger le modèle GGUF (exemple Q4_K_M) huggingface-cli download \ openai/OpenAI-gpt-oss-20B-(MoE) \ --include "*.Q4_K_M.gguf" \ --local-dir ./models/gpt-oss-20b

Fichiers GGUF disponibles sur HuggingFace

Compatible avec votre machine ?

Scannez votre configuration matérielle pour savoir si OpenAI gpt-oss 20B (MoE) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.

Scanner ma machine →

Modèles similaires