qwen 0.6B params Open Source

Alibaba Qwen3 0.6B

Chat Multilingue

Le plus petit Qwen3 : un modèle ultra-léger qui tourne sur presque n'importe quelle machine, y compris sans GPU. Idéal pour l'edge, les tests et l'intégration embarquée.

Caractéristiques principales

Paramètres 0.6B params
RAM min (Q4) 2 Go
Contexte 32K tokens
Famille qwen
Année 2025
Use cases Chat, Multilingue

Variantes disponibles

Quantization Taille RAM requise VRAM requise Vitesse HuggingFace
Q4_K_M 0.5 Go 2 Go 1 Go ~120 tok/s HuggingFace →

Installation

Ollama

La méthode la plus simple pour lancer Alibaba Qwen3 0.6B en local.

ollama run qwen3:0.6b

Pas encore installé ? Voir le guide Ollama

LM Studio

Interface graphique pour exécuter Alibaba Qwen3 0.6B sans ligne de commande.

  1. Télécharger et ouvrir LM Studio
  2. Aller dans l'onglet Discover
  3. Rechercher Alibaba Qwen3 0.6B
  4. Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
  5. Charger le modèle et démarrer un chat

Voir le guide LM Studio

llama.cpp

Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.

# Télécharger le modèle GGUF (exemple Q4_K_M) huggingface-cli download \ Qwen/Alibaba-Qwen3-0.6B \ --include "*.Q4_K_M.gguf" \ --local-dir ./models/qwen3-0.6b

Fichiers GGUF disponibles sur HuggingFace

Compatible avec votre machine ?

Scannez votre configuration matérielle pour savoir si Alibaba Qwen3 0.6B peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.

Scanner ma machine →

Modèles similaires