gemma 4B params Open Source

Google Gemma 3 4B (multimodal)

Chat Vision Multilingue

Gemma 3 4B est multimodal (texte + image) et supporte un contexte long. Idéal pour le chat, l'analyse d'images et les usages locaux polyvalents sur petit GPU.

Caractéristiques principales

Paramètres 4B params
RAM min (Q4) 6 Go
Contexte 128K tokens
Famille gemma
Année 2025
Use cases Chat, Vision, Multilingue

Variantes disponibles

Quantization Taille RAM requise VRAM requise Vitesse HuggingFace
Q4_K_M 3.3 Go 6 Go 4 Go ~65 tok/s HuggingFace →

Installation

Ollama

La méthode la plus simple pour lancer Google Gemma 3 4B (multimodal) en local.

ollama run gemma3:4b

Pas encore installé ? Voir le guide Ollama

LM Studio

Interface graphique pour exécuter Google Gemma 3 4B (multimodal) sans ligne de commande.

  1. Télécharger et ouvrir LM Studio
  2. Aller dans l'onglet Discover
  3. Rechercher Google Gemma 3 4B (multimodal)
  4. Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
  5. Charger le modèle et démarrer un chat

Voir le guide LM Studio

llama.cpp

Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.

# Télécharger le modèle GGUF (exemple Q4_K_M) huggingface-cli download \ google/Google-Gemma-3-4B-(multimodal) \ --include "*.Q4_K_M.gguf" \ --local-dir ./models/gemma-3-4b

Fichiers GGUF disponibles sur HuggingFace

Compatible avec votre machine ?

Scannez votre configuration matérielle pour savoir si Google Gemma 3 4B (multimodal) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.

Scanner ma machine →

Modèles similaires