gemma 12B params Open Source

Google Gemma 3 12B (multimodal)

Chat Code Vision Multilingue

Gemma 3 12B est l'un des meilleurs modèles multimodaux ouverts pour le local : excellent en français, vision intégrée et contexte long, sur GPU 12 Go ou Mac.

Caractéristiques principales

Paramètres 12B params
RAM min (Q4) 11 Go
Contexte 128K tokens
Famille gemma
Année 2025
Use cases Chat, Code, Vision, Multilingue

Variantes disponibles

Quantization Taille RAM requise VRAM requise Vitesse HuggingFace
Q4_K_M 8.1 Go 11 Go 9 Go ~36 tok/s HuggingFace →

Installation

Ollama

La méthode la plus simple pour lancer Google Gemma 3 12B (multimodal) en local.

ollama run gemma3:12b

Pas encore installé ? Voir le guide Ollama

LM Studio

Interface graphique pour exécuter Google Gemma 3 12B (multimodal) sans ligne de commande.

  1. Télécharger et ouvrir LM Studio
  2. Aller dans l'onglet Discover
  3. Rechercher Google Gemma 3 12B (multimodal)
  4. Sélectionner la variante souhaitée (Q4_K_M recommandé) et télécharger
  5. Charger le modèle et démarrer un chat

Voir le guide LM Studio

llama.cpp

Pour les utilisateurs avancés souhaitant un contrôle total sur l'inférence.

# Télécharger le modèle GGUF (exemple Q4_K_M) huggingface-cli download \ google/Google-Gemma-3-12B-(multimodal) \ --include "*.Q4_K_M.gguf" \ --local-dir ./models/gemma-3-12b

Fichiers GGUF disponibles sur HuggingFace

Compatible avec votre machine ?

Scannez votre configuration matérielle pour savoir si Google Gemma 3 12B (multimodal) peut tourner sur votre ordinateur - RAM, VRAM, et vitesse estimée.

Scanner ma machine →

Modèles similaires