Hébergé en France · Conforme RGPD · API compatible OpenAI

L'IA générative souveraine
pour votre entreprise

Les meilleurs modèles open-weight - Mistral, Llama, Qwen, DeepSeek - servis depuis des GPU hébergés en France. Vos données ne quittent jamais l'Union européenne, ne servent jamais à entraîner de modèles, et vos outils existants fonctionnent sans réécriture grâce à notre API compatible OpenAI.

Réponse sous 48 h · DPA art. 28 RGPD · Sans engagement pour l'API

Pourquoi une IA souveraine ?

Utiliser une IA cloud grand public en entreprise, c'est souvent envoyer vos documents, votre code et les données de vos clients sur des serveurs situés hors de l'Union européenne, soumis à des législations extraterritoriales. Il existe une autre voie.

Hébergement en France

Inférence exécutée sur des GPU situés dans des datacenters français, opérés par des acteurs européens. Aucun transfert de données hors UE, aucune exposition au Cloud Act.

RGPD par conception

Pas de conservation des prompts par défaut, pas d'entraînement sur vos données, DPA conforme à l'article 28. Votre DPO valide en une lecture, pas en six mois d'analyse de transferts internationaux.

Compatible OpenAI

L'endpoint api.llms.fr est une API compatible OpenAI : changez une URL et une clé, et vos applications, agents et intégrations existants fonctionnent immédiatement.

Indépendance

Modèles open-weight : pas de dépendance à un fournisseur unique, pas de changement de comportement du modèle du jour au lendemain, réversibilité totale - vous pouvez même rapatrier le modèle en local.

Offre 1 - API mutualisée

Les grands modèles, facturés au token

Démarrez en quelques minutes : un catalogue de modèles open-weight de référence, servis depuis la France, facturés au million de tokens. Idéal pour prototyper puis passer à l'échelle.

Modèle Taille Points forts Contexte Entrée / 1M tokens Sortie / 1M tokens
Qwen3-Coder 30B 30B MoE Code & agents de développement, très rapide 256K 0,15 € 0,50 €
Mistral Small 3.2 24B Chat, extraction, résumé - excellent en français 128K 0,20 € 0,60 €
gpt-oss-120b 120B MoE Raisonnement, agents, usage général 128K 0,30 € 1,20 €
Llama 3.3 70B 70B Usage général, forte qualité multilingue 128K 0,90 € 0,90 €
GLM-5.2 MoE (~750B) Code long-horizon et agentique, état de l'art open-weight 200K 1,00 € 3,90 €
DeepSeek V4 MoE Raisonnement complexe, maths, analyse 128K 0,90 € 3,60 €

Tarifs de lancement, HT. Le catalogue évolue avec les meilleures sorties open-weight, et nous ajoutons un modèle à la demande sous 24-48 h. Streaming, function calling et sorties structurées inclus sur tous les modèles. Voir la grille complète et les packs de crédits →

Offre 2 - Instances GPU dédiées

Votre GPU, votre modèle, votre débit

Une instance GPU réservée à votre entreprise, dimensionnée avec vous selon vos volumes, vos modèles et vos contraintes. Isolation totale, coût mensuel prévisible, modèles au choix - y compris vos modèles fine-tunés.

Starter

NVIDIA L4 24 Go VRAM

Modèles jusqu'à 14B - chatbot interne, RAG documentaire, extraction

à partir de 690 € /mois HT
Demander un devis

Performance

NVIDIA H100 80 Go VRAM

70B+ pleine précision, fort débit - production exigeante, multi-équipes

à partir de 3 490 € /mois HT
Demander un devis

Sur-mesure

Multi-GPU H100/H200 160 Go+ VRAM

Très grands modèles, fine-tuning, SLA renforcé, volumes importants

sur devis
Demander un devis
  • ✓ Aucune mutualisation : le GPU est à vous
  • ✓ Dimensionnement accompagné selon vos besoins réels
  • ✓ Modèle au choix, y compris fine-tuné sur vos données
  • ✓ Débit et latence garantis, monitoring inclus
  • ✓ Accessible via l'API api.llms.fr ou en endpoint privé
  • ✓ Évolutif : montée ou descente de gamme à tout moment
Inclus dans l'offre

api.llms.fr - un endpoint, tous vos outils

api.llms.fr expose l'ensemble des modèles via une API compatible OpenAI. Branchez vos applications, vos workflows n8n, LangChain, et vos agents de code - OpenCode, OpenClaw, Hermes Agent - en changeant simplement l'URL de base.

Voir la documentation de l'API →
export OPENAI_BASE_URL="https://api.llms.fr/v1"
export OPENAI_API_KEY="llms_sk_..."

# Vos outils fonctionnent, vos données restent en France.

Pensé pour les données sensibles

Dès que vos prompts contiennent des données personnelles, médicales, financières ou du code propriétaire, la localisation du traitement n'est plus un détail : c'est une obligation.

Santé

Aide au compte-rendu, synthèse de dossiers, courriers - sans exporter de données patients hors UE.

Juridique

Analyse de contrats et de pièces couvertes par le secret professionnel, en toute confidentialité.

Finance & assurance

Traitement de documents clients et conformité DORA/ACPR, avec un sous-traitant européen.

Secteur public

Une IA générative alignée avec les doctrines cloud de l'État et l'exigence de souveraineté.

Équipes de développement

Agents de code (OpenCode, OpenClaw, Aider…) branchés sur vos modèles : votre code source ne quitte pas l'Europe.

RH & interne

Assistants internes sur documents RH, paie, entretiens - des données par nature ultra-sensibles.

Questions fréquentes

Parlons de votre cas d'usage

Décrivez-nous vos besoins - volumes, modèles, contraintes de conformité - et nous vous proposons un dimensionnement et un accès de test sous 48 h.

Demander un accès →