api.llms.fr
un endpoint, tous vos outils
api.llms.fr expose les meilleurs modèles hébergés en France via une API compatible OpenAI. Changez une URL de base, et vos applications, workflows et agents de code - OpenCode, OpenClaw, Hermes Agent, Claude Code - tournent sur une IA conforme RGPD.
# Avant : vos données quittent l'Union européenne
export OPENAI_BASE_URL="https://api.openai.com/v1"
# Après : vos données restent en France
export OPENAI_BASE_URL="https://api.llms.fr/v1"
export OPENAI_API_KEY="llms_sk_..." Opérationnel en 3 étapes
Obtenez votre clé
Demandez un accès via notre formulaire. Vous recevez une clé API et la documentation sous 48 h.
Changez l'URL de base
Pointez votre SDK, outil ou agent vers https://api.llms.fr/v1. Aucune autre modification de code.
Choisissez votre modèle
Mistral, Llama, Qwen, DeepSeek… ou votre instance GPU dédiée. Changez de modèle en changeant un paramètre.
Branchez vos outils et vos agents
SDK, frameworks, plateformes no-code et agents de code : si l'outil parle le format OpenAI, il parle à api.llms.fr.
curl https://api.llms.fr/v1/chat/completions \
-H "Authorization: Bearer $LLMS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mistral-small-3",
"messages": [{"role": "user", "content": "Bonjour !"}]
}' from openai import OpenAI
client = OpenAI(
base_url="https://api.llms.fr/v1",
api_key="llms_sk_...",
)
response = client.chat.completions.create(
model="llama-3.3-70b",
messages=[{"role": "user", "content": "Bonjour !"}],
) import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.llms.fr/v1",
apiKey: "llms_sk_...",
});
const response = await client.chat.completions.create({
model: "qwen-3-32b",
messages: [{ role: "user", content: "Bonjour !" }],
}); // opencode.json
{
"provider": {
"llmsfr": {
"npm": "@ai-sdk/openai-compatible",
"options": {
"baseURL": "https://api.llms.fr/v1",
"apiKey": "{env:LLMS_API_KEY}"
},
"models": {
"qwen-3-32b": {},
"llama-3.3-70b": {}
}
}
}
} # Tout agent compatible API OpenAI :
export OPENAI_BASE_URL="https://api.llms.fr/v1"
export OPENAI_API_KEY="llms_sk_..."
# L'agent utilise désormais des modèles
# hébergés en France, conformes RGPD. # Via la passerelle compatible Anthropic de LLMs.fr
export ANTHROPIC_BASE_URL="https://api.llms.fr/anthropic"
export ANTHROPIC_AUTH_TOKEN="llms_sk_..."
claude --model llama-3.3-70b Fonctionne aussi avec LangChain, LlamaIndex, n8n, Flowise, Dify, LibreChat, Open WebUI, Aider, Continue, Cline et tout client compatible OpenAI.
Ce que fait l'API
Compatible API OpenAI
Endpoints /v1/chat/completions, /v1/embeddings, /v1/models. Streaming, function calling, sorties structurées JSON. Vos SDK et outils actuels fonctionnent sans modification.
Multi-modèles & fallback
Un seul endpoint pour tout le catalogue : changez de modèle en changeant un paramètre. Règles de routage et repli automatique si un modèle est indisponible.
Clés & quotas par équipe
Créez des clés API par projet, par équipe ou par agent, avec quotas et plafonds de dépense. Révocation instantanée.
Observabilité sans indiscrétion
Volumes, latences, coûts par clé et par modèle - sans journaliser le contenu de vos prompts. La journalisation des contenus est strictement opt-in.
Inférence en France
Toutes les requêtes sont servies par des GPU situés en France. Aucun transfert hors UE, aucune exposition au Cloud Act.
Zéro rétention par défaut
Vos prompts et réponses ne sont ni stockés ni utilisés pour entraîner des modèles. Conforme RGPD, DPA fourni.
Questions fréquentes
C'est l'API unifiée de LLMs.fr : un endpoint unique, compatible avec l'API OpenAI, qui donne accès à l'ensemble des modèles de LLMs.fr Cloud - hébergés en France - ainsi qu'à vos instances GPU dédiées. Elle route intelligemment votre requête vers le bon modèle, mais pour vous c'est une seule URL : vous changez la base URL dans vos outils, et tout le reste fonctionne comme avant (SDK OpenAI, LangChain, LlamaIndex, n8n, Zapier, agents de code, etc.).
Tout agent capable de parler à une API compatible OpenAI : OpenCode, OpenClaw, Hermes Agent, Aider, Continue, Cline… Il suffit généralement de définir OPENAI_BASE_URL et une clé API. Claude Code est également supporté via la passerelle compatible Anthropic. Votre code source est alors traité par des modèles hébergés en France au lieu de partir sur un cloud hors UE.
Oui. L'API supporte le streaming (Server-Sent Events), le function calling / tool use, les sorties structurées JSON et les embeddings, dans le même format que l'API OpenAI. Si votre application fonctionne avec OpenAI aujourd'hui, elle fonctionnera avec api.llms.fr.
Les requêtes vers le catalogue mutualisé sont facturées au million de tokens, selon la grille tarifaire de LLMs.fr Cloud. Les requêtes vers votre instance GPU dédiée sont incluses dans son forfait mensuel. L'API elle-même est incluse, sans surcoût.
Par défaut : uniquement des métadonnées techniques (modèle appelé, nombre de tokens, latence) nécessaires à la facturation et au monitoring. Le contenu des prompts et des réponses n'est ni journalisé ni conservé. Vous pouvez activer une journalisation à des fins de débogage, mais c'est votre choix, jamais le nôtre.
L'API est en cours d'ouverture. Demandez un accès via notre formulaire : nous vous fournissons une clé de test et la documentation complète sous 48 h.
Prêt à rapatrier votre IA en France ?
Obtenez une clé de test, branchez vos outils, et mesurez par vous-même : même API, mêmes performances, zéro donnée hors UE.
Demander un accès →