Les équipes créatives et techniques qui déploient des fonctionnalités IA sur GPT, Claude, Gemini, Grok et modèles open weight connaissent la friction : cinq consoles, cinq cycles de facturation, cinq configurations SDK. OpenRouter unifie le tout en un endpoint compatible OpenAI, une clé API et 400+ modèles issus de 70+ fournisseurs. Ce guide professionnel couvre définition, double routage, avantages, matrice OpenRouter vs API directe, tarification et BYOK, exemples de code, SEO francophone, FAQ et passerelle MACNOX — pour décider avec méthode, pas au feeling.
- En bref :
base_urlvershttps://openrouter.ai/api/v1, SDK OpenAI conservé, slugs de modèle interchangeables. Zéro markup token — 5,5 % de frais sur crédits (min. 0,80 USD). - Free tier : 25+ modèles gratuits, 50 req/jour sans achat, 1 000/jour après 10 USD, plafond 20 req/min.
- Idéal pour : prototypes, agents multi-modèles, fallback sans cinq intégrations. À éviter pour SLA enterprise, fine-tunes privés ou résidence stricte mono-vendeur.
SECTION 01 API LLM multi-fournisseurs : clés, routage et pannes s'accumulent vite
Mi-2026, la plupart des stacks production appellent plusieurs modèles. Le coût d'intégration est réel :
- Prolifération de clés : OpenAI, Anthropic, Google, xAI, Moonshot — chacun sa console, ses limites et ses en-têtes d'auth. Rotation en CI/CD = risque sécurité.
- Fragmentation SDK : Messages API vs Chat Completions — chaque famille de modèle exige un adaptateur dans votre framework agent.
- Angles morts de panne : Sans fallback préconfiguré, une indisponibilité fournisseur bloque toute la chaîne créative ou de build.
- Opacité budgétaire : Comparer les coûts token par token demande des tableaux. L'évaluation de Kimi K3 vs Claude coûte souvent plus en intégration qu'en tarif catalogue.
- Workflows Apple : Valider des agents OpenRouter dans Xcode ou des pipelines CI macOS exige un environnement natif — les VM dégradent Metal et Core ML.
Positionnement : OpenRouter est une passerelle LLM unifiée — une clé, endpoint
https://openrouter.ai/api/v1, accès à 70+ fournisseurs et 400+ modèles dont GPT-5.x, Claude 4.x, Gemini 2.x, Grok, DeepSeek et Kimi — avec fallback et BYOK.
SECTION 02 Qu'est-ce qu'OpenRouter ? Double routage, fallback, tarifs et BYOK
OpenRouter se place entre votre application et les fournisseurs upstream. Vous envoyez une requête Chat Completions standard ; OpenRouter gère sélection, équilibrage et facturation agrégée.
| Dimension | Model routing | Provider routing |
|---|---|---|
| Format requête | Slug complet, ex. anthropic/claude-sonnet-4 |
Préfixe fournisseur, ex. anthropic/ |
| Logique de sélection | Fournisseur le moins cher ou le plus rapide pour ce modèle exact | Modèles du vendeur épinglé uniquement |
| Meilleur pour | Accès optimisé en coût à un tier de modèle | Conformité, facturation ou parité fonctionnelle chez un vendeur |
| Fallback | Tableau models — slugs testés dans l'ordre |
Fallback intra-vendeur sauf slugs cross-vendor ajoutés |
| Cas typique | Agents multi-modèles : GPT → Claude → Gemini si panne | Contrat enterprise Anthropic avec un seul endpoint |
Modèles gratuits et limites
- Avant achat de crédits : 50 requêtes gratuites/jour, non débitées du solde.
- Après 10+ USD de crédits : 1 000 requêtes gratuites/jour.
- Plafond : 20 requêtes/minute sur modèles free.
| Type de frais | Taux | Notes |
|---|---|---|
| Prix token | Zéro markup | Pass-through au prix catalogue fournisseur |
| Top-up carte | 5,5 % (min. 0,80 USD) | À l'achat de crédits, pas par token |
| Top-up crypto | 5 % | Rail de paiement alternatif |
| BYOK | 1 M req/mois gratuites | Facturation upstream ; au-delà, tarifs plateforme |
SECTION 03 OpenRouter vs API directe : matrice, cinq raisons et quand s'abstenir
| Facteur | OpenRouter | API directe |
|---|---|---|
| Temps de setup | Une clé, un endpoint, drop-in OpenAI SDK | Clés, SDKs et gestion d'erreurs séparés |
| Accès modèles | 400+ modèles, 70+ fournisseurs | Modèles du vendeur uniquement |
| Fallback | Tableau models intégré |
Logique failover à construire |
| Coût token | Prix catalogue + 5,5 % frais crédits | Prix catalogue ; remises enterprise possibles |
| Latence | Hop gateway supplémentaire (ms faibles) | Connexion directe, RTT minimal |
| Conformité / SLA | Terms OpenRouter ; données via gateway | BAA vendeur, SOC2, endpoints régionaux |
| Meilleur défaut pour | Prototypes, agents, comparaisons de coût | Production avec contrats enterprise négociés |
Cinq raisons de choisir OpenRouter
- Une intégration, tous les modèles : Changer les slugs sans réécrire le client — comme pour Grok 4.5 vs Claude.
- Compatibilité SDK OpenAI : Modifier
base_urletapi_keyseulement. - Fallback automatique : Claude → GPT → Gemini en une requête.
- Tarification transparente : Catalogue sans spread caché.
- Free tier : 25+ modèles gratuits avant contrat vendeur.
Quand ne pas utiliser OpenRouter
- SLA enterprise et BAA : Santé et finance avec accord signé chez un vendeur spécifique.
- Fine-tunes privés : Votre GPT-4 fine-tuné n'est pas dans le catalogue public.
- Résidence stricte : Capacité dédiée Anthropic en région EU ≠ routage gateway.
- Ultra-faible latence : Le hop gateway ajoute des millisecondes critiques.
- Volume négocié : Budgets à six chiffres/mois — le direct avec remise l'emporte souvent.
SECTION 04 Exemples de code OpenRouter API : curl, Python, SDK OpenAI, Node, streaming, fallback
Tous les exemples utilisent l'URL de base OpenRouter et une clé dashboard. Rouvrez la doc officielle après mises à jour upstream.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-H "HTTP-Referer: https://your-app.com" \
-H "X-Title: Your App Name" \
-d '{
"model": "openai/gpt-4o",
"messages": [{"role": "user", "content": "Expliquez le model routing en un paragraphe."}]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="your_openrouter_api_key",
)
response = client.chat.completions.create(
model="google/gemini-2.5-pro",
messages=[{"role": "user", "content": "Comparez GPT et Claude pour la revue de code."}],
)
print(response.choices[0].message.content)
const resp = await fetch("https://openrouter.ai/api/v1/chat/completions", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.OPENROUTER_API_KEY}`,
"Content-Type": "application/json",
"HTTP-Referer": "https://your-app.com",
"X-Title": "Your App Name",
},
body: JSON.stringify({
model: "anthropic/claude-sonnet-4",
messages: [{ role: "user", content: "Ecrivez un helper retry TypeScript." }],
}),
});
const data = await resp.json();
console.log(data.choices[0].message.content);
{
"models": [
"anthropic/claude-sonnet-4",
"openai/gpt-4o",
"google/gemini-2.5-flash"
],
"messages": [
{"role": "user", "content": "Fallback si panne."}
]
}
SECTION 05 Configurer OpenRouter : 6 étapes de l'inscription au fallback production
- Compte et clé API : Inscription sur openrouter.ai, Settings → Keys, stockage en secrets manager.
- Crédits (optionnel pour upgrade free) : Minimum 10 USD pour 1 000 req gratuites/jour.
- Pointer le client :
base_url=https://openrouter.ai/api/v1dans le SDK OpenAI. - Choisir les slugs : Format
vendor/model— ex.openai/gpt-4o,moonshotai/kimi-k3. - Fallback production : Tableau
modelsavec 2–3 alternates ; logger le modèle servi. - En-têtes et monitoring :
HTTP-RefereretX-Title; alertes budget avant CI/CD ; tests sur macOS natif plutôt qu'en VM pour Metal/Core ML.
SECTION 06 Données citables, SEO francophone et conclusion production
- Catalogue : 70+ fournisseurs, 400+ modèles, endpoint
https://openrouter.ai/api/v1. - Free tier : 25+ modèles gratuits ; 50 req/jour avant achat ; 1 000/jour après 10 USD ; 20 req/min.
- Revenus : Zéro markup token ; 5,5 % frais crédits (min. 0,80 USD) ; BYOK 1 M/mois gratuit.
- Routage : Model routing par slug ; provider routing épingle vendeur ; tableaux
modelspour fallback. - SDK : Drop-in OpenAI —
base_urletapi_keyuniquement.
Sources vérifiables — à rouvrir après mise à jour :
OpenRouter Official Documentation
OpenRouter FAQ — tarifs, modèles gratuits, BYOK
OpenRouter Models API — catalogue live
Matrice SEO francophone
| Cluster | Intention | Signal titre |
|---|---|---|
| OpenRouter API tutoriel | Intégration | Guide complet, étape par étape |
| OpenRouter vs OpenAI API | Décision | Comparaison, API directe |
| OpenRouter modèles gratuits | Prototypage | Free tier, tarifs |
| OpenRouter Python | Code copier-coller | Exemples, tutoriel |
| Combiné | Full funnel | Guide 2026 + comparaison + code |
Schema et distribution
- Canonical : Chaque locale sur elle-même — ex.
https://macnox.com/fr/blog/2026-openrouter-api-guide-gpt-claude-gemini.html. - Schema :
BlogPosting+FAQPageimbriqué — questions identiques aux<details>. - Distribution FR : dev.to (canonical retour), LinkedIn technique, forums créatifs Apple, Reddit r/LocalLLaMA.
OpenRouter résout l'accès aux modèles, mais les équipes branchant agents multi-modèles, CI/CD macOS et pipelines de test 7×24 rencontrent trois limites : (1) une panne gateway ne remplace pas une infra locale qui dort ; (2) CI macOS en VM dégrade Metal et Core ML ; (3) un MacBook de bureau n'est pas un hôte agent permanent. Pour une puissance Apple native sans perte, une CI/CD iOS stable et une automatisation Agent IA, les nœuds physiques cloud MACNOX restent souvent le meilleur choix : matériel Apple 100 %, Root complet, location flexible. Voir intégration Kimi K3 multi-vendor, analyse coût agent Grok 4.5 et location vs achat Mac Mini M4.
SECTION 07 FAQ
Qu'est-ce qu'OpenRouter et comment ça fonctionne ?
OpenRouter est une passerelle API compatible OpenAI qui route les requêtes vers 70+ fournisseurs et 400+ modèles via une seule clé. Pointez tout client OpenAI SDK vers https://openrouter.ai/api/v1 et changez les IDs de modèle.
OpenRouter est-il gratuit ?
OpenRouter propose 25+ modèles gratuits. Sans crédits : 50 req/jour. Après 10 USD de crédits : 1 000 req/jour. Modèles free : max 20 req/minute.
OpenRouter applique-t-il une marge sur les tokens ?
Aucun markup token. Prix catalogue transmis. Revenus : 5,5 % sur crédits (min. 0,80 USD), 5 % crypto, BYOK au-delà de 1 M req gratuites/mois.
Quelle différence entre model routing et provider routing ?
Model routing optimise pour un slug comme anthropic/claude-sonnet-4. Provider routing épingle anthropic/. Les tableaux fallback essaient d'autres modèles en cas de panne.
Quand ne PAS utiliser OpenRouter ?
SLA enterprise, fine-tunes privés, résidence stricte mono-vendeur ou latence minimale. Gros volumes négociés en direct coûtent souvent moins.
Puis-je utiliser mes propres clés API (BYOK) ?
Oui. BYOK attache vos clés — facturation upstream. 1 M req BYOK/mois sans frais plateforme ; au-delà, tarifs standard.