Accueil / Blog / OpenRouter API
ENGINEERING_BLOG · 2026.07.24

OpenRouter API : guide complet
GPT, Claude, Gemini — un endpoint, 400+ modèles

Les équipes créatives et techniques qui déploient des fonctionnalités IA sur GPT, Claude, Gemini, Grok et modèles open weight connaissent la friction : cinq consoles, cinq cycles de facturation, cinq configurations SDK. OpenRouter unifie le tout en un endpoint compatible OpenAI, une clé API et 400+ modèles issus de 70+ fournisseurs. Ce guide professionnel couvre définition, double routage, avantages, matrice OpenRouter vs API directe, tarification et BYOK, exemples de code, SEO francophone, FAQ et passerelle MACNOX — pour décider avec méthode, pas au feeling.

  • En bref : base_url vers https://openrouter.ai/api/v1, SDK OpenAI conservé, slugs de modèle interchangeables. Zéro markup token — 5,5 % de frais sur crédits (min. 0,80 USD).
  • Free tier : 25+ modèles gratuits, 50 req/jour sans achat, 1 000/jour après 10 USD, plafond 20 req/min.
  • Idéal pour : prototypes, agents multi-modèles, fallback sans cinq intégrations. À éviter pour SLA enterprise, fine-tunes privés ou résidence stricte mono-vendeur.

SECTION 01 API LLM multi-fournisseurs : clés, routage et pannes s'accumulent vite

Mi-2026, la plupart des stacks production appellent plusieurs modèles. Le coût d'intégration est réel :

  • Prolifération de clés : OpenAI, Anthropic, Google, xAI, Moonshot — chacun sa console, ses limites et ses en-têtes d'auth. Rotation en CI/CD = risque sécurité.
  • Fragmentation SDK : Messages API vs Chat Completions — chaque famille de modèle exige un adaptateur dans votre framework agent.
  • Angles morts de panne : Sans fallback préconfiguré, une indisponibilité fournisseur bloque toute la chaîne créative ou de build.
  • Opacité budgétaire : Comparer les coûts token par token demande des tableaux. L'évaluation de Kimi K3 vs Claude coûte souvent plus en intégration qu'en tarif catalogue.
  • Workflows Apple : Valider des agents OpenRouter dans Xcode ou des pipelines CI macOS exige un environnement natif — les VM dégradent Metal et Core ML.

Positionnement : OpenRouter est une passerelle LLM unifiée — une clé, endpoint https://openrouter.ai/api/v1, accès à 70+ fournisseurs et 400+ modèles dont GPT-5.x, Claude 4.x, Gemini 2.x, Grok, DeepSeek et Kimi — avec fallback et BYOK.

SECTION 02 Qu'est-ce qu'OpenRouter ? Double routage, fallback, tarifs et BYOK

OpenRouter se place entre votre application et les fournisseurs upstream. Vous envoyez une requête Chat Completions standard ; OpenRouter gère sélection, équilibrage et facturation agrégée.

Model routing vs provider routing sur OpenRouter
Dimension Model routing Provider routing
Format requête Slug complet, ex. anthropic/claude-sonnet-4 Préfixe fournisseur, ex. anthropic/
Logique de sélection Fournisseur le moins cher ou le plus rapide pour ce modèle exact Modèles du vendeur épinglé uniquement
Meilleur pour Accès optimisé en coût à un tier de modèle Conformité, facturation ou parité fonctionnelle chez un vendeur
Fallback Tableau models — slugs testés dans l'ordre Fallback intra-vendeur sauf slugs cross-vendor ajoutés
Cas typique Agents multi-modèles : GPT → Claude → Gemini si panne Contrat enterprise Anthropic avec un seul endpoint

Modèles gratuits et limites

  • Avant achat de crédits : 50 requêtes gratuites/jour, non débitées du solde.
  • Après 10+ USD de crédits : 1 000 requêtes gratuites/jour.
  • Plafond : 20 requêtes/minute sur modèles free.
Structure tarifaire OpenRouter (juillet 2026)
Type de frais Taux Notes
Prix token Zéro markup Pass-through au prix catalogue fournisseur
Top-up carte 5,5 % (min. 0,80 USD) À l'achat de crédits, pas par token
Top-up crypto 5 % Rail de paiement alternatif
BYOK 1 M req/mois gratuites Facturation upstream ; au-delà, tarifs plateforme

SECTION 03 OpenRouter vs API directe : matrice, cinq raisons et quand s'abstenir

OpenRouter vs API directe — matrice de décision
Facteur OpenRouter API directe
Temps de setup Une clé, un endpoint, drop-in OpenAI SDK Clés, SDKs et gestion d'erreurs séparés
Accès modèles 400+ modèles, 70+ fournisseurs Modèles du vendeur uniquement
Fallback Tableau models intégré Logique failover à construire
Coût token Prix catalogue + 5,5 % frais crédits Prix catalogue ; remises enterprise possibles
Latence Hop gateway supplémentaire (ms faibles) Connexion directe, RTT minimal
Conformité / SLA Terms OpenRouter ; données via gateway BAA vendeur, SOC2, endpoints régionaux
Meilleur défaut pour Prototypes, agents, comparaisons de coût Production avec contrats enterprise négociés

Cinq raisons de choisir OpenRouter

  1. Une intégration, tous les modèles : Changer les slugs sans réécrire le client — comme pour Grok 4.5 vs Claude.
  2. Compatibilité SDK OpenAI : Modifier base_url et api_key seulement.
  3. Fallback automatique : Claude → GPT → Gemini en une requête.
  4. Tarification transparente : Catalogue sans spread caché.
  5. Free tier : 25+ modèles gratuits avant contrat vendeur.

Quand ne pas utiliser OpenRouter

  • SLA enterprise et BAA : Santé et finance avec accord signé chez un vendeur spécifique.
  • Fine-tunes privés : Votre GPT-4 fine-tuné n'est pas dans le catalogue public.
  • Résidence stricte : Capacité dédiée Anthropic en région EU ≠ routage gateway.
  • Ultra-faible latence : Le hop gateway ajoute des millisecondes critiques.
  • Volume négocié : Budgets à six chiffres/mois — le direct avec remise l'emporte souvent.

SECTION 04 Exemples de code OpenRouter API : curl, Python, SDK OpenAI, Node, streaming, fallback

Tous les exemples utilisent l'URL de base OpenRouter et une clé dashboard. Rouvrez la doc officielle après mises à jour upstream.

openrouter_curl.sh
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -H "HTTP-Referer: https://your-app.com" \
  -H "X-Title: Your App Name" \
  -d '{
    "model": "openai/gpt-4o",
    "messages": [{"role": "user", "content": "Expliquez le model routing en un paragraphe."}]
  }'
openrouter_openai_sdk.py
from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key="your_openrouter_api_key",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-pro",
    messages=[{"role": "user", "content": "Comparez GPT et Claude pour la revue de code."}],
)
print(response.choices[0].message.content)
openrouter_node.mjs
const resp = await fetch("https://openrouter.ai/api/v1/chat/completions", {
  method: "POST",
  headers: {
    "Authorization": `Bearer ${process.env.OPENROUTER_API_KEY}`,
    "Content-Type": "application/json",
    "HTTP-Referer": "https://your-app.com",
    "X-Title": "Your App Name",
  },
  body: JSON.stringify({
    model: "anthropic/claude-sonnet-4",
    messages: [{ role: "user", content: "Ecrivez un helper retry TypeScript." }],
  }),
});
const data = await resp.json();
console.log(data.choices[0].message.content);
openrouter_fallback.json
{
  "models": [
    "anthropic/claude-sonnet-4",
    "openai/gpt-4o",
    "google/gemini-2.5-flash"
  ],
  "messages": [
    {"role": "user", "content": "Fallback si panne."}
  ]
}

SECTION 05 Configurer OpenRouter : 6 étapes de l'inscription au fallback production

  1. Compte et clé API : Inscription sur openrouter.ai, Settings → Keys, stockage en secrets manager.
  2. Crédits (optionnel pour upgrade free) : Minimum 10 USD pour 1 000 req gratuites/jour.
  3. Pointer le client : base_url=https://openrouter.ai/api/v1 dans le SDK OpenAI.
  4. Choisir les slugs : Format vendor/model — ex. openai/gpt-4o, moonshotai/kimi-k3.
  5. Fallback production : Tableau models avec 2–3 alternates ; logger le modèle servi.
  6. En-têtes et monitoring : HTTP-Referer et X-Title ; alertes budget avant CI/CD ; tests sur macOS natif plutôt qu'en VM pour Metal/Core ML.

SECTION 06 Données citables, SEO francophone et conclusion production

  • Catalogue : 70+ fournisseurs, 400+ modèles, endpoint https://openrouter.ai/api/v1.
  • Free tier : 25+ modèles gratuits ; 50 req/jour avant achat ; 1 000/jour après 10 USD ; 20 req/min.
  • Revenus : Zéro markup token ; 5,5 % frais crédits (min. 0,80 USD) ; BYOK 1 M/mois gratuit.
  • Routage : Model routing par slug ; provider routing épingle vendeur ; tableaux models pour fallback.
  • SDK : Drop-in OpenAI — base_url et api_key uniquement.

Sources vérifiables — à rouvrir après mise à jour :

OpenRouter Official Documentation

OpenRouter FAQ — tarifs, modèles gratuits, BYOK

OpenRouter Models API — catalogue live

Matrice SEO francophone

Mots-clés à forte intention — marché FR
Cluster Intention Signal titre
OpenRouter API tutoriel Intégration Guide complet, étape par étape
OpenRouter vs OpenAI API Décision Comparaison, API directe
OpenRouter modèles gratuits Prototypage Free tier, tarifs
OpenRouter Python Code copier-coller Exemples, tutoriel
Combiné Full funnel Guide 2026 + comparaison + code

Schema et distribution

  • Canonical : Chaque locale sur elle-même — ex. https://macnox.com/fr/blog/2026-openrouter-api-guide-gpt-claude-gemini.html.
  • Schema : BlogPosting + FAQPage imbriqué — questions identiques aux <details>.
  • Distribution FR : dev.to (canonical retour), LinkedIn technique, forums créatifs Apple, Reddit r/LocalLLaMA.

OpenRouter résout l'accès aux modèles, mais les équipes branchant agents multi-modèles, CI/CD macOS et pipelines de test 7×24 rencontrent trois limites : (1) une panne gateway ne remplace pas une infra locale qui dort ; (2) CI macOS en VM dégrade Metal et Core ML ; (3) un MacBook de bureau n'est pas un hôte agent permanent. Pour une puissance Apple native sans perte, une CI/CD iOS stable et une automatisation Agent IA, les nœuds physiques cloud MACNOX restent souvent le meilleur choix : matériel Apple 100 %, Root complet, location flexible. Voir intégration Kimi K3 multi-vendor, analyse coût agent Grok 4.5 et location vs achat Mac Mini M4.

SECTION 07 FAQ

Qu'est-ce qu'OpenRouter et comment ça fonctionne ?

OpenRouter est une passerelle API compatible OpenAI qui route les requêtes vers 70+ fournisseurs et 400+ modèles via une seule clé. Pointez tout client OpenAI SDK vers https://openrouter.ai/api/v1 et changez les IDs de modèle.

OpenRouter est-il gratuit ?

OpenRouter propose 25+ modèles gratuits. Sans crédits : 50 req/jour. Après 10 USD de crédits : 1 000 req/jour. Modèles free : max 20 req/minute.

OpenRouter applique-t-il une marge sur les tokens ?

Aucun markup token. Prix catalogue transmis. Revenus : 5,5 % sur crédits (min. 0,80 USD), 5 % crypto, BYOK au-delà de 1 M req gratuites/mois.

Quelle différence entre model routing et provider routing ?

Model routing optimise pour un slug comme anthropic/claude-sonnet-4. Provider routing épingle anthropic/. Les tableaux fallback essaient d'autres modèles en cas de panne.

Quand ne PAS utiliser OpenRouter ?

SLA enterprise, fine-tunes privés, résidence stricte mono-vendeur ou latence minimale. Gros volumes négociés en direct coûtent souvent moins.

Puis-je utiliser mes propres clés API (BYOK) ?

Oui. BYOK attache vos clés — facturation upstream. 1 M req BYOK/mois sans frais plateforme ; au-delà, tarifs standard.