OpenRouter : avis et comparatif
Un agrégateur multi-modèles cross-fournisseurs — 400+ modèles répartis sur plus de 70 fournisseurs, une seule clé API pour appeler OpenAI/Anthropic/Google/Meta/Mistral et bien d'autres
Dernière vérification : 2026-08-11 · Visiter le site officiel →
OpenRouter n’est pas un « relais » au sens domestique chinois
Les développeurs de Chine continentale qui cherchent un « relais » (中转站) ont généralement en tête deux besoins précis : le règlement via Alipay/WeChat Pay, et la connexion directe depuis la Chine continentale pour une faible latence. OpenRouter ne satisfait ni l’un ni l’autre — le paiement se fait surtout par carte bancaire, et ses nœuds sont à l’étranger, donc l’accès depuis la Chine continentale nécessite un proxy.
Mais OpenRouter offre autre chose de difficile à remplacer : la couverture de modèles la plus large au monde — plus de 400 modèles répartis sur plus de 70 fournisseurs, tous accessibles via une seule clé API couvrant OpenAI, Anthropic, Google, Meta, Mistral, Cohere, et quasiment tous les autres grands fournisseurs.
Si votre besoin central est de comparer plusieurs modèles côte à côte, ou si vous avez déjà une infrastructure de proxy et que la connexion directe depuis la Chine continentale ne vous préoccupe pas, OpenRouter est le premier choix naturel ; si vous avez besoin d’une connexion directe à faible latence depuis la Chine continentale, regardez d’autres plateformes de ce comparatif comme 4SAPI ou KoalaAPI.
Tarification : répercussion du prix officiel + des frais de 5,5 %
La logique tarifaire centrale d’OpenRouter est « répercuter le prix officiel + des frais de plateforme ». En détail :
La partie répercutée : la tarification par token des principaux modèles est essentiellement alignée sur le prix officiel de chaque fournisseur (données de mars 2026 ; revérifié en 2026-08 — la page d’accueil d’OpenAI met désormais en avant la gamme GPT-5.6, les prix unitaires sont donc à vérifier sur la page models officielle) :
| Modèle | Prix d’entrée (par M tokens) | Prix de sortie (par M tokens) | Connexion directe |
|---|---|---|---|
| Claude Fable 5 | 10 $ | 50 $ | ✗ (proxy nécessaire) |
| Claude Opus 4.8 | 5 $ | 25 $ | ✗ |
| Claude Sonnet 4.6 | 3 $ | 15 $ | ✗ |
| GPT-5.5 | 1,25 $ | 10 $ | ✗ |
| Gemini 3.5 Flash | voir le site officiel | voir le site officiel | ✗ |
| DeepSeek-V4-Flash | voir le site officiel | voir le site officiel | ✗ |
Frais de plateforme (le coût caché) :
- Frais de paiement par carte bancaire : 5,5 % (minimum 0,80 $ — le taux effectif est plus élevé sur les petites recharges)
- Des frais BYOK de 5 % au-delà d’un volume d’appels mensuel de 1 million de requêtes
En prenant Claude Sonnet 4.6 comme exemple : le prix officiel est de 3 $/15 $ par million de tokens ; le coût réel sur OpenRouter s’élève à environ 3,17 $/15,83 $ (+5,5 %). En pratique, prévoyez le prix officiel plus une surcharge de 5 à 7 % comme hypothèse de planification prudente.
Côté gratuit, il existe actuellement plus de 27 modèles open source entièrement gratuits (entrée et sortie à 0 $), dont Gemma 4 et MiniMax M2.5, plafonnés à 50 appels par jour (la limite s’assouplit une fois que vous avez rechargé 10 $ ou plus).
Étendue de la couverture de modèles : un acteur mondial de premier plan
L’atout central d’OpenRouter, c’est l’étendue de sa couverture de modèles :
- OpenAI : couverture complète de GPT-5.5, GPT-4o, et la série o1/o3
- Anthropic : Claude Fable 5, Claude Opus 4.8, Claude Sonnet 4.6, Claude Haiku 4.5
- Google : Gemini 3.5 Flash/Pro, la série Gemini 2.5
- Meta : la série Llama 4
- Mistral : Mistral Large 3, Mistral Small, et d’autres
- Autres : Grok 4.3 (xAI), DeepSeek V4, Qwen3, Kimi K2, et plus encore
Les nouveaux modèles ont tendance à être mis en ligne extrêmement vite — généralement dans les heures ou les jours suivant la sortie publique d’un fournisseur. Côté bascule automatique, les utilisateurs peuvent configurer un « basculement automatique vers un modèle de secours quand le principal est indisponible », donnant aux déploiements en production un degré significatif de tolérance aux pannes.
Utilisation au quotidien
Inscription : rendez-vous sur openrouter.ai, inscrivez-vous en un clic avec un compte Google ou GitHub — les nouveaux utilisateurs ne reçoivent aucun crédit d’inscription ; après inscription, le palier gratuit par défaut s’applique (50 appels gratuits/jour sur plus de 25 modèles open source, avec limite de débit). L’ensemble du processus prend environ 2 minutes.
Paiement : prend surtout en charge les cartes bancaires internationales et le crypto USDC ; certaines pages prennent en charge Alipay (via l’option « utiliser des méthodes de paiement ponctuelles »), mais le parcours est relativement complexe. Les utilisateurs domestiques sans carte bancaire étrangère font face à une barrière d’entrée un peu plus élevée.
Obtenir votre clé API : après inscription, générez une clé sur la page Keys. Le point de terminaison est https://openrouter.ai/api/v1, entièrement compatible avec le SDK OpenAI — il suffit de remplacer le base_url et l’api_key.
Tableau de bord : fournit des journaux d’appels détaillés, une ventilation des coûts et des statistiques par modèle/période — pratique pour l’analyse de coûts et la comparaison multi-modèles.
Support : communauté principalement anglophone — Discord et GitHub sont tous deux actifs — mais les canaux de support dédiés aux utilisateurs domestiques sont plus faibles.
Stabilité et latence
OpenRouter n’a pas de nœuds à connexion directe en Chine continentale — les serveurs sont déployés à l’étranger. Sur la base des données réelles de 2026 :
- Via un proxy : latence du premier token autour de 600-1200 ms
- Sans proxy (accès direct depuis la Chine continentale) : latence autour de 1500-3000 ms, et instable
Pour les outils de codage IA sensibles à la latence comme Claude Code et Cursor, nous recommanderions de faire tourner un proxy stable en permanence, sinon les délais d’attente deviennent la norme. Comparé à 4SAPI (qui revendique un TTFT de 520 ms), l’expérience d’OpenRouter sur les réseaux domestiques est nettement moins bonne.
Le mécanisme de bascule est un vrai point fort : quand un modèle amont (disons GPT-5.5) est limité en débit, il peut basculer automatiquement vers un modèle de secours, réduisant les interruptions métier.
Pour qui
- Les développeurs qui font du benchmarking/de la sélection multi-modèles : si votre projet vibe-coding veut comparer Claude vs GPT vs Gemini sur la qualité et le coût, OpenRouter vous permet de tous les tester avec une seule clé.
- Les équipes qui ont déjà une infrastructure de proxy à l’étranger : la latence et le paiement ne sont pas des obstacles dans ce scénario.
- Les équipes produit qui construisent pour un public international : ayant besoin d’un choix de modèles international où la chaîne d’appel passe de toute façon par l’étranger.
- Les développeurs qui veulent essayer des modèles gratuits : plus de 27 modèles open source gratuits permettent de valider des prompts à coût nul.
Mauvais profil : les projets tournant principalement sur des serveurs domestiques ayant besoin d’une connexion directe à faible latence, ou les utilisateurs limités à Alipay/WeChat Pay.
Comparaisons directes
- vs 4SAPI : 4SAPI offre un nœud à connexion directe en Chine continentale (revendiquant un TTFT de 520 ms) (en anglais) et prend en charge Alipay, offrant une expérience domestique nettement meilleure qu’OpenRouter. OpenRouter a une couverture de modèles plus large et une empreinte internationale plus mature, mais son expérience domestique reste clairement en retrait par rapport à 4SAPI.
- vs 302.AI : 302.AI est aussi facturé à l’usage avec un solde qui n’expire jamais (en anglais), et prend en charge Alipay et la connexion directe depuis la Chine continentale — mieux adapté aux utilisateurs domestiques qui veulent une boîte à outils IA tout-en-un, pas seulement une API brute. OpenRouter penche davantage vers le routage de modèles au niveau développeur et la comparaison multi-modèles.
La règle de décision centrale : si vous êtes en Chine continentale et utilisez surtout Claude/GPT, choisissez 4SAPI ou 302.AI ; si vous opérez à l’échelle mondiale et avez besoin de la couverture de modèles la plus large possible, choisissez OpenRouter.
Recommandations pratiques
Comme plateforme principale (bon profil) : les équipes qui ont déjà une infrastructure de proxy stable ; les produits destinés à un public international ; les processus de sélection technique devant comparer côte à côte plus de 10 modèles candidats.
Comme outil complémentaire (bon profil) : les développeurs domestiques au quotidien peuvent traiter OpenRouter comme un « outil de benchmarking multi-modèles » — lancer occasionnellement une comparaison multi-modèles, tout en gardant le travail de production quotidien sur une plateforme à connexion directe domestique.
Non recommandé comme plateforme principale (mauvais profil) : les activités sensibles à la latence d’accès domestique ; les utilisateurs limités à Alipay/WeChat Pay ; les développeurs ayant besoin d’un usage quotidien à faible latence de Claude Code (4SAPI ou KoalaAPI conviennent mieux).
Les pourcentages de marge, les conditions de crédit gratuit et autres détails sont sujets au site en direct et à la page de facturation d’OpenRouter. Cet avis a été vérifié le 2026-08-11.
Avis similaires
- Cloudflare AI Gateway : une couche gratuite de contrôle du trafic IA — mise en cache, limitation de débit, supervision, accélération en périphérie de réseau
- lxg2it ModelRouter (en anglais) : plus de 7 fournisseurs à 0 % de marge, routage automatique vers le modèle disponible le moins cher, compatible OpenAI
- Zhipu AI (en anglais) : la série GLM officielle de Zhipu, IA multimodale intégrée, capacité en chinois de tout premier plan
- NodAPI (en anglais) : agrégation multi-modèles rapide, connexion directe à faible latence en Chine continentale, un choix de premier plan pour les scénarios temps réel
En bref
| Modèle tarifaire | Répercute le prix officiel plus une marge (les sources divergent — 1 %, 5,5 %, jusqu'à 25 %), inclut plus de 25 modèles gratuits (avec limite de débit), et offre 1 $ de crédit gratuit aux nouveaux utilisateurs |
|---|---|
| Couverture de modèles | 400+ modèles répartis sur plus de 70 fournisseurs, couvrant quasiment tous les grands fournisseurs — OpenAI, Anthropic, Google, Meta, Mistral, Cohere, et bien d'autres |
| Latence / SLA | Bascule automatique vers un modèle de secours quand le principal est indisponible ; la latence dépend en dernier ressort de l'API officielle amont |
| Connexion directe Chine continentale | Nœuds étrangers — l'accès depuis la Chine continentale nécessite généralement un proxy/VPN |
| Idéal pour | Développeurs / Secours / bascule |
| Programme de parrainage | Aucun programme d'affiliation/parrainage public trouvé pour le marché chinois ; le modèle mondial courant est un partage de revenus avec la communauté de développeurs ou les intégrateurs — non confirmé si cela est ouvert aux utilisateurs de Chine continentale. |
Avantages
- La couverture de modèles la plus large de ce comparatif — presque tous les grands fournisseurs et les modèles nouvellement sortis sont intégrés quasi immédiatement
- Idéal pour le « benchmarking/la sélection multi-modèles » — une seule clé permet de tester chaque modèle candidat et de comparer coût et qualité côte à côte
- Bascule automatique — quand un modèle amont est limité en débit ou tombe, la bascule vers un modèle de secours se fait en douceur
- Plus de 25 modèles gratuits disponibles (avec limite de débit), pratique pour tester des prompts à coût nul
- Très international — documentation et communauté matures, bien adapté aux outils de développement visant un public mondial
Inconvénients
- L'accès depuis la Chine continentale est mauvais sans proxy/VPN, ce qui va un peu à l'encontre de l'intérêt d'un « relais » pour les développeurs domestiques
- Le pourcentage de marge n'est pas décrit de façon cohérente selon les modèles ou les sources — vous devez calculer vous-même votre coût réel
- Le paiement se fait surtout par carte bancaire internationale/PayPal, une barrière plus élevée pour les utilisateurs limités à Alipay/WeChat Pay
Comparer plus de relais d'API IA
Consultez le comparatif complet — filtrez par niveau de prix, couverture de modèles et connexion directe depuis la Chine continentale.
Retour au comparatif →