Comparatif des relais d'API IA 2026
Ces avis sont rédigés et édités de façon indépendante — nous n'avons actuellement aucun partenariat commercial avec l'un des fournisseurs ci-dessous, et l'ordre reflète notre propre note, pas un placement payant. Certains chiffres proviennent des supports marketing des fournisseurs ; vérifiez toujours le site officiel pour la tarification en vigueur. Chaque fiche indique sa propre date de dernière vérification.
📌 Les 143 relais ci-dessous disposent tous d'une fiche détaillée complète en français. Notre suivi côté chinois du site couvre 153+ fournisseurs au total ; les quelques entrées les plus récentes pas encore traduites restent disponibles dans la version chinoise. Parcourez le comparatif complet en chinois →
Comparatif des fournisseurs
Classés par note éditoriale, du plus élevé au plus faible.
DeepSeek
L'API officielle de DeepSeek, avec une tarification de la série V4 qui a bouleversé le marché et une solide capacité de raisonnement
Zhipu AI GLM
L'API officielle de Zhipu — GLM-4.7-Flash définitivement gratuit, contexte de 200K + 59,2 % sur SWE-bench, connexion directe en Chine continentale
Groq Cloud
Propulsé par des puces LPU conçues sur mesure, l'une des vitesses d'inférence les plus rapides au monde, une offre gratuite généreuse pour les modèles open source
Helicone
0 % de marge répercutée, observabilité LLM intégrée, open source et auto-hébergeable, suivi complet des logs/coûts/sessions
nexos.ai
Fondé par l'équipe de Nord Security, 30 M€ levés en série A, une passerelle IA de sécurité/conformité pour entreprises
Alibaba Cloud Bailian
La plateforme IA officielle d'Alibaba Cloud, SLA de niveau entreprise, la série de modèles propriétaires Qwen d'Alibaba
Cloudflare AI Gateway
Une couche gratuite de contrôle du trafic IA — mise en cache, limitation de débit, supervision, accélération en périphérie de réseau
Fal AI
Génération d'images ultra-rapide de la série Flux, fine-tuning LoRA, le meilleur choix pour les workflows créatifs IA
LingyaAI
Ligne dédiée en Chine continentale, plus de 600 modèles unifiés, facturation avec TVA pour les entreprises — conçu pour la production longue durée et la conformité d'entreprise
Moonshot AI (Kimi)
L'API officielle de Kimi — contexte ultra-long de 256K, capacités remarquables de traitement de documents et de codage
NoneLinear
Plus de 480 modèles, SLA de 99,99 %, le meilleur choix pour un usage entreprise de niveau production
OpenRouter
Un agrégateur multi-modèles cross-fournisseurs — 400+ modèles répartis sur plus de 70 fournisseurs, une seule clé API pour appeler OpenAI/Anthropic/Google/Meta/Mistral et bien d'autres
Portkey
Désormais intégré à Palo Alto Networks — la passerelle IA centrale de Prisma AIRS ; accès unifié à plus de 1600 modèles, suite LLMOps complète
SiliconFlow
Hébergement cloud de modèles open source chinois — DeepSeek, Qwen, GLM et plus de 100 modèles, un moteur d'inférence maison et un support de puces domestiques
Together AI
Agrégation de calcul de modèles open source à grande échelle — plus de 100 modèles derrière une API, adapté à la fois à la recherche et à l'entreprise
TokenRiver
Passerelle intelligente de niveau entreprise pour grands modèles IA, plus de 650 modèles, avantage de taux de change ¥1=$1, bascule automatique multi-canal, destination de redirection de l'ancien ShiyunApi
Vercel AI Gateway
0 % de marge, 5 $ de crédit gratuit, zéro rétention de données (ZDR), le meilleur choix pour les développeurs frontend
Fireworks AI
Inférence de niveau entreprise pour modèles open source, optimisation poussée du Function Calling, SLA à latence ultra-faible
Jina AI API
Chaîne multimodale complète embeddings + reranking + reader, CDN à faible latence pour les workflows RAG
Lambda Labs
Compute cloud GPU + inférence open source ; renommé Lambda, 60 à 70 % moins cher que les grands clouds, privilégié en recherche IA
Laozhang API
Un relais Claude chinois bien connu et de longue date, au tarif aligné sur les prix officiels, avec une solide réputation de stabilité — un premier choix sûr si vous ne voulez pas vous prendre la tête
n1n.ai
Passerelle d'API LLM unifiée de niveau entreprise — une seule clé pour 400+ modèles, ¥20 de crédit gratuit pour les nouveaux utilisateurs
Requesty
Adapté à l'UE, plus de 400 modèles, conforme au RGPD, basculement en 20 ms
Weelinking
SLA de 99,99 %, plus de 200 modèles, redondance multi-couche — un premier choix stable pour les environnements de production en entreprise
4SAPI / Starlink 4SAPI
Un « système de routage auto-réparateur » de niveau entreprise + un pool de comptes entreprise, centré sur la faible latence et la haute concurrence — arrive fréquemment en tête des comparatifs pour les assistants de code IA et les usages multimodaux
AnPin AI
Ligne dédiée 1 Gbps + routage multi-nœuds, promesse de stabilité de 99,99 %, l'administrateur répond en temps réel sur X
API Yi
Agrégateur d'API IA établi de longue date, 300 000 visites mensuelles, large couverture des modèles de pointe
Zhipu AI (BigModel)
Le fleuron officiel GLM de Zhipu : GLM-5.2 (contexte 1M) en production, GLM-5.3 bientôt disponible, IA multimodale, capacité chinoise de tout premier plan
Cohere API
Embeddings, reranking et génération de texte en un seul endroit — un choix de premier plan pour les ingénieurs RAG
DeepInfra
Inférence à faible latence pour les modèles open source, tarification basse et extrêmement transparente, paiement en crypto pris en charge, inclut des modèles de génération d'images
EasyRouter
Créé par Fu Sheng, 15 % de remise sur tout le catalogue, plus de 40 fournisseurs de modèles, jusqu'à 75 % de remise sur DeepSeek
HuggingFace Inference API
Accès en un clic à des centaines de milliers de modèles open source, la référence de la communauté ML
hvoy.ai
Un annuaire et agrégateur d'avis sur les relais — pas un relais en soi, mais un outil pour trouver le bon
Lepton AI
Plateforme d'inférence open source fondée par d'anciens de Meta, désormais intégrée à NVIDIA DGX Cloud (lepton.ai redirige vers NVIDIA)
01.AI (Lingyi Wanwu)
Fondée par Kai-Fu Lee, série Yi à double approche open/closed-source, capacité multilingue remarquable
Martian
Ancien pionnier du routage commercial des LLM ; le site est désormais Thesean AI, un laboratoire de recherche sur la meilleure exécution des LLM
Mistral AI API
L'acteur open source de référence en Europe, conforme au RGPD, génération de code Codestral à bas prix
Modal
GPU serverless à la demande, déploiement à friction minimale pour l'inférence de modèles personnalisés
ModelScope
La communauté de modèles open source d'Alibaba, avec un palier d'inférence gratuit pour Qwen/DeepSeek
Not Diamond
Le routeur de modèles intelligent le plus puissant pour les agents de codage — économies de 20 %+ en gardant la qualité de pointe
Novita AI
200+ modèles open source, génération d'images dédiée, inférence mondiale à bas coût
PackyAPI
Un relais domestique précoce optimisé spécifiquement pour Claude Code, une communauté active, un bonus de 1 $ pour les nouveaux utilisateurs, un choix de premier plan pour les flux de code
Perplexity API
IA augmentée par la recherche, récupération web en temps réel, citations intégrées
PoloAPI
Équilibre la stabilité et la couverture multi-modèles, conçu autour du principe « on configure une fois et ça tourne », avec des fonctionnalités de gouvernance d'entreprise comme les statistiques d'usage et l'audit
Replicate
Agrégation de modèles open source + déploiement de modèles personnalisés, une plateforme de référence pour la génération d'images/vidéos, permet de publier des modèles privés
RunPod
Cloud GPU facturé à la seconde, pool de calcul communautaire, 70 % moins cher qu'AWS
Segmind
Génération d'images Flux/SD à partir de 0,001 $/image, un choix de premier plan pour la génération créative en gros volume
Unify AI
Équipiers IA sans configuration, accédant à tous les modèles de 8 fournisseurs dont OpenAI/Google/DeepSeek/Anthropic
Unity2.ai
30 milliards+ de tokens traités quotidiennement, un choix de premier plan pour les relais d'entreprise à forte concurrence
Anyscale
De l'équipe derrière le framework Ray, déploiement de niveau entreprise à forte concurrence et fine-tuning pour modèles open source
Eden AI
Une seule API agrégeant OpenAI/Anthropic/Google, avec routage de secours intégré
FlintAPI
SaaS à routage intelligent — abonnement + dépassement à l'usage, 30+ LLM chinois sous une seule API, 5 $ de crédit gratuit pour les nouveaux utilisateurs
FlowBar
Double couverture modèles domestiques + internationaux, 80+ routes de modèles, 50 000 tokens d'essai pour les nouveaux utilisateurs, facturation à l'usage en USD, fiabilité de niveau production
Inworld Router
220+ modèles avec 0 % de marge, routage conditionnel intelligent, optimisé pour les agents de codage et les compagnons IA
Privnode
10 $ de crédit à l'inscription, intégration poussée avec Claude Code, focalisé sur les modèles de code
ProAI API
Jugé par plusieurs communautés comme le choix le plus équilibré et le plus digne de confiance — résout les problèmes de connectivité tout en maîtrisant les coûts, avec une triple couverture Claude/GPT/Gemini
RightCode
Focalisé sur le code, rechargement à partir de ¥1, documentation claire, Sonnet à partir de ¥0,9/M
RunAPI
Une alternative domestique à OpenRouter — 300+ modèles avec routage intelligent, support Claude Code/OpenClaw, runapi.host en connexion directe depuis la Chine
AIFast.club
444+ modèles avec connexion directe en Chine continentale, remises sur recharge en volume (jusqu'à -7,5 %), tableau de bord de suivi en temps réel, gestion unifiée par clé unique
AiHubMix
Intégration conviviale pour développeurs, palier de test gratuit permanent, support du Prompt Caching, documentation solide
Atlas Cloud
Agrégateur spécialisé génération image/vidéo (Seedance/MiniMax/GPT Image…), 300+ modèles, facturation transparente à la seconde
AzAPI
Agrégateur multimodale de modèles créatifs : MJ/Suno/Luma/Kling/Flux/Udio ; domaine .com.cn enregistré ICP ; taux par groupe (Azure 0,4 ¥/USD)
Baidu Qianfan
Plateforme officielle de Baidu, famille de modèles ERNIE, SLA de niveau entreprise, support du fine-tuning de modèles
ByteCat
Conçu pour les ingénieurs de code — guides complets de configuration Codex Linux/Windows, connexion directe en Chine continentale, spécialiste des modèles de codage IA
CloseAI
Se présente comme la plus grande plateforme de relais d'IA de niveau entreprise en Asie, support natif des protocoles OpenAI/Claude/Gemini, accords DPA de traitement des données disponibles
JiekouAI
Couverture complète de modèles, forfaits abonnement + facturation à l'usage, produit dédié Cloud Code, intégration en 30 secondes
LinkAi
Documentation claire, ratio de bonus élevé sur les grosses recharges — ¥100 rechargés donnent ¥30 gratuits — couvre à la fois Claude et GPT
MegaLLM
70+ modèles agrégés via des canaux officiels, stable et hautement disponible, un relais d'API IA mondial pour les besoins de milieu et haut de gamme
MoleAPI
API unique unifiant GPT-4o/Claude/Gemini, latence en connexion directe <50ms, compatible format OpenAI, crédit gratuit pour les nouvelles inscriptions
OAIPro
Relais via canal officiel, tarifé à parité avec les tarifs officiels, haute stabilité
ofox.ai
Passerelle LLM unifiée couvrant 100+ modèles dont GPT/Claude/DeepSeek, construite autour de la compatibilité Claude et d'un accès source officiel sans dégradation
OpenClaw
Un assistant personnel IA open source — gratuit, auto-hébergé, peut réutiliser des modèles par abonnement/passerelle/locaux
Huawei Cloud Pangu
Le grand modèle maison de Huawei, un choix de premier plan pour les scénarios de finance/gouvernement/santé à haute conformité
Relaydance
Reconverti au relais de génération vidéo : une API pour Seedance 2.0/2.5, plus des modèles texte Claude/Grok et image
UnoRouter
Agrégation multi-modèles, 300+ modèles (44+ fournisseurs), 253 modèles gratuits, abonnements avec crédit doublé
WinToken
Bonus généreux de nouveau site, environ ¥113 de crédit d'essai pour les nouveaux utilisateurs, double mode abonnement/à l'usage, large couverture de modèles
XycAi (Xingdao Intelligence)
Certification de conformité + Kling AI, un relais d'entreprise mixte modèles domestiques/internationaux
YKH.AI
Tarification minimaliste, multiplicateur Lite 0,2, positionnement axé performance
AI21 Labs API
Architecture hybride Jamba, contexte long à faible coût, spécialisation NLP entreprise
AICloud Feiyun
50 appels Sonnet gratuits offerts chaque jour, connexion directe à bas prix vers Claude
35.AIGCBEST
Relais spécialisé OpenAI (désormais rebaptisé « Qianduoduo API »), structure tarifaire Azure, taux de change autour de 1,5¥/USD, stable et fiable
AIMLAPI
1000+ modèles via un seul endpoint — l'agrégateur multi-modèles de référence pour les développeurs internationaux
ChatFire
Agrégation multimodale à bas prix, taux de change ¥0,5-1/USD, un mélange de modèles domestiques et internationaux, inclut la génération d'images et de vidéos
Claude API
Relais Claude spécialisé, lancé en avril 2026, supporte la génération d'images, 1¥ de crédit d'essai, accès Opus à prix compétitif
DigitalOcean Gradient
Une plateforme d'inférence IA pour l'écosystème développeur DigitalOcean, modèles open-source facturés à l'usage
DMXAPI
Agrégateur multimodal de 480+ modèles, couverture unifiée texte/image/vidéo, stabilité de niveau entreprise
DuckCoding
Crédit d'inscription de 1 $, tarification par palier, facturation d'entreprise supportée, orienté cas d'usage de codage
Tencent Cloud Hunyuan
Le modèle Hunyuan officiel de Tencent, profondément intégré à l'écosystème Tencent Cloud
IKunCode
Un relais orienté codage avec une communauté QQ active, facturation purement à l'usage sans forfaits, couvre Claude Fable 5/GPT-5.6 et les derniers fleurons
NodAPI
Agrégation multi-modèles rapide, 545+ modèles, connexion directe en Chine continentale à faible latence, Alipay/WeChat/Stripe
Poixe AI
En activité depuis 2024, 17+ fournisseurs / 8 familles de modèles couverts, modèles gratuits + remises par palier
UU API
Pool de comptes MAX, génération d'images à ¥0,04/image, bonus nouvel utilisateur de ¥1
iFlytek Spark
La plateforme officielle d'iFlytek — forte à la fois en voix et en texte, la nouvelle plateforme Astron MaaS, une force verticale dans l'éducation et la santé
302.AI
Paiement à l'usage sans frais mensuel — une plateforme de ressources IA de niveau entreprise offrant « l'accès unique à tous les modèles courants », avec un solde qui n'expire jamais
B.AI
Gamme complète de modèles + paiement en USDT/crypto, respectueux de la vie privée, aucune vérification d'identité réelle requise
Bob API
Style développeur solo, connexion directe en Chine continentale de haute qualité, modèles courants, adapté aux projets personnels
Glama AI Gateway
Une passerelle IA à tarification transparente, changement rapide entre fournisseurs pour vos expérimentations
Quanzil API
Relais d'agrégation à couverture complète, 454+ modèles, paiements WeChat/Alipay/crypto, facturation disponible
KoalaAPI
Spécialisé dans l'intégration des modèles courants d'outre-mer (Gemini/ChatGPT/Claude), revendique un taux de succès de 99,7 %+ pour Claude 4.5
MNAPI
Surveillance de qualité inter-fournisseurs, agrégation tout-en-un, 239+ modèles (Claude/GPT/Gemini/Grok/image & vidéo)
Poe API
De Quora, API multi-modèles par abonnement, accès rapide aux capacités IA courantes
Sub2API
Un relais de mutualisation d'abonnements, accès partagé façon achat groupé à faible coût à la capacité Claude Max
UiUiAPI
Agrégation de plus de 300 grands modèles, conception entreprise haute concurrence, revendique un approvisionnement par canal officiel avec des taux de remise transparents et quantifiés
XJAI (Hunter API)
Désormais rebaptisé « Hunter API », agrégation multi-modèles, taux de change autour de 1 ¥/USD, couverture de 533+ modèles
Yinhe API
Bonus d'inscription de 0,4 $, optimisation dédiée à Claude Code, un bon choix pour les tests légers
147API / 147AI
Le « choix incontournable » dans plusieurs avis — interface hautement compatible, règlement en RMB, relais d'agrégation de niveau entreprise
AiGoCode
Abonnement + paiement à l'usage ; ¥50=50 $ de crédit (1:1) ; couverture des modèles grand public ; essai avant abonnement
Boluotu AI
⚠️ Pivot annoncé vers l'entreprise : recharges personnelles et nouvelles inscriptions fermées ; 1044+ modèles dont les derniers fleurons
Chutes
Hébergement à faible latence de modèles open source SOTA (Kimi/GLM/DeepSeek/Qwen…) ; à l'usage + abonnements ; API unifiée compatible OpenAI
GGWK1
Agrégation des trois familles OpenAI/Claude/Gemini, taux de change ¥0,6-1/USD, connexion directe en Chine continentale
Lumin AI
Lancé en 2026 ; l'ancien luminai.cn a migré vers luminai.cc, et le domaine principal nécessite désormais un proxy
MKEAI
Connexion directe basse latence en Chine continentale vers Claude/GPT/Gemini/Grok/DeepSeek, déploiement rapide des nouveaux modèles (Grok 4.6/Gemini 3.7/Opus 5), inscription de nouveaux utilisateurs actuellement fermée
No.1-API
Un relais d'agrégation de modèles tout-en-un avec des interfaces bien documentées, un point d'entrée unifié pour Claude/GPT/Gemini/DeepSeek
StepFun
La plateforme officielle de StepFun, série Step-3.x, fleuron multimodal plus voix et image, faible latence
TokenMix
Agrégation multi-modèles, options de paiement flexibles, au service des développeurs en Chine comme à l'étranger
V-API
Relais multi-modèles en connexion directe couvrant Claude/GPT/Gemini/DeepSeek/Grok, connexion directe stable en Chine continentale
YunWu API
Plus de 500 modèles agrégés, taux de change ¥0,5/USD, appels GPT-4o gratuits quotidiens via connexion GitHub
Zhihui API
Une nouvelle plateforme de 2026 couvrant les familles GPT-5.6 / Claude Opus / Gemini / Grok, avec bonus de recharge par palier pour les membres
Boxying
Prix ultra-bas : Claude à 0,3x le tarif officiel, Codex à 0,21x, 1 ¥ = 1 $ ; relais domestique léger
DawCode
Une nouvelle plateforme de 2026, récompenses de connexion quotidienne, ¥4 de crédit d'essai pour les nouveaux utilisateurs
Nio API
Marque passée à newapi.gs, sous-domaines génériques pour résister au blocage, actuellement axé sur GPT/Gemini, ancienne interface toujours compatible
Yiye Zhiqiu API
Pas de recharge minimale, léger et adapté aux tests, preuve de concept à barrière nulle
UniAPI
Triple couverture OpenAI/Claude/Gemini + modèles multimodaux comme Midjourney/Suno/Kling, connexion directe en Chine continentale, facturation à remise par canal
Shenma Relay API
2557 modèles multimodaux couverts (texte/image/audio/vidéo), affirme être le plus important du secteur, facturation à l'usage avec connexion directe en Chine continentale
GPTGOD
Un relais rétro-ingénieré à prix ultra-bas, taux de change autour de ¥0,6/USD — extrêmement peu cher mais la stabilité n'est pas garantie
AIAPIpk
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; la plateforme de comparaison est inaccessible
Baichuan API
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; service inaccessible
Banana AI
Sunset : la plateforme d'inférence GPU sans serveur a été arrêtée le 31/03/2024
Chien API
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; service inaccessible
Cooper-API
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; service inaccessible
GPTAPI.US
Arrêté (vérifié le 16/08/2026) : le domaine est en parking ; service indisponible
lxg2it ModelRouter
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; service inaccessible
Meshs One
Arrêté (vérifié le 16/08/2026) : site inaccessible ; service indisponible
NanoBanana
Ne propose plus de service de relais (vérifié le 16/08/2026) : désormais un outil gratuit d'images Nano Banana
NativeAI API
Ne propose plus de service de relais (vérifié le 16/08/2026) : désormais le site d'une société japonaise de développement logiciel
OAIPlus
Arrêté (vérifié le 16/08/2026) : site inaccessible ; service indisponible
PaintBot
Arrêté (vérifié le 16/08/2026) : site inaccessible ; service indisponible
SBGPT
Arrêté (vérifié le 16/08/2026) : le domaine est à vendre ; service arrêté
Sulian AI
Arrêté (vérifié le 16/08/2026) : serveur d'origine sans réponse ; service indisponible
TomCat API
Arrêté (vérifié le 16/08/2026) : le domaine ne résout plus ; service inaccessible
Xingtu API
Redirigé vers un site sans rapport ; n'est plus un service de relais (vérifié le 16/08/2026)
ZHTec API
Arrêté (vérifié le 16/08/2026) : site inaccessible ; service indisponible
ShiyunApi ⚠️ Fermé → TokenRiver
Service arrêté ; la marque successeur est TokenRiver 词元之河 (tokenriver.cn), désormais axée sur les modèles chinois domestiques
FAQ
Qu'est-ce qu'un relais d'API IA, et pourquoi les développeurs de Chine continentale en utilisent-ils un ?
Un relais d'API IA (aussi appelé revendeur d'API) achète en gros de la capacité d'API officielle auprès d'OpenAI, Anthropic, Google et d'autres, puis en revend l'accès avec une barrière à l'entrée plus basse via un point d'accès compatible OpenAI. Pour les utilisateurs de Chine continentale, un relais règle trois problèmes à la fois : s'inscrire sans carte bancaire liée à une région non prise en charge, payer en RMB via Alipay/WeChat Pay, et atteindre le modèle via un nœud à connexion directe plutôt que par un VPN.
En quoi un relais diffère-t-il de l'API officielle ?
Techniquement, un relais expose la même interface compatible OpenAI que l'API officielle — il suffit de pointer base_url vers le relais et de garder le reste de votre code inchangé. Les différences se situent au niveau du prix (souvent 10 à 40 % sous le tarif officiel, mais pas toujours), de la fiabilité (qui dépend entièrement de l'exploitation du relais) et de la fidélité du modèle (certains relais substituent discrètement un modèle moins cher à celui demandé). Choisir un relais fiable est tout l'enjeu.
Comment savoir si un relais est fiable ?
Cinq points à vérifier : (1) une véritable structure derrière le site, pas un projet personnel anonyme ; (2) les versions exactes des modèles sont indiquées clairement, sans discours marketing vague ; (3) des retours d'expérience indépendants existent quelque part en ligne ; (4) la tarification est plausible — un prix très en dessous du coût réel de l'API officielle est un signal de modèle dégradé ; (5) les petites recharges sont acceptées, pour tester avant d'engager un solde important.
Pourquoi seulement une partie des fournisseurs a-t-elle un avis en français ?
Nous suivons plus de 153 relais côté chinois du site, et nous nous appuyons sur les fiches déjà traduites en anglais pour cette version française plutôt que de tout traduire d'un coup — chaque fiche listée ici a été rédigée et vérifiée de façon indépendante, comme son équivalent chinois. Si le fournisseur que vous cherchez n'apparaît pas ici, le comparatif complet en chinois les couvre tous.