Comparatif des relais d'API IA 2026
Ces avis sont rédigés et édités de façon indépendante — nous n'avons actuellement aucun partenariat commercial avec l'un des fournisseurs ci-dessous, et l'ordre reflète notre propre note, pas un placement payant. Certains chiffres proviennent des supports marketing des fournisseurs ; vérifiez toujours le site officiel pour la tarification en vigueur. Chaque fiche indique sa propre date de dernière vérification.
📌 Les 143 relais ci-dessous disposent tous d'une fiche détaillée complète en français. Notre suivi côté chinois du site couvre 153+ fournisseurs au total ; les quelques entrées les plus récentes pas encore traduites restent disponibles dans la version chinoise. Parcourez le comparatif complet en chinois →
Comparatif des fournisseurs
Classés par note éditoriale, du plus élevé au plus faible.
DeepSeek
L'API officielle de DeepSeek, avec une tarification de la série V4 qui a bouleversé le marché et une solide capacité de raisonnement
Zhipu AI GLM
L'API officielle de Zhipu — GLM-4.7-Flash définitivement gratuit, contexte de 200K + 59,2 % sur SWE-bench, connexion directe en Chine continentale
Groq Cloud
Propulsé par des puces LPU conçues sur mesure, l'une des vitesses d'inférence les plus rapides au monde, une offre gratuite généreuse pour les modèles open source
Helicone
0 % de marge répercutée, observabilité LLM intégrée, open source et auto-hébergeable, suivi complet des logs/coûts/sessions
nexos.ai
Fondé par l'équipe de Nord Security, 30 M€ levés en série A, une passerelle IA de sécurité/conformité pour entreprises
Alibaba Cloud Bailian
La plateforme IA officielle d'Alibaba Cloud, SLA de niveau entreprise, la série de modèles propriétaires Qwen d'Alibaba
Cloudflare AI Gateway
Une couche gratuite de contrôle du trafic IA — mise en cache, limitation de débit, supervision, accélération en périphérie de réseau
Fal AI
Génération d'images ultra-rapide de la série Flux, fine-tuning LoRA, le meilleur choix pour les workflows créatifs IA
LingyaAI
Ligne dédiée en Chine continentale, plus de 600 modèles unifiés, facturation avec TVA pour les entreprises — conçu pour la production longue durée et la conformité d'entreprise
Moonshot AI (Kimi)
L'API officielle de Kimi — contexte ultra-long de 256K, capacités remarquables de traitement de documents et de codage
NoneLinear
Plus de 480 modèles, SLA de 99,99 %, le meilleur choix pour un usage entreprise de niveau production
OpenRouter
Un agrégateur multi-modèles cross-fournisseurs — 400+ modèles répartis sur plus de 70 fournisseurs, une seule clé API pour appeler OpenAI/Anthropic/Google/Meta/Mistral et bien d'autres
Portkey
Désormais intégré à Palo Alto Networks — la passerelle IA centrale de Prisma AIRS ; accès unifié à plus de 1600 modèles, suite LLMOps complète
SiliconFlow
Hébergement cloud de modèles open source chinois — DeepSeek, Qwen, GLM et plus de 100 modèles, un moteur d'inférence maison et un support de puces domestiques
Together AI
Agrégation de calcul de modèles open source à grande échelle — plus de 100 modèles derrière une API, adapté à la fois à la recherche et à l'entreprise
TokenRiver
Passerelle intelligente de niveau entreprise pour grands modèles IA, plus de 650 modèles, avantage de taux de change ¥1=$1, bascule automatique multi-canal, destination de redirection de l'ancien ShiyunApi
Vercel AI Gateway
0 % de marge, 5 $ de crédit gratuit, zéro rétention de données (ZDR), le meilleur choix pour les développeurs frontend
Fireworks AI
Inférence de niveau entreprise pour modèles open source, optimisation poussée du Function Calling, SLA à latence ultra-faible
Jina AI API
Chaîne multimodale complète embeddings + reranking + reader, CDN à faible latence pour les workflows RAG
Lambda Labs
Calcul cloud GPU plus API d'inférence, 60 à 70 % moins cher qu'AWS/GCP — une référence pour la recherche en IA
Laozhang API
Un relais Claude chinois bien connu et de longue date, au tarif aligné sur les prix officiels, avec une solide réputation de stabilité — un premier choix sûr si vous ne voulez pas vous prendre la tête
n1n.ai
Passerelle d'API LLM unifiée de niveau entreprise — une seule clé pour 400+ modèles, ¥20 de crédit gratuit pour les nouveaux utilisateurs
Requesty
Adapté à l'UE, plus de 400 modèles, conforme au RGPD, basculement en 20 ms
Weelinking
SLA de 99,99 %, plus de 200 modèles, redondance multi-couche — un premier choix stable pour les environnements de production en entreprise
4SAPI / Starlink 4SAPI
Un « système de routage auto-réparateur » de niveau entreprise + un pool de comptes entreprise, centré sur la faible latence et la haute concurrence — arrive fréquemment en tête des comparatifs pour les assistants de code IA et les usages multimodaux
AnPin AI
Ligne dédiée 1 Gbps + routage multi-nœuds, promesse de stabilité de 99,99 %, l'administrateur répond en temps réel sur X
API Yi
Agrégateur d'API IA établi de longue date, 300 000 visites mensuelles, large couverture des modèles de pointe
Zhipu AI (BigModel)
Le fleuron officiel GLM-5 de Zhipu, IA multimodale, capacité chinoise de tout premier plan — la tarification de l'API a augmenté à partir de février 2026
Cohere API
Embeddings, reranking et génération de texte en un seul endroit — un choix de premier plan pour les ingénieurs RAG
DeepInfra
Inférence à faible latence pour les modèles open source, tarification basse et extrêmement transparente, paiement en crypto pris en charge, inclut des modèles de génération d'images
EasyRouter
Créé par Fu Sheng, 15 % de remise sur tout le catalogue, plus de 40 fournisseurs de modèles, jusqu'à 75 % de remise sur DeepSeek
HuggingFace Inference API
Accès en un clic à des centaines de milliers de modèles open source, la référence de la communauté ML
hvoy.ai
Un annuaire et agrégateur d'avis sur les relais — pas un relais en soi, mais un outil pour trouver le bon
Lepton AI
Construit par une ancienne équipe de Meta, déploiement minimaliste pour les modèles open source, une plateforme d'inférence à bas coût
01.AI (Lingyi Wanwu)
Fondée par Kai-Fu Lee, série Yi à double approche open/closed-source, capacité multilingue remarquable
Martian
Un pionnier du routage LLM commercial, des arbitrages dynamiques coût x qualité, un choix de premier plan pour l'optimisation en production
Mistral AI API
L'acteur open source de référence en Europe, conforme au RGPD, génération de code Codestral à bas prix
Modal
GPU serverless à la demande, déploiement à friction minimale pour l'inférence de modèles personnalisés
ModelScope
La communauté de modèles open source d'Alibaba, avec un palier d'inférence gratuit pour Qwen/DeepSeek
Not Diamond
Routage intelligent SOTA de référence dans le secteur, sélectionne automatiquement le meilleur modèle, réduit les coûts tout en préservant la qualité
Novita AI
200+ modèles open source, génération d'images dédiée, inférence mondiale à bas coût
PackyAPI
Un relais domestique précoce optimisé spécifiquement pour Claude Code, une communauté active, un bonus de 1 $ pour les nouveaux utilisateurs, un choix de premier plan pour les flux de code
Perplexity API
IA augmentée par la recherche, récupération web en temps réel, citations intégrées
PoloAPI
Équilibre la stabilité et la couverture multi-modèles, conçu autour du principe « on configure une fois et ça tourne », avec des fonctionnalités de gouvernance d'entreprise comme les statistiques d'usage et l'audit
Replicate
Agrégation de modèles open source + déploiement de modèles personnalisés, une plateforme de référence pour la génération d'images/vidéos, permet de publier des modèles privés
RunPod
Cloud GPU facturé à la seconde, pool de calcul communautaire, 70 % moins cher qu'AWS
Segmind
Génération d'images Flux/SD à partir de 0,001 $/image, un choix de premier plan pour la génération créative en gros volume
Unify AI
Routage intelligent basé sur réseau de neurones, 70+ modèles, équilibrant coût/vitesse/qualité
Unity2.ai
30 milliards+ de tokens traités quotidiennement, un choix de premier plan pour les relais d'entreprise à forte concurrence
Anyscale
De l'équipe derrière le framework Ray, déploiement de niveau entreprise à forte concurrence et fine-tuning pour modèles open source
Eden AI
Une seule API agrégeant OpenAI/Anthropic/Google, avec routage de secours intégré
FlintAPI
SaaS à routage intelligent — abonnement + dépassement à l'usage, 30+ LLM chinois sous une seule API, 5 $ de crédit gratuit pour les nouveaux utilisateurs
FlowBar
Double couverture modèles domestiques + internationaux, 80+ routes de modèles, 50 000 tokens d'essai pour les nouveaux utilisateurs, facturation à l'usage en USD, fiabilité de niveau production
Inworld Router
200+ modèles à 0 % de marge, profondément optimisé pour l'IA gaming/divertissement, routage intelligent des requêtes basé sur la complexité
lxg2it ModelRouter
7+ fournisseurs à 0 % de marge, routage automatique vers le modèle disponible le moins cher, compatible OpenAI
Privnode
10 $ de crédit à l'inscription, intégration poussée avec Claude Code, focalisé sur les modèles de code
ProAI API
Jugé par plusieurs communautés comme le choix le plus équilibré et le plus digne de confiance — résout les problèmes de connectivité tout en maîtrisant les coûts, avec une triple couverture Claude/GPT/Gemini
RightCode
Focalisé sur le code, rechargement à partir de ¥1, documentation claire, Sonnet à partir de ¥0,9/M
RunAPI
Une alternative domestique à OpenRouter — 150+ modèles avec routage intelligent, support Claude Code/OpenClaw, connexion directe rapide
AIAPIpk
Comparaison en temps réel des prix et de la disponibilité entre plateformes de relais, un outil de classement concurrentiel
AIFast.club
572+ modèles avec connexion directe en Chine continentale, remises sur volume, tableau de bord de suivi en temps réel, gestion unifiée par clé unique
AiHubMix
Intégration conviviale pour développeurs, palier de test gratuit permanent, support du Prompt Caching, documentation solide
Atlas Cloud
Agrégation multimodale centrée sur la génération d'images/vidéos, tarification de niveau entreprise, pour les scénarios d'applications IA créatives
AzAPI
Agrégateur de modèles créatifs multimodaux, MJ/Suno/Luma/Kling/Flux/Udio, domaine .com.cn enregistré, Claude à ¥2,5/USD
Baidu Qianfan
Plateforme officielle de Baidu, famille de modèles ERNIE, SLA de niveau entreprise, support du fine-tuning de modèles
ByteCat
Conçu pour les ingénieurs de code — guides complets de configuration Codex Linux/Windows, connexion directe en Chine continentale, spécialiste des modèles de codage IA
CloseAI
Se présente comme la plus grande plateforme de relais d'IA de niveau entreprise en Asie, support natif des protocoles OpenAI/Claude/Gemini, accords DPA de traitement des données disponibles
JiekouAI
Couverture complète de modèles, forfaits abonnement + facturation à l'usage, produit dédié Cloud Code, intégration en 30 secondes
LinkAi
Documentation claire, ratio de bonus élevé sur les grosses recharges — ¥100 rechargés donnent ¥30 gratuits — couvre à la fois Claude et GPT
MegaLLM
70+ modèles agrégés via des canaux officiels, stable et hautement disponible, un relais d'API IA mondial pour les besoins de milieu et haut de gamme
MoleAPI
API unique unifiant GPT-4o/Claude/Gemini, latence en connexion directe <50ms, compatible format OpenAI, crédit gratuit pour les nouvelles inscriptions
OAIPro
Relais via canal officiel, tarifé à parité avec les tarifs officiels, haute stabilité
ofox.ai
Passerelle LLM unifiée couvrant 100+ modèles dont GPT/Claude/DeepSeek, construite autour de la compatibilité Claude et d'un accès source officiel sans dégradation
OpenClaw
Compagnon de déploiement Claude en un clic, connexion directe à faible latence dédiée aux utilisateurs de Claude Code
Huawei Cloud Pangu
Le grand modèle maison de Huawei, un choix de premier plan pour les scénarios de finance/gouvernement/santé à haute conformité
Relaydance
Relais spécialisé pour les modèles Grok et Doubao, plus une couverture Claude et GPT, trois méthodes de paiement
UnoRouter
Spécialisée pour les cas d'usage de jeu de rôle, 200+ modèles, routage à faible latence, 0 % de marge
WinToken
Bonus généreux de nouveau site, environ ¥113 de crédit d'essai pour les nouveaux utilisateurs, double mode abonnement/à l'usage, large couverture de modèles
Xingtu API
Agrégation multi-modèles de niveau entreprise avec facturation, accès flexible aux grands modèles domestiques et internationaux
XycAi (Xingdao Intelligence)
Certification de conformité + Kling AI, un relais d'entreprise mixte modèles domestiques/internationaux
YKH.AI
Tarification minimaliste, palier Lite à ¥0,25/M tokens, positionnement axé performance
AI21 Labs API
Architecture hybride Jamba, contexte long à faible coût, spécialisation NLP entreprise
AICloud Feiyun
50 appels Sonnet gratuits offerts chaque jour, connexion directe à bas prix vers Claude
35.AIGCBEST
Relais spécialisé OpenAI, structure tarifaire Azure, taux de change autour de 1,5¥/USD, stable et fiable
AIMLAPI
400+ modèles derrière un point d'accès unifié, un choix de premier plan pour les développeurs internationaux voulant de l'agrégation multi-modèles
Banana AI
Inférence GPU légère, déploiement rapide de modèles personnalisés, faible temps de démarrage à froid, convivial pour les développeurs
ChatFire
Agrégation multimodale à bas prix, taux de change ¥0,5-1/USD, un mélange de modèles domestiques et internationaux, inclut la génération d'images et de vidéos
Claude API
Relais Claude spécialisé, lancé en avril 2026, supporte la génération d'images, 1¥ de crédit d'essai, accès Opus à prix compétitif
DigitalOcean Gradient
Une plateforme d'inférence IA pour l'écosystème développeur DigitalOcean, modèles open-source facturés à l'usage
DMXAPI
Agrégateur multimodal de 480+ modèles, couverture unifiée texte/image/vidéo, stabilité de niveau entreprise
DuckCoding
Crédit d'inscription de 1 $, tarification par palier, facturation d'entreprise supportée, orienté cas d'usage de codage
Tencent Cloud Hunyuan
Le modèle Hunyuan officiel de Tencent, profondément intégré à l'écosystème Tencent Cloud
IKunCode
Un relais orienté codage avec une communauté QQ active, facturation purement à l'usage sans forfaits, GPT 5.5 dès ¥1/6 par million de tokens
NodAPI
Agrégation multi-modèles rapide, connexion directe en Chine continentale à faible latence, un choix de premier plan pour les scénarios temps réel
Poixe AI
En activité depuis 2024, 17+ fournisseurs / 8 familles de modèles couverts, modèles gratuits + remises par palier
UU API
Pool de comptes MAX, génération d'images à ¥0,04/image, bonus nouvel utilisateur de ¥1
iFlytek Spark
La plateforme officielle d'iFlytek — forte à la fois en voix et en texte, la nouvelle plateforme Astron MaaS, une force verticale dans l'éducation et la santé
302.AI
Paiement à l'usage sans frais mensuel — une plateforme de ressources IA de niveau entreprise offrant « l'accès unique à tous les modèles courants », avec un solde qui n'expire jamais
B.AI
Gamme complète de modèles + paiement en USDT/crypto, respectueux de la vie privée, aucune vérification d'identité réelle requise
Bob API
Style développeur solo, connexion directe en Chine continentale de haute qualité, modèles courants, adapté aux projets personnels
Cooper-API
Interface épurée, conviviale pour les développeurs individuels, connexion directe en Chine continentale aux modèles courants
Glama AI Gateway
Une passerelle IA à tarification transparente, changement rapide entre fournisseurs pour vos expérimentations
GPTAPI.US
Double région États-Unis/Chine, paiement double devise PayPal + Alipay, connexion directe stable à GPT/Claude/Gemini
KoalaAPI
Spécialisé dans l'intégration des modèles courants d'outre-mer (Gemini/ChatGPT/Claude), revendique un taux de succès de 99,7 %+ pour Claude 4.5
Meshs One
Un nœud international pour accéder aux modèles chinois depuis l'étranger, bâti sur une architecture AI API Gateway
MNAPI
Surveillance de qualité inter-fournisseurs, agrégation tout-en-un, comparaisons de classement concurrentiel
Poe API
De Quora, API multi-modèles par abonnement, accès rapide aux capacités IA courantes
SBGPT
Taux de change ¥0,4-0,6/USD, groupé Azure, un choix de premier plan pour les prix les plus bas
Sub2API
Un relais de mutualisation d'abonnements, accès partagé façon achat groupé à faible coût à la capacité Claude Max
Sulian AI
Sauvegarde multi-lignes à faible latence, architecture de reprise après sinistre, connexion directe stable pour la production
UiUiAPI
Agrégation de plus de 300 grands modèles, conception entreprise haute concurrence, revendique un approvisionnement par canal officiel avec des taux de remise transparents et quantifiés
XJAI
Spécialisé OpenAI, groupé Azure, tarification attractive à un taux de change de 0,9¥/USD
Yinhe API
Bonus d'inscription de 0,4 $, optimisation dédiée à Claude Code, un bon choix pour les tests légers
ZHTec API
Taux de change 0,5-0,6¥/USD, paliers VIP et standard, relais à prix ultra-bas
147API / 147AI
Le « choix incontournable » dans plusieurs avis — interface hautement compatible, règlement en RMB, relais d'agrégation de niveau entreprise
AiGoCode
Claude rétro-ingénié à bas prix, ¥2/10M tokens, forfaits mensuels en option
Boluotu AI
Adossé à un canal Azure officiel, taux de change ¥1-2,5/USD, focus sur un bas prix stable, adapté aux développeurs soucieux de leur budget
Chutes
Routage multi-modèles mondial à faible latence, pratique pour les tests A/B, tarification compétitive
GGWK1
Agrégation des trois familles OpenAI/Claude/Gemini, taux de change ¥0,6-1/USD, connexion directe en Chine continentale
Lumin AI
Lancé en 2026, barrière d'entrée basse à ¥5, endpoint Kiro à ¥2/10M tokens
MKEAI
Petites recharges bienvenues, connexion directe basse latence en Chine continentale vers Claude/GPT/Gemini/DeepSeek
NanoBanana
Génération d'images et de vidéos en qualité 4K, série de modèles NanoBanana exclusive, spécialisée dans la génération multimédia
NativeAI API
SDK multi-modèles unifié, nouvelle tentative et bascule automatiques, observabilité de niveau entreprise
No.1-API
Un relais d'agrégation de modèles tout-en-un avec des interfaces bien documentées, un point d'entrée unifié pour Claude/GPT/Gemini/DeepSeek
PaintBot
Piloté par le panneau OneAPI, taux de change ¥0,5/USD, interface standardisée
StepFun
La plateforme officielle de StepFun, la série Step, légère et efficace, faible latence
TokenMix
Agrégation multi-modèles, options de paiement flexibles, au service des développeurs en Chine comme à l'étranger
V-API
Relais multi-modèles en connexion directe couvrant Claude/GPT/Gemini/DeepSeek/Grok, connexion directe stable en Chine continentale
YunWu API
Plus de 500 modèles agrégés, taux de change ¥0,5/USD, appels GPT-4o gratuits quotidiens via connexion GitHub
Zhihui API
Une nouvelle plateforme de 2026 couvrant les familles GPT-5.6 / Claude Opus / Gemini / Grok, avec bonus de recharge par palier pour les membres
Baichuan API
Une zone dédiée aux modèles Baichuan plus la compatibilité API tierce, connexion directe en Chine continentale, le meilleur choix pour les développeurs axés Baichuan
Boxying
Relais domestique léger et sans fioritures couvrant les modèles courants, rapide à prendre en main
DawCode
Une nouvelle plateforme de 2026, récompenses de connexion quotidienne, ¥4 de crédit d'essai pour les nouveaux utilisateurs
Jeniya API
Fidèle à son nom, construit autour de la simplicité — couverture complète des modèles, barrière d'entrée basse
Nio API
Large couverture sur plusieurs scénarios métier, migration de domaine en cours, interface qui reste compatible
OAIPlus
Relais centré OpenAI, interface épurée, adapté aux débutants, connexion directe en Chine continentale
TomCat API
Relais domestique stable, connexion directe à faible latence, facturation à l'usage pour les modèles courants
Chien API
Relais direct par canaux officiels, taux de change ¥1-2/USD, un spécialiste OpenAI pour les développeurs individuels
Yiye Zhiqiu API
Pas de recharge minimale, léger et adapté aux tests, preuve de concept à barrière nulle
UniAPI
Triple couverture OpenAI/Claude/Gemini + modèles multimodaux comme Midjourney/Suno/Kling, connexion directe en Chine continentale, facturation à remise par canal
Shenma Relay API
2557 modèles multimodaux couverts (texte/image/audio/vidéo), affirme être le plus important du secteur, facturation à l'usage avec connexion directe en Chine continentale
GPTGOD
Un relais rétro-ingénieré à prix ultra-bas, taux de change autour de ¥0,6/USD — extrêmement peu cher mais la stabilité n'est pas garantie
ShiyunApi ⚠️ Fermé
⚠️ Fermé depuis juin 2026 ; le site officiel redirige désormais vers TokenRiver (tokenriver.cn)
FAQ
Qu'est-ce qu'un relais d'API IA, et pourquoi les développeurs de Chine continentale en utilisent-ils un ?
Un relais d'API IA (aussi appelé revendeur d'API) achète en gros de la capacité d'API officielle auprès d'OpenAI, Anthropic, Google et d'autres, puis en revend l'accès avec une barrière à l'entrée plus basse via un point d'accès compatible OpenAI. Pour les utilisateurs de Chine continentale, un relais règle trois problèmes à la fois : s'inscrire sans carte bancaire liée à une région non prise en charge, payer en RMB via Alipay/WeChat Pay, et atteindre le modèle via un nœud à connexion directe plutôt que par un VPN.
En quoi un relais diffère-t-il de l'API officielle ?
Techniquement, un relais expose la même interface compatible OpenAI que l'API officielle — il suffit de pointer base_url vers le relais et de garder le reste de votre code inchangé. Les différences se situent au niveau du prix (souvent 10 à 40 % sous le tarif officiel, mais pas toujours), de la fiabilité (qui dépend entièrement de l'exploitation du relais) et de la fidélité du modèle (certains relais substituent discrètement un modèle moins cher à celui demandé). Choisir un relais fiable est tout l'enjeu.
Comment savoir si un relais est fiable ?
Cinq points à vérifier : (1) une véritable structure derrière le site, pas un projet personnel anonyme ; (2) les versions exactes des modèles sont indiquées clairement, sans discours marketing vague ; (3) des retours d'expérience indépendants existent quelque part en ligne ; (4) la tarification est plausible — un prix très en dessous du coût réel de l'API officielle est un signal de modèle dégradé ; (5) les petites recharges sont acceptées, pour tester avant d'engager un solde important.
Pourquoi seulement une partie des fournisseurs a-t-elle un avis en français ?
Nous suivons plus de 153 relais côté chinois du site, et nous nous appuyons sur les fiches déjà traduites en anglais pour cette version française plutôt que de tout traduire d'un coup — chaque fiche listée ici a été rédigée et vérifiée de façon indépendante, comme son équivalent chinois. Si le fournisseur que vous cherchez n'apparaît pas ici, le comparatif complet en chinois les couvre tous.