SiliconFlow : avis et comparatif
Hébergement cloud de modèles open source chinois — DeepSeek, Qwen, GLM et plus de 100 modèles, un moteur d'inférence maison et un support de puces domestiques
Dernière vérification : 2026-08-11 · Visiter le site officiel →
SiliconFlow n’est pas un relais
Cette distinction compte.
Le modèle économique typique d’un relais : acheter en gros des comptes officiels OpenAI/Anthropic, puis revendre l’accès en dessous du taux de change officiel. La plateforme elle-même ne détient aucun poids de modèle.
Le modèle économique de SiliconFlow est totalement différent : elle héberge directement des poids de modèles open source, en faisant tourner son propre moteur d’inférence (déjà adapté aux puces domestiques Ascend), ce qui en fait l’un des véritables opérateurs cloud de modèles comme DeepSeek, Qwen et Kimi K2.
Cela signifie : aucun risque de « dégradation de capacité » (il n’existe pas de limitation de débit sur un compte officiel ici) ; aucune marge supplémentaire d’une couche intermédiaire ; et les mises à jour de version de modèle suivent les sorties open source officielles de façon quasi synchrone. Le compromis : pas de GPT/Claude/Gemini ni d’autres modèles commerciaux propriétaires.
Tarification en détail
La tarification de SiliconFlow se situe au plancher du marché parmi les plateformes comparables — certains petits modèles sont définitivement gratuits, et même ses modèles phares sont à des prix extrêmement bas. Selon les données du site d’août 2026, tarification de référence des principaux modèles (vérifiez le site en direct pour le tarif actuel) :
| Modèle | Prix d’entrée (par M tokens) | Prix de sortie (par M tokens) | Connexion directe |
|---|---|---|---|
| DeepSeek-V4-Flash | ¥1,00 | ¥2,00 (cache ¥0,02) | ✓ |
| DeepSeek-V4-Pro | ¥12,00 | ¥24,00 (cache ¥1,00) | ✓ |
| Qwen3.5-397B-A17B | ¥1,20 | ¥7,20 | ✓ |
| Qwen2.5-7B (gratuit) | ¥0 | ¥0 | ✓ |
| Kimi-K2.7-Code | ¥6,50 | ¥27,00 (cache ¥1,30) | ✓ |
| GLM-5.2 | ¥8,00 | ¥28,00 (cache ¥2,00) | ✓ |
| MiniMax-M2.5 | ¥2,10 | ¥8,40 (cache ¥0,21) | ✓ |
Prenons DeepSeek-V4-Flash comme exemple : environ ¥1,00 en entrée et ¥2,00 en sortie par million de tokens — toujours parmi les plus bas des plateformes comparables. Pour comparaison, la tarification officielle de Claude Sonnet 4.6 chez Anthropic est de 3 $/15 $ par million de tokens (entrée/sortie), soit environ ¥21,6/¥108 — les modèles open source phares de SiliconFlow sont un à deux ordres de grandeur moins chers que les modèles propriétaires phares.
À noter : SiliconFlow n’offre pas GPT/Claude/Gemini ni d’autres modèles commerciaux propriétaires. Si votre usage nécessite Claude Code ou GPT-5.5, il vous faudra un autre relais.
Couverture de modèles et performance réelle
SiliconFlow répertorie actuellement plus de 150 modèles open source, dont :
- La famille DeepSeek : DeepSeek-V3.2, DeepSeek-V4-Flash, DeepSeek-V4-Pro, la série DeepSeek-R1, et plus encore — mise à jour presque en synchronisation avec les sorties officielles.
- La famille Qwen : Qwen3-235B-A22B, Qwen3-30B-A3B, Qwen2.5-7B (gratuit), et le reste de la gamme Qwen.
- GLM/InternLM : la série GLM de Zhipu, la série InternLM du Shanghai AI Lab.
- Kimi K2 Instruct : le modèle Kimi K2 de Moonshot, nouvellement répertorié en 2026.
- MiniMax M3 : le dernier modèle phare de MiniMax.
Puisque SiliconFlow se concentre sur les modèles open source, elle n’a pas GPT-5.5, Claude Fable 5, Gemini 3.5, ni d’autres modèles propriétaires phares. Certains retours notent que le support de SiliconFlow pour les puces domestiques (Ascend) est solide, avec des performances d’inférence déjà comparables aux GPU courants. Il n’y a aucun risque de dégradation de capacité, puisqu’elle héberge directement des poids open source plutôt que de dépendre d’un compte officiel soumis à des limites de débit.
Utilisation au quotidien
Inscription : rendez-vous sur siliconflow.cn, inscrivez-vous avec une adresse e-mail pour commencer à utiliser le service ; après avoir effectué la vérification d’identité réelle, réclamez un bon universel de ¥16 valable sur toute la plateforme via Centre d’activités → 认证专享礼. À noter : depuis le 2026-05-15, les comptes non vérifiés ne peuvent pas utiliser la plateforme. L’ensemble du processus prend 3 à 5 minutes.
Paiement : prend en charge Alipay et WeChat Pay, réglé en RMB, sans montant minimum de recharge (nous suggérerions tout de même de recharger au moins ¥10 pour un accès complet aux fonctionnalités).
Obtenir votre clé API : connectez-vous et générez-en une directement sur la page « API Keys » de la console. Elle prend en charge le format compatible OpenAI (https://api.siliconflow.cn/v1) — vous pouvez passer de l’inscription à votre premier appel API en moins de 5 minutes.
Tableau de bord : fournit des statistiques d’usage, une ventilation des coûts et des journaux d’appels — relativement sobre, fonctionnel mais moins détaillé que certaines plateformes de niveau entreprise.
Programme de parrainage : un programme de bonus bilatéral public « Responsable de parrainage » (campagne du 2026-01-15 au 2026-12-31) : devenez Responsable de parrainage et chaque parrainage réussi (inscription + vérification d’identité réelle) rapporte un bon universel de ¥16 aux deux parties, sans contact commercial requis ; le lien de parrainage est disponible directement dans la console.
Stabilité et latence
Les serveurs de SiliconFlow sont déployés domestiquement, aucun proxy/VPN nécessaire — pratique pour les développeurs domestiques. Selon les retours d’utilisateurs, générer 500 mots de contenu prend environ 7 secondes (pour la famille DeepSeek-V3), économisant le temps réseau transfrontalier par rapport à une API officielle.
Il n’existe pas de chiffre de latence unifié officiel ni d’engagement SLA, mais compte tenu de l’avantage de connexion directe en Chine continentale, la latence réelle est généralement meilleure qu’un relais étranger nécessitant un proxy. Aucune panne à grande échelle n’a été observée jusqu’à présent, et les retours de développeurs individuels sur la stabilité sont positifs.
Côté limites de débit : les modèles gratuits ont un plafond de QPS (vérifiez la configuration actuelle sur le site en direct) ; les modèles payants ont des limites de débit relativement plus souples — contactez directement le support pour des scénarios à haute concurrence.
Pour qui
- Les gros utilisateurs de modèles open source domestiques : l’usage principal pour DeepSeek, Qwen, Kimi et modèles similaires — bien moins cher que n’importe quel relais propriétaire.
- Les développeurs individuels vibe-coding : valider des prototypes de produit à bas coût — les ¥14 de crédit d’essai vont loin pour les tests.
- Tout ce qui nécessite une connexion directe en Chine continentale : les projets tournant sur des serveurs domestiques qui ne veulent pas configurer un proxy séparé juste pour les appels API.
- Les équipes qui veulent un pool de modèles de secours : utiliser des modèles open source comme repli en dessous de Claude/GPT, avec un avantage de coût significatif.
Mauvais profil : les usages nécessitant des modèles propriétaires phares comme GPT-5.5, Claude Code ou Gemini.
Comparaisons directes
Comparé à des plateformes domestiques similaires :
- vs 147API : 147API couvre des modèles propriétaires comme OpenAI/Claude/Gemini, mais sa tarification est généralement plus élevée que la tarification des modèles open source de SiliconFlow ; si vous n’utilisez que des modèles open source, SiliconFlow est moins cher.
- vs 302.AI : 302.AI prend en charge les modèles propriétaires phares (GPT/Claude/Gemini) avec un solde qui n’expire jamais (en anglais), à un prix proche du tarif officiel ; si vous avez besoin d’un accès tout-en-un à plusieurs modèles propriétaires, 302.AI est mieux adapté.
Distinction centrale : SiliconFlow = accès plancher-de-prix aux modèles open source, tandis que 302.AI/147API = un canal pratique vers les modèles propriétaires.
En résumé
SiliconFlow est l’une des plateformes de référence pour les API de grands modèles open source domestiques — une tarification hautement compétitive (certains modèles gratuits), une connexion directe en Chine continentale sans proxy nécessaire, et une expérience d’inscription conviviale. Sa seule vraie limite est de ne pas couvrir GPT/Claude ni d’autres modèles propriétaires phares — si votre usage nécessite un modèle propriétaire, il vous faudra l’associer à un autre relais.
Pour les développeurs dont la charge de travail principale est DeepSeek, Qwen et d’autres modèles open source domestiques, nous la recommanderions fortement comme plateforme principale.
Si vous avez aussi besoin de Claude et voulez faire des tests d’intégration avec du crédit gratuit, le palier de test définitivement gratuit d’AiHubMix plus son support de Prompt Caching (en anglais) peut combler le manque côté propriétaire de SiliconFlow. Si même le palier bas prix vous semble encore trop cher et que vous voulez réduire au maximum le coût d’exploration de l’API, Yunwu API (0,5 ¥/USD plus un crédit GitHub gratuit quotidien) (en anglais) est une alternative bas prix plus agressive.
Les détails de crédit d’essai et de promotion sont sujets au site en direct de SiliconFlow. Cet avis a été vérifié le 2026-08-11.
Avis similaires
- AICloud Feiyun (en anglais) : 50 appels Sonnet gratuits par jour, accès Claude en connexion directe à bas coût
- Boxying (en anglais) : un relais domestique léger, sans fioritures, modèles courants, prise en main rapide
- Lumin AI (en anglais) : lancé en 2026, barrière d’entrée basse à ¥5, point de terminaison Kiro à ¥2/10M tokens
- DMXAPI (en anglais) : plus de 480 modèles, agrégation multimodale texte/image/vidéo, stabilité de niveau entreprise
En bref
| Modèle tarifaire | Facturation à l'usage, revendique les prix les plus bas du marché ; après vérification d'identité réelle, réclamez un bon universel de ¥16 valable sur toute la plateforme via Centre d'activités → 认证专享礼 ; le programme « Responsable de parrainage » verse ¥16 aux deux parties lorsqu'un ami invité complète l'inscription + la vérification d'identité réelle (campagne jusqu'au 2026-12-31) |
|---|---|
| Couverture de modèles | Plus de 100 modèles open source couvrant DeepSeek, Qwen, GLM, InternLM et d'autres grands modèles open source domestiques courants ; certains modèles sont gratuits à l'appel |
| Latence / SLA | Serveurs domestiques en connexion directe, sans surcoût réseau transfrontalier ; aucun chiffre de latence officiel publié |
| Connexion directe Chine continentale | Connexion directe en Chine continentale, aucun proxy/VPN nécessaire |
| Idéal pour | Développeurs / Secours / bascule |
| Programme de parrainage | Un programme de parrainage public : les nouveaux utilisateurs reçoivent ¥14 de crédit d'essai à l'inscription, et les parrains reçoivent ¥14 supplémentaires pour chaque parrainage réussi — aucun contact commercial requis, ce qui en fait l'un des rares programmes qu'un projet en démarrage peut exploiter sans aucune négociation. |
Avantages
- L'une des gammes de modèles open source les plus larges parmi les plateformes domestiques — les séries DeepSeek/Qwen sont mises à jour rapidement
- Connexion directe en Chine continentale — latence plus faible et risque de conformité plus faible que les relais étrangers
- Un programme de parrainage public bilatéral — utilisable comme matériel promotionnel dès le démarrage à froid, sans processus commercial requis
- Bien adapté aux développeurs individuels à budget limité et aux projets vibe-coding en phase de validation de prototype
Inconvénients
- Centré sur les modèles open source — la couverture des modèles propriétaires phares (GPT-4.x/Claude 4.x officiels) est en retrait par rapport à certains relais
- Aucun chiffre unifié de latence/SLA rendu public — les garanties de niveau entreprise ne sont pas aussi solides que les plateformes axées SLA comme Shiyun API
Comparer plus de relais d'API IA
Consultez le comparatif complet — filtrez par niveau de prix, couverture de modèles et connexion directe depuis la Chine continentale.
Retour au comparatif →