Allons droit au but : aucune plateforme ne propose aujourd'hui une API DeepSeek V4 Flash « vraiment gratuite, illimitée et permanente » — chaque voie gratuite a un quota ou une échéance. Mais les points d'entrée gratuits sont réellement nombreux : SenseNova est en bêta ouverte, OpenCode Zen est gratuit à durée limitée, NVIDIA a un palier de prototypage gratuit, et DeepSeek officiel plus Alibaba, Tencent, Qiniu et ModelScope offrent tous des crédits d'inscription. Récupérez-en quelques-uns et vous avez quelques millions de tokens pour coder et tester. Chaque plateforme ci-dessous est présentée en « ce qu'on obtient → où le réclamer → comment le brancher », avec la base_url et l'identifiant de modèle. À la fin, une configuration minimale pour Codex et Claude Code, une fiche récapitulative et une liste d'erreurs courantes.
D'abord, pourquoi ce modèle : DeepSeek V4 Flash est le modèle que DeepSeek a fait passer en bêta publique 0731 le 31 juillet 2026 — une architecture MoE de 284 Md au total / 13 Md actifs avec une fenêtre de contexte d'un million de tokens, environ 0,14 $/M en entrée et 0,28 $/M en sortie. Il occupe le palier d'entrée le moins cher en ce moment, ce qui explique pourquoi autant de plateformes l'utilisent comme appât gratuit. Pour coder, tester et les usages à faible volume, les quotas gratuits ci-dessous sont largement suffisants.
Sommaire
- 1. SenseNova Token Plan (bêta gratuite)
- 2. OpenCode Zen (gratuit à durée limitée)
- 3. NVIDIA NIM (prototypage gratuit)
- 4. DeepSeek officiel (bonus de 5 M de tokens)
- 5. Alibaba Bailian (1 M dédié à V4 Flash)
- 6. Tencent TokenHub (1 M / 90 jours)
- 7. Qiniu Cloud (bonus de 3 M)
- 8. ModelScope (crédits quotidiens)
- 9. Autres plateformes avec de petits cadeaux d'inscription
- 10. Ne perdez pas votre temps : ces « gratuits » n'incluent pas V4 Flash
- 11. Comment l'utiliser : une configuration minimale
- 12. Fiche récapitulative
- 13. Erreurs courantes et solutions
- 14. Quelques pièges partagés
- 15. FAQ
- 16. Prochaines étapes
1. SenseNova Token Plan (bêta gratuite)
Ce qu'on obtient : appels gratuits pendant la bêta, sans rechargement ni carte ; le quota se réactualise par fenêtre de 5 heures. V4 Flash tourne autour de 1 500 / 500 / 150 appels toutes les 5 heures selon les sources (vérifiez la console). Un compte peut contenir jusqu'à 20 clés API qui partagent un même pool de quota. La bêta est limitée dans le temps et pourrait devenir payante — récupérez-la tant qu'elle est là.
Comment le réclamer :
- Allez sur platform.sensenova.cn et inscrivez-vous avec un numéro +86 (les numéros étrangers ne fonctionnent pas pour l'instant).
- Connectez-vous, ouvrez la page « API Keys » de la console et créez une clé.
- Enregistrez la clé, la base_url et l'identifiant de modèle — vous en aurez besoin à l'étape suivante.
Se connecter à Claude Code / Codex : base_url https://token.sensenova.cn/v1, identifiant de modèle deepseek-v4-flash, compatible OpenAI. Codex parle le format OpenAI, il se connecte donc directement :
export OPENAI_BASE_URL=https://token.sensenova.cn/v1
export OPENAI_API_KEY=sk-votre-cle-sensenova
codex --model deepseek-v4-flash Claude Code parle le protocole Anthropic et cet endpoint est au format OpenAI, il faut donc d'abord une couche de traduction (voir la section 11).
2. OpenCode Zen (gratuit à durée limitée)
Ce qu'on obtient : une promotion à durée limitée, 0 $ sans carte, contexte 1M. Le quota n'est pas public — poussez et vous tomberez sur 429 / 503 / « Free usage exceeded ». Attention : les conversations du free tier peuvent servir à l'entraînement du modèle, évitez donc d'y mettre du code d'entreprise sensible.
Comment le réclamer :
- Allez sur opencode.ai/zen et inscrivez-vous avec un e-mail ou un compte GitHub.
- Générez une clé API dans la console (la page liste les modèles gratuits).
- Enregistrez la clé ; le modèle gratuit est
opencode/deepseek-v4-flash-free.
Se connecter à Claude Code / Codex : base_url https://opencode.ai/zen/v1, identifiant de modèle opencode/deepseek-v4-flash-free (ou simplement deepseek-v4-flash-free). Codex se connecte directement :
export OPENAI_BASE_URL=https://opencode.ai/zen/v1
export OPENAI_API_KEY=votre-cle-zen
codex --model opencode/deepseek-v4-flash-free C'est du gratuit promotionnel — utilisable aujourd'hui, mais ça peut être retiré à tout moment.
3. NVIDIA NIM (prototypage gratuit)
Ce qu'on obtient : un palier développeur gratuit, sans carte bancaire ; limité à environ 40 requêtes/minute (non facturé au token), clés valables 12 mois, pas de SLA. Il prend en charge l'appel d'outils (tool calling), donc il convient bien aux agents.
Comment le réclamer :
- Allez sur build.nvidia.com et inscrivez-vous avec un compte développeur gratuit.
- Cherchez
deepseek-v4-flash, ouvrez la page du modèle et cliquez sur « Get API Key » pour générer une clé préfixéenvapi-. - Enregistrez la clé ; elle est valable 12 mois et est comptée en requêtes, pas en tokens.
Se connecter à Claude Code / Codex : base_url https://integrate.api.nvidia.com/v1, identifiant de modèle deepseek-ai/deepseek-v4-flash. Codex se connecte directement :
export OPENAI_BASE_URL=https://integrate.api.nvidia.com/v1
export OPENAI_API_KEY=nvapi-votre-cle-nim
codex --model deepseek-ai/deepseek-v4-flash Ces trois voies sont les plus simples puisque aucune ne demande de carte. En résumé : SenseNova convient aux développeurs en Chine qui veulent une utilisation fréquente et soutenue (quota frais toutes les 5 heures) ; OpenCode Zen convient aux longues sessions de contexte occasionnelles (1M), mais pas au code sensible ; NVIDIA convient aux agents grâce au tool calling, et 40 req/min suffisent en général pour un usage personnel.
4. DeepSeek officiel (bonus de 5 M de tokens)
Ce qu'on obtient : 5 millions de tokens pour les nouveaux utilisateurs (environ le premier mois / 30 jours). Le tarif officiel est d'environ ¥1 en entrée / ¥2 en sortie (¥0,02 en entrée en cache) par million de tokens. DeepSeek a annoncé une hausse des prix le 6 août, donc tout ce qui suit le bonus sera au tarif en vigueur.
Comment le réclamer :
- Allez sur platform.deepseek.com et inscrivez-vous avec un numéro de téléphone.
- Ouvrez « API Keys », créez une clé — le crédit arrive automatiquement.
- L'accès direct passe par
api.deepseek.com: utilisez le chemin/anthropicpour Claude Code et/v1pour Codex.
Se connecter à Claude Code / Codex : DeepSeek officiel fournit un endpoint compatible Anthropic, donc Claude Code se connecte directement :
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=votre-cle-deepseek
export ANTHROPIC_MODEL=deepseek-chat Pour Codex, pointez l'endpoint OpenAI https://api.deepseek.com/v1 avec le modèle deepseek-chat. La documentation officielle utilise deepseek-chat comme alias de V4 Flash — vous verrez la correspondance dans la console, il suffit de remplir ce nom.
5. Alibaba Bailian (1 M de tokens dédiés à V4 Flash)
Ce qu'on obtient : un quota gratuit séparé de 1 M de tokens pour V4 Flash ; l'ensemble de la gamme cumule 70 M de tokens / 90 jours, attribué automatiquement aux nouveaux utilisateurs sans friction. Attention : le prix d'entrée en cache de Bailian est de 0,20 ¥/M, soit 10 fois le 0,02 ¥ officiel — surveillez les coûts sur les longs contextes.
Comment le réclamer :
- Allez sur bailian.console.aliyun.com, créez un compte Alibaba Cloud et activez Bailian.
- Trouvez DeepSeek V4 Flash dans la place de modèles et activez-le — le crédit est accordé automatiquement.
- Copiez l'endpoint compatible OpenAI et la clé API depuis la console.
Se connecter à Claude Code / Codex : utilisez l'endpoint compatible OpenAI de la console, identifiant de modèle deepseek-v4-flash (Flash et Pro ont des quotas séparés). Codex :
export OPENAI_BASE_URL=endpoint-fourni-par-la-console-bailian
export OPENAI_API_KEY=votre-cle-bailian
codex --model deepseek-v4-flash 6. Tencent TokenHub (1 M de tokens / 90 jours)
Ce qu'on obtient : 1 M de tokens / 90 jours, sans friction pour les nouveaux utilisateurs.
Comment le réclamer :
- Allez sur cloud.tencent.com et créez un compte Tencent Cloud.
- Trouvez DeepSeek V4 Flash dans la place de modèles (TokenHub) et activez-le.
- Copiez l'endpoint compatible OpenAI et la clé API ; le nom du modèle est
deepseek-v4-flash.
Se connecter à Claude Code / Codex : utilisez l'endpoint compatible OpenAI de la place de modèles, identifiant de modèle deepseek-v4-flash. Pointez le OPENAI_BASE_URL de Codex dessus :
export OPENAI_BASE_URL=endpoint-de-la-place-de-modeles-tencent
export OPENAI_API_KEY=votre-cle-tencent
codex --model deepseek-v4-flash 7. Qiniu Cloud (bonus de 3 M de tokens)
Ce qu'on obtient : 3 millions de tokens pour les nouveaux utilisateurs (particuliers uniquement), activés à la création de votre première clé API. Qiniu a été parmi les premiers à servir la version GA de V4 Flash et a mesuré environ 170 tokens/s.
Comment le réclamer :
- Allez sur qiniu.com/ai et inscrivez-vous avec un compte particulier.
- Créez votre première clé API dans la console — cette étape active le bonus de 3 M de tokens.
- Enregistrez l'endpoint
https://api.qnaigc.com/v1et le modèledeepseek/deepseek-v4-flash-20260731.
Se connecter à Claude Code / Codex : base_url https://api.qnaigc.com/v1, identifiant de modèle deepseek/deepseek-v4-flash-20260731. Qiniu prend aussi en charge le protocole Anthropic, donc Claude Code peut se connecter directement avec l'endpoint Anthropic de la console plus votre clé Qiniu. Codex se connecte directement :
export OPENAI_BASE_URL=https://api.qnaigc.com/v1
export OPENAI_API_KEY=votre-cle-qiniu
codex --model deepseek/deepseek-v4-flash-20260731 8. ModelScope (crédits quotidiens)
Ce qu'on obtient : après la refonte, 250 crédits « MoLi »/jour ; V4 Flash coûte environ 2 crédits par appel, soit ~125 appels/jour. Une autre source avance ~2 000 appels/jour par compte avec 50–500/jour par modèle (ajusté dynamiquement). Pas de carte nécessaire.
Comment le réclamer :
- Allez sur modelscope.cn, connectez-vous avec un compte Alibaba Cloud lié.
- Créez une clé sur la page « API-KEY » ; les crédits quotidiens sont accordés automatiquement.
- Utilisez l'endpoint d'inférence de la console, nom du modèle
deepseek-v4-flash.
Se connecter à Claude Code / Codex : utilisez l'endpoint d'inférence de la console, identifiant de modèle deepseek-v4-flash (y compris la variante 0731), compatible OpenAI. Pointez Codex dessus :
export OPENAI_BASE_URL=endpoint-d-inference-de-modelscope
export OPENAI_API_KEY=votre-cle-modelscope
codex --model deepseek-v4-flash Parmi ces cinq bonus d'inscription, le choix est simple : DeepSeek officiel pour le plus gros bonus (5 M) et le support direct de Claude Code ; Qiniu pour la vitesse (170 tokens/s) et un endpoint Anthropic ; Alibaba et Tencent valent le coup si vous avez déjà des comptes cloud ; ModelScope gagne sur le rafraîchissement quotidien pour du gratuit à long terme. Réclamez-les tous et vous tenez cinq ou six clés gratuites.
9. Autres plateformes avec de petits cadeaux d'inscription
Ces plateformes offrent des cadeaux plus petits, ou de simples prix promotionnels, mais elles servent toutes deepseek-v4-flash et fonctionnent bien comme clés de secours :
- Nous Research (Nous Portal) : DeepSeek V4 Flash 0731 à −90 % pendant 7 jours — pas gratuit, mais vraiment bon marché.
- OpenRouter (openrouter.ai) : palier payant
deepseek/deepseek-v4-flashà ~0,0679 $ / 0,168 $ par M ; gratuitdeepseek/deepseek-v4-flash:freeà ~50 appels/jour, 20 RPM. Ce palier gratuit est contesté — le 14 juillet 2026, quelqu'un a mesuré une réponse « no provider » (endpoints vides), une suspicion de liste morte. Vérifiez la page OpenRouter en direct avant de vous y fier ; ne le traitez jamais comme « gratuit et ça marche ». - TokenRiver (tokenriver.cn) : protocoles natifs OpenAI/Anthropic/Gemini, cadeau d'inscription d'1 M de tokens (à vérifier à la connexion).
- AiHubMix (aihubmix.com) : compatible OpenAI, couche de test gratuite permanente à l'inscription (quota faible ; confirmez que V4 Flash est dans la couche gratuite).
- FlowBar (flowbarai.com) : 50 000 tokens d'essai (30 jours), base_url
https://api.flowbarai.com/v1, nœuds à l'étranger nécessitant un proxy. - EasyRouter (easyrouter.io) : 400 points gratuits ; pas de service en Chine continentale.
- iFlytek Spark (xinghuo.xfyun.cn) : Spark Lite gratuit en permanence, quota gratuit pour les nouveaux à la connexion, V4 Flash est dans le catalogue.
- 302.AI, DMXAPI, Meshs One, 4SAPI, Together AI : ces cinq sont des alternatives payantes qui servent V4 Flash sans vrai palier gratuit — regardez-les quand vous en aurez besoin.
La configuration est identique aux plateformes ci-dessus : elles sont toutes compatibles OpenAI, donc Codex ou LiteLLM fonctionnent. Pour la base_url, FlowBar est https://api.flowbarai.com/v1 ; les autres donnent l'endpoint dans leur console, et le nom du modèle est uniformément deepseek-v4-flash.
10. Ne perdez pas votre temps : ces « gratuits » n'incluent pas V4 Flash
Quand vous voyez « DeepSeek gratuit », vérifiez d'abord que c'est bien V4 Flash. Ceux-ci seront un voyage perdu :
- Volcano Ark : le cadeau de 500 000 tokens aux nouveaux est réservé à R1 et exclut explicitement V4 ; V4 Flash n'a qu'un demi-tarif à durée limitée (jusqu'au 27 août 2026).
- Baidu Qianfan : aucun quota gratuit trouvé pour V4 Flash ; la plateforme est orientée agents d'entreprise, pas la peine d'y courir.
- Cloudflare Workers AI : le free tier (10 000 Neurons/jour) ne couvre que le distill R1, pas V4 Flash.
- SambaNova : le free tier n'a que V3.1 / V3.2, pas de V4 Flash.
- Groq / Cerebras : aucun des deux n'héberge V4 Flash, seulement d'autres versions de DeepSeek — ne vous inscrivez pas pour ça.
11. Comment l'utiliser : une configuration minimale
Une fois la clé gratuite récupérée, la brancher dans un outil est le vrai sujet. Voici deux chemins : Codex direct (format OpenAI, couvre la plupart des plateformes gratuites) et Claude Code (direct uniquement quand la plateforme fournit un endpoint Anthropic).
11.1 Codex : une configuration pour toutes les plateformes compatibles OpenAI
Codex (@openai/codex) parle nativement le format Chat Completions d'OpenAI, donc il peut se connecter à tous les endpoints gratuits ci-dessus — les seules différences sont base_url et model. Installez-le d'abord :
npm install -g @openai/codex Sous macOS / Linux, les variables d'environnement sont le plus rapide, avec SenseNova en exemple :
export OPENAI_BASE_URL=https://token.sensenova.cn/v1
export OPENAI_API_KEY=sk-votre-cle-sensenova
codex --model deepseek-v4-flash L'équivalent sous Windows PowerShell :
$env:OPENAI_BASE_URL="https://token.sensenova.cn/v1"
$env:OPENAI_API_KEY="sk-votre-cle-sensenova"
codex --model deepseek-v4-flash Pour fixer une plateforme en permanence, écrivez ~/.codex/config.toml et fournissez la clé via OPENAI_API_KEY :
# ~/.codex/config.toml
model = "deepseek-v4-flash"
provider = "openai"
base-url = "https://token.sensenova.cn/v1" Ensuite, lancez simplement codex. Pour changer de plateforme, modifiez base-url et model avec les valeurs de la fiche ; rien d'autre ne bouge. Pour une tâche ponctuelle sans interface interactive, utilisez codex exec : codex exec "corrige les erreurs de type dans ce dépôt" — il partage les mêmes variables d'environnement et config.toml.
11.2 Comment vérifier que ça marche
Après avoir modifié la configuration, testez avec curl avant de vous battre dans l'outil. C'est identique pour chaque plateforme compatible OpenAI :
curl https://token.sensenova.cn/v1/chat/completions \
-H "Authorization: Bearer sk-votre-cle-sensenova" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"salut"}]}' Un choices[0].message.content dans la réponse signifie que ça marche. 401 = mauvaise clé, 404 = mauvais identifiant de modèle, 429 = quota ou limite de débit — voir la section 13.
Vous préférez Python ? Le même script teste toutes les plateformes — il suffit d'échanger trois paramètres :
from openai import OpenAI
client = OpenAI(
base_url="https://token.sensenova.cn/v1",
api_key="sk-votre-cle-sensenova",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Présente-toi en une phrase"}],
)
print(resp.choices[0].message.content) Échangez base_url, api_key et model pour chaque plateforme de la fiche et parcourez-les une par une — la clé qui marche devient évidente très vite.
11.3 Claude Code : direct uniquement quand la plateforme fournit un endpoint Anthropic
Claude Code parle le protocole Anthropic Messages et lit trois variables d'environnement par défaut : ANTHROPIC_BASE_URL, ANTHROPIC_AUTH_TOKEN, ANTHROPIC_MODEL. DeepSeek officiel et Qiniu fournissent des endpoints Anthropic, donc vous pouvez les remplir directement :
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=votre-cle-deepseek
export ANTHROPIC_MODEL=deepseek-chat L'équivalent sous Windows PowerShell :
$env:ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
$env:ANTHROPIC_AUTH_TOKEN="votre-cle-deepseek"
$env:ANTHROPIC_MODEL="deepseek-chat" Pour router aussi le modèle principal et les sous-agents vers V4 Flash, définissez en plus :
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-chat
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-chat
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-chat
export CLAUDE_CODE_SUBAGENT_MODEL=deepseek-chat Rouvrez le terminal, lancez Claude Code et exécutez /status — si la Base URL et le Modèle s'affichent correctement, vous êtes en ligne.
11.4 Vous voulez Claude Code sur les autres plateformes ? Mettez LiteLLM devant
SenseNova, NVIDIA, OpenCode Zen, Bailian, Tencent et ModelScope ne donnent que des endpoints au format OpenAI, donc remplir base_url directement dans Claude Code ne fonctionnera pas. La solution la plus simple est un proxy LiteLLM local qui traduit l'endpoint OpenAI en protocole Anthropic ; pointez Claude Code sur le proxy :
# config.yaml (LiteLLM)
model_list:
- model_name: deepseek-v4-flash
litellm_params:
model: openai/deepseek-v4-flash
api_base: https://token.sensenova.cn/v1
api_key: sk-votre-cle-sensenova litellm --config config.yaml Ensuite définissez ANTHROPIC_BASE_URL sur http://localhost:4000 et ANTHROPIC_AUTH_TOKEN sur la clé LiteLLM. Le guide complet est dans le guide LiteLLM de ce site.
Pour router toutes vos chaînes gratuites vers Claude Code en une fois, listez plusieurs modèles dans une seule configuration et changez par nom :
model_list:
- model_name: sensenova-flash
litellm_params:
model: openai/deepseek-v4-flash
api_base: https://token.sensenova.cn/v1
api_key: ${SENSENOVA_KEY}
- model_name: nvidia-flash
litellm_params:
model: openai/deepseek-ai/deepseek-v4-flash
api_base: https://integrate.api.nvidia.com/v1
api_key: ${NVIDIA_KEY}
- model_name: qiniu-flash
litellm_params:
model: openai/deepseek/deepseek-v4-flash-20260731
api_base: https://api.qnaigc.com/v1
api_key: ${QINIU_KEY} export ANTHROPIC_BASE_URL=http://localhost:4000
export ANTHROPIC_AUTH_TOKEN=sk-cle-litellm
export ANTHROPIC_MODEL=sensenova-flash Changer de modèle devient alors une modification d'une seule variable, ANTHROPIC_MODEL. Si vous ne voulez pas écrire la configuration à la main, un sélecteur graphique comme CC Switch a des préréglages de fournisseurs intégrés (voir le guide CC Switch de ce site).
11.5 Un ordre de réclamation judicieux
Pour tout récupérer efficacement : commencez par DeepSeek officiel (5 M, Claude Code direct), puis SenseNova (bêta gratuite, Codex direct) et Qiniu (3 M), et finissez par les crédits Bailian, Tencent et ModelScope en secours. Cela vous donne des clés gratuites sur différents protocoles, donc si l'une meurt, une autre tient encore.
11.6 Configuration Codex par plateforme : seules deux lignes changent
Quand vous fixez ~/.codex/config.toml à long terme, la seule différence entre les plateformes est base-url et model. Par exemple :
# NVIDIA NIM
model = "deepseek-ai/deepseek-v4-flash"
provider = "openai"
base-url = "https://integrate.api.nvidia.com/v1"
# OpenCode Zen
model = "opencode/deepseek-v4-flash-free"
provider = "openai"
base-url = "https://opencode.ai/zen/v1"
# DeepSeek officiel (endpoint OpenAI)
model = "deepseek-chat"
provider = "openai"
base-url = "https://api.deepseek.com/v1" Les clés viennent toujours de la variable d'environnement OPENAI_API_KEY. Pour le reste (Bailian, Tencent, Qiniu, ModelScope), échangez ces deux lignes avec les valeurs de la fiche — la structure est identique. Sous Windows, le fichier de configuration se trouve dans %USERPROFILE%\.codex\config.toml.
11.7 Faire tourner plusieurs clés gratuites
Les quotas gratuits sont intrinsèquement instables, alors gardez plusieurs clés et faites-les tourner. Dans Codex, on change en modifiant les variables d'environnement et en ouvrant une nouvelle session :
unset OPENAI_BASE_URL OPENAI_API_KEY
export OPENAI_BASE_URL=https://api.qnaigc.com/v1
export OPENAI_API_KEY=votre-cle-qiniu
codex --model deepseek/deepseek-v4-flash-20260731 Quand une clé renvoie 429 ou est épuisée, passez à la suivante — aucune réinstallation nécessaire. Même idée dans Claude Code : échangez ANTHROPIC_BASE_URL et ANTHROPIC_AUTH_TOKEN.
Si vous ne comptez utiliser qu'un seul outil, la conclusion tient en une phrase : Codex seulement — configurez base-url et model pour n'importe quelle plateforme selon 11.1 ; Claude Code seulement — inscrivez-vous chez DeepSeek officiel et définissez les trois variables selon 11.3 ; c'est la combinaison la plus simple.
12. Fiche récapitulative
| Plateforme | Réclamer sur | base_url | Identifiant de modèle | Quota gratuit | Claude Code direct |
|---|---|---|---|---|---|
| SenseNova | platform.sensenova.cn | https://token.sensenova.cn/v1 | deepseek-v4-flash | Bêta gratuite, actualisée toutes les 5 h | via LiteLLM |
| OpenCode Zen | opencode.ai/zen | https://opencode.ai/zen/v1 | opencode/deepseek-v4-flash-free | Gratuit à durée limitée, 0 $ sans carte | via LiteLLM |
| NVIDIA NIM | build.nvidia.com | https://integrate.api.nvidia.com/v1 | deepseek-ai/deepseek-v4-flash | Prototypage gratuit, ~40 req/min | via LiteLLM |
| DeepSeek officiel | platform.deepseek.com | https://api.deepseek.com/v1 | deepseek-chat | Bonus d'inscription de 5 M de tokens | Direct |
| Alibaba Bailian | bailian.console.aliyun.com | endpoint de la console | deepseek-v4-flash | 1 M de tokens rien que pour V4 Flash | via LiteLLM |
| Tencent TokenHub | cloud.tencent.com | endpoint de la place de modèles | deepseek-v4-flash | 1 M de tokens / 90 jours | via LiteLLM |
| Qiniu Cloud AI | qiniu.com/ai | https://api.qnaigc.com/v1 | deepseek/deepseek-v4-flash-20260731 | Bonus d'inscription de 3 M de tokens | Direct |
| ModelScope | modelscope.cn | endpoint d'inférence de la console | deepseek-v4-flash | 250 crédits MoLi/jour | via LiteLLM |
| OpenRouter | openrouter.ai | https://openrouter.ai/api/v1 | deepseek/deepseek-v4-flash ou :free | Free tier ~50 appels/jour (contesté) | via LiteLLM |
| FlowBar | flowbarai.com | https://api.flowbarai.com/v1 | deepseek-v4-flash | 50 000 tokens d'essai (30 jours) | via LiteLLM |
| TokenRiver | tokenriver.cn | endpoint de la console | deepseek-v4-flash | Cadeau d'inscription d'1 M de tokens | via LiteLLM |
| AiHubMix | aihubmix.com | endpoint de la console | deepseek-v4-flash | Couche de test gratuite permanente | via LiteLLM |
| EasyRouter | easyrouter.io | endpoint de la console | deepseek-v4-flash | 400 points gratuits | via LiteLLM |
Notes : Codex se connecte directement à toutes les plateformes compatibles OpenAI ; seule Claude Code nécessite la distinction. « Direct » signifie que la plateforme fournit un endpoint Anthropic ; « via LiteLLM » signifie qu'un proxy de traduction est requis. La plupart des plateformes demandent un numéro de téléphone ou une vérification d'identité — inscrivez-vous avec de vraies informations pour éviter d'être signalé.
13. Erreurs courantes et solutions
- 401 Unauthorized / Invalid API key : la clé est mal recopiée ou contient un espace parasite. Certaines clés ont des préfixes (
sk-,nvapi-) — copiez-les exactement depuis la console. - 404 / model not found : mauvais identifiant de modèle. Ils ne sont pas uniformes d'une plateforme à l'autre —
deepseek-v4-flash,opencode/deepseek-v4-flash-free,deepseek-ai/deepseek-v4-flash,deepseek/deepseek-v4-flash-20260731diffèrent. Copiez depuis la fiche. - 429 Too Many Requests : quota ou limite de débit atteinte. SenseNova est une fenêtre de 5 heures, NVIDIA ~40 req/min, OpenRouter gratuit ~50/jour — attendez la réinitialisation ou changez de clé.
- 503 / « Free usage exceeded » : courant avec les promos à durée limitée comme OpenCode Zen ; le quota gratuit est épuisé ou la promo est terminée. Normal.
- no provider / endpoints vides : le problème de « liste morte » du
:freed'OpenRouter — « Gratuit » sur une page d'annuaire ne veut pas dire que quelqu'un sert réellement. Passez au palier payant ou à une autre plateforme. - Erreurs de Claude Code contre un endpoint OpenAI : Claude Code ne parle pas le protocole OpenAI. Confirmez que vous êtes sur l'endpoint
/anthropicde la plateforme, ou passez par LiteLLM. - Délai de connexion : les nœuds à l'étranger (FlowBar, certains relais) nécessitent un proxy ; les délais sur un réseau chinois sont normaux. Utilisez un proxy ou passez à une plateforme en accès direct depuis la Chine (SenseNova, Qiniu, Bailian, Tencent, ModelScope).
14. Quelques pièges partagés
- « Gratuit » ≠ illimité : chaque free tier a un quota, une échéance, ou les deux. SenseNova se réactualise sur 5 h, ModelScope quotidiennement, les 5 M de DeepSeek sont limités au premier mois/30 jours, le 1 M de Bailian/Tencent expire en 90 jours, les 3 M de Qiniu s'activent à la création de la première clé et sont réservés aux particuliers.
- Vos données sont le prix : des free tiers comme OpenCode Zen déclarent que les conversations peuvent améliorer leurs modèles. Gardez le code d'entreprise sensible hors des free tiers.
- Ça peut disparaître du jour au lendemain : OpenCode Zen est une promo à durée limitée et NVIDIA n'a pas de SLA — traitez-les comme un bonus, pas comme une dépendance de production.
- Verrous régionaux : SenseNova n'accepte que les numéros +86 ; les nœuds de FlowBar sont à l'étranger et nécessitent un proxy ; EasyRouter exclut la Chine continentale.
- Les chiffres de la console font foi : les comptes exacts par fenêtre (appels SenseNova par 5 h, comptes quotidiens ModelScope) diffèrent selon les sources — la console est la vérité.
- Les conditions gratuites changent plus vite que les tarifs : cet article est un instantané autour du 12 août 2026 — vérifiez toujours la page actuelle de la plateforme.
15. FAQ
- Puis-je réclamer à nouveau un bonus d'inscription après épuisement ? Les cadeaux d'inscription sont généralement uniques ; ceux basés sur une fenêtre ou un jour (SenseNova, ModelScope) se réactualisent automatiquement.
- Puis-je créer plusieurs comptes sur une même plateforme ? Techniquement oui, mais la plupart imposent un compte par personne (Qiniu réservé aux particuliers, SenseNova exige le +86), et l'inscription en masse risque le signalement — déconseillé.
- Ma clé gratuite va-t-elle juste s'arrêter de fonctionner ? Les paliers promotionnels (OpenCode Zen, prototypage NVIDIA) peuvent changer à tout moment — normal, d'où l'insistance à garder plusieurs clés.
- Puis-je faire tourner la production sur le free tier ? Déconseillé — pas de SLA, peut disparaître à tout moment. La production va chez DeepSeek officiel ou un relais payant solide.
- Combien de temps dure le quota ? En gros : une conversation V4 Flash fait quelques milliers de tokens, donc 1 M de tokens couvre quelques centaines de conversations moyennes — une à deux semaines de code/tests personnels. Le bonus officiel de 5 M est plus généreux. L'analyse en long contexte est le vrai gouffre.
- Comment faire durer le quota gratuit ? Appuyez-vous sur l'entrée en cache, limitez la longueur de sortie et ne bourrez pas des fichiers entiers dans le contexte. L'entrée en cache de V4 Flash ne coûte que 0,02 ¥/M — relire le même matériau avec des hits de cache économise beaucoup sur les longues tâches.
16. Prochaines étapes
- Inscrivez-vous sur une ou deux plateformes et réclamez vos clés (DeepSeek officiel + SenseNova est le départ recommandé — l'un donne Claude Code direct, l'autre Codex direct).
- Configurez Codex ou Claude Code selon la section 11 et confirmez avec curl avant de commencer à travailler.
- Quand un quota s'épuise ou renvoie 429, tournez vers la clé suivante — ne vous battez pas sur une voie morte.
- Mettez la fiche de la section 12 en favori ; les quotas gratuits changent vite, alors revenez-y dans un moment.