S'il fallait résumer en une phrase l'état réel de ce dossier au moment de la publication, ce serait : « annoncé, pas encore actif, aucun chiffre ». Le mécanisme de « surtaxe de pointe x2 entre 9h-12h et 14h-18h, heure de Pékin » évoqué mi-juillet ne figure toujours nulle part sur la page tarifaire officielle de DeepSeek au moment où nous écrivons ces lignes. Puis, le 6 août, DeepSeek a publié via son tableau de bord utilisateur et sa console API une annonce plus vague et plus large — « nous prévoyons de relever prochainement l'ensemble de la tarification des services API DeepSeek, avec une hausse significative attendue » — toujours sans aucun chiffre précis, aucune date d'entrée en vigueur, ni nouvelle grille tarifaire. C'est le deuxième mouvement tarifaire de DeepSeek en moins d'un mois, et c'est la raison d'être de cet article : la fenêtre où l'entreprise a dit « les prix vont augmenter » sans préciser de combien est précisément le moment où les lecteurs ont besoin d'un guide « que faire maintenant » — pas besoin d'attendre le chiffre final pour que ce soit utile.
Sommaire
- 1. Ce que nous avons vérifié : la tarification de pointe n'est toujours pas active, et une nouvelle annonce plus floue est arrivée le 6 août
- 2. Revérifié avant publication : la situation a-t-elle évolué au 7 août ?
- 3. Pourquoi maintenant : la logique de Liang Wenfeng et le contexte sectoriel
- 4. Comment la communauté réagit : frustration mêlée de résignation côté chinois, recherche d'alternatives côté anglophone
- 5. Cinq parades techniques réellement utilisées par les développeurs
- 6. Les relais font-ils vraiment baisser la facture sur DeepSeek ? Trois mécanismes, trois réponses très différentes
- 7. Que faire concrètement maintenant, si vous hésitez encore
1. Ce que nous avons vérifié : la tarification de pointe n'est toujours pas active, et une nouvelle annonce plus floue est arrivée le 6 août
1.1 D'abord la question la plus importante : la « tarification de pointe » de juillet n'est toujours pas en vigueur
Nous avons directement consulté la page tarifaire officielle de DeepSeek (api-docs.deepseek.com/quick_start/pricing/) pour vérifier : aucune trace d'une tarification de pointe ou selon l'heure n'y figure. V4-Flash comme V4-Pro affichent toujours un tarif unique — l'entrée de V4-Flash est à 0,0028 $ en cache hit et 0,14 $ en cache miss, avec une sortie à 0,28 $ ; l'entrée de V4-Pro est d'environ 0,0036 $ en cache hit et 0,435 $ en cache miss, avec une sortie à 0,87 $. Plusieurs sources indépendantes (KuCoin, Dataconomy, entre autres) indiquaient elles aussi, autour du 6 août, que « la page tarifaire officielle affiche toujours un tarif unique ; la tarification de pointe n'est pas encore lancée ». Autrement dit, le mécanisme de « surtaxe x2 entre 9h-12h et 14h-18h, heure de Pékin » annoncé mi-juillet reste, au moment où nous écrivons, à l'état « annoncé, non actif ». Si vous utilisez l'API DeepSeek en ce moment même, vous payez toujours le tarif hors pointe — votre facture n'a pas doublé à cause de ce mécanisme encore hypothétique.
1.2 Mais un nouveau développement le 6 août : une annonce de hausse plus large et plus floue
Le 6 août 2026, DeepSeek a publié, via son tableau de bord utilisateur et sa console API, une annonce citée verbatim par plusieurs médias : « Nous prévoyons de relever prochainement l'ensemble de la tarification des services API DeepSeek, avec une hausse significative attendue. Le plan précis et la date d'entrée en vigueur seront communiqués par notification officielle. » Cette annonce ne contient aucun chiffre précis, aucune date d'entrée en vigueur, aucune ventilation par modèle — et son périmètre est plus large que celui de la tarification de pointe de juillet. Plusieurs rapports soulignent que cela pourrait signifier que même le tarif de base hors pointe est appelé à augmenter, et pas seulement « le prix double en heure de pointe ». En mettant les deux mesures bout à bout, il s'agit du deuxième mouvement tarifaire de DeepSeek en moins d'un mois, et sa nature est passée d'une « surtaxe selon l'heure » à une « refonte tarifaire générale ».
Une limite mérite d'être énoncée clairement : au moment de cette enquête et de la rédaction, aucune source officielle ni fiable n'a communiqué de pourcentage précis, de date d'entrée en vigueur ou de nouvelle grille tarifaire.
Nous ne reprenons pas le chiffre de « 2 à 10 fois » qui circule en ligne
Au cours de nos recherches, nous avons trouvé un blog SEO anglophone affirmant que la hausse de DeepSeek serait de « 2 à 10 fois », citant des propos attribués au « fondateur de DeepSeek, Jun Song ». Le véritable fondateur de DeepSeek est Liang Wenfeng — cet article se trompe même sur le nom du fondateur, un signal clair de source peu fiable. Nous ne retenons pas son multiplicateur ; nous le mentionnons uniquement comme contre-exemple des spéculations exagérées qui circulent en ligne, et les lecteurs doivent rester vigilants quant à la qualité des sources. Ce chiffre n'apparaît nulle part dans les conclusions de cet article comme un fait établi.
2. Revérifié avant publication : la situation a-t-elle évolué au 7 août ?
Résultat de la revérification avant publication : la page tarifaire officielle n'a toujours pas été mise à jour, et « une hausse significative est attendue » figure désormais dans la documentation tarifaire elle-même
S'agissant d'une actualité en direct et susceptible d'évoluer à tout moment, nous avons mené une vérification indépendante juste avant la publication, en récupérant à nouveau directement la documentation tarifaire officielle. Résultat : au 7 août, V4-Flash et V4-Pro affichent toujours les mêmes tarifs uniques listés ci-dessus, sans aucune trace de tarification de pointe. Nous avons également relevé un détail que notre enquête précédente n'avait pas repéré : la phrase « nous prévoyons de relever prochainement l'ensemble de la tarification API, avec une hausse significative attendue » figure désormais directement dans la documentation tarifaire officielle elle-même — et non plus seulement dans des pop-up du tableau de bord ou des reformulations de presse — ce qui suggère qu'il ne s'agit pas d'une annonce ponctuelle, mais de la position publique officielle et actuelle de DeepSeek. Plusieurs rapports indépendants publiés après le 6 août (dont Bloomberg et le South China Morning Post) aboutissent, après recoupement, à la même conclusion : DeepSeek a confirmé qu'une hausse généralisée arrive, mais aucun d'entre eux n'avance de chiffre ni de date d'entrée en vigueur. Autrement dit, rien de substantiel n'a changé entre la fin de notre enquête et la publication de cet article — la situation reste « confirmée à venir, montant et calendrier inconnus ». Considérez cet article comme un instantané d'un vide informationnel, et non comme une conclusion définitive qui n'aurait de valeur qu'une fois les chiffres officiels connus.
3. Pourquoi maintenant : la logique de Liang Wenfeng et le contexte sectoriel
Plus intéressant que « de combien », il y a la logique tarifaire avancée par la direction de DeepSeek elle-même. Elle provient des propos du fondateur Liang Wenfeng lors d'une réunion avec des investisseurs en juillet, cités par plusieurs médias dont The Star Malaysia : la tarification de l'API DeepSeek repose sur un « modèle de profit raisonnable » — après l'achat d'un lot de matériel, l'entreprise souhaite le rentabiliser en environ 10 mois ; Liang Wenfeng a déclaré explicitement que la demande, aux niveaux de prix actuels, est « quasiment inélastique » — « même une hausse de 50 % ne changerait pas significativement la consommation de tokens » ; et l'entreprise ne cherche pas à maximiser ses profits, seulement à obtenir un « retour raisonnable ». Autrement dit, cette hausse ressemble moins à une entreprise à court de liquidités qu'à une décision tarifaire délibérée, prise après avoir estimé l'élasticité de la demande.
Le contexte mérite d'être posé dans le même cadre : plusieurs rapports indiquent que la consommation quotidienne de tokens de DeepSeek-V4-Flash a atteint 8 000 milliards le 1er août, largement cité comme le déclencheur immédiat ayant fait basculer le calcul selon lequel « les prix bas ne sont plus tenables ». DeepSeek serait par ailleurs en train de boucler un deuxième tour de financement de 740 millions de dollars et de préparer une introduction en bourse dans l'année, tout en prévoyant environ 1 GW de capacité de calcul en Mongolie-Intérieure — un investissement en infrastructure de l'ordre de 50 milliards de dollars. Et surtout, ce n'est pas propre à DeepSeek : Zhipu/GLM a relevé ses prix de 83 % au premier trimestre 2026 (alors même que l'usage progressait de 400 % sur la même période), et Kimi K3 de Moonshot a suspendu les nouvelles inscriptions en juillet face à une explosion de la demande. La stratégie « prix cassés pour gagner en volume » est en train de reculer dans l'ensemble du secteur chinois des grands modèles, au profit d'un récit de « rentabilité durable » — cette hausse doit être lue à l'aune de ce contexte sectoriel, et non comme un événement isolé.
Le seul changement de prix confirmé comme réellement en vigueur aujourd'hui, c'est « zéro » — la grille tarifaire officielle est identique à celle d'il y a une semaine. Ce qui a réellement changé, ce sont les attentes : le marché sait désormais qu'une hausse arrive et qu'elle pourrait être conséquente, mais personne — pas même DeepSeek — n'y a encore mis de chiffre. Ce vide informationnel est, en lui-même, la description la plus fidèle de la situation actuelle, et c'est le contexte direct des réactions communautaires et des parades décrites plus bas.
4. Comment la communauté réagit : frustration mêlée de résignation côté chinois, recherche d'alternatives côté anglophone
4.1 Communautés sinophones (V2EX, Zhihu)
Nous avons repéré au moins trois fils pertinents sur V2EX et deux articles très suivis sur Zhihu. Ce que nous avons pu récupérer révèle plusieurs constantes : l'ambiance est un mélange de déception et de résignation plutôt qu'une colère collective — un utilisateur a plaisanté « j'ai commencé à l'utiliser hier, et aujourd'hui arrive déjà l'avis de hausse » ; d'autres se demandent si cela ne trahit pas des tensions de trésorerie. On observe aussi une méfiance envers la communication officielle elle-même — un utilisateur a relayé une affirmation selon laquelle « l'entreprise a démenti toute hausse », aussitôt contredite par « l'annonce est bien affichée en pleine page d'accueil de la console API », ce qui a déclenché un débat sur la crédibilité des sources — signe que la communication de DeepSeek elle-même manque de transparence, ce qui alimente la défiance de la communauté. Certains comparent DeepSeek à des modèles étrangers comme Claude, mais davantage par nostalgie d'un temps où c'était « ridiculement bon marché » que comme l'annonce d'un basculement réel. Une partie des critiques vise l'historique tarifaire de DeepSeek lui-même — d'une « baisse permanente de 75 % » à la « tarification de pointe », puis maintenant à une « hausse généralisée » — résumé par certains utilisateurs comme une recette classique : construire sa réputation sur des prix cassés, puis reprendre discrètement la marge. Il est à noter qu'aucun des fils récupérés ne contient de discussion technique concrète sur le passage à un relais ou à l'auto-hébergement — V2EX ressemble davantage à une conversation émotionnelle et de confiance qu'à une discussion de solutions, un contraste à noter face aux échanges plus techniques des communautés anglophones et des blogs développeurs ci-dessous.
4.2 Communautés anglophones (Reddit, Hacker News)
Sur r/DeepSeek, sur Reddit, l'alternative la plus citée dans les discussions autour de la hausse de prix est GPT-5.6 Luna, en partie grâce à son support de la vision — certains utilisateurs disent avoir déjà « basculé par anticipation » vers ce modèle. Hacker News dispose également d'un fil de discussion dédié, dont le titre suffit à indiquer que la communauté internationale des développeurs suit ce dossier — mais des limitations de fréquence d'accès ne nous ont pas permis de récupérer le contenu détaillé des commentaires cette fois-ci ; nous le signalons clairement plutôt que d'inventer des détails.
5. Cinq parades techniques réellement utilisées par les développeurs
Plus utile que les défouloirs émotionnels, voici ce que les développeurs mettent réellement en œuvre. En croisant des blogs développeurs comme CSDN, ofox.ai et d'autres sources similaires, les stratégies d'adaptation qui reviennent le plus souvent se répartissent en cinq catégories :
- Audit d'usage et économies techniques de tokens : passer en revue la consommation historique de tokens, alléger le system prompt, utiliser du RAG pour restreindre la fenêtre de contexte, fixer un plafond
max_tokens, et passer aux réponses en streaming ; - Routage des modèles par niveau de complexité de la tâche : rediriger les questions simples, le polissage de texte et la complétion de code basique vers V4-Flash, en réservant V4-Pro aux tâches de raisonnement complexe ou de génération de code — au lieu d'utiliser par défaut le modèle le plus cher pour tout ;
- Découplage via une couche d'abstraction multi-modèles/multi-fournisseurs : ne pas coder DeepSeek en dur comme back-end par défaut, mais construire une couche capable de basculer dynamiquement de fournisseur et de router vers l'option la moins chère du moment — utiliser des modèles ouverts légers comme Qwen2.5-Coder en pré-filtre est une méthode concrète évoquée ;
- Éviter tout engagement contractuel long terme : ne signer aucun contrat long terme ni prépaiement important verrouillé sur le tarif actuel tant que DeepSeek n'a pas publié de nouvelle grille tarifaire réelle, et isoler les dépenses DeepSeek dans une ligne distincte d'un tableau de bord de coûts, afin de voir immédiatement l'impact réel dès qu'une hausse sera effective ;
- Évaluer l'auto-hébergement du modèle à poids ouverts : si le volume d'appels le justifie, évaluer la location de GPU pour auto-héberger les poids ouverts de DeepSeek (via vLLM, TGI ou des frameworks d'inférence similaires), transformant un « paiement au token à DeepSeek » en un « paiement à l'heure de GPU à un fournisseur cloud ». Cette voie n'est viable que parce que DeepSeek a ouvert les poids de son modèle — c'est justement la logique développée dans la section suivante.
Par ailleurs, un article d'ofox.ai intitulé « DeepSeek V4 Flash : 6 Ways to Pay Less » propose six conseils qui relèvent tous d'une optimisation de l'usage à l'intérieur de la grille tarifaire officielle — améliorer le taux de cache hit, surveiller l'écart de prix de lecture en cache selon l'hébergeur tiers choisi, épingler explicitement la dernière version du modèle pour éviter de rester par défaut sur une version obsolète, se méfier de la perte de qualité cachée que peuvent introduire des hébergeurs bon marché via une quantification à basse précision ou une fenêtre de contexte réduite, désactiver le mode réflexion quand ce n'est pas nécessaire pour économiser des tokens de sortie, et bien choisir son framework d'agent pour limiter la consommation de tokens liée à la répétition du contexte. Rien de tout cela ne relève d'un arbitrage ou d'une remise via un relais — c'est une question différente de « comment trouver un canal en dessous du prix officiel », qui fait justement l'objet de la section suivante.
6. Les relais font-ils vraiment baisser la facture sur DeepSeek ? Trois mécanismes, trois réponses très différentes
C'est la partie qui intéresse le plus nos lecteurs. En recoupant nos propres tests de plus de 120 fournisseurs relais mentionnant DeepSeek, nous avons spécifiquement testé la question « passer par un relais pour accéder à DeepSeek permet-il réellement d'économiser ? ». Réponse honnête : oui, mais tout dépend du type de relais, et les résultats varient énormément — il n'est pas exact de dire que les relais sont en général moins chers que le tarif officiel.
6.1 Mécanisme un : la concurrence sur le calcul auto-hébergé permise par les poids ouverts — réelle, mais pas moins chère sur toutes les dimensions
DeepSeek a ouvert les poids de sa gamme V4, ce qui signifie que n'importe quel tiers disposant de suffisamment de puissance de calcul peut auto-héberger le modèle et en revendre l'usage — une voie d'économie propre à DeepSeek, puisque les modèles fermés comme GPT ou Claude n'ont pas d'équivalent. Nos propres tests montrent que SiliconFlow facture DeepSeek-V4-Flash environ 0,15 ¥/0,15 ¥ (entrée/sortie), contre un tarif officiel hors cache d'environ 1 ¥/2 ¥ — soit environ 85 % de moins en entrée et 92,5 % de moins en sortie, un écart considérable. Mais V4-Pro n'est pas uniformément moins cher : SiliconFlow le facture environ 2 ¥/8 ¥, contre un tarif officiel hors cache d'environ 3 ¥/6 ¥ — environ 33 % de moins en entrée, mais environ 33 % de plus en sortie. C'est un contre-exemple qu'il faut signaler honnêtement : l'hébergement tiers de modèles à poids ouverts ne garantit pas que chaque modèle, sur chaque dimension de facturation, soit moins cher que l'officiel — il faut faire le calcul selon son propre ratio de tokens entrée/sortie, et ne pas se fier à l'impression générale que « l'hébergement de modèles ouverts est forcément moins cher ».
EasyRouter (soutenu par Fu Sheng, PDG de Cheetah Mobile) facture l'ensemble de sa gamme à 85 % du tarif officiel, mais DeepSeek V4 Pro descend spécifiquement jusqu'à 25 % du tarif officiel — la remise la plus importante et la mieux étayée en crédibilité (pas un petit site anonyme) que nous ayons trouvée pour un modèle DeepSeek en particulier. Par ailleurs, la plateforme comparative tierce cctest.ai affiche en temps réel plusieurs relais plus modestes, avec peu d'avis, proposant des tarifs DeepSeek encore plus bas, généralement 70 à 93 % en dessous de l'officiel. Ces chiffres méritent une vraie prudence : le cadre habituel du secteur, fondé sur un « multiplicateur », veut que les relais achetant légitimement du quota officiel en gros et le revendant se situent typiquement entre 0,8x et 1,5x le tarif officiel ; des multiplicateurs aussi bas que 0,05x-0,3x (5 % à 30 % de l'officiel) trahissent en général des clés partagées, un accès par rétro-ingénierie ou des comptes de marché gris — un tel écart de prix ne vient probablement pas d'une remise d'achat en gros ordinaire. Nous ne cautionnons pas ces offres ici ; nous rapportons les données comparatives ainsi que le risque associé.
6.2 Mécanisme deux : l'arbitrage de change/quota — sans lien avec la tarification propre de DeepSeek, une astuce générique
Notre propre test de TokenRiver donne un exemple concret : la plateforme règle au taux « 1 ¥ = 1 $ », alors que le taux de change réel du marché est d'environ 7,2 ¥/$ — ce qui, une fois converti, donne environ 86 % « d'économies » sur DeepSeek V4 Flash selon ce calcul. Mais il faut le dire clairement : cette « économie » n'a rien à voir avec la mécanique tarifaire propre à DeepSeek — le même chiffre de 86 % s'applique tout autant à Claude Opus 5 ou GPT-5.6 sur la même plateforme, car il s'agit simplement de l'arithmétique « prix en $/M × 1 ¥=1 $ ». C'est un tour de passe-passe comptable d'arbitrage de change générique, applicable à n'importe quel modèle facturé en dollars, qui revient en réalité à dire « votre recharge achète davantage de crédit en dollars nominaux au taux de conversion officiel », et non « ce modèle précis est vraiment moins cher sur ce relais précis ». Plusieurs autres relais déjà testés sur ce site, avec des taux de change autour de 1-2,5 ¥/USD, sont d'autres exemples du même mécanisme.
6.3 Ce que dit DeepSeek lui-même : les relais qui revendent du quota officiel appliquent généralement une majoration, pas une remise
Notre propre fiche de test DeepSeek sur ce site contient une phrase qui mérite d'être citée directement : « De nombreux relais prennent en charge les modèles DeepSeek… tarification transparente : le prix officiel sert de base, et les relais y ajoutent une marge. » Cela correspond exactement aux deux mécanismes ci-dessus : les relais qui battent réellement le prix officiel sont presque toujours ceux qui auto-hébergent les poids ouverts (mécanisme un) ; les relais qui se contentent d'« acheter du quota de compte DeepSeek officiel en gros et de le revendre » sont, selon nos propres tests publiés sur ce site, décrits comme majorant les prix, pas comme les remisant. Même entreprise, deux chemins : auto-héberger permet de vraiment économiser ; revendre du quota officiel signifie généralement, de l'aveu même de nos testeurs, payer plus cher — ce contraste est le message le plus honnête que nous puissions livrer ici.
« Achat en gros pour verrouiller le tarif avant la hausse » : aucun cas concret trouvé cette fois-ci
Nous avons spécifiquement vérifié si des relais proposaient un mécanisme d'achat en gros de quota officiel permettant de verrouiller le tarif avant l'entrée en vigueur d'une hausse, et nous n'avons trouvé aucun cas concret et citable d'un relais prouvant l'existence d'un tel mécanisme — ce que renvoient les moteurs de recherche ressemble davantage à une spéculation de bon sens qu'à une conclusion étayée par une source réelle. Pour être clair : ne pas trouver de preuve ne signifie pas que ce mécanisme n'existe certainement pas, seulement que nous n'avons trouvé aucune information publique fiable à l'appui. Ce n'est pas la même chose que la remise classique d'achat en gros (acheter plus, payer moins par unité), qui est une logique d'approvisionnement standard et ancienne — « accumuler l'ancien tarif juste avant une hausse » est une opération d'arbitrage ponctuelle, dans une fenêtre extrêmement courte, et il convient de noter que, DeepSeek n'ayant même pas encore publié de date d'entrée en vigueur pour cette hausse, « accumuler l'ancien tarif » n'a aujourd'hui aucune fenêtre concrète pour s'exercer — sans date d'entrée en vigueur, il n'y a pas de moment « juste avant l'échéance » à exploiter.
7. Que faire concrètement maintenant, si vous hésitez encore
En mettant tout cela bout à bout, le conseil honnête aujourd'hui est le suivant : ne paniquez pas pour un chiffre qui n'a pas encore été publié, et ne comptez pas sur l'idée générale que « les relais sont moins chers » pour économiser automatiquement. Ce qui mérite vraiment d'être fait dès maintenant, c'est de mettre en œuvre en premier lieu les techniques d'économie de tokens évoquées plus haut — optimisation du cache hit, routage des tâches par niveau, découplage via une couche d'abstraction — puisqu'elles sont rentables, hausse ou pas. Dans le même temps, isolez les dépenses DeepSeek sur une ligne distincte de votre tableau de bord de coûts, afin de pouvoir calculer immédiatement l'impact réel dès qu'un chiffre officiel sera publié, plutôt que de fouiller vos factures dans la précipitation après coup.
Mis bout à bout, cela signifie
La hausse de prix de DeepSeek en est toujours au stade « confirmée, montant inconnu ». Au moment de cette publication, toute affirmation avançant un pourcentage précis manque de source officielle et doit être considérée avec prudence.
- Développeurs qui continuent d'utiliser l'API officielle de DeepSeek à court terme → privilégiez l'optimisation du taux de cache hit et le routage des tâches par niveau, deux leviers rentables hausse ou pas, et évitez de signer un contrat à tarif verrouillé sur le long terme pendant cette période.
- Développeurs envisageant un fournisseur relais → déterminez d'abord s'il auto-héberge des poids ouverts ou revend du quota officiel. Le premier cas (comme SiliconFlow ou EasyRouter ci-dessus) offre des remises réelles sur certains modèles et certaines dimensions de facturation ; le second est, de l'aveu même de nos propres tests, généralement une majoration plutôt qu'une remise ; les « économies » d'arbitrage de change n'ont aucun rapport avec le fait que DeepSeek augmente ou non ses propres prix.
- Équipes à fort volume disposant de réelles capacités d'infrastructure → il vaut la peine d'évaluer sérieusement l'auto-hébergement du modèle à poids ouverts, transformant une dépense au token en une dépense à l'heure de GPU, mais seulement après avoir cartographié précisément son propre profil réel de consommation de tokens.
- Tout le monde → considérez cet article comme un instantané de la situation autour du 7 août 2026. Dès que DeepSeek publiera des chiffres réels et une date d'entrée en vigueur, consultez directement la page tarifaire officielle — nous publierons un article de bilan dédié une fois les chiffres réels connus.