S'il ne fallait retenir qu'un chiffre de cet article, ce serait « 0,022 à 0,60 » — l'écart, en dollars par seconde, entre le palier le moins cher que nous avons trouvé (Seedance 2.0 Fast, via des sources tierces) et le plus cher (Veo 3.1 Standard en 4K, directement issu de la grille tarifaire de Google) : près de 30 fois. Et cela sans compter les plus de 20 % qu'on peut gagner ou perdre rien qu'en choisissant le mauvais relais pour exactement le même modèle. La tarification de la génération vidéo est un problème nettement plus complexe que celle des modèles de texte — facturation à la seconde, au token, au crédit et au clip coexistent chez ces quatre éditeurs, et « combien ça coûte réellement par seconde » est une question qu'il faut travailler pour résoudre plutôt qu'un chiffre unique à lire directement.
Cet article couvre quatre des modèles de génération vidéo les plus suivis du moment : Seedance 2.0 et 2.5 de ByteDance, Kling 3.0 de Kuaishou, Veo 3.1 de Google, et Tongyi Wanxiang (Wan) 2.7 d'Alibaba. Notre méthode comporte deux niveaux : d'abord, extraire les tarifs bruts que la documentation ou la page tarifaire de chaque éditeur publie réellement ; ensuite, recouper les prix réellement affichés par plusieurs plateformes relais et agrégateurs tiers — dont plusieurs déjà testées en profondeur par eggstriker, comme Atlas Cloud, Krea, Getimg.ai, WaveSpeedAI et la plateforme développeur officielle de Kling. Chaque fois qu'un chiffre n'est publié nulle part officiellement et n'existe que sous forme d'estimation tierce, nous le disons clairement plutôt que de lisser le tableau pour qu'il paraisse plus net que la réalité sous-jacente.
Sommaire
- 1. Vue d'ensemble : les tarifs des quatre modèles, côte à côte
- 2. Seedance de ByteDance — les deux paliers de 2.0, et le tarif de 2.5 tombé aujourd'hui
- 3. Kling 3.0 de Kuaishou — un tarif officiel en crédits, pas en dollars
- 4. Veo 3.1 de Google — la grille la plus transparente, et la plus chère
- 5. Wan 2.7 d'Alibaba — la seule option à poids ouverts, hébergeable soi-même
- 6. Choisir sur la qualité : scores Elo, 4K, durée et synchronisation labiale
- 7. Deux voies d'accès : API directes des éditeurs vs relais agrégateurs
- 8. Même modèle, plateforme différente : ce que coûte réellement Seedance 2.0 en 720p
- 9. Quels fournisseurs testés par eggstriker vendent réellement ces quatre modèles
- 10. Ce qui compte le plus pour les lecteurs de Chine continentale : qui est accessible directement
- 11. Choisir selon son cas d'usage : cinq profils de lecteurs
- 12. Une note sur la fraîcheur de ces données
- 13. Conclusion
1. Vue d'ensemble : les tarifs des quatre modèles, côte à côte
Voici les chiffres essentiels. Dans la colonne « Tarif officiel », nous avons cité la grille tarifaire propre à l'éditeur partout où nous avons pu en trouver une ; là où ce n'était pas possible, nous le précisons plutôt que de forcer un chiffre qui n'existe pas vraiment. La colonne « Prix de référence relais/tiers » reflète des chiffres retrouvés de façon cohérente sur plusieurs sources indépendantes — utile pour comprendre l'ordre de grandeur, mais ne remplace pas la vérification d'un devis en temps réel avant de s'engager.
| Modèle | Éditeur | Tarif officiel | Prix de référence relais/tiers | Différenciateur clé |
|---|---|---|---|---|
| Seedance 2.0 | ByteDance | Tarifs exacts à consulter dans la console Volcano Engine Ark ; sources tierces : palier Fast autour de 0,022 $/s, Mini autour de 0,056 $/s (720p), Standard autour de 0,112 $/s, 4K jusqu'à environ 0,353 $/s | Atlas Cloud 0,1486 $/s, WaveSpeed 0,15 $/s, OpenRouter 0,1512 $/s, fal.ai 0,1814 $/s (tous en 720p avec entrée vidéo) ; Krea dès 0,0849 $/s | Lancé le 12 février 2026. 4K natif, génération audio-vidéo unifiée. Score de 1 225 Elo sur le classement texte-vers-vidéo d'Artificial Analysis (en tête au lancement, 3ᵉ aujourd'hui) |
| Seedance 2.5 | ByteDance | Facturation au token, via Volcano Engine / BytePlus ModelArk : 70 ¥/M tokens (sans entrée vidéo), 42 ¥/M tokens (avec entrée vidéo) ; exemples officiels : environ 3,36 ¥ pour un clip 480p de 5 s, environ 7,56 ¥ pour du 720p de 5 s | Aucune référence relais confirmée à la publication (la page du modèle sur Replicate affiche « bientôt disponible ») | Lancé le 31 juillet 2026 ; tarif API publié le 7 août 2026 — le jour même de la rédaction. Les plans uniques durent désormais 30 secondes (le double de 2.0), jusqu'à 50 entrées de référence, pas encore de score Elo tiers indépendant |
| Kling 3.0 | Kuaishou | Système de crédits : 6 crédits/s (sans audio, 720p), 8 crédits/s (sans audio, 1080p), 9 crédits/s (audio natif, 720p), 12 crédits/s (audio natif, 1080p), plus un supplément de 2 crédits/s pour le contrôle vocal. Rapporté au pack d'entrée à 5 $ pour 330 crédits, cela donne environ 0,09-0,18 $/s | Krea dès 0,05 $/s ; d'autres revendeurs comme EvoLink dès 0,075 $/s (Kling 3.0), 0,1111 $/s (Kling O1) | Guide API officiel publié le 6 février 2026. Occupe 4 des 10 premières places du classement d'Artificial Analysis. Un plan unique de 15 secondes peut atteindre 4K/60fps en une seule passe |
| Veo 3.1 | Lite : 720p 0,05 $/s, 1080p 0,08 $/s (pas de 4K) ; Fast : 720p 0,10 $/s, 1080p 0,12 $/s, 4K 0,30 $/s ; Standard : 720p/1080p 0,40 $/s à plat, 4K 0,60 $/s (tous ces tarifs incluent l'audio ; facturation uniquement en cas de génération réussie) | Les prix des relais tiers suivent globalement le tarif officiel ou sont légèrement supérieurs (logique de revente des modèles fermés, voir section 7) | Le seul des quatre dont la grille tarifaire est lisible directement dans la documentation officielle. Largement considéré comme le meilleur pour le détail en gros plan, la synchronisation audio-vidéo des dialogues et le respect des prompts — mais nettement plus cher que les trois autres à palier équivalent | |
| Wan 2.7 | Alibaba/Tongyi | Tarif officiel DashScope/Model Studio à consulter dans la console, modèle par modèle — non listé sur les pages de documentation publiques ; poids image et vidéo publiés sous licence Apache 2.0 (principalement via ModelScope, GitHub en canal secondaire) | OpenRouter 0,10 $/s ; Atlas Cloud dès 0,10 $/s ; EvoLink : 0,086 $/s en 720p, 0,144 $/s en 1080p ; la génération précédente, Wan-2.2 Turbo Spicy, descend jusqu'à 0,026 $/s sur Atlas Cloud — le tarif à la seconde le plus bas trouvé dans tout ce comparatif | Lancé le 3 avril 2026. « Thinking Mode » unique qui planifie la composition et la disposition spatiale avant de générer, clips de 15 secondes, jusqu'à 5 images de référence pour la cohérence multi-personnages, et le seul des quatre à poids ouverts, hébergeable soi-même |
Une précision qui mérite d'être signalée en dehors du tableau : le tarif officiel de Seedance 2.5 est tombé le jour même de la rédaction de cet article, donc les plateformes relais n'ont presque certainement pas encore eu le temps de l'intégrer ni de fixer leur propre marge. Nous avons vérifié directement la page du modèle sur Replicate, qui affiche actuellement « bientôt disponible » — si vous voulez accéder à 2.5 via un relais dès maintenant, vous attendez probablement encore. Plus de détails en section 9.
2. Seedance de ByteDance — les deux paliers de 2.0, et le tarif de 2.5 tombé aujourd'hui
Seedance 2.0 est disponible depuis près de six mois maintenant (lancé le 12 février 2026), vendu via Volcano Engine Ark et facturé selon quatre axes : résolution (480p/720p/1080p/4K), durée (4-15 secondes), mode de génération (Standard/Fast/Mini), et présence ou non d'entrées audio/vidéo de référence. Les compilations tierces situent le palier Fast le moins cher autour de 0,022 $/s, et le palier 4K le plus cher autour de 0,353 $/s — un écart de 16 fois au sein du même modèle, ce qui rappelle bien que « combien coûte Seedance par seconde » n'a pas de réponse unique tant qu'on n'a pas précisé le palier et la résolution.
La vraie nouveauté, c'est Seedance 2.5 : lancé officiellement le 31 juillet 2026 (eggstriker propose déjà un test approfondi détaillant ses évolutions — les plans uniques passant de 15 à 30 secondes, les entrées de référence passant d'environ 15 à 50), mais à l'époque, le tarif de l'API destinée aux développeurs était totalement vide, avec pour seule information « bientôt disponible via BytePlus ModelArk ». Ce vide s'est comblé le 7 août 2026 — le jour de cette publication — lorsque Volcano Engine a communiqué un tarif basé sur les tokens plutôt qu'un taux direct à la seconde : 70 ¥ par million de tokens sans entrée vidéo, 42 ¥ par million avec entrée vidéo, avec des exemples officiels d'environ 3,36 ¥ pour un clip 480p de 5 secondes et 7,56 ¥ pour du 720p de 5 secondes. Converti en un chiffre approximatif à la seconde, cela donne environ 0,10 $/s en 480p et 0,23 $/s en 720p — soit 40 à 50 % de plus que le palier Standard officiel de Seedance 2.0 à résolution équivalente, ce qui correspond raisonnablement à un modèle vidéo qui vient de doubler la durée de ses plans et plus que tripler son plafond d'entrées de référence.
À quel point ces chiffres sont-ils récents : à considérer comme un instantané du jour de publication
Le tarif de Seedance 2.5 est arrivé en pleine rédaction de cet article — la fin d'un véritable vide d'information, presque exactement au moment de notre vérification. Les plateformes relais mettent généralement de quelques jours à quelques semaines pour intégrer un modèle, le tester et fixer leur propre marge, et au moment de notre vérification, la page du modèle Seedance 2.5 sur Replicate affichait encore « bientôt disponible », sans prix en ligne. Si vous lisez ceci quelque temps après la publication, consultez directement la page tarifaire officielle de Volcano Engine / BytePlus ModelArk — les prix des relais auront probablement rattrapé leur retard d'ici là, mais ce n'était pas encore le cas au moment de la rédaction.
Côté qualité, Seedance 2.0 a brièvement mené le classement Elo texte-vers-vidéo d'Artificial Analysis à son lancement et occupe actuellement la 3ᵉ place avec un score de 1 225, dépassé par MiniMax H3 (1 242), lancé le même jour que 2.5. Il reste considéré comme un modèle de premier plan pour la cohérence multi-plans, le contrôle de la caméra et la simulation physique. Seedance 2.5 n'a pas encore de benchmark tiers indépendant à la publication de cet article — les évolutions fonctionnelles annoncées sur le blog officiel de ByteDance sont des caractéristiques produit réelles, mais l'ampleur exacte de l'amélioration par rapport à 2.0 reste pour l'instant autodéclarée, un point que nous avons déjà approfondi dans notre test dédié à Seedance 2.5.
3. Kling 3.0 de Kuaishou — un tarif officiel en crédits, pas en dollars
Kling affiche l'une des cadences de sortie les plus rapides du secteur de la génération vidéo, de v1 jusqu'à v2.5 puis une version O1 dotée de capacités de raisonnement. Un détail mérite d'être signalé : le test officiel d'eggstriker sur la plateforme développeur Kling AI (klingai.com), vérifié pour la dernière fois le 6 août 2026, liste la gamme de produits de v1 à v2.5 plus O1 — sans jamais mentionner de version « 3.0 ». Or, plusieurs outils de suivi tarifaire tiers vérifiés cette fois-ci, ainsi que nos propres tests de Krea et Atlas Cloud, utilisent systématiquement « Kling 3.0 » ou « Kling V3.0 », et un guide API d'apparence officielle est daté du 6 février 2026. Nous n'avons pas trouvé d'explication officielle claire réconciliant ces deux conventions de nommage. Cet article présente les tarifs sous le libellé « Kling 3.0 », largement utilisé, mais si vous consultez directement le site officiel, le nom de version que vous verrez pourrait ne pas correspondre exactement — vérifiez l'identifiant exact du modèle sur klingai.com/dev avant de construire quoi que ce soit dessus.
Le tarif officiel repose sur un système de crédits plutôt qu'un taux direct en dollars par seconde : 6 crédits/s pour du 720p sans audio, 8 crédits/s pour du 1080p sans audio, 9 crédits/s pour de l'audio natif en 720p, 12 crédits/s pour de l'audio natif en 1080p, plus un supplément de 2 crédits/s pour le contrôle vocal. Rapporté au pack d'entrée à 5 $ pour 330 crédits, cela donne environ 0,09-0,18 $/s selon la résolution et la présence d'audio. Ce chiffre correspond bien à une autre synthèse tierce situant le tarif officiel à « 0,084-0,168 $/s (mode Standard à Pro) » — les deux chiffres se recoupent proprement.
À noter : la page tarifaire officielle de Kling est nettement plus difficile à trouver que la moyenne — le tableau complet des tarifs se trouve derrière une connexion à la console développeur, et la majorité de ce qui est trouvable publiquement provient d'agrégations tierces plutôt que d'une page officielle directement consultable, ce qui explique pourquoi nous n'avons pas attribué à Kling le label « le plus transparent » (réservé à Veo 3.1 dans la section suivante). Côté relais, Krea affiche Kling 3.0 dès 0,05 $/s, en dessous même du palier d'entrée officiel, et d'autres revendeurs comme EvoLink affichent environ 0,075 $/s. Ce schéma « l'officiel coûte plus cher que le tiers » rappelle ce que nous avons déjà observé avec des modèles de texte à poids ouverts comme GLM-5.2, mais le mécanisme est différent ici : Kling est un modèle fermé, donc un prix tiers plus bas provient plus probablement de remises sur achats groupés ou de la façon dont les packs de crédits sont découpés en interne, et non d'une véritable concurrence sur le calcul comme c'est le cas avec les poids ouverts.
Côté qualité, Kling 3.0 occupe quatre des dix premières places du classement texte-vers-vidéo d'Artificial Analysis (selon différentes résolutions/modes) — la meilleure visibilité de classement des quatre modèles couverts ici. Ses différenciateurs officiellement revendiqués sont d'atteindre le 4K/60fps en un seul plan de 15 secondes, et une synchronisation labiale fine sur plusieurs personnages dans une même scène — deux points bien confirmés par les retours des communautés de créateurs chinois.
4. Veo 3.1 de Google — la grille la plus transparente, et la plus chère
Comparé aux deux précédents, Veo 3.1 est le seul modèle de ce comparatif où l'on peut ouvrir la documentation officielle et lire un tableau tarifaire complet sans avoir à décoder un système de crédits ou une conversion en tokens : la page tarifaire de l'API Gemini de Google liste directement trois paliers et six chiffres concrets — Lite à 0,05 $/s (720p) et 0,08 $/s (1080p, pas de 4K) ; Fast à 0,10 $/s (720p), 0,12 $/s (1080p) et 0,30 $/s (4K) ; Standard à un tarif fixe de 0,40 $/s pour le 720p comme le 1080p, et 0,60 $/s en 4K. Tous ces chiffres incluent déjà la génération audio, et Google précise explicitement que la facturation n'intervient qu'en cas de génération réussie — une étape de traitement audio en échec, par exemple, n'est pas facturée.
La structure tarifaire elle-même envoie un signal clair : Google a séparé « avez-vous besoin d'une qualité de premier plan » et « avez-vous besoin d'un délai plus rapide » en deux axes distincts. Lite vise les cas d'usage sensibles au budget, Fast est le point d'équilibre pour la plupart des productions, et Standard cible les flux professionnels où la qualité prime sur le budget. Comparé aux trois autres, Veo 3.1 Standard en 4K (0,60 $/s) est le tarif officiel le plus élevé que nous ayons trouvé dans tout ce comparatif — environ 70 % de plus que le palier Standard de Seedance 2.0, et deux à trois fois le tarif d'entrée officiel de Kling 3.0. Mais si l'on ne regarde que Lite (0,05 $/s en 720p), le prix se situe en réalité dans la fourchette basse parmi les quatre — l'impression que « Veo est cher » concerne surtout le palier Standard/4K spécifiquement, et bien choisir son palier fait une vraie différence.
Côté qualité, plusieurs tests tiers décrivent systématiquement Veo 3.1 comme le généraliste le plus équilibré — l'audio natif, la synchronisation labiale des dialogues et le respect des prompts sont largement considérés comme les plus solides de sa catégorie, et son utilisabilité pour les développeurs ainsi que sa documentation sont les plus abouties des quatre, un point également recoupé dans notre précédent test de Seedance 2.5. Pour les scénarios nécessitant une synchronisation audio-vidéo précise des dialogues dès la première génération — pensez aux courts-métrages portés par des personnages ou aux prévisualisations de scripts publicitaires — Veo 3.1 reste actuellement le choix le plus sûr, même au prix fort.
5. Wan 2.7 d'Alibaba — la seule option à poids ouverts, hébergeable soi-même
Tongyi Wanxiang (Wan) 2.7 d'Alibaba a été lancé le 3 avril 2026, et il se positionne différemment des trois autres : la documentation publique DashScope/Model Studio se contente de noter que « la résolution affecte le coût » et que « la facturation est à la seconde — vérifiez le tarif du modèle avant l'appel », sans lister de grille tarifaire réelle comme le fait Veo. Il faut se connecter à la console, modèle par modèle, pour voir un chiffre — une friction similaire à celle du tarif officiel de Kling.
Mais Wan 2.7 possède une caractéristique qu'aucun des trois autres ne partage : ses poids image et vidéo sont publiés sous licence Apache 2.0, distribués principalement via ModelScope, la propre plateforme d'Alibaba, avec GitHub comme canal secondaire (certains sites tiers notent que l'organisation officielle sur Hugging Face n'héberge encore que les poids de la génération précédente 2.1/2.2, donc si vous comptez récupérer les poids depuis Hugging Face spécifiquement, vérifiez d'abord le numéro de version). Cela signifie que les équipes disposant d'un accès GPU peuvent, en théorie, contourner entièrement toute couche API et relais et s'auto-héberger — les évaluations tierces situent le seuil pratique autour de 16 Go de VRAM, idéalement 24 Go, une barre nettement plus basse que la plupart des modèles de texte auto-hébergés.
Les poids étant ouverts, la concurrence sur l'hébergement tiers est plus réelle pour Wan que pour les trois autres : OpenRouter affiche 0,10 $/s, Atlas Cloud démarre également à 0,10 $/s, et EvoLink liste 0,086 $/s en 720p et 0,144 $/s en 1080p ; la génération précédente, Wan-2.2 Turbo Spicy, descend jusqu'à 0,026 $/s sur Atlas Cloud — le prix à la seconde le plus bas que nous ayons trouvé parmi toutes les familles de modèles de ce comparatif, juste au-dessus des 0,022 $/s de Seedance 2.0 Fast et bien en dessous du tarif officiel d'entrée de gamme des trois autres. Cela reflète un schéma que nous avons déjà vérifié à plusieurs reprises avec des modèles de texte à poids ouverts (DeepSeek, GLM, Kimi) : les poids ouverts permettent aux fournisseurs d'inférence tiers de se concurrencer sur le prix, et la grille tarifaire officielle n'est fréquemment pas la plus basse du marché.
Sur le plan des capacités, la caractéristique la plus distinctive de Wan 2.7 est le « Thinking Mode » — avant de générer les images proprement dites, le modèle planifie d'abord la composition, le découpage des plans de caméra et la disposition spatiale, dans le but d'améliorer la cohérence des scènes complexes avec plusieurs personnages ou des mouvements de caméra élaborés. C'est le seul des quatre à revendiquer explicitement une étape de planification distincte avant la génération. Il prend également en charge des clips jusqu'à 15 secondes, jusqu'à 5 images de référence pour la cohérence multi-personnages, et le contrôle des images de début et de fin — un ensemble de fonctionnalités visant un objectif similaire à « l'extension multi-tours plus 50 entrées de référence » de Seedance 2.5, mais Wan fait du processus de génération lui-même une étape intermédiaire explicable, plutôt que de simplement fournir davantage de matériel de référence.
6. Choisir sur la qualité : scores Elo, 4K, durée et synchronisation labiale
En alignant les différenciateurs des quatre éditeurs, il apparaît clairement que chacun mise sur une sous-dimension différente plutôt que de se concurrencer frontalement sur le même terrain :
- Seedance 2.0/2.5 : cohérence multi-plans, simulation physique, 4K natif plus génération audio-vidéo unifiée, 2.5 misant davantage sur des plans uniques de 30 secondes et l'extension multi-tours — idéal pour les contenus nécessitant une cohérence narrative sur la durée.
- Kling 3.0 : la meilleure visibilité de classement sur Artificial Analysis (4 des 10 premières places), des plans uniques de 15 secondes pouvant atteindre directement le 4K/60fps, et une synchronisation labiale multi-personnages remarquable — le meilleur historique dans les communautés de créateurs chinois.
- Veo 3.1 : largement considéré comme le plus solide pour la synchronisation audio-vidéo des dialogues, le respect des prompts et l'utilisabilité pour les développeurs — le premier choix quand la précision dès la première tentative compte, au prix du tarif officiel le plus élevé.
- Wan 2.7 : l'explicabilité du Thinking Mode combinée à la flexibilité tarifaire propre aux poids ouverts en font le modèle offrant le plus de leviers d'économies parmi les quatre, même s'il dispose actuellement d'une visibilité moindre sur les benchmarks indépendants que les trois autres.
Une précision qui mérite d'être formulée honnêtement : les scores Elo précis varient sensiblement d'un site de suivi tiers à l'autre (par exemple, les scores de Kling sur certains sites ne correspondent pas aux chiffres d'Artificial Analysis que nous avons recoupés directement). Cet article ne cite que des affirmations corroborées par plusieurs sources indépendantes (comme « Kling 3.0 occupe quatre des dix premières places du classement » ou « Seedance 2.0 se classe 3ᵉ avec 1 225 Elo »). Lorsqu'un chiffre précis d'une source unique n'a pas pu être recoupé, nous avons choisi de ne pas le citer plutôt que de retenir celui qui semblait le plus flatteur.
7. Deux voies d'accès : API directes des éditeurs vs relais agrégateurs
Pour les développeurs, il existe fondamentalement deux chemins vers ces quatre modèles.
Voie 1 : les API directes des éditeurs. ByteDance passe par Volcano Engine Ark/BytePlus ModelArk, Kuaishou par la plateforme développeur Kling AI (klingai.com/dev), Google par l'API Gemini/Vertex AI, et Alibaba par DashScope/Model Studio. Cette voie offre généralement le tarif brut le plus bas (pas de marge de relais) et est la seule qui garantit un accès en priorité aux modèles les plus récents dès leur lancement — comme le tarif de Seedance 2.5 aujourd'hui. La contrepartie est d'intégrer séparément quatre protocoles API, schémas d'authentification et logiques de facturation complètement différents, avec une facturation éparpillée entre quatre consoles distinctes.
Voie 2 : un agrégateur/relais unifiant plusieurs modèles sous un seul compte. fal.ai, Replicate, OpenRouter, et des fournisseurs déjà testés par eggstriker — Atlas Cloud, Krea, Getimg.ai, WaveSpeedAI, entre autres — proposent tous un compte et un protocole API uniques couvrant simultanément deux ou trois de ces quatre modèles (très peu de plateformes couvrent les quatre ; voir la section suivante pour le détail). L'intérêt ici est d'éviter le travail d'intégration répété et de pouvoir comparer les résultats des modèles côte à côte dans le même environnement de test, mais cela coûte généralement un peu plus cher que le tarif direct de l'éditeur (logique classique de revente de modèle fermé), et les nouveaux modèles comme Seedance 2.5 apparaissent toujours avec un décalage — de quelques jours à quelques semaines — avant qu'un relais ne les liste.
8. Même modèle, plateforme différente : ce que coûte réellement Seedance 2.0 en 720p
La voie 2 comporte une réelle concurrence tarifaire intégrée. Prenons Seedance 2.0 en 720p avec entrée vidéo comme exemple — les devis que nous avons recoupés donnent Atlas Cloud à 0,1486 $/s, WaveSpeed à 0,15 $/s, OpenRouter à 0,1512 $/s et fal.ai à 0,1814 $/s — un écart d'environ 22 % entre le moins cher et le plus cher. Ces chiffres proviennent en grande partie du propre article comparatif du blog d'Atlas Cloud, et en tant que fournisseur se comparant favorablement à ses concurrents, ce type de contenu comparatif publié par l'entreprise elle-même comporte naturellement un certain biais promotionnel. Nous le présentons ici comme un ordre de grandeur, pas comme une recommandation d'une plateforme en particulier — vérifiez le devis réel et actuel de chaque plateforme avant de vous engager.
La leçon est simple : même pour exactement le même modèle et la même configuration, un écart de prix d'environ 20 % entre relais est bien réel. Pour une production à grand volume (par exemple, une équipe de contenu consommant des centaines de milliers de secondes de vidéo par mois), cet écart représente une somme non négligeable, et il vaut la peine de comparer plusieurs plateformes avant de s'engager dans une intégration en production.
9. Quels fournisseurs testés par eggstriker vendent réellement ces quatre modèles
C'est la question qui intéresse le plus les lecteurs d'eggstriker : parmi la douzaine de fournisseurs multimodaux déjà testés sur ce site, qui vend réellement Seedance, Kling, Veo et Wan ? Nous avons vérifié directement le catalogue de modèles de chaque fournisseur, et voici ce que nous avons trouvé :
| Fournisseur | Seedance | Kling | Veo | Wan | Remarque |
|---|---|---|---|---|---|
| Getimg.ai | ✓ | ✓ | ✓ | ✓ | La couverture la plus complète des quatre modèles ciblés parmi les fournisseurs vérifiés — les quatre figurent dans ses « 9 modèles vidéo ». L'accès API et l'abonnement web sont deux systèmes distincts nécessitant une inscription séparée |
| Atlas Cloud | ✓ | ✓ (V3.0) | ✗ | ✓ (2.7) | Couverture vidéo spécialisée approfondie, mais Veo n'apparaît pas dans son catalogue listé ; tarification de niveau entreprise |
| Krea AI | ✓ | ✓ (3.0) | ✓ (3.1) | ✗ | Double approche : ses propres modèles d'image Krea 2 plus une agrégation tierce ; Wan n'apparaît pas dans son catalogue listé |
| WaveSpeedAI | ✓ | ✓ | Non explicitement listé | ✓ | La vitesse est l'argument central — revendique un rendu vidéo jusqu'à 4 fois plus rapide que des plateformes comparables |
| Kling AI (officiel) | ✗ | Accès officiel direct (gamme nommée v1-v2.5 + O1 ; aucun libellé « 3.0 » observé) | ✗ | ✗ | Connexion officielle directe, facturée en RMB — la seule option ici sans proxy |
| Replicate | La page affiche « bientôt disponible » | Disponible dans certaines régions | Non trouvé | Non trouvé | Principalement un agrégateur de modèles ouverts ; les variantes Wan apparaissent surtout sous des identifiants tiers hébergés comme « wavespeedai/wan-2.1 » |
| Vidu / PixVerse / MiniMax | ✗ | ✗ | ✗ | ✗ | Ces trois-là sont eux-mêmes des modèles vidéo maison concurrents de Seedance/Kling/Veo/Wan, pas des revendeurs — hors du périmètre de « qui vend ces quatre modèles » |
| AZAPI / Shenma Relay / UniAPI | ✗ | ✓ | ✗ | ✗ | Relais multimodaux généralistes où Kling n'est qu'une ligne dans un catalogue créatif plus large — aucun des trois autres n'apparaît |
Quelques points méritent d'être soulignés. Premièrement, Getimg.ai est le seul fournisseur vérifié dont le catalogue couvre les quatre modèles ciblés à la fois, mais son accès API et son abonnement web sont deux systèmes distincts — avant d'intégrer, vérifiez que vous obtenez bien une clé API capable d'appeler ces quatre modèles vidéo, et non un simple crédit d'abonnement web. Deuxièmement, la gamme vidéo d'Atlas Cloud inclut explicitement Seedance 2.0, Kling V3.0 et Wan 2.7, mais Veo n'apparaît nulle part dans son catalogue — si Veo 3.1 est une exigence incontournable pour vous, Atlas Cloud n'est actuellement pas une option unique complète. Troisièmement, la plateforme développeur Kling AI est la seule option véritablement « officielle directe » de cette liste — facturation en RMB, aucun proxy nécessaire — mais comme son nom l'indique, elle ne vend que son propre modèle, pas un accès revendu à Seedance, Veo ou Wan. Quatrièmement, à la publication de cet article, Seedance 2.5 n'a été confirmé actif sur aucune plateforme relais vérifiée — la page du modèle sur Replicate affiche directement « bientôt disponible » — ce qui est le revers de la même situation signalée en section 2 : le tarif vient de tomber, et les relais n'ont pas encore rattrapé leur retard.
10. Ce qui compte le plus pour les lecteurs de Chine continentale : qui est accessible directement
Il existe une répartition facile à négliger parmi ces quatre modèles : Seedance (ByteDance), Kling (Kuaishou) et Wan (Alibaba) sont tous des produits d'entreprises chinoises continentales, et leurs canaux officiels — Volcano Engine, la plateforme développeur Kling AI, DashScope — ont été conçus nativement pour les utilisateurs de Chine continentale, facturés en RMB, sans proxy nécessaire. Veo fait exception : c'est un produit Google, et quelle que soit la voie d'accès choisie — l'API Gemini/Vertex AI de Google elle-même, ou n'importe quel agrégateur étranger — les utilisateurs de Chine continentale ne peuvent pas y accéder sans proxy ni ligne dédiée. C'est le seul modèle de ce comparatif où changer de fournisseur ne fait pas disparaître la barrière d'accès.
En pratique, cela signifie que si votre produit ou flux de travail est sensible à la fois au budget et à la friction d'accès, et que vous pouvez vous passer de Veo, vous pouvez en théorie accéder à Seedance, Kling et Wan entièrement via leurs canaux officiels respectifs sans jamais passer par un relais, au tarif officiel de premier niveau (le tarif de la console DashScope pour Wan 2.7, par exemple, devrait en théorie être inférieur à celui de tout relais tiers le revendant, puisqu'un revendeur doit toujours préserver sa propre marge). À l'inverse, si vous avez véritablement besoin de Veo 3.1 — par exemple pour sa synchronisation audio-vidéo des dialogues — la couche de coût et de risque liée au proxy/ligne dédiée ne disparaît quelle que soit la voie choisie, et à ce moment-là, la valeur d'un relais passe de « la commodité » à « la tranquillité d'esprit » : pour la plupart des équipes, payer un agrégateur qui a déjà résolu le problème d'infrastructure vers Google est plus rentable que de construire et maintenir soi-même cette chaîne de proxy.
Il y a un dernier angle à signaler pour les équipes de Chine continentale : les poids ouverts de Wan 2.7 apportent une valeur supplémentaire ici. Si vous disposez d'un accès GPU atteignant le seuil de 16-24 Go de VRAM, vous pouvez en théorie contourner entièrement toute couche API et relais et récupérer directement les poids depuis ModelScope pour un auto-hébergement — une voie qui ne touche jamais au proxy ni à la facturation transfrontalière, ce qui en fait la seule option véritablement « zéro relais » parmi les quatre, au prix d'assumer soi-même le déploiement, l'exploitation et le matériel.
11. Choisir selon son cas d'usage : cinq profils de lecteurs
En résumé
Il n'y a pas de vainqueur unique en « meilleur rapport qualité-prix » toutes catégories parmi ces quatre modèles — le bon choix dépend fortement du cas d'usage. Les équipes les plus sensibles au budget devraient regarder Seedance 2.0 Fast ou la génération précédente Wan-2.2 Turbo ; les équipes ayant besoin de la meilleure synchronisation audio-vidéo devront payer plus cher pour Veo ; et les équipes voulant un véritable auto-hébergement et une indépendance à long terme n'ont vraiment qu'une seule option : Wan 2.7.
- Budget extrêmement serré, simple validation de la qualité de sortie → Commencez par Seedance 2.0 Fast (environ 0,022 $/s selon des sources tierces) et la génération précédente Wan-2.2 Turbo Spicy (environ 0,026 $/s sur Atlas Cloud) — la fourchette la plus basse à la seconde trouvée dans ce comparatif.
- Équipes construisant des contenus narratifs longs, multi-plans → Les plans de 30 secondes et les 50 entrées de référence de Seedance 2.5 n'ont actuellement aucun rival direct, mais le tarif vient de tomber — testez avec un petit budget avant d'y engager des flux de production.
- Équipes nécessitant des scènes de dialogue avec une synchronisation audio-vidéo stricte → Veo 3.1 Fast (0,10-0,12 $/s) est le point d'équilibre entre coût et qualité ; réservez Standard en 4K aux scénarios à budget flexible où la qualité d'image est non négociable.
- Équipes techniques avec accès GPU cherchant l'indépendance à long terme → Wan 2.7 est la seule option à poids ouverts parmi les quatre, et le seuil d'auto-hébergement (16-24 Go de VRAM) n'est pas déraisonnablement élevé — à intégrer dans une comparaison de coûts à long terme.
- Équipes s'appuyant sur des relais pour un accès unique et une comparaison côte à côte → Getimg.ai offre actuellement la couverture de modèles la plus complète, bien que l'API et l'abonnement soient des systèmes distincts ; si Veo n'est pas une exigence incontournable, Atlas Cloud est plus solide sur la profondeur spécifique à la vidéo. Consultez le comparatif des relais API IA d'eggstriker pour une vue d'ensemble complète des fournisseurs.
12. Une note sur la fraîcheur de ces données
À considérer comme un instantané autour du 7 août 2026
Les tarifs et les sorties de modèles de génération vidéo évoluent plus vite que ceux des modèles de texte — le fait que le tarif de l'API de Seedance 2.5 soit passé de « totalement vide » à « officiellement publié » dans les jours qu'il nous a fallu pour rédiger cet article en est un bon exemple. Là où nous avons indiqué « non publié / nécessite une connexion console » (le tableau tarifaire officiel complet de Kling 3.0, le tarif exact par unité de Wan 2.7 sur DashScope), cela ne signifie pas que l'information est indisponible en permanence — seulement que nous ne l'avons pas trouvée directement sur une page de documentation publique au moment de la vérification, et qu'elle nécessite de se connecter à la console concernée. Plusieurs prix de référence relais/tiers proviennent de contenus de blog comparatifs publiés par les fournisseurs eux-mêmes, qui comportent naturellement un certain biais promotionnel ; nous avons recoupé avec plusieurs sources indépendantes chaque fois que possible, mais les lecteurs devraient tout de même vérifier un devis en temps réel avant de s'engager. Le libellé de version « Kling 3.0 » ne correspond pas directement au nom de produit officiel dans le propre test d'eggstriker sur klingai.com (vérifié pour la dernière fois le 2026-08-06) — une incohérence de nommage découverte lors de cette vérification et signalée honnêtement en section 3.
13. Conclusion
Après avoir passé en revue les tarifs des quatre éditeurs, une conclusion honnête s'impose : les modèles de génération vidéo n'ont pas encore convergé vers un langage tarifaire unifié comme les modèles de texte l'ont fait avec le « par million de tokens ». La facturation à la seconde, au token, au crédit et au clip coexistent toutes, et même un seul modèle se décompose en plusieurs paliers tarifaires selon la résolution, la durée et la présence ou non d'audio. Cela signifie que « quel modèle est le moins cher » n'a pas de réponse universelle unique — il faut d'abord préciser le cas d'usage exact (résolution, durée, audio ou non) avant de pouvoir vraiment comparer.
S'il fallait une orientation générale : si le budget est la priorité absolue, Seedance 2.0 Fast et la génération précédente Wan-2.2 Turbo représentent le plancher tarifaire actuel ; si la qualité est la priorité absolue, Veo 3.1 et Kling 3.0 sont chacun en tête sur des aspects différents — respectivement la synchronisation audio-vidéo et la visibilité de classement — mais tous deux impliquent une réelle prime de prix ; et si ce qui compte le plus est l'indépendance à long terme et le fait de ne pas être enfermé dans les futures hausses de prix d'une plateforme relais ou d'un éditeur, Wan 2.7 est actuellement la seule réponse permettant un véritable auto-hébergement. Et pour les lecteurs de Chine continentale spécifiquement, la règle la plus simple à retenir est peut-être celle-ci : Seedance, Kling et Wan sont tous accessibles directement via des canaux officiels continentaux, facturés en RMB — Veo est le seul des quatre réellement inaccessible sans proxy, une répartition qui mérite peut-être d'être retenue plus longtemps que n'importe quel prix à la seconde de ce comparatif.