Le 8 juillet 2026, SpaceXAI (xAI) a publié Grok 4.5, le nouveau modèle phare de nouvelle génération après Grok 4.3. C'est le premier modèle de xAI conçu spécifiquement pour la programmation et les tâches agentiques, entraîné en partie sur de vraies sessions de développeurs issues de Cursor, et tarifé à 2 $/M en entrée, 6 $/M en sortie. Moins d'une semaine après son lancement, on pouvait déjà lire en ligne qu'il s'agissait « peut-être du modèle offrant le meilleur rapport qualité-prix du marché en ce moment ». C'est une affirmation accrocheuse — et c'est justement parce qu'elle l'est qu'il vaut la peine de vérifier réellement les chiffres plutôt que de la répéter. Cet article met sur une même table la tarification réelle de 8 des modèles les plus discutés du moment, les classe par catégorie, puis répond honnêtement à la question posée dans le titre.

D'entrée de jeu, pour que vous sachiez où cela mène :

  • Parmi les modèles phares fermés/propriétaires, le rapport qualité-prix de Grok 4.5 est réellement parmi les meilleurs — moins cher que GPT-5.5, Claude Sonnet 5 et Claude Opus 4.8, avec en prime une meilleure efficacité en tokens
  • Mais ce n'est pas le seul modèle le moins cher du marché — DeepSeek-V4-Flash et Qwen3.6-35B-A3B d'Alibaba le battent tous deux de plus de 10 fois sur le prix en entrée
  • Ce n'est également pas le modèle multimodal le moins cher — les deux modèles que beaucoup considèrent comme « l'alternative moins chère », GLM-5.2 et DeepSeek-V4, ne prennent en réalité pas du tout en charge l'entrée visuelle, donc ce ne sont pas de vrais substituts ; le modèle qui rivalise réellement avec Grok 4.5 sur le rapport qualité-prix multimodal est Qwen3.6 d'Alibaba
  • La réponse honnête dépend donc de la catégorie dans laquelle on compare — ce n'est pas un simple « oui, Grok 4.5 l'emporte »

1. Ce qu'est Grok 4.5 : tarification, positionnement et données d'entraînement

Grok 4.5 est le modèle publié par SpaceXAI (xAI) le 8 juillet 2026 — la génération suivant Grok 4.3, et surtout le premier modèle de xAI conçu spécifiquement pour la programmation et les tâches agentiques, une rupture avec le positionnement généraliste « conversation et raisonnement » de ses générations précédentes. Les informations publiques indiquent que ses données d'entraînement s'appuient fortement sur de vraies sessions de développeurs issues d'outils comme Cursor — autrement dit, il a été façonné par la façon dont les gens utilisent réellement l'IA pour écrire du code, plutôt que purement à partir de dépôts de code publics et de jeux de données de programmation compétitive.

Côté tarification, Grok 4.5 se positionne à 2,00 $/M en entrée, 6,00 $/M en sortie, avec une remise de 75 % sur les hits de cache. Cela le place bien en dessous de Claude Opus 4.8 (5 $/25 $) et de Claude Fable 5 (10 $/50 $), et il est également moins cher que le palier le plus élevé de GPT-5.5 (5 $/30 $). Il prend aussi en charge l'entrée visuelle, ce qui en fait un modèle véritablement multimodal — un point qui compte beaucoup pour la suite, car plusieurs des « alternatives moins chères » auxquelles on le compare ne prennent en réalité pas du tout en charge la vision.

L'argument de vente de xAI pour Grok 4.5 n'est pas « le meilleur score de benchmark » — c'est l'efficacité en tokens : accomplir la même tâche de programmation/agentique en consommant moins de tokens de sortie, ce qui réduit le coût réel par tâche. Ce positionnement révèle quelque chose d'important — Grok 4.5 se bat sur le terrain du « coût total de la tâche », pas sur celui du « sommet du classement », ce qui explique exactement pourquoi la question posée dans le titre de cet article ne peut pas recevoir une réponse simple par oui ou par non. Il faut préciser à quoi il est comparé et selon quel axe.

Pour les utilisateurs de relais en particulier, cette approche du « coût total » est plus utile qu'un simple prix au million de tokens. Si le modèle A coûte deux fois plus cher au million de tokens mais n'a besoin que d'un quart des tokens pour terminer la même tâche, la facture réelle peut malgré tout être plus basse — c'est exactement ce que les chiffres ci-dessous vont vérifier. L'inverse est également vrai : le prix affiché le plus bas ne garantit pas automatiquement la dépense réelle la plus basse, si le modèle a besoin de plus de tentatives pour réussir la tâche du premier coup. C'est pourquoi cet article ne s'arrête pas à un simple tableau de prix — il examine ensemble la capacité, le prix et l'adéquation à l'usage.

2. Le classement : tarification réelle de 8 modèles courants

Voici la tarification officielle de 8 des modèles les plus discutés du moment réunis dans un même tableau, avec en plus le modèle le plus cher d'Anthropic, Claude Fable 5 (10 $/50 $), inclus comme « ancre haut de gamme » — il n'est explicitement pas positionné comme une option économique et ne fait pas partie du classement proprement dit, mais il est utile pour visualiser à quel point l'écart de prix est large.

ModèleDéveloppeurEntrée $/MSortie $/MMultimodal ?
Qwen3.6-35B-A3BAlibaba0,14 $0,90 $✅ Oui (vision + programmation agentique)
DeepSeek-V4-FlashDeepSeek0,14 $0,28 $❌ Texte uniquement
DeepSeek-V4-ProDeepSeek0,435 $0,87 $❌ Texte uniquement
GLM-5.2Zhipu / Z.ai1,40 $4,40 $❌ Texte uniquement
Grok 4.5SpaceXAI / xAI2,00 $6,00 $✅ Oui (entrée visuelle)
GPT-5.5OpenAI1–5 $ (par palier)6–30 $ (par palier)✅ Oui
Claude Sonnet 5Anthropic3,00 $ (prix d'appel 2,00 $ jusqu'au 31/08/2026)15,00 $ (prix d'appel 10,00 $)✅ Oui (contexte 1M, vision haute résolution 2576px)
Claude Opus 4.8Anthropic5,00 $25,00 $✅ Oui
Claude Fable 5 (ancre)Anthropic10,00 $50,00 $✅ Oui (pas une option économique)

Un détail à signaler dans ce tableau : la tarification de GPT-5.5 n'est pas un chiffre unique — elle est découpée par palier selon la longueur de contexte et le niveau de raisonnement. Son palier d'entrée démarre aussi bas que 1 $/M en entrée, 6 $/M en sortie, ce qui le place en dessous de GLM-5.2 et de Grok 4.5 ; mais son palier le plus complet atteint 5 $/M en entrée, 30 $/M en sortie — plus cher que Claude Sonnet 5. C'est pourquoi GPT-5.5 ne peut pas se voir attribuer un rang unique ici — sa place dépend entièrement du palier que vous payez réellement.

Comme un tableau unique à neuf lignes noie l'essentiel, nous l'avons scindé en deux comparaisons qui correspondent réellement à ce que cet exercice exige : l'une limitée aux modèles prenant en charge l'entrée multimodale, l'autre ignorant totalement le support multimodal et classant simplement les modèles les moins chers dans l'absolu. Ces deux classements ont des vainqueurs différents — et cet écart est tout l'enjeu de cet article.

Sous-classement A : modèles multimodaux uniquement (triés par prix en entrée)

RangModèleEntrée $/MSortie $/MRemarque
1Qwen3.6-35B-A3B0,14 $0,90 $Modèle multimodal le moins cher dans l'absolu, aucune vraie concurrence
2Grok 4.52,00 $6,00 $Meilleur rapport qualité-prix parmi les modèles phares fermés/propriétaires
3GPT-5.5 (palier d'entrée)1–5 $6–30 $Le palier d'entrée bat Grok 4.5 ; le palier complet coûte plus cher
4Claude Sonnet 53,00 $ (appel 2,00 $)15,00 $ (appel 10,00 $)Proche de Grok 4.5 pendant la période de prix d'appel
5Claude Opus 4.85,00 $25,00 $
ancreClaude Fable 510,00 $50,00 $Pas une option économique

Sous-classement B : les moins chers dans l'absolu, sans distinction de support multimodal

RangModèleEntrée $/MSortie $/MMultimodal ?
Ex æquo 1Qwen3.6-35B-A3B0,14 $0,90 $✅ Oui
Ex æquo 1DeepSeek-V4-Flash0,14 $0,28 $❌ Texte uniquement
3DeepSeek-V4-Pro0,435 $0,87 $❌ Texte uniquement
4GLM-5.21,40 $4,40 $❌ Texte uniquement
5Grok 4.52,00 $6,00 $✅ Oui

Cet « ex æquo pour la première place » du sous-classement B mérite qu'on s'y attarde

Qwen3.6-35B-A3B et DeepSeek-V4-Flash affichent un prix en entrée identique à 0,14 $/M — le point de confusion le plus facile de tout cet article. En surface, les deux semblent à égalité, mais DeepSeek-V4-Flash est en réalité moins cher en sortie (0,28 $ contre 0,90 $), et surtout : seul Qwen3.6 prend en charge l'entrée multimodale. DeepSeek-V4-Flash est un modèle texte uniquement. Cela signifie que si votre charge de travail nécessite de la vision (compréhension de captures d'écran, OCR de documents, tâches agentiques de type reconstruction d'interface), DeepSeek-V4-Flash n'est même pas sur la liste des candidats, peu importe son prix bas. Nous décortiquons ce piège du « faux ex æquo » dans la section suivante.

3. Un piège courant : deux des options « moins chères » ne sont même pas multimodales

Beaucoup de gens voient GLM-5.2 (1,40 $/4,40 $) et DeepSeek-V4-Pro (0,435 $/0,87 $) tarifés en dessous de Grok 4.5 (2,00 $/6,00 $) et supposent instinctivement « ce sont forcément des alternatives moins chères à Grok 4.5 ». Cette intuition se vérifie dans les scénarios texte uniquement — pour la programmation, la synthèse de documents, la génération de tests unitaires, GLM-5.2 et DeepSeek sont réellement peu chers et performants. Mais dès que votre charge de travail implique une entrée visuelle, cette comparaison s'effondre entièrement.

La raison est simple : GLM-5.2 et les deux paliers de DeepSeek-V4 (Pro et Flash) sont actuellement des modèles texte uniquement, sans aucune prise en charge d'entrée image ou visuelle. Ce n'est pas « un support multimodal plus faible » — il n'y a tout simplement aucun point d'entrée multimodal. Vous ne pouvez pas leur soumettre une capture d'écran pour interpréter la mise en page d'une interface, ni leur faire lire un PDF scanné contenant des graphiques. Cela signifie qu'ils ne devraient pas figurer dans une « comparaison de rapport qualité-prix multimodal » dès le départ, quel que soit l'attrait de leur tarification.

Ce n'est pas une critique de GLM-5.2 ou de DeepSeek — bien au contraire. Pour la programmation texte uniquement, l'automatisation agentique et le traitement de documents, leur rapport qualité-prix est réellement excellent (nous avons calculé les chiffres complets de l'écart de prix de GLM-5.2 face à Claude Fable 5 dans notre précédent article sur GLM-5.2). Le problème n'apparaît que lorsque votre cas d'usage exige que le modèle puisse réellement « voir » — à ce moment-là, le prix bas affiché cesse d'être pertinent, et votre liste réelle de candidats se réduit aux modèles qui prennent effectivement en charge l'entrée multimodale : Qwen3.6, Grok 4.5, GPT-5.5, et la gamme Claude Sonnet 5 / Opus 4.8 / Fable 5.

Autrement dit, tout « classement de rapport qualité-prix » doit d'abord se demander « compare-t-on bien la même catégorie ? » — sans quoi on aboutit à une conclusion plausible en apparence mais qui compare en réalité des choux et des carottes, du type « GLM-5.2/DeepSeek est plusieurs fois moins cher que Grok 4.5, donc le rapport qualité-prix de Grok 4.5 n'est pas bon ».

4. Où Grok 4.5 gagne réellement : benchmarks, efficacité en tokens et faiblesses connues

Pour évaluer équitablement le rapport qualité-prix de Grok 4.5, il faut regarder ce qu'il peut réellement faire, pas seulement son prix affiché. D'après les données de benchmark publiques et les rapports tiers, Grok 4.5 présente plusieurs atouts réels :

  • Score SWE-bench Verified de 86,6 % — déjà très proche des environ 88,6 % de Claude Opus 4.8, un écart d'environ deux points de pourcentage, alors qu'Opus 4.8 coûte 2,5 fois plus cher
  • Le meilleur score de benchmark d'utilisation agentique d'outils (33 %) de tous les modèles testés — directement pertinent pour les agents de programmation et les flux d'automatisation qui dépendent d'appels d'outils fréquents et précis
  • Une efficacité en tokens nettement supérieure : sur des tâches de style SWE-bench Pro, Grok 4.5 accomplit le travail avec une moyenne d'environ 15 954 tokens de sortie seulement, contre environ 67 020 pour Opus 4.8 — à peu près un quart des tokens, soit environ 4 fois plus d'efficacité en tokens. En combinant un prix au token plus bas avec un nombre de tokens plus faible, l'écart réel de coût par tâche finit par être plus large que ce que suggérerait la seule tarification affichée au million de tokens

Mis bout à bout, ces chiffres décrivent un modèle qui ne gagne pas sur « le score brut le plus élevé » — il gagne sur « des résultats proches du sommet pour une fraction de l'argent et des tokens ». C'est en réalité ce que « rapport qualité-prix » est censé signifier, par opposition à simplement « pas cher ».

⚠️ L'honnêteté implique aussi de citer les faiblesses. Grok 4.5 n'est pas sans défauts. Une évaluation tierce rapporte que son taux d'hallucination a grimpé à environ 54 %, contre environ 25 % pour le précédent Grok 4.3 — un bond significatif. Sur l'Artificial Analysis Intelligence Index, un benchmark agrégé, il se classe quatrième au global, derrière Claude Fable 5, GPT-5.5 et Claude Opus 4.8. Ses solides résultats sur CursorBench ont aussi suscité des interrogations sur une possible contamination de l'ensemble d'entraînement, puisque ses propres données d'entraînement proviennent de sessions de programmation de type Cursor qui se recoupent conceptuellement avec le benchmark. Ce sont des faits réels et importants issus de cette recherche, qu'il ne faut pas passer sous silence simplement parce que l'histoire du rapport qualité-prix est flatteuse.

5. Le vrai roi sous-estimé du rapport qualité-prix : Qwen3.6-35B-A3B

Si la question se limite strictement à « quel est le modèle multimodal le moins cher », la réponse n'est pas Grok 4.5 — c'est Qwen3.6-35B-A3B, publié par Alibaba à peu près à la même période. C'est un modèle nativement multimodal — capable à la fois d'entrée visuelle et de programmation agentique — tarifé à seulement 0,14 $/M en entrée, 0,90 $/M en sortie.

Convertir cela en ratios rend la chose concrète : Qwen3.6-35B-A3B est environ 14 fois moins cher que Grok 4.5 en entrée (2,00 ÷ 0,14 ≈ 14,3) et environ 6,7 fois moins cher en sortie (6,00 ÷ 0,90 ≈ 6,7). Cet écart est bien plus large que celui entre GLM-5.2/DeepSeek et Grok 4.5 — et, contrairement à ces deux-là, Qwen3.6 constitue une comparaison réellement équitable face à Grok 4.5, puisque les deux prennent effectivement en charge l'entrée multimodale.

Alors pourquoi un modèle aussi peu cher et aussi réellement multimodal ne bénéficie-t-il pas de la même attention que Grok 4.5 ou GLM-5.2 ? Une explication raisonnable tient à la manière dont l'attention se propage : Grok 4.5 profite de la visibilité intégrée de xAI et d'Elon Musk lui-même, GLM-5.2 a eu un catalyseur viral avec l'histoire de la réduction de coûts chez Coinbase, tandis que la lignée Qwen a historiquement eu une présence plus discrète dans les communautés techniques anglophones — même si elle est déjà référencée sur la plateforme Bailian d'Alibaba Cloud, Hugging Face et ModelScope. C'est exactement le point qu'il faut souligner ici : le buzz et le classement du rapport qualité-prix sont deux choses différentes, et le modèle le plus discuté n'est pas nécessairement celui qui l'emporte sur les chiffres.

6. Le verdict honnête : retour à la question du titre

Retour au titre : « Grok 4.5 est-il vraiment le modèle offrant le meilleur rapport qualité-prix en ce moment ? » En mettant tout ce qui précède ensemble, la réponse honnête est que cela dépend de la comparaison que vous faites — pas un simple oui ou non :

  • Non, ce n'est pas le seul modèle le moins cher dans l'absolu : DeepSeek-V4-Flash (0,14 $/0,28 $) et Qwen3.6-35B-A3B (0,14 $/0,90 $) le battent tous deux de plus de 10 fois sur le prix en entrée — sur les chiffres bruts seuls, Grok 4.5 ne se hisse pas dans le peloton de tête
  • Non, ce n'est pas non plus le modèle multimodal le moins cher : ce titre revient à Qwen3.6-35B-A3B, qui égale ses capacités de vision et de programmation agentique pour une fraction du prix de Grok 4.5
  • Oui, au sein de la catégorie plus étroite — mais, pour la plupart des utilisateurs de relais, plus pertinente en pratique — des modèles phares multimodaux fermés/propriétaires, Grok 4.5 offre réellement le meilleur rapport qualité-prix disponible aujourd'hui. Il est moins cher que le palier le plus élevé de GPT-5.5, Claude Sonnet 5, Claude Opus 4.8 et Claude Fable 5, tout en livrant des résultats de benchmark et une efficacité en tokens crédibles : un score SWE-bench Verified d'environ 87 % qui égale presque Opus 4.8, et le meilleur score d'utilisation agentique d'outils de tous les modèles testés

Autrement dit, si votre liste de candidats est déjà limitée aux « modèles phares fermés de pointe » — c'est-à-dire que vous n'envisagez ni les modèles à poids ouverts ni l'auto-hébergement — Grok 4.5 est réellement la meilleure affaire au sein de ce sous-ensemble en ce moment. Mais si vous élargissez la liste à l'ensemble du marché, en incluant notamment les modèles ouverts chinois, le titre de « meilleur rapport qualité-prix du marché » devrait revenir à Qwen3.6-35B-A3B (pour les usages multimodaux) ou à DeepSeek-V4-Flash (pour les usages texte uniquement), pas à Grok 4.5. C'est exactement l'attitude que le titre de cet article cherche à transmettre : ne pas présupposer la conclusion, mettre les chiffres sur la table, et laisser le classement parler de lui-même.

7. Comment utiliser une passerelle One API pour accéder à Grok 4.5 et aux 7 autres modèles à la fois

Les 8 modèles comparés dans cet article proviennent de 6 fournisseurs différents — si vous créez un compte séparé et gérez une clé API séparée pour chacun, votre flux de travail devient vite ingérable. Une solution courante consiste à mettre en place une passerelle unifiée devant tous ces modèles. Le guide LiteLLM de ce site couvre une approche ; une autre option open source largement utilisée, particulièrement populaire dans la communauté des relais/proxys, est One API (songquanpeng/one-api) et son fork populaire New API (Calcium-Ion/new-api). Les deux sont des systèmes de « passerelle LLM / redistribution de clés » : une interface unifiée unique devant OpenAI, Anthropic Claude, Google Gemini, DeepSeek, Qwen, GLM et d'autres fournisseurs courants, livrée sous forme d'un binaire unique plus une image Docker, déploiement en une commande — bien adapté à la gestion de plusieurs canaux de modèles et à la redistribution de quotas au sein d'une équipe.

Configurer Grok 4.5 via One API (ou New API) ressemble grosso modo à ceci :

  1. Déployer le service : démarrez-le avec l'image Docker officielle (en production, utilisez MySQL plutôt que le SQLite par défaut), puis connectez-vous au panneau d'administration.
  2. Ajouter un canal : allez dans la gestion des canaux, ajoutez un nouveau canal, et choisissez xAI comme type de canal (c'est un type de canal dont la communauté One API a explicitement documenté la prise en charge). Saisissez votre propre clé API xAI/SpaceXAI, définissez le nom du modèle sur grok-4.5, enregistrez, et cliquez sur « Tester » pour confirmer la connexion.
  3. Générer un jeton : dans la gestion des jetons, créez une nouvelle clé API qui peut être limitée à des canaux/modèles spécifiques avec un plafond de quota — c'est l'élément de « redistribution de clés », qui permet de distribuer des clés individuellement plafonnées aux membres de l'équipe ou aux projets.
  4. L'intégrer à vos outils : pointez le client que vous utilisez (le guide claude-code-router de ce site, l'entrée de modèle personnalisé de Cursor, ou tout client acceptant un base_url personnalisé) vers votre instance One API, et appelez-le avec le nom de modèle défini sur grok-4.5 — le protocole de communication est compatible OpenAI de bout en bout, donc rien de spécifique à Grok n'a besoin d'être modifié dans votre code.

La valeur ici tient en « déployer une fois, gérer tous les modèles » : GLM-5.2, DeepSeek, Qwen, Grok 4.5, et même Claude/GPT peuvent tous être ajoutés comme canaux sur la même instance One API, de sorte qu'une équipe partage une seule clé, une seule facture et un seul tableau de bord d'utilisation au lieu de six comptes fournisseurs séparés. Si vous préférez ne pas gérer votre propre serveur, de nombreux fournisseurs de relais sur le marché sont eux-mêmes construits sur One API/New API en interne — avant de vous inscrire, il vaut la peine de vérifier s'ils ont déjà ajouté Grok 4.5 à leur liste de canaux. Pour un comparatif complet des options de relais, consultez le comparatif des relais d'API IA de ce site.

8. FAQ

Q : Alors, Grok 4.5 est-il le « roi du rapport qualité-prix » ou pas ?

R : Cela dépend de la définition que vous donnez à ce titre. Si cela signifie « le modèle phare fermé/propriétaire de pointe le moins cher avec des benchmarks et une efficacité en tokens crédibles », Grok 4.5 se qualifie actuellement. Si cela signifie « le seul modèle le moins cher du marché » ou « le modèle multimodal le moins cher », ces titres reviennent respectivement à DeepSeek-V4-Flash et Qwen3.6-35B-A3B, pas à Grok 4.5.

Q : GLM-5.2 et DeepSeek sont clairement moins chers — pourquoi ne peuvent-ils pas simplement remplacer Grok 4.5 ?

R : Dans les scénarios texte uniquement (génération de code, synthèse de documents, tâches agentiques textuelles), ils sont réellement le choix le moins cher et peuvent le remplacer directement. Mais aucun des deux ne prend actuellement en charge l'entrée visuelle, donc toute tâche nécessitant que le modèle puisse « voir » — compréhension de captures d'écran, reconstruction d'interface, reconnaissance de graphiques/documents scannés — est hors de leur portée. Pour ces cas, il faut choisir parmi Qwen3.6, Grok 4.5, GPT-5.5 et la gamme Claude.

Q : Qwen3.6-35B-A3B est-il vraiment fiable ? Pourquoi en ai-je si peu entendu parler ?

R : C'est le modèle Qwen de dernière génération d'Alibaba, prenant nativement en charge l'entrée visuelle et la programmation agentique, et déjà référencé sur la plateforme Bailian d'Alibaba Cloud, Hugging Face et ModelScope. Sa relative discrétion tient davantage à la dynamique de l'attention — pas d'équivalent à l'histoire de réduction de coûts chez Coinbase ou à la visibilité portée par Musk — qu'à sa capacité ou à sa fiabilité. Si votre cas d'usage est multimodal et sensible au coût, il mérite d'être testé sérieusement.

Q : Un développeur ordinaire peut-il accéder à Grok 4.5 via un relais ?

R : Oui, et certains relais ont déjà commencé à le référencer. Sachez simplement qu'il s'agit d'une situation de zone grise — les conditions officielles ne l'interdisent pas explicitement, mais le produit grand public est indirectement bloqué via X — ce qui diffère des modèles nativement disponibles en Chine comme GLM/DeepSeek/Qwen. Il vaut la peine de privilégier les fournisseurs de relais qui prennent en charge le changement flexible de modèle et publient une politique de données claire.

Q : Quand le prix d'appel de Claude Sonnet 5 prend-il fin ?

R : Le prix d'appel officiel de 2,00 $/M en entrée, 10,00 $/M en sortie court jusqu'au 31 août 2026, après quoi il revient au tarif standard de 3,00 $/15,00 $. Si vous évaluez le rapport qualité-prix de Sonnet 5 face à Grok 4.5, intégrez cette fenêtre temporelle dans la comparaison.

Q : Ces prix et ces benchmarks vont-ils rapidement devenir obsolètes ?

R : Oui. La tarification et les résultats de benchmark des modèles IA évoluent vite — les données de cet article sont à jour à la mi-juillet 2026. Si vous lisez ceci des mois plus tard, vérifiez les canaux officiels ou le comparatif des relais d'API IA de ce site pour les chiffres les plus récents plutôt que d'appliquer directement les chiffres spécifiques présentés ici.

Pour conclure : les classements de rapport qualité-prix n'ont de sens qu'au sein d'une catégorie

  • Grok 4.5 (2 $/6 $) offre le meilleur rapport qualité-prix parmi les modèles phares multimodaux fermés/propriétaires — des benchmarks proches d'Opus 4.8, environ 4 fois plus d'efficacité en tokens, et le meilleur score d'utilisation agentique d'outils de tous les modèles testés
  • Ce n'est pas le seul modèle le moins cher dans l'absolu : DeepSeek-V4-Flash (0,14 $/0,28 $) et Qwen3.6-35B-A3B (0,14 $/0,90 $) le battent tous deux de plus de 10 fois sur le prix en entrée
  • Ce n'est pas non plus le modèle multimodal le moins cher : ce titre revient à Qwen3.6-35B-A3B — environ 14 fois moins cher en entrée, 6,7 fois moins cher en sortie, et une comparaison réellement équitable puisque les deux prennent en charge la vision
  • GLM-5.2 et DeepSeek-V4 sont peu chers mais texte uniquement — ils ne devraient pas être comparés en « rapport qualité-prix » face au Grok 4.5 multimodal ; c'est le piège le plus facile à commettre
  • Accès en Chine continentale : Qwen/DeepSeek/GLM sont nativement en connexion directe ; Grok se situe dans une zone grise (bloqué au niveau grand public via X, mais pas explicitement interdit dans les conditions d'API) ; Claude et GPT nécessitent un relais

La réponse à la question du titre est donc : non, Grok 4.5 n'est ni le seul modèle le moins cher, ni le modèle multimodal le moins cher du marché — mais oui, au sein de la catégorie plus étroite des modèles phares fermés/propriétaires, il offre réellement le meilleur rapport qualité-prix disponible aujourd'hui.