
L'API LLM la moins chère en 2026 : comparatif complet des tarifs, 19 modèles
Publié le 25 juil. 2026
Si vous choisissez une API LLM uniquement sur le coût, l’écart est plus grand que ce que la plupart des gens imaginent. En comparant les 19 modèles suivis par le Calculateur de tarifs API LLM de ce site — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM et xAI — le modèle le moins cher et le plus cher diffèrent de plus de 60x sur une base comparable. Cet écart compte bien plus que le logo du fournisseur auquel vous êtes habitué.
Le classement
Pour comparer équitablement, chaque modèle ci-dessous est noté sur un tarif combiné : 750 000 tokens d’entrée + 250 000 tokens de sortie pour 1M de tokens au total, ce qui correspond à peu près à une requête typique de type chat où la réponse est plus courte que le prompt. Les prix sont pour 1M de tokens, vérifiés par rapport à la page de tarification officielle de chaque fournisseur.
| Rang | Modèle | Fournisseur | Entrée | Sortie | Combiné (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Plusieurs éléments ressortent. Chaque fournisseur — pas seulement un — dispose à la fois d’un niveau économique et d’un niveau haut de gamme séparés par plusieurs multiples, donc « quel fournisseur est le moins cher » est la mauvaise question ; « quel modèle précis » est la bonne. Deuxièmement, les deux modèles les moins chers (Gemini 2.5 Flash-Lite et DeepSeek V4 Flash) tombent exactement sur le même tarif combiné bien qu’ils proviennent d’entreprises sans lien entre elles — à l’extrémité basse, les prix des offres économiques ont convergé plutôt qu’un seul fournisseur ne cassant les prix du marché.
Pourquoi le modèle le moins cher n’est pas automatiquement le bon choix
Le prix seul ne vous dit pas si un modèle est assez performant pour votre tâche. Les modèles d’entrée de gamme conviennent généralement bien à la classification, l’extraction, les réponses courtes et autres tâches étroites et bien définies — le genre de travail où la capacité de raisonnement supplémentaire d’un modèle haut de gamme reste inutilisée. Ils sont moins adaptés au raisonnement ouvert, aux workflows d’agents longs à plusieurs étapes, ou aux tâches où une mauvaise réponse coûte cher à rattraper plus tard ; un modèle moins cher qui se trompe et nécessite une nouvelle tentative (ou une correction humaine) peut finir par coûter plus cher qu’un modèle plus onéreux qui répond correctement du premier coup.
Un point de départ raisonnable : prototypez avec le modèle que vous connaissez le mieux, puis une fois la tâche bien définie, testez si un modèle d’entrée de gamme du même tableau produit un résultat suffisamment similaire — si c’est le cas, les économies s’accumulent à grande échelle ; sinon, l’écart de prix n’était de toute façon pas le vrai facteur de coût.
Calculer votre chiffre réel
Ce tableau utilise un mélange fixe de 3:1 pour rendre le classement possible, mais votre véritable répartition entrée/sortie de tokens n’est presque certainement pas de 3:1 — une tâche de résumé pourrait être de 10:1, une tâche de génération de code plus proche de 1:2. Le classement combiné ci-dessus est un bon point de départ pour choisir des candidats à tester, pas un substitut au calcul de votre coût spécifique.
Pour cela, utilisez directement le Calculateur de tarifs API LLM : entrez vos nombres réels de tokens d’entrée et de sortie, et il calcule le coût exact pour n’importe lequel de ces 19 modèles, plus une estimation mensuelle si vous connaissez approximativement le nombre de requêtes que vous ferez. Si vous ne connaissez pas encore votre nombre de tokens, l’outil Compteur de jetons IA vous donne le chiffre réel à partir d’un prompt concret, plutôt qu’une estimation approximative. Les deux fonctionnent entièrement dans votre navigateur — pas de clé API, pas de compte, rien n’est envoyé nulle part.