Calculateur de coût d’API LLM
Chiffrez une charge de travail sur 46 modèles d’OpenAI, Anthropic, Google, DeepSeek, Qwen, Mistral, xAI et d’autres, à partir d’un nombre de tokens ou de votre vrai prompt.
Entrée
Résultat
Le résultat apparaîtra ici.Avant de lancer une fonctionnalité reposant sur un LLM, il vous faut un chiffre : combien coûteront mille, ou un million, de ces requêtes ? Saisissez les tokens d’entrée et de sortie d’une requête et le nombre de requêtes prévu — ou collez le prompt lui-même et laissez l’outil le compter — et il chiffre la charge sur le modèle choisi ainsi que sur 45 autres, du moins cher au plus cher. Les prix proviennent d’un instantané daté de la table tarifaire maintenue par LiteLLM (BerriAI/litellm, MIT), la passerelle open source que de nombreuses équipes utilisent pour suivre leurs dépenses, et la date de l’instantané figure dans chaque résultat.
Comment ça marche
- Le coût vaut les tokens d’entrée × le prix d’entrée plus les tokens de sortie × le prix de sortie, par million de tokens, multiplié par le nombre de requêtes ; les statistiques répartissent le total entre la part d’entrée et la part de sortie.
- Le texte collé est compté avec o200k_base, exact pour les familles GPT-4o, GPT-4.1 et GPT-5 d’OpenAI et approximatif pour tous les autres ; lorsqu’un texte est présent, le champ des tokens d’entrée est ignoré.
- La tarification long contexte s’applique quand l’entrée d’une requête dépasse le seuil du fournisseur — par exemple au-delà de 272K tokens sur GPT-5.4 à 5.6, et de 200K sur Gemini 2.5 Pro, Gemini 3.1 Pro et Grok — et les prix par paliers de Qwen sont appliqués palier par palier.
- Le tableau comparatif marque votre modèle d’un ▶ et place ✗ à côté de tout modèle dont la fenêtre de contexte ne peut pas contenir à la fois l’entrée et la sortie de la requête.
Où vont vos données
Nulle part. Cet outil s’exécute entièrement dans votre navigateur : le texte collé est traité par la page, jamais transmis à un serveur ni consigné dans un journal.
Cet outil est gratuit et ne demande aucun compte. Ses résultats n’existent que dans la page ouverte et ne sont enregistrés nulle part.
Ce que ça coûte
Cet outil est gratuit, sans connexion ni points.
Questions fréquentes
- Ces prix sont-ils à jour ?
- Ils proviennent d’un instantané, dont la date est indiquée dans le résultat. Les fournisseurs baissent souvent leurs prix et ajoutent de nouveaux modèles toutes les quelques semaines ; pour un contrat ou la validation d’un budget, vérifiez donc la page de tarifs du fournisseur. L’instantané est tiré de la table de LiteLLM et mis à jour à la main, pas récupéré en direct.
- Les remises pour entrée en cache ou traitement par lots sont-elles incluses ?
- Non ; chaque token d’entrée est facturé au tarif standard. Le prix réduit de l’entrée en cache est affiché en statistique lorsque le fournisseur en propose un, pour que vous puissiez calculer l’économie sur un préfixe de prompt qui se répète. Les API batch, qui divisent généralement le prix par deux en échange de résultats sous 24 heures, ne sont pas modélisées.
- Comment tenir compte des tokens de raisonnement ?
- Les modèles de raisonnement comme o3, GPT-5, DeepSeek-reasoner ou Claude avec la réflexion étendue facturent leur raisonnement caché comme des tokens de sortie. Ajoutez le budget de raisonnement que vous prévoyez au champ des tokens de sortie ; le bloc usage d’une vraie réponse, que le décodeur de flux SSE de ce site sait lire, vous indique combien une requête typique en a consommé.
- Pourquoi DeepSeek V4 apparaît-il chez Fireworks et Llama chez Groq ?
- Les modèles à poids ouverts sont vendus par de nombreux hébergeurs à des prix différents, et l’instantané retient un hébergeur représentatif par modèle : Groq pour Llama 3.1 et 3.3, DeepInfra pour Llama 4 Maverick, Fireworks pour DeepSeek V4. La colonne fournisseur l’indique, pour que vous sachiez de qui est le prix affiché.
L’open source derrière
Cet outil est une implémentation autonome, sans bibliothèque tierce. BerriAI/litellm (MIT) fait le même travail sous forme de bibliothèque : pour l’intégrer à votre programme, commencez par là plutôt que d’appeler une page web.
BerriAI/litellmAussi appelé
- calculateur coût API LLM
- prix API OpenAI
- coût par token GPT
- prix API Claude
- tarif API DeepSeek
- comparateur prix tokens
- llm cost calculator