Outil gratuit

Calculateur de coût de tokens IA

Indiquez votre volume de requêtes et le nombre de tokens par requête pour estimer et comparer le coût API des modèles selon les tarifs EasyAPI en temps réel.

Utilisation

Scénarios courants

Part des tokens d’entrée servis par le cache de prompt. S’applique uniquement aux modèles avec un prix de cache.

Estimer les tokens d’un texte

Estimation approximative : environ 1 token par caractère chinois et environ 4 caractères par token en anglais. Les tokenizers varient ; l’usage renvoyé par l’API fait foi.

Comparaison des coûts

10 000 requêtes / mois · 1 000 tokens en entrée / 500 en sortie par requête

gpt-6-astraclaude-fable-5.1gemini-3.5-flashdeepseek-v4.1-flash

deepseek-v4.1-flash est le moins cher, environ $2,91 par mois, soit environ 99 % d’économie par rapport à claude-fable-5.1.

ModèleEntrée / 1M tokensSortie / 1M tokensPar requêtePar jourPar mois
deepseek-v4.1-flash
DeepSeekLe moins cherTarif dynamique
$0,0969$0,3875$0,000291$0,0969$2,91
$1,275$7,65$0,0051$1,70$51,00
gpt-6-astra
OpenAITarif dynamique
$10$50$0,035$11,67$350
$10$50$0,035$11,67$350

Prix issus des tarifs EasyAPI en temps réel (remises incluses). Coût journalier sur une base de 30 jours par mois ; votre facture fait foi.

Comment le coût est calculé

Les API de LLM facturent généralement séparément les tokens d’entrée et de sortie, au prix par million de tokens. Le calculateur utilise ces formules :

  • Coût par requête = (tokens d’entrée hors cache × prix d’entrée + tokens en cache × prix du cache + tokens de sortie × prix de sortie) ÷ 1 000 000
  • Coût mensuel = coût par requête × requêtes par mois ; coût journalier = coût mensuel ÷ 30
  • Le prix de sortie est souvent plusieurs fois supérieur au prix d’entrée : la sortie pèse le plus pour les réponses longues (code, rédaction)
  • Avec le cache de prompt, les prompts système et contextes répétés sont facturés au prix du cache, ce qui réduit fortement le coût des applications à long contexte

Questions fréquentes

Qu’est-ce qu’un token ?

Un token est l’unité de base de traitement du texte par un LLM. En anglais, un token correspond à environ 4 caractères ou 0,75 mot ; en chinois, à environ un caractère. Les tokens d’entrée et de sortie sont facturés séparément.

Les prix sont-ils exacts ?

Les prix sont lus en temps réel sur le Model Square d’EasyAPI, remises incluses, comme sur les pages des modèles. Les modèles à tarif dynamique sont estimés au palier de base ; la facture de la console fait foi.

Comment connaître le nombre de tokens d’une requête ?

Utilisez « Estimer les tokens d’un texte » ci-dessus pour un ordre de grandeur. Une fois intégré, l’usage exact de chaque appel figure dans le champ usage de la réponse et dans les journaux de la console.

Comment réduire le coût des API de LLM ?

Utilisez des modèles légers pour les tâches simples, raccourcissez prompts et contexte, limitez la longueur de sortie, activez le cache de prompt et répartissez les requêtes entre modèles selon la complexité.

Une seule clé API permet-elle d’appeler tous ces modèles ?

Oui. EasyAPI propose une API compatible OpenAI : une clé suffit pour appeler les modèles autorisés sur votre compte, il suffit de changer le paramètre model.

Appelez tous ces modèles avec une seule clé API

Inscrivez-vous à EasyAPI pour appeler GPT, Claude, Gemini, DeepSeek et d’autres via une API compatible OpenAI, en ne payant que ce que vous consommez.