Aller au contenu principal
PHARE · GRATUITCalculateur VRAM, quel GPU pour quel modèle ? →
À la une Pack modèles IA & mode →
Vantaige

Outil gratuit

Calculateur gratuit de tokens IA

Comptez les tokens, caractères et mots de n'importe quel texte. Choisissez un fournisseur et un modèle, puis consultez le coût API estimé sur plus de 80 modèles, dont GPT, Claude, Gemini, Qwen, DeepSeek et Llama.

Tokens
0
gpt-5.4
Caractères
456
386 sans espaces
Mots
71
Phrases
4
Paragraphes
1

Découvrez notre bibliothèque de plus de 1 000 prompts gratuits et des packs payants avec des dizaines de milliers d'autres

Visualisation des tokens

Chargement du tokenizer...

Estimer le coût d'un modèle

OpenAIEstimation
80%

80 % de l'entrée · ~0 tokens de sortie

Requêtes par jour
Utilisateurs
Croissance mensuelle %

Vous prévoyez une utilisation à grande échelle ? Projetez votre facture mensuelle et annuelle avec le Calculateur de coûts IA.

Entrée
0 tokens · $2.5/M
$0.00
Sortie
0 tokens · $15/M
$0.00
Total par requête$0.00
Quotidien
$0.00
Mensuel
$0.00
Annuel
$0.00
Total entrée en cache $0.00

Coût par fournisseur*

Votre entrée plus une sortie de 80 %, par fournisseur. Choisissez n'importe quel modèle dans une carte.

Anthropic

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

OpenAI

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

Google

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

xAI

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

Z.AI

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

MiniMax

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

DeepSeek

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

Moonshot (Kimi)

Entrée$0.00
Entrée en cache$0.00
Sortie$0.00
Total est.$0.00
$0.00 / mois

Affichage de 8 sur 16 fournisseurs

Les tarifs des modèles changent chaque semaine. Recevez le delta en un e-mail.

Un e-mail court dès qu'un tarif majeur bouge. Pas de spam.

Comment fonctionne le calculateur de tokens

Les grands modèles de langage ne lisent pas directement des caractères ou des mots. Ils lisent des tokens, les petits fragments de texte sur lesquels un modèle est entraîné. Comme chaque API facture au token, connaître votre nombre de tokens est le seul moyen fiable de prévoir le coût avant d'envoyer une requête.

Collez votre texte ci-dessus et cet outil compte les tokens en direct. Les modèles OpenAI sont tokenisés exactement dans votre navigateur. Pour Anthropic, Google, xAI, DeepSeek, Mistral, Cohere et Perplexity, les comptages sont estimés, car ces fournisseurs ne publient pas de tokenizer public exact. La grille comparative affiche le même texte tarifé sur les douze modèles les plus populaires afin que vous puissiez repérer l'option la moins chère en un coup d'œil.

Ratios de tokens par type de contenu

Le même nombre de mots coûte plus ou moins de tokens selon la nature du texte. Voici des plages typiques mesurées avec le tokenizer GPT ; utilisez-les comme des estimations plutôt que des chiffres exacts.

Type de contenuExempleRatio~Tokens / 1 000 motsRemarques
Prose en anglaisThe quick brown fox jumps over the lazy dog.~1,3 token par mot~1 300Écriture courante. Le tokenizer GPT est optimisé pour ce type de texte, qui sert donc de référence.
Rédaction techniqueThe endpoint returns a 200 status on success.~1,5 token par mot~1 500Le jargon et les termes peu courants se découpent en davantage de fragments de sous-mots.
Code sourcefor (let i = 0; i < n; i++) { run(i); }~2 à 3 tokens par mot~2 000 à 3 000Les crochets, opérateurs et l'indentation deviennent chacun généralement leur propre token.
JSON ou XML{ "id": 42, "active": true }~3 à 4 tokens par mot~3 000 à 4 000La ponctuation structurelle comme les accolades, guillemets et deux-points consomme beaucoup de tokens.
Chinois, japonais, coréen東京タワーは高い~1,5 à 2,5 tokens par caractèrecompter par caractèreLes écritures non latines concentrent moins de texte par token, ce qui rend le même sens plus coûteux.
Nombres et identifiants1234567890, 550e8400-e29bvariable, les chiffres sont découpésvariableLes longs nombres et identifiants se fragmentent chacun en plusieurs tokens.

Comment fonctionne la tarification des tokens : entrée, sortie, cache et lot

Chaque grande API de LLM facture séparément les tokens d'entrée et de sortie. Les tokens d'entrée sont ceux de votre prompt, du message système et de tout contexte que vous fournissez. Les tokens de sortie sont ce que le modèle renvoie. Comme générer du texte demande plus de calcul que le lire, les tokens de sortie sont généralement tarifés plusieurs fois plus cher que les tokens d'entrée. Sur de nombreux modèles de pointe, le tarif de sortie représente deux à quatre fois le tarif d'entrée, si bien qu'une charge riche en réponses peut coûter bien plus que ne le suggère le simple nombre de tokens.

Le tarif d'entrée en cache est une remise que proposent les fournisseurs lorsque vous envoyez plusieurs fois le même préfixe de prompt, comme un long message système ou un document statique. Le fournisseur met en cache les représentations clé-valeur du premier appel et facture les appels suivants à un tarif réduit, généralement de 50 à 90 % inférieur au tarif d'entrée standard. Cela rend la tarification en cache particulièrement intéressante pour les applications utilisant un contexte fixe sur de nombreuses requêtes.

L'API par lot (proposée par OpenAI, Anthropic et d'autres) vous permet de soumettre un grand nombre de requêtes de manière asynchrone. Plutôt que des réponses en temps réel, les résultats sont renvoyés dans une fenêtre définie, souvent 24 heures. En échange de cette latence, les fournisseurs facturent généralement environ la moitié du tarif standard par token. Les API par lot conviennent parfaitement aux charges hors ligne telles que la classification de documents, la génération d'embeddings ou les évaluations ne nécessitant pas de résultats immédiats.

La grille comparative du calculateur ci-dessus affiche côte à côte les tarifs d'entrée, de sortie, en cache et par lot afin que vous puissiez choisir le niveau tarifaire adapté à votre cas d'usage avant de vous engager sur un modèle.

Pour qui est-ce fait ?

Découvrez si votre rôle, votre activité ou votre flux de travail correspond à la façon dont cet outil est réellement utilisé.

Indie AI app developers

You need to know the real per-request cost of a GPT wrapper app before shipping it, so you run an openai api cost calculator against sample prompts and responses.

Prompt engineers

You need to trim a system prompt so it stops overflowing the model's limit, so you search for a token counter for prompts to see the exact count per model.

RAG and embeddings engineers

You need to pick a chunk size that stays under the embedding model's token ceiling, so you search chunk size token calculator while splitting documents for a vector database.

Startup founders and product managers

You need to model gross margin on a new AI feature before setting a price, so you search llm api cost calculator to compare input and output token cost across providers.

AI automation agency owners and consultants

You need a defensible number to quote a client for an automation build, so you search ai project cost estimator using the client's actual prompt volume.

Customer support and chatbot builders

You need to budget a support bot handling thousands of daily conversations, so you search chatbot token cost calculator to project monthly API spend.

ML and fine-tuning engineers

You need to size a training set correctly before uploading it, so you search count tokens for fine-tuning to check a JSONL file against the provider's limits.

Content marketers and SEO teams

You need the true cost of generating hundreds of AI articles before greenlighting a batch run, so you search ai content generation cost calculator to price it out first.

Localization and multilingual product teams

You need to see how much more a non-English prompt costs to run, so you search multilingual token cost calculator and paste the same sentence in several languages.

Students and AI self-learners

You're new to how LLMs work and want a hands-on answer, so you search what is a token in ChatGPT and paste text in to watch it split apart.

No-code automation builders (n8n, Zapier, Make)

You need to know if a node's output will overflow the next step's input cap, so you search token limit calculator before wiring an AI action into your workflow.

Custom GPT and GPTs Store builders

You need your custom instructions to fit OpenAI's character cap, so you search gpt instructions character limit while trimming a system prompt down.

Technical writers and documentation teams

You need to know if an entire manual will fit in a model's context window before pasting it in, so you check a context window calculator against the doc's word count.

Finance, ops, and procurement staff

You need to forecast AI software spend for a budget review, so you search ai api budget calculator to turn expected usage into a monthly dollar figure.

AI researchers and data scientists

You need to compare context window size and price across providers before picking a model for a new project, so you search compare llm context window sizes.

Questions fréquentes

Un token est l'unité de base qu'un modèle de langage lit et facture. Il s'agit généralement d'un fragment de mot de quelques caractères. Pour un texte en anglais, un token équivaut à environ quatre caractères ou 0,75 mot.

Environ 1 333 tokens pour de la prose en anglais (un mot équivaut à environ 1,33 token). Consultez les ratios de tokens par type de contenu ci-dessous, car le code et les autres formats diffèrent.

Environ 75 mots pour de la prose en anglais. Un token équivaut à environ 0,75 mot, soit environ quatre caractères.

Chaque famille de modèles utilise son propre tokenizer, ce qui fait varier les comptages d'environ 5 à 15 %. OpenAI utilise tiktoken avec le Byte-Pair Encoding, tandis qu'Anthropic et Google utilisent des implémentations de tokenizer différentes pouvant produire des comptages légèrement différents pour la même entrée.

Exacts pour les modèles OpenAI (le véritable tokenizer GPT s'exécute dans votre navigateur). Pour les autres fournisseurs comme Anthropic, Google et DeepSeek, les comptages sont estimés en mettant à l'échelle le comptage GPT, car ces fournisseurs ne publient pas de tokenizer public. Considérez les estimations comme proches, mais pas exactes.

Cela dépend du modèle. Utilisez la grille comparative ci-dessus pour comparer les modèles, ou parcourez l<aiToolsLink>annuaire des outils IA</aiToolsLink> complet pour une tarification détaillée. Les coûts vont de moins dun dollar pour les petits modèles ouverts à plusieurs dollars par million de tokens pour les modèles de pointe.

La fenêtre de contexte est le nombre maximal de tokens qu'un modèle peut prendre en compte à la fois, incluant à la fois votre prompt d'entrée et la sortie générée par le modèle. Au-delà de cette limite, les parties les plus anciennes de la conversation sont supprimées.

Les tokens d'entrée sont ceux que vous envoyez dans votre prompt. Les tokens de sortie sont ce que le modèle génère en réponse. Les tokens de sortie sont généralement facturés à un tarif plus élevé, souvent deux à quatre fois le prix de l'entrée, car la génération demande plus de calcul que le traitement de l'entrée.

La tarification d'entrée en cache est une remise appliquée aux préfixes de prompt répétés que le fournisseur met en cache côté serveur. Lorsque vous envoyez le même message système de façon répétée, la partie en cache est facturée à un tarif réduit, ce qui peut réduire significativement les coûts pour les applications à fort volume.

Collez votre prompt dans le calculateur ci-dessus pour voir le nombre de tokens et le coût estimé pour le modèle choisi avant d'envoyer la requête API. Besoin d'un prompt à tester ? Parcourez notre Prompt Vault qui contient des milliers de prompts prêts à l'emploi.

Vantaige propose un Prompt Vault avec plus de 1 000 prompts gratuits, ainsi que des packs payants contenant des dizaines de milliers d'autres, prêts à coller dans le calculateur ou dans l'outil d'IA de votre choix.

Non. Le comptage des tokens s'effectue entièrement dans votre navigateur. Votre texte n'est jamais téléversé ni stocké. Seuls les tarifs des modèles sont récupérés, et cette requête ne contient aucun texte.

* Prix en USD pour 1 000 000 de tokens, provenant de Portkey-AI/models. Prix mis à jour le 2026-09-27. (catalog: 2026-09-27) Les comptages OpenAI sont exacts ; ceux des autres fournisseurs sont estimés à partir du tokenizer GPT et peuvent différer de la facturation finale.