Calculateur de coût d'IA en tokens
Le coût d'une API d'IA se résume à quatre chiffres : requêtes par mois, tokens en entrée, tokens en sortie et prix du modèle. Les valeurs de départ reprennent l'exemple de notre article sur le calcul du coût d'un projet d'IA : un chatbot de support avec 300 000 requêtes par mois. Vous pouvez aussi l'appeler simulateur : les valeurs changent à mesure que vous déplacez les curseurs.
Mille utilisateurs à dix requêtes par jour, c'est 300 000 par mois.
Question, instructions et contexte. 1 token ≈ 0,75 mot.
La réponse générée.
Pour les pics et les réponses plus longues : 20 % à 30 %.
| Modèle | Entrée / sortie par million | Coût par mois |
|---|---|---|
| Claude Fable 5.1 | $10.00 / $50.00 | 6 000 US$ |
| Claude Opus 5 | $5.00 / $25.00 | 3 000 US$ |
| Claude Sonnet 5 | $2.00 / $10.00 | 1 200 US$ |
| Claude Haiku 4.5 | $1.00 / $5.00 | 600 US$ |
| GPT-5.5 | $5.00 / $30.00 | 3 450 US$ |
| GPT-5.6 sol | $4.00 / $20.00 | 2 400 US$ |
| GPT-5.4 | $2.50 / $15.00 | 1 725 US$ |
| GPT-5.6 terra | $2.00 / $12.00 | 1 380 US$ |
| GPT-5.4 nano | $0.20 / $1.25 | 143 US$ |
| GPT-5.6 luna | $0.20 / $1.20 | 138 US$ |
| Gemini 3.1 Pro | $2.00 / $12.00 | 1 380 US$ |
| Gemini 3.5 Flash | $1.50 / $9.00 | 1 035 US$ |
| Gemini 3.8 Flash | $0.75 / $3.75 | 450 US$ |
| Gemini 2.5 Flash-Lite | $0.10 / $0.40 | 51,00 US$ |
Prix catalogue en dollars, sans remises de caching (jusqu'à 90 %) ni de batch (50 %), vérifiés sur les pages officielles des fournisseurs le 16 septembre 2026 (liens dans Sources). Ils changent souvent : vérifiez toujours avant de décider.
Estimation indicative : les valeurs réelles dépendent de votre processus et de vos données.
Comment c'est calculé
Coût par mois = requêtes × (tokens en entrée × prix d'entrée + tokens en sortie × prix de sortie) ÷ 1 000 000.
Les prix sont exprimés par million de tokens et la sortie coûte presque toujours environ cinq fois l'entrée. C'est pourquoi la réponse pèse plus sur la facture que la question, même avec moins de tokens.
La marge de sécurité couvre les variations d'usage, les longues conversations et les réponses plus longues que prévu. Dans une proposition, donnez toujours une fourchette et le volume sur lequel elle repose.
Sources
Questions fréquentes
Qu'est-ce qu'un token ?
C'est l'unité avec laquelle les modèles lisent et écrivent le texte. En moyenne, un token correspond à environ 0,75 mot, et un million de tokens à environ 750 000 mots.
Comment réduire le coût sans perdre en qualité ?
Le premier levier est de choisir le bon modèle pour chaque tâche : les tâches simples ont rarement besoin du haut de gamme. Ensuite, le prompt caching pour le contexte répété, le batch pour ce qui n'exige pas de réponse immédiate et une limite à la longueur des réponses.
Pourquoi le même volume coûte-t-il si différemment selon le modèle ?
Parce que le prix par token varie de plus de cent fois entre le modèle le moins cher et le plus cher. Chez un même fournisseur, l'écart entre modèles compte plus que l'écart entre fournisseurs.
Les prix sont en dollars. Combien cela fait-il en euros ?
Les fournisseurs facturent en dollars. Convertissez au taux du jour ; comme les prix et le taux évoluent, considérez le résultat comme une estimation et non comme un devis.
Est-ce un calculateur ou un simulateur ?
C'est la même chose : vous changez les valeurs et voyez le résultat immédiatement, sans rien installer ni laisser vos coordonnées. Si vous cherchiez un simulateur de coût d'IA, c'est ici.
- Comment calculer le coût d'un projet d'IA basé sur les tokens
- Combien coûte l'utilisation de l'API d'IA en 2026 : comparaison des prix (OpenAI, Claude et Gemini)
- Combien coûte l'IA par cas d'usage réel : chatbot, code, documents et contenu
- Comment réduire les coûts des tokens de votre application d'IA : 8 stratégies
Autres calculateurs
Besoin d'aide pour le mettre en pratique ?
Lors d'une évaluation gratuite de 30 minutes, nous examinons votre activité et vous montrons où se trouve le meilleur retour.
Demander une évaluation gratuite