Ressources · Calculateurs

    Calculateur de coût d'IA en tokens

    Le coût d'une API d'IA se résume à quatre chiffres : requêtes par mois, tokens en entrée, tokens en sortie et prix du modèle. Les valeurs de départ reprennent l'exemple de notre article sur le calcul du coût d'un projet d'IA : un chatbot de support avec 300 000 requêtes par mois. Vous pouvez aussi l'appeler simulateur : les valeurs changent à mesure que vous déplacez les curseurs.

    Vos chiffres
    requêtes

    Mille utilisateurs à dix requêtes par jour, c'est 300 000 par mois.

    tokens

    Question, instructions et contexte. 1 token ≈ 0,75 mot.

    tokens

    La réponse générée.

    %

    Pour les pics et les réponses plus longues : 20 % à 30 %.

    Modèle
    Résultat
    Coût par mois, marge comprise720 US$
    Sans marge600 US$
    Par requête0,0020 US$
    Par an, marge comprise8 640 US$
    Le même volume sur d'autres modèles
    ModèleEntrée / sortie par millionCoût par mois
    Claude Fable 5.1$10.00 / $50.006 000 US$
    Claude Opus 5$5.00 / $25.003 000 US$
    Claude Sonnet 5$2.00 / $10.001 200 US$
    Claude Haiku 4.5$1.00 / $5.00600 US$
    GPT-5.5$5.00 / $30.003 450 US$
    GPT-5.6 sol$4.00 / $20.002 400 US$
    GPT-5.4$2.50 / $15.001 725 US$
    GPT-5.6 terra$2.00 / $12.001 380 US$
    GPT-5.4 nano$0.20 / $1.25143 US$
    GPT-5.6 luna$0.20 / $1.20138 US$
    Gemini 3.1 Pro$2.00 / $12.001 380 US$
    Gemini 3.5 Flash$1.50 / $9.001 035 US$
    Gemini 3.8 Flash$0.75 / $3.75450 US$
    Gemini 2.5 Flash-Lite$0.10 / $0.4051,00 US$

    Prix catalogue en dollars, sans remises de caching (jusqu'à 90 %) ni de batch (50 %), vérifiés sur les pages officielles des fournisseurs le 16 septembre 2026 (liens dans Sources). Ils changent souvent : vérifiez toujours avant de décider.

    Estimation indicative : les valeurs réelles dépendent de votre processus et de vos données.

    Coût par mois, marge comprise720 US$

    Comment c'est calculé

    Coût par mois = requêtes × (tokens en entrée × prix d'entrée + tokens en sortie × prix de sortie) ÷ 1 000 000.

    Les prix sont exprimés par million de tokens et la sortie coûte presque toujours environ cinq fois l'entrée. C'est pourquoi la réponse pèse plus sur la facture que la question, même avec moins de tokens.

    La marge de sécurité couvre les variations d'usage, les longues conversations et les réponses plus longues que prévu. Dans une proposition, donnez toujours une fourchette et le volume sur lequel elle repose.

    Sources

    Questions fréquentes

    Qu'est-ce qu'un token ?

    C'est l'unité avec laquelle les modèles lisent et écrivent le texte. En moyenne, un token correspond à environ 0,75 mot, et un million de tokens à environ 750 000 mots.

    Comment réduire le coût sans perdre en qualité ?

    Le premier levier est de choisir le bon modèle pour chaque tâche : les tâches simples ont rarement besoin du haut de gamme. Ensuite, le prompt caching pour le contexte répété, le batch pour ce qui n'exige pas de réponse immédiate et une limite à la longueur des réponses.

    Pourquoi le même volume coûte-t-il si différemment selon le modèle ?

    Parce que le prix par token varie de plus de cent fois entre le modèle le moins cher et le plus cher. Chez un même fournisseur, l'écart entre modèles compte plus que l'écart entre fournisseurs.

    Les prix sont en dollars. Combien cela fait-il en euros ?

    Les fournisseurs facturent en dollars. Convertissez au taux du jour ; comme les prix et le taux évoluent, considérez le résultat comme une estimation et non comme un devis.

    Est-ce un calculateur ou un simulateur ?

    C'est la même chose : vous changez les valeurs et voyez le résultat immédiatement, sans rien installer ni laisser vos coordonnées. Si vous cherchiez un simulateur de coût d'IA, c'est ici.

    Pour aller plus loin

    Autres calculateurs

    Besoin d'aide pour le mettre en pratique ?

    Lors d'une évaluation gratuite de 30 minutes, nous examinons votre activité et vous montrons où se trouve le meilleur retour.

    Demander une évaluation gratuite