Calculadora de custo de IA por tokens
O custo de uma API de IA resume-se a quatro números: pedidos por mês, tokens de entrada, tokens de saída e o preço do modelo. Os valores iniciais são o exemplo do nosso artigo sobre como calcular o custo de um projeto de IA: um chatbot de suporte com 300 mil pedidos por mês. Também lhe podes chamar simulador: os valores mudam à medida que mexes nos cursores.
Mil utilizadores com dez pedidos por dia são 300 mil por mês.
Pergunta, instruções e contexto. 1 token ≈ 0,75 palavras.
A resposta gerada.
Para picos e respostas mais longas: 20% a 30%.
| Modelo | Input / output por milhão | Custo por mês |
|---|---|---|
| Claude Fable 5.1 | $10.00 / $50.00 | 6.000 US$ |
| Claude Opus 5 | $5.00 / $25.00 | 3.000 US$ |
| Claude Sonnet 5 | $2.00 / $10.00 | 1.200 US$ |
| Claude Haiku 4.5 | $1.00 / $5.00 | 600 US$ |
| GPT-5.5 | $5.00 / $30.00 | 3.450 US$ |
| GPT-5.6 sol | $4.00 / $20.00 | 2.400 US$ |
| GPT-5.4 | $2.50 / $15.00 | 1.725 US$ |
| GPT-5.6 terra | $2.00 / $12.00 | 1.380 US$ |
| GPT-5.4 nano | $0.20 / $1.25 | 143 US$ |
| GPT-5.6 luna | $0.20 / $1.20 | 138 US$ |
| Gemini 3.1 Pro | $2.00 / $12.00 | 1.380 US$ |
| Gemini 3.5 Flash | $1.50 / $9.00 | 1.035 US$ |
| Gemini 3.8 Flash | $0.75 / $3.75 | 450 US$ |
| Gemini 2.5 Flash-Lite | $0.10 / $0.40 | 51,00 US$ |
Preços de tabela em dólares, sem descontos de caching (até 90%) nem batch (50%), conferidos nas páginas oficiais dos fornecedores a 16 de setembro de 2026 (ligações em Fontes). Mudam com frequência: confirma sempre antes de decidir.
Estimativa indicativa: os valores reais dependem do teu processo e dos teus dados.
Como é calculado
Custo por mês = pedidos × (tokens de entrada × preço de entrada + tokens de saída × preço de saída) ÷ 1.000.000.
Os preços são por milhão de tokens e o de saída é quase sempre cerca de cinco vezes o de entrada. Por isso a resposta pesa mais na fatura do que a pergunta, mesmo tendo menos tokens.
A margem de segurança cobre variações de uso, conversas longas e respostas maiores do que o previsto. Numa proposta, apresenta sempre um intervalo e o volume em que assenta.
Fontes
Perguntas frequentes
O que é um token?
É a unidade em que os modelos leem e escrevem texto. Em média, um token corresponde a cerca de 0,75 palavras, e um milhão de tokens a cerca de 750 mil palavras.
Como reduzo o custo sem perder qualidade?
A maior alavanca é escolher o modelo certo para cada tarefa: tarefas simples raramente precisam do topo de gama. Depois, prompt caching para contexto repetido, batch para o que não precisa de resposta imediata e limites ao tamanho das respostas.
Porque é que o mesmo volume custa tão diferente de modelo para modelo?
Porque o preço por token varia mais de cem vezes entre o modelo mais barato e o mais caro. Dentro do mesmo fornecedor, a diferença entre modelos pesa mais do que a diferença entre fornecedores.
Os preços estão em dólares. Quanto é em euros?
Os fornecedores faturam em dólares. Converte ao câmbio do dia; como os preços e o câmbio mudam, trata o resultado como uma estimativa e não como um orçamento.
Isto é uma calculadora ou um simulador?
É a mesma coisa: mudas os valores e vês o resultado na hora, sem instalar nada nem deixar contacto. Se procuravas um simulador de custos de IA, é isto.
Outras calculadoras
Queres ajuda a pôr isto em prática?
Numa avaliação gratuita de 30 minutos olhamos para a tua operação e mostramos onde está o maior retorno.
Pedir avaliação gratuita