Recursos · Calculadoras

    Calculadora de custo de IA por tokens

    O custo de uma API de IA resume-se a quatro números: pedidos por mês, tokens de entrada, tokens de saída e o preço do modelo. Os valores iniciais são o exemplo do nosso artigo sobre como calcular o custo de um projeto de IA: um chatbot de suporte com 300 mil pedidos por mês. Também lhe podes chamar simulador: os valores mudam à medida que mexes nos cursores.

    Os teus números
    pedidos

    Mil utilizadores com dez pedidos por dia são 300 mil por mês.

    tokens

    Pergunta, instruções e contexto. 1 token ≈ 0,75 palavras.

    tokens

    A resposta gerada.

    %

    Para picos e respostas mais longas: 20% a 30%.

    Modelo
    Resultado
    Custo por mês, com margem720 US$
    Sem margem600 US$
    Por pedido0,0020 US$
    Por ano, com margem8.640 US$
    O mesmo volume noutros modelos
    ModeloInput / output por milhãoCusto por mês
    Claude Fable 5.1$10.00 / $50.006.000 US$
    Claude Opus 5$5.00 / $25.003.000 US$
    Claude Sonnet 5$2.00 / $10.001.200 US$
    Claude Haiku 4.5$1.00 / $5.00600 US$
    GPT-5.5$5.00 / $30.003.450 US$
    GPT-5.6 sol$4.00 / $20.002.400 US$
    GPT-5.4$2.50 / $15.001.725 US$
    GPT-5.6 terra$2.00 / $12.001.380 US$
    GPT-5.4 nano$0.20 / $1.25143 US$
    GPT-5.6 luna$0.20 / $1.20138 US$
    Gemini 3.1 Pro$2.00 / $12.001.380 US$
    Gemini 3.5 Flash$1.50 / $9.001.035 US$
    Gemini 3.8 Flash$0.75 / $3.75450 US$
    Gemini 2.5 Flash-Lite$0.10 / $0.4051,00 US$

    Preços de tabela em dólares, sem descontos de caching (até 90%) nem batch (50%), conferidos nas páginas oficiais dos fornecedores a 16 de setembro de 2026 (ligações em Fontes). Mudam com frequência: confirma sempre antes de decidir.

    Estimativa indicativa: os valores reais dependem do teu processo e dos teus dados.

    Custo por mês, com margem720 US$

    Como é calculado

    Custo por mês = pedidos × (tokens de entrada × preço de entrada + tokens de saída × preço de saída) ÷ 1.000.000.

    Os preços são por milhão de tokens e o de saída é quase sempre cerca de cinco vezes o de entrada. Por isso a resposta pesa mais na fatura do que a pergunta, mesmo tendo menos tokens.

    A margem de segurança cobre variações de uso, conversas longas e respostas maiores do que o previsto. Numa proposta, apresenta sempre um intervalo e o volume em que assenta.

    Fontes

    Perguntas frequentes

    O que é um token?

    É a unidade em que os modelos leem e escrevem texto. Em média, um token corresponde a cerca de 0,75 palavras, e um milhão de tokens a cerca de 750 mil palavras.

    Como reduzo o custo sem perder qualidade?

    A maior alavanca é escolher o modelo certo para cada tarefa: tarefas simples raramente precisam do topo de gama. Depois, prompt caching para contexto repetido, batch para o que não precisa de resposta imediata e limites ao tamanho das respostas.

    Porque é que o mesmo volume custa tão diferente de modelo para modelo?

    Porque o preço por token varia mais de cem vezes entre o modelo mais barato e o mais caro. Dentro do mesmo fornecedor, a diferença entre modelos pesa mais do que a diferença entre fornecedores.

    Os preços estão em dólares. Quanto é em euros?

    Os fornecedores faturam em dólares. Converte ao câmbio do dia; como os preços e o câmbio mudam, trata o resultado como uma estimativa e não como um orçamento.

    Isto é uma calculadora ou um simulador?

    É a mesma coisa: mudas os valores e vês o resultado na hora, sem instalar nada nem deixar contacto. Se procuravas um simulador de custos de IA, é isto.

    Para aprofundar

    Outras calculadoras

    Queres ajuda a pôr isto em prática?

    Numa avaliação gratuita de 30 minutos olhamos para a tua operação e mostramos onde está o maior retorno.

    Pedir avaliação gratuita