O que é esta ferramenta?
As APIs de LLM são cobradas por token, não por requisição — e os tokens de entrada (seu prompt, mensagem de sistema, histórico de chat) têm preço diferente dos tokens de saída (o que o modelo gera), geralmente com um acréscimo de 4 a 8 vezes na saída. Essa divisão torna difícil estimar de cabeça "quanto isso vai custar", especialmente ao comparar modelos de fornecedores diferentes com tabelas de preços distintas.
Esta calculadora pega seus tokens de entrada e saída, multiplica cada um pela tarifa por milhão de tokens do modelo selecionado e soma os dois — o mesmo cálculo que o sistema de cobrança do fornecedor faz. Ao informar um volume mensal de requisições, ela projeta um total mensal, útil para orçamento antes de você se comprometer com um modelo em produção.
Por que usar?
- 19 modelos da OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu e xAI — opções econômicas, intermediárias e de ponta, incluindo as principais APIs de modelos chineses e o Grok.
- Uma tabela comparativa classifica todos os modelos por custo para os seus tokens exatos, sem precisar calcular cada um manualmente.
- Detalhamento separado de custo de entrada/saída, já que os tokens de saída custam várias vezes mais que os de entrada em todos os fornecedores.
- Volume mensal de requisições opcional para uma projeção rápida de orçamento, não apenas uma estimativa de requisição única.
- Preços verificados diretamente na documentação do fornecedor, com a data de verificação exibida — não extraídos automaticamente nem estimados.
- 100% local — sem chave de API, sem conta, nenhum dado sai do seu navegador.
Como usar
- Selecione um modelo no menu suspenso, agrupado por fornecedor (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Informe seu número de tokens de entrada (prompt + mensagem de sistema + contexto) e o número esperado de tokens de saída.
- Veja o custo por requisição, dividido em custo de entrada e custo de saída.
- Opcionalmente, informe requisições por mês para ver um custo mensal estimado.
- Role até a tabela comparativa para ver todos os modelos classificados por custo com os mesmos tokens.
Exemplo
Entrada
GPT-5.6 Terra, 1.000 tokens de entrada, 500 tokens de saídaResultado
Custo de entrada $0,0025 + custo de saída $0,0075 = $0,01 por requisiçãoCom 10.000 requisições/mês, isso dá aproximadamente $100/mês — custos pequenos por requisição somam rápido em escala, por isso vale fazer as contas antes de escolher um modelo.
Entendendo o custo de entrada vs. saída
Todo modelo desta lista precifica tokens de entrada e saída separadamente, e a diferença entre eles é grande e consistente entre fornecedores — a saída costuma custar de 5 a 6 vezes mais por token do que a entrada. Isso significa que uma resposta do modelo longa e detalhada custa desproporcionalmente mais do que um prompt longo com uma resposta curta, mesmo que a contagem total de tokens pareça semelhante.
Implicação prática: se você está otimizando gastos com API, reduzir o tamanho da saída (instruções mais curtas no prompt de sistema, como "responda em um parágrafo") geralmente economiza mais, token por token, do que reduzir a entrada.
Custo mensal aproximado por padrão de uso
Estes são exemplos ilustrativos, não orçamentos — use a calculadora acima com seus próprios números de tokens e modelo escolhido para obter um valor exato.
| Padrão de uso | Tokens típicos/requisição | Modelo de exemplo | Custo mensal aproximado (10 mil requisições) |
|---|---|---|---|
| Respostas curtas de chatbot | 300 entrada / 150 saída | GPT-5.4 Nano | ≈ $2-3/mês |
| Rotulagem e classificação de dados | 500 entrada / 50 saída | DeepSeek V4 Flash | ≈ $1/mês |
| Resumo de documentos | 3.000 entrada / 400 saída | Claude Sonnet 5 | ≈ $100/mês |
| Assistente de geração de código | 1.500 entrada / 1.000 saída | Gemini 3.5 Flash | ≈ $110-115/mês |
| Redação de conteúdo longo | 1.000 entrada / 2.500 saída | GPT-5.6 Sol | ≈ $800/mês |
Perguntas frequentes
Por que a saída é tão mais cara que a entrada em todos os modelos?
Gerar tokens (saída) exige uma passagem completa pelo modelo para cada novo token, executada sequencialmente, enquanto processar os tokens de entrada (o prompt) pode ser feito em paralelo, em um único lote. Essa assimetria de custo computacional é o motivo pelo qual todos os grandes fornecedores cobram a saída a cerca de 4 a 8 vezes o valor da entrada.
Como sei quantos tokens meu prompt vai usar?
Use a ferramenta Contador de Tokens de IA do CodeKitHub — cole seu prompt ou mensagem de sistema real e ela mostra a contagem exata de tokens usando o tokenizador real, em vez de uma estimativa aproximada baseada em caracteres. A contagem de tokens de saída é mais difícil de prever antecipadamente; uma abordagem razoável é verificar o uso real em algumas respostas de API reais e usar isso como estimativa.
Esses preços têm garantia de estarem atualizados?
Não — os preços de API dos fornecedores de IA mudam com certa frequência, às vezes com pouco aviso prévio. Os preços nesta ferramenta foram verificados diretamente na página oficial de preços de cada fornecedor na data mostrada perto da calculadora. Antes de tomar uma decisão de orçamento ou compra, verifique você mesmo a página atual: preços da OpenAI (developers.openai.com/api/docs/pricing), preços da Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) e preços do Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Por que meu modelo favorito não está na lista?
Esta ferramenta cobre uma amostra representativa das faixas econômica/intermediária/de ponta da OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu e xAI (19 modelos no total), em vez de todos os modelos de cada fornecedor, para manter a lista fácil de consultar e os dados de preços fáceis de manter atualizados. Se você precisa de um modelo que não está listado, verifique o preço por milhão de tokens na página do fornecedor e faça o mesmo cálculo (custo de entrada + custo de saída) manualmente.
O preço do Gemini 3.1 Pro Preview considera prompts longos?
Não — o preço mostrado é o da faixa de ≤200 mil tokens do Google. O preço do Gemini aumenta para prompts acima desse limite, e esta calculadora não modela essa faixa de acréscimo, para manter a ferramenta simples. Se seus prompts costumam ultrapassar 200 mil tokens, consulte a página de preços do Google para a tarifa exata de contexto longo.
Os preços de DeepSeek, Qwen, Kimi e GLM estão em dólares?
Sim — todos os preços nesta ferramenta, incluindo os modelos chineses, correspondem à tarifa oficial da API internacional em dólares, para que todos os modelos possam ser comparados na mesma base. Alguns desses fornecedores também oferecem consoles cobrados em yuan para contas da China continental, com tarifas diferentes (geralmente mais baixas); consulte o console do próprio fornecedor se você for cobrado em yuan.