CodeKitHub
Português
A API de LLM mais barata em 2026: comparação completa de preços, 19 modelos

A API de LLM mais barata em 2026: comparação completa de preços, 19 modelos

Publicado em 25 de jul. de 2026

Se você está a escolher uma API de LLM apenas com base no custo, a diferença é maior do que a maioria das pessoas espera. Comparando os 19 modelos que a Calculadora de preços de API LLM deste site acompanha — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM e xAI — o modelo mais barato e o mais caro diferem em mais de 60x numa base comparável. Essa diferença importa muito mais do que o logótipo do fornecedor a que está habituado.

A classificação

Para comparar de forma justa, cada modelo abaixo é avaliado com uma taxa combinada: 750.000 tokens de entrada + 250.000 tokens de saída por cada 1M de tokens totais, aproximando-se de um pedido típico de estilo chat em que a resposta é mais curta do que o prompt. Os preços são por 1M de tokens, verificados na página de preços oficial de cada fornecedor.

Posição Modelo Fornecedor Entrada Saída Combinado (3:1)
1 Gemini 2.5 Flash-Lite Google $0.10 $0.40 $0.175
1 DeepSeek V4 Flash DeepSeek $0.14 $0.28 $0.175
3 Qwen3.6 Flash Qwen $0.19 $1.13 $0.42
4 GPT-5.4 Nano OpenAI $0.20 $1.25 $0.46
5 DeepSeek V4 Pro DeepSeek $0.44 $0.87 $0.54
6 Grok Code Fast 1 xAI $1.00 $2.00 $1.25
7 GPT-5.4 Mini OpenAI $0.75 $4.50 $1.69
8 Claude Haiku 4.5 Anthropic $1.00 $5.00 $2.00
9 GLM-5.2 Zhipu $1.40 $4.40 $2.15
10 GPT-5.6 Luna OpenAI $1.00 $6.00 $2.25
11 Grok 4.5 xAI $2.00 $6.00 $3.00
12 Gemini 3.5 Flash Google $1.50 $9.00 $3.38
13 Qwen3.7 Max Qwen $2.50 $7.50 $3.75
14 Claude Sonnet 5 Anthropic $2.00 $10.00 $4.00
15 Gemini 3.1 Pro Preview Google $2.00 $12.00 $4.50
16 GPT-5.6 Terra OpenAI $2.50 $15.00 $5.63
17 Kimi K3 Moonshot $3.00 $15.00 $6.00
18 Claude Opus 5 Anthropic $5.00 $25.00 $10.00
19 GPT-5.6 Sol OpenAI $5.00 $30.00 $11.25

Há vários pontos a destacar. Cada fornecedor — não apenas um — tem um nível económico e um nível topo de gama separados por vários múltiplos, por isso “qual fornecedor é mais barato” é a pergunta errada; “qual modelo específico” é a certa. Em segundo lugar, os dois modelos mais baratos (Gemini 2.5 Flash-Lite e DeepSeek V4 Flash) caem exatamente na mesma taxa combinada apesar de virem de empresas sem qualquer ligação entre si — no extremo inferior, os preços de nível económico convergiram, em vez de um fornecedor estar simplesmente a praticar preços mais baixos do que o resto do mercado.

Por que o modelo mais barato não é automaticamente a escolha certa

O preço por si só não lhe diz se um modelo é suficientemente bom para a sua tarefa. Os modelos de nível económico costumam ser adequados para classificação, extração, respostas curtas e outras tarefas restritas e bem definidas — o tipo de trabalho em que a capacidade extra de raciocínio de um modelo topo de gama acaba por não ser usada. São menos adequados para raciocínio aberto, fluxos de agentes longos com múltiplas etapas, ou tarefas em que uma resposta errada é cara de corrigir mais tarde; um modelo mais barato que erra a tarefa e precisa de uma nova tentativa (ou de uma correção humana) pode acabar por custar mais do que um modelo mais caro que acerta à primeira.

Um ponto de partida razoável: crie um protótipo com o modelo que conhece melhor e, depois de a tarefa estar bem definida, teste se um modelo de nível económico da mesma tabela produz um resultado aceitavelmente semelhante — se produzir, a poupança acumula-se à escala; se não produzir, a diferença de preço não era, de qualquer forma, o verdadeiro fator de custo.

Calcular o seu número real

Esta tabela usa uma mistura fixa de 3:1 para tornar a classificação possível, mas a sua divisão real de tokens de entrada/saída quase de certeza não é 3:1 — uma tarefa de resumo pode ser 10:1, uma tarefa de geração de código mais próxima de 1:2. A classificação combinada acima é um bom ponto de partida para escolher candidatos a testar, não um substituto para calcular o seu custo específico.

Para isso, use diretamente a Calculadora de preços de API LLM: introduza as suas contagens reais de tokens de entrada e saída e ela calcula o custo exato para qualquer um destes 19 modelos, além de uma estimativa mensal se souber aproximadamente quantos pedidos vai fazer. Se ainda não souber as suas contagens de tokens, a ferramenta Contador de tokens de IA dá-lhe o número real a partir de um prompt concreto, em vez de uma estimativa aproximada. Ambas funcionam inteiramente no seu navegador — sem chave de API, sem conta, nada é enviado para lado nenhum.

← Voltar ao blog