Che cos'è questo strumento?
Le API LLM vengono fatturate per token, non per richiesta — e i token di input (il prompt, i messaggi di sistema, la cronologia della chat) hanno un prezzo diverso rispetto ai token di output (ciò che genera il modello), solitamente con un ricarico di 4-8 volte per l’output. Questa distinzione rende difficile valutare a occhio «quanto costerà», soprattutto quando si confrontano modelli di fornitori diversi con listini prezzi differenti.
Questo calcolatore prende il numero di token in ingresso e in uscita, moltiplica ciascuno di essi per la tariffa per milione di token del modello selezionato e li somma: lo stesso calcolo effettuato dal sistema di fatturazione del fornitore. Aggiungendo il volume mensile di richieste, il calcolatore fornisce una stima del totale mensile, utile per definire il budget prima di scegliere un modello da implementare in produzione.
Perché usarlo?
- 19 modelli di OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu e xAI: opzioni economiche, di fascia media e di punta, comprese le principali API dei modelli cinesi e Grok.
- Una tabella comparativa affiancata classifica ogni modello in base al costo per il numero esatto di gettoni che ti serve, così non dovrai calcolare ogni singolo modello a mano.
- Ripartizione separata dei costi di input e output, poiché i token di output hanno un prezzo parecchie volte superiore a quello dei token di input su ogni provider.
- Volume mensile di richieste (facoltativo) per una rapida proiezione di bilancio, non solo una stima basata su una singola richiesta.
- I prezzi sono stati verificati direttamente sulla base della documentazione fornita dal venditore, con indicazione della data di verifica — non sono stati ricavati da fonti esterne né stimati.
- 100% locale — nessuna chiave API, nessun account, nessun dato esce dal tuo browser.
Come si usa
- Seleziona un modello dal menu a tendina, raggruppati per fornitore (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Inserisci il numero di token di input (prompt + messaggio di sistema + eventuale contesto) e il numero di token di output previsto.
- Leggi il costo per richiesta, suddiviso in costo di input e costo di output.
- Se lo desideri, inserisci il numero di richieste mensili per visualizzare una stima del costo mensile.
- Scorri verso il basso fino alla tabella comparativa per vedere tutti i modelli classificati in base al costo a parità di numero di gettoni.
Esempio
Input
GPT-5.6 Terra, 1,000 input tokens, 500 output tokensRisultato
Input cost $0.0025 + output cost $0.0075 = $0.01 per requestCon 10.000 richieste al mese, si tratta di circa 100 dollari al mese: i piccoli costi per singola richiesta si accumulano rapidamente quando si raggiungono grandi volumi, ed è proprio per questo che è importante fare i conti prima di scegliere un modello.
Comprendere la differenza tra costi di input e costi di output
Ogni modello presente in questo elenco applica tariffe separate ai token di input e di output, e il divario tra i due è ampio e costante tra i vari fornitori: l’output costa sistematicamente 5-6 volte di più per token rispetto all’input. Ciò significa che una risposta del modello prolissa e dettagliata costa sproporzionatamente di più rispetto a un prompt lungo con una risposta breve, anche se il numero totale di token appare simile.
Implicazione pratica: se si sta ottimizzando la spesa per l'API, ridurre la lunghezza dell'output (istruzioni più concise fornite dal sistema, come "rispondi in un paragrafo") di solito comporta un risparmio maggiore rispetto alla riduzione dell'input, token per token.
Costo mensile approssimativo in base al modello di utilizzo
Si tratta di esempi illustrativi, non di cifre precise: per ottenere un valore esatto, utilizza il calcolatore qui sopra inserendo il numero di token e il modello che preferisci.
| Modello di utilizzo | Token tipici/richiesta | Modello di esempio | Costo mensile approssimativo (10.000 richieste) |
|---|---|---|---|
| Risposte brevi del chatbot | 300 in entrata / 150 in uscita | GPT-5.4 Nano | ≈ 2-3 $ al mese |
| Etichettatura e classificazione dei dati | 500 in entrata / 50 in uscita | DeepSeek V4 Flash | ≈ 1 $ al mese |
| Sintesi di documenti | 3.000 in entrata / 400 in uscita | Claude Sonnet 5 | ≈ 100 $ al mese |
| Assistente alla generazione del codice | 1.500 in entrata / 1.000 in uscita | Gemini 3.5 Flash | ≈ 110-115 $ al mese |
| Redazione di contenuti di approfondimento | 1.000 in entrata / 2.500 in uscita | GPT-5.6 Sol | ≈ 800 $ al mese |
Domande frequenti
Perché in tutti i modelli il prezzo del prodotto finale è così superiore a quello dei fattori di produzione?
La generazione dei token (output) richiede un passaggio completo in avanti attraverso il modello per ogni nuovo token, eseguito in modo sequenziale, mentre l’elaborazione dei token di input (il prompt) può avvenire in parallelo in un unico batch. Questo costo di calcolo asimmetrico è il motivo per cui tutti i principali fornitori applicano all’output una tariffa pari a circa 4-8 volte quella dell’input.
Come faccio a sapere quanti token userà il mio prompt?
Utilizza lo strumento "Token Counter" di CodeKitHub: incolla il tuo prompt o messaggio di sistema effettivo e ti mostrerà il conteggio esatto dei token utilizzando il tokenizer reale, anziché una stima approssimativa basata sui caratteri. Il numero di token in uscita è più difficile da prevedere in anticipo; un approccio ragionevole consiste nel verificare l'utilizzo effettivo da alcune risposte API reali e utilizzarlo come stima.
È garantito che questi prezzi siano aggiornati?
No — I prezzi delle API dei fornitori di IA cambiano piuttosto spesso, a volte con scarso preavviso. I prezzi riportati in questo strumento sono stati verificati direttamente sulla pagina ufficiale dei prezzi di ciascun fornitore alla data indicata accanto al calcolatore. Prima di stabilire un budget o prendere una decisione di acquisto, controlla tu stesso la pagina aggiornata: Prezzi di OpenAI (developers.openai.com/api/docs/pricing), prezzi di Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) e prezzi di Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Perché [il mio modello preferito] non è nell'elenco?
Questo strumento copre una selezione rappresentativa di modelli di fascia economica, media e di punta offerti da OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu e xAI (19 modelli in totale), anziché tutti i modelli offerti da ciascun fornitore, per rendere l’elenco di facile consultazione e garantire l’accuratezza dei dati sui prezzi. Se avete bisogno di un modello che non è presente nell'elenco, controllate il suo prezzo per 1 milione di token sulla pagina del fornitore ed effettuate manualmente lo stesso calcolo del costo di input più il costo di output.
Il prezzo della versione di anteprima di Gemini 3.1 Pro tiene conto dei prompt lunghi?
No — il prezzo indicato corrisponde alla fascia di Google per un massimo di 200.000 token. Le tariffe di Gemini aumentano per i prompt più lunghi di tale soglia, ma questo calcolatore non tiene conto di tale fascia di sovrapprezzo, per mantenere lo strumento semplice. Se i tuoi prompt superano regolarmente i 200.000 token, consulta la pagina dei prezzi di Google per conoscere l’esatta tariffa applicabile ai contesti lunghi.
I prezzi di DeepSeek, Qwen, Kimi e GLM sono espressi in dollari statunitensi?
Sì — tutti i prezzi indicati in questo strumento, compresi i modelli cinesi, corrispondono alle tariffe API internazionali ufficiali in USD, quindi è possibile confrontare ogni modello sulla stessa base. Alcuni di questi fornitori offrono anche console fatturate in CNY per gli account della Cina continentale a tariffe diverse (spesso inferiori); controlla la console del fornitore stesso se la fatturazione è in CNY.