Un token è l’unità minima in cui un modello di IA legge, scrive e fattura il testo. Non è una parola né una lettera: è un frammento. In italiano e in inglese, un token equivale in media a circa 4 caratteri, o all’incirca 0,75 parole. Tutto ciò che paghi su un’API di IA si misura in token, di ingresso e di uscita.

In sintesi

Cos’èL’unità in cui il modello spezza il testo
Dimensione media~4 caratteri · ~0,75 parole
Riferimento rapido1.000 token ≈ 750 parole ≈ 1,5 pagine
Come si fatturaPer token di ingresso e di uscita, a prezzi diversi

Come viene spezzato il testo

Il modello non vede parole, vede token. Le parole comuni di solito sono un solo token; quelle rare, i nomi propri, i numeri lunghi o le parole in altre lingue si spezzano in più parti. Per questo lo stesso testo tradotto può costare di più o di meno a seconda della lingua: non cambia il contenuto, cambia in quanti pezzi viene tagliato.

Ingresso e uscita si pagano in modo diverso

Ogni richiesta paga due cose: i token che invii (ingresso: il tuo prompt, le istruzioni, il contesto) e quelli che il modello restituisce (uscita: la sua risposta). L’uscita costa parecchio di più per token dell’ingresso, quindi una risposta lunga pesa in bolletta più di quanto sembri.

Perché questo decide la tua bolletta

Il tuo costo non dipende da quante richieste fai, ma da quanti token muovi. Un prompt con un documento intero incollato dentro può costare più di cento domande brevi. La formula è sempre la stessa: token × prezzo per token × volume di richieste. Da lì esce il costo per attività, la metrica che conta davvero.

Conta i tuoi

Inserisci i tuoi token di ingresso e di uscita e il tuo volume mensile nel calcolatore di costo dei token e confronta tra modelli: vedrai in un minuto da dove viene la tua spesa. Se il numero ti sorprende, parti dalle 7 leve per ridurre la bolletta.

Domande frequenti

Quante parole sono 1.000 token? Circa 750 parole, o all’incirca 1,5 pagine di testo corrente. È una media: i numeri, i nomi propri e le lingue meno frequenti consumano più token per parola.

Ingresso e uscita si pagano uguale? No. L’uscita costa diverse volte più per token dell’ingresso, per questo limitare la lunghezza delle risposte è una delle leve di risparmio più rapide.

Il system prompt conta? Sì. Tutto ciò che invii conta come ingresso a ogni richiesta, incluse le istruzioni fisse, a meno che tu non usi il prompt caching per non pagarle ogni volta.


In e-ficient misuriamo il costo per attività di aziende che hanno già l’IA in produzione e ti diciamo quanto risparmieresti con ogni leva al tuo volume reale. Il primo audit è gratuito se attivi un piano con impegno di tre mesi e restituisce una diagnosi in 72 ore.