Blog
Quello che impariamo misurando la spesa in IA di aziende che la usano già in produzione.
-
Prezzi dei token: i cambiamenti del 2026 che alzano la tua fattura senza che tu tocchi nulla
Promozioni con scadenza, fasce di contesto lungo, sovrapprezzi per residenza dei dati e un aumento già annunciato per gennaio 2027. Cosa è cambiato in OpenAI, Anthropic e Google, e cosa farci.
Leggi → -
Modello proprio vs API: quando conviene il self-hosting
Quando conviene ospitare il proprio modello invece di pagare a richiesta API: la soglia reale di volume, i costi che nessuno somma e come decidere con i numeri.
Leggi → -
Perché il contesto lungo fa esplodere il costo dell'IA
Ogni token di contesto si paga a ogni richiesta. Perché le finestre lunghe moltiplicano la fattura e come ridurle senza perdere qualità.
Leggi → -
Come monitorare la spesa in IA: quali metriche seguire
Cosa misurare per controllare il costo dell'IA: costo per attività, per utente e per endpoint. Senza quelle tre metriche non sai dove stai pagando troppo.
Leggi → -
Cos'è un token di IA e come viene fatturato
Un token è l'unità in cui i modelli di IA leggono e fatturano il testo: circa 4 caratteri o 0,75 parole. Come si contano e perché decidono la tua bolletta.
Leggi → -
Quale modello usare per ogni attività: la leva di costo più grande
Come scegliere il modello di IA in base all'attività: la maggior parte si risolve con un modello piccolo a una frazione del prezzo. Tabella attività → modello → costo e come instradare.
Leggi → -
Batch API: metà del costo se l'attività può attendere
Cos'è il batch API e quanto fa risparmiare: circa il 50 % rispetto alle richieste in tempo reale, in cambio di non essere immediato. Quali attività ci stanno e quali no.
Leggi → -
Prompt caching: paga una volta il contesto che si ripete
Cos'è il prompt caching e quanto fa risparmiare: 50-90 % sui token di contesto che riutilizzi tra le richieste. Quando conviene e come attivarlo senza toccare la qualità.
Leggi → -
Come ridurre la bolletta di OpenAI: 7 leve di risparmio
Sette modi per abbassare il costo dell'API di IA senza perdere qualità, ordinati per quanto fanno risparmiare. La maggior parte si applica in ore, non in settimane.
Leggi → -
GPT-4o, Claude e Gemini: prezzi delle API a confronto (2026)
Quanto costa ogni modello per milione di token e, ciò che conta davvero, quanto finisce per costare ciascuno nel tuo caso a seconda del volume. La tabella e il perché.
Leggi → -
RAG, fine-tuning o contesto lungo: quale costa meno per il tuo caso
Il confronto si fa di solito sulla qualità. Ma la decisione si rompe quasi sempre sul costo, e lì le tre opzioni si comportano in modo molto diverso.
Leggi → -
Costo per token e costo per attività: perché la tua fattura di IA sale anche se i prezzi scendono
OpenAI ha tagliato i prezzi delle API fino all'80% e molte aziende hanno visto la fattura salire il mese successivo. La spiegazione sta nell'unità che stai misurando.
Leggi →