Un token es la unidad mínima en la que un modelo de IA lee, escribe y factura el texto. No es una palabra ni una letra: es un fragmento. En español y en inglés, un token equivale de media a unos 4 caracteres, o aproximadamente 0,75 palabras. Todo lo que pagas en una API de IA se mide en tokens, de entrada y de salida.

De un vistazo

Qué esLa unidad en la que el modelo trocea el texto
Tamaño medio~4 caracteres · ~0,75 palabras
Referencia rápida1.000 tokens ≈ 750 palabras ≈ 1,5 páginas
Cómo se facturaPor tokens de entrada y de salida, con precios distintos

Cómo se trocea el texto

El modelo no ve palabras, ve tokens. Las palabras comunes suelen ser un solo token; las raras, los nombres propios, los números largos o las palabras en otros idiomas se parten en varios. Por eso el mismo texto traducido puede costar más o menos según el idioma: no cambia el contenido, cambia en cuántos trozos se corta.

Entrada y salida se cobran distinto

Cada petición paga dos cosas: los tokens que envías (entrada: tu prompt, las instrucciones, el contexto) y los que el modelo devuelve (salida: su respuesta). La salida cuesta bastante más por token que la entrada, así que una respuesta larga pesa más en la factura de lo que parece.

Por qué esto determina tu factura

Tu coste no depende de cuántas peticiones haces, sino de cuántos tokens mueves. Un prompt con un documento entero pegado dentro puede costar más que cien preguntas cortas. La fórmula es siempre la misma: tokens × precio por token × volumen de peticiones. De ahí sale el coste por tarea, que es la métrica que de verdad importa.

Cuenta los tuyos

Mete tus tokens de entrada y de salida y tu volumen mensual en la calculadora de coste de tokens y compáralo entre modelos: verás en un minuto de dónde sale tu gasto. Si el número te sorprende, empieza por las 7 palancas para reducir la factura.

Preguntas frecuentes

¿Cuántas palabras son 1.000 tokens? Alrededor de 750 palabras, o unas 1,5 páginas de texto corrido. Es una media: los números, los nombres propios y los idiomas menos frecuentes gastan más tokens por palabra.

¿Se cobran igual la entrada y la salida? No. La salida cuesta varias veces más por token que la entrada, por eso limitar la longitud de las respuestas es una de las palancas de ahorro más rápidas.

¿Cuenta el prompt del sistema? Sí. Todo lo que envías cuenta como entrada en cada petición, incluidas las instrucciones fijas, salvo que uses prompt caching para no pagarlas cada vez.


En e-ficient medimos el coste por tarea de empresas que ya tienen IA en producción y te decimos cuánto ahorrarías con cada palanca a tu volumen real. La primera auditoría es gratuita si contratas un plan con compromiso de tres meses y devuelve un diagnóstico en 72 horas.