🌐 ES

🧮 Calculadora de coste de tokens de IA

Calcula los costes de tokens para GPT, Claude, Gemini y otras API de LLM importantes. Introduce directamente la cantidad de tokens o pega texto para estimarlos y luego consulta el coste mensual proyectado.

Simulación de uso mensual

En el modo de pegar texto, o en el modo directo cuando se dejan en blanco la entrada y la salida, la simulación asume una distribución del 70% de entrada y 30% de salida por solicitud. Si en el modo directo se completan tanto los tokens de entrada como los de salida, se usan esos números exactos por solicitud.

Coste estimado (por solicitud)
Coste de entrada Coste de salida Coste total
Coste de entrada si está en caché (referencia)

La caché real se aplica a prompts del sistema o contexto repetidos, no a un texto nuevo completo en cada llamada.

Fuente:
Simulación de uso mensual
Coste por día Coste por mes (×30) Coste por año (×365)
GUÍA

Más información

01

1. Por qué estimar el coste de la API de LLM antes de escalar

Calcular el coste previsto antes de integrar una API de LLM en una nueva función o producto evita que una base de usuarios en crecimiento se convierta en una factura inmanejable. Esto importa aún más en servicios con prompts largos o conversaciones de varios turnos: una sola solicitud puede parecer barata, pero las cifras cambian rápido cuando las multiplicas por el volumen diario o mensual. Esta calculadora muestra tanto el coste por solicitud como una simulación mensual para que tengas una idea del presupuesto antes de escalar.

02

2. En qué se diferencian los tokens de las palabras y los caracteres

Un token es la unidad más pequeña en la que un modelo procesa texto, y no se corresponde 1:1 con palabras o caracteres. Una regla práctica habitual para inglés es de aproximadamente 4 caracteres por token, pero solo es una aproximación: los recuentos reales dependen del tokenizador de cada modelo (por ejemplo, de tipo BPE). Los idiomas CJK (coreano, japonés y chino), en particular, suelen usar más tokens por carácter que el inglés, ya que un solo carácter a menudo se divide en varios subword tokens; por eso, la misma cantidad de caracteres puede costar bastante más que un texto equivalente en inglés.

03

3. Por qué el precio de entrada y salida es distinto

La mayoría de los proveedores fija el precio de los tokens de salida (generados) varias veces por encima de los tokens de entrada (prompt), y todos los modelos de este conjunto siguen ese patrón. La entrada se puede procesar (codificar) de una vez, mientras que la salida tiene que generarse (decodificarse) token a token, con más cómputo y latencia por token. Por eso, mantener las respuestas breves es una palanca especialmente eficaz para reducir costes.

04

4. Qué es la caché de prompts

La caché de prompts (caché de contexto) permite que un proveedor almacene en su servidor un prompt del sistema, un contexto largo o un documento, y luego cobre una tarifa mucho más baja cuando ese mismo contenido vuelve a aparecer en una solicitud posterior. Rinde especialmente bien en configuraciones conversacionales en las que un prompt del sistema o el historial del chat se retransmiten en cada turno. No se aplica cuando cada solicitud envía texto realmente nuevo, así que la cifra de "si está en caché" de esta calculadora es un escenario de referencia, no una garantía.

05

5. Cómo reducir los costes de tokens en producción

(1) Mantén los prompts tan cortos como realmente requiera la tarea e incluye solo el contexto necesario. (2) Aprovecha la caché de prompts para prompts del sistema o contexto que se repiten entre solicitudes. (3) Deriva tareas simples como clasificación o resumen a un modelo más barato y pequeño en lugar de tu modelo insignia. (4) Agrupa varias solicitudes para aprovechar descuentos por lotes u optimizaciones de rendimiento. Solo estas cuatro palancas ya pueden recortar de forma importante el coste operativo real.

06

6. Limitaciones de esta calculadora

Esta calculadora estima el coste a partir de las tarifas públicas de lista de cada proveedor para su API. No tiene en cuenta descuentos por volumen, contratos empresariales, rendimiento reservado, créditos gratis, diferencias de precio regionales ni la ralentización efectiva derivada de los límites de tasa. Los importes facturados reales pueden variar según las condiciones de tu contrato; úsala como punto de partida para presupuestar y confirma las cifras finales directamente con el proveedor.

Preguntas frecuentes

¿Qué precisión tiene la estimación de texto a token?
~4 caracteres por token es una regla práctica aproximada basada en texto en inglés. Los tokenizadores reales varían según el modelo, y el texto no inglés (coreano, japonés, chino, etc.) puede desviarse más de esta aproximación. Para obtener recuentos exactos, pasa el texto por el tokenizador oficial del proveedor del modelo.
¿Por qué la salida es más cara que la entrada?
Generar tokens uno a uno (decodificación) requiere más cómputo que procesar la entrada de una vez (codificación), por eso la mayoría de los proveedores fija el precio de los tokens de salida varias veces por encima de los de entrada.
¿Esto incluye tokens de imagen o audio?
No. Esta calculadora solo maneja tokens de texto. Las entradas de imagen, audio y vídeo suelen facturarse con esquemas de precios separados que quedan fuera del alcance de esta herramienta.
¿Con qué frecuencia se actualizan estos precios?
Manual, según la fecha mostrada en el campo as_of del archivo de datos. Los precios del proveedor pueden cambiar sin previo aviso, así que confirma siempre las cifras más recientes en la página oficial de precios del proveedor antes de cerrar un presupuesto.