Calculadora de longitud de prompts

Esta calculadora estima la longitud de un prompt en tokens a partir del número de caracteres y una relación configurable de caracteres por token. También permite añadir una reserva de salida para ver cuánto contexto total puede ocupar una solicitud antes de enviarla a un modelo.

Es una herramienta de planificación, especialmente útil cuando todavía no se dispone del tokenizador exacto del modelo o se quiere hacer una estimación rápida sobre plantillas, instrucciones, documentos y variables insertadas. La relación caracteres/token cambia con el idioma, el contenido y el tokenizador, por lo que el valor debe interpretarse como aproximado. Para límites estrictos de producción conviene verificar después con el tokenizador oficial o el contador del proveedor.

Datos de cálculo

tokens
Resultado
Tokens estimados
Tokens de entrada
Reserva de salida
Contexto total estimado

1. Cuenta los caracteres
Incluye instrucciones, datos insertados y texto de contexto que viajarán en el prompt.

2. Ajusta la relación
Usa una media de caracteres por token adecuada a tu modelo o a mediciones anteriores.

3. Reserva salida
Indica cuántos tokens quieres dejar disponibles para la respuesta.

4. Revisa la entrada estimada
El valor principal sirve como aproximación del tamaño del prompt.

5. Comprueba el contexto total
Compáralo con la ventana del modelo que vayas a utilizar.

Tokens estimados = techo(Caracteres / Caracteres por token)
Contexto total = Tokens estimados + Reserva de salida

Qué significa el resultado

El resultado aproxima los tokens de entrada que puede ocupar el prompt.

La conversión carácter-token es una aproximación; texto, idioma y tokenizador pueden cambiar el recuento real.

Datos: 12.000 caracteres, 4 caracteres por token y 1.500 tokens reservados para salida.

Cálculo: Entrada ≈ techo(12.000 / 4) = 3.000 tokens. Contexto total = 3.000 + 1.500 = 4.500 tokens.

Resultado: 3.000 tokens de entrada estimados y 4.500 tokens de contexto total.

Interpretación: La solicitud debería planificarse como una carga aproximada de 4.500 tokens contando la respuesta reservada.

¿Por qué el recuento es aproximado?

Los tokenizadores dividen el texto según patrones propios, no por un número fijo de caracteres. Idioma, puntuación y vocabulario cambian la relación.

¿Debo contar también el prompt del sistema?

Sí, si forma parte del contexto enviado al modelo y necesitas estimar el uso total.

¿Qué valor uso para caracteres por token?

Lo mejor es derivarlo de ejemplos reales del mismo modelo y tipo de contenido. El valor predeterminado solo sirve como punto de partida editable.

¿La reserva de salida se consume siempre?

No. Es capacidad apartada para evitar que la respuesta se quede sin espacio; el consumo real puede ser menor.

¿En qué se diferencia de una calculadora de contexto?

La longitud del prompt estima la entrada; una calculadora de contexto se centra en cómo entrada, salida y otros elementos caben dentro de una ventana máxima.