Calculadora de contexto de OpenAI

Compara los tokens que ya ocupa una solicitud con la ventana de contexto disponible y calcula cuánto espacio queda antes de alcanzar el límite.

Datos de cálculo

tokens
tokens
tokens
tokens
tokens
Resultado
Resultado estimado
Tokens comprometidos
Margen restante
Uso del contexto
Entrada antes de reservar salida

1. Indica la ventana máxima
Usa el límite de contexto del modelo que vas a utilizar; no confundas contexto total con máximo de salida.

2. Suma el contexto fijo
Incluye instrucciones de sistema, políticas y otros bloques enviados en cada solicitud.

3. Añade historial o documentos
Introduce los tokens que aportan conversación previa, archivos recuperados u otro contexto dinámico.

4. Reserva la nueva entrada y la salida
La respuesta necesita espacio dentro del presupuesto total; reservarla reduce el margen disponible.

5. Comprueba el margen
Un resultado cercano a cero indica que pequeñas variaciones pueden provocar truncamiento o que necesites reducir el contexto.

tokens comprometidos = sistema + historial/documentos + nueva entrada + salida reservada

margen = ventana de contexto − tokens comprometidos

uso (%) = tokens comprometidos ÷ ventana × 100

Qué significa el resultado

El margen indica cuántos tokens quedan dentro de la ventana después de reservar espacio para la respuesta.

Los límites concretos dependen del modelo y pueden distinguir entre contexto total y máximo de salida; consulta la documentación vigente del modelo.

Datos: ventana de 1.050.000 tokens, 2.000 de sistema, 120.000 de historial, 8.000 de nueva entrada y 16.000 reservados para salida.

Cálculo: comprometidos = 2.000 + 120.000 + 8.000 + 16.000 = 146.000. Margen = 1.050.000 − 146.000 = 904.000.

Resultado: quedan 904.000 tokens; se utiliza aproximadamente el 13,90 % de la ventana.

¿La ventana de contexto es lo mismo que la salida máxima?

No necesariamente. Un modelo puede admitir una ventana total grande y, a la vez, limitar cuántos tokens puede generar en una respuesta.

¿Debo contar los documentos recuperados por RAG?

Sí, si su contenido se inserta en la solicitud. Esos tokens consumen parte de la ventana junto con instrucciones, historial y pregunta.

¿Qué pasa si el margen es negativo?

La combinación no cabe en la ventana configurada. Debes reducir contexto, reservar menos salida cuando sea razonable o elegir una configuración con mayor capacidad.

¿Conviene usar el 100 % del contexto?

Operar con margen suele ser más robusto porque la longitud real de la entrada y la salida puede variar entre solicitudes.

¿Cómo obtengo un recuento más preciso?

Usa los datos de uso de la API o un tokenizador compatible con el modelo. Las estimaciones manuales son útiles para diseño, pero no sustituyen el recuento real.