Planificador de presupuesto de tokens para datos sintéticos

Esta calculadora estima cuántos tokens puede consumir un trabajo de generación de datos sintéticos durante un periodo definido. Combina el número de muestras o tareas previstas, los tokens de entrada y salida por tarea y un margen adicional para reintentos, mensajes de sistema o variación entre ejemplos. Resulta útil al preparar lotes de entrenamiento, pruebas de coste o límites de uso antes de lanzar una generación a gran escala.

El resultado principal es el presupuesto total de tokens. También muestra el consumo diario y el volumen medio por tarea, de modo que puedas comparar configuraciones de prompt, tamaño de salida y duración del lote sin depender de un precio concreto de proveedor.

Volumen y tamaño de las solicitudes

tareas
tokens
tokens
días
%
Resultado
Tokens presupuestados
Tokens por día
Tokens por tarea
Total sin margen

1. Indica las tareas diarias. Usa el número de ejemplos sintéticos que esperas generar cada día.

2. Añade los tokens de entrada. Incluye instrucciones, contexto y cualquier ejemplo que viaje en cada solicitud.

3. Estima los tokens de salida. Introduce el tamaño medio de la respuesta generada por tarea.

4. Define la duración. Introduce cuántos días se ejecutará el lote o campaña de generación.

5. Reserva un margen. Usa el porcentaje adicional para cubrir reintentos y variación del tamaño real.

6. Revisa el presupuesto. Compara el total con tus límites operativos o con otro escenario de prompt.

Tokens totales = tareas/día × (tokens entrada + tokens salida) × días × (1 + margen/100)

El margen se aplica al volumen total estimado. Los tokens por tarea son la suma de entrada y salida; el consumo diario se obtiene multiplicando esa cifra por las tareas diarias.

Qué significa el resultado

El resultado representa el volumen total aproximado de tokens que debes reservar para el periodo y el patrón de uso introducido.

Es una estimación de planificación: el consumo real puede variar por tokenización, longitud de los mensajes, reintentos y comportamiento del modelo.

Datos: 18.000 tareas/día, 700 tokens de entrada, 450 de salida, 14 días y 8 % de margen.

Cálculo: tokens base por tarea = 700 + 450 = 1.150. Tokens base = 18.000 × 1.150 × 14 = 289.800.000. Con margen: 289.800.000 × 1,08 = 312.984.000 tokens.

Resultado: presupuesto aproximado de 312.984.000 tokens, es decir, unos 22.356.000 tokens al día.

¿El margen adicional aumenta tanto la entrada como la salida?

Sí. En este modelo el margen se aplica al consumo total previsto, por lo que cubre cualquier crecimiento del conjunto de tokens. Si solo quieres reservar margen para una parte, ajusta previamente ese componente.

¿Debo contar los tokens de ejemplos incluidos en el prompt?

Sí. Si esos ejemplos se envían en cada tarea, forman parte de los tokens de entrada y deben incluirse en la media por solicitud.

¿El resultado equivale al coste en dinero?

No. El presupuesto está expresado en tokens. Para obtener un coste necesitas aplicar las tarifas de entrada y salida del modelo o usar la calculadora de coste por tarea.

¿Qué hago si unas tareas son mucho más largas que otras?

Usa una media representativa y un margen acorde a la dispersión, o calcula por separado los grupos con tamaños de prompt muy distintos. Eso evita que una única media oculte picos relevantes.

¿Sirve para presupuestar reintentos por validación de calidad?

Sí, siempre que los representes mediante el margen adicional o aumentes las tareas diarias. Conviene usar el método que mejor refleje cómo se repiten realmente las generaciones.