Planificador de presupuesto de tokens para asistente de ventas con IA

Esta herramienta estima cuántos tokens puede consumir al día un asistente de ventas con IA a partir del volumen de conversaciones, los turnos de cada conversación y el tamaño medio de los mensajes de entrada y salida. También permite reservar tokens de contexto fijo por conversación, por ejemplo para instrucciones del sistema, datos del CRM o información de producto que se añade una sola vez al inicio.

El resultado es útil para preparar límites de uso, comparar escenarios antes de contratar capacidad y anticipar el gasto que después puede calcularse con una tarifa por millón de tokens. No pretende predecir exactamente el consumo de un modelo concreto: la tokenización varía según el modelo y el idioma, y herramientas externas, llamadas a funciones o historiales más largos pueden incrementar el contexto real.

Carga conversacional prevista

tokens
tokens
tokens
Resultado
tokens totales al día
Entrada diaria
Salida diaria
Proyección a 30 días
  1. Define el volumen diario. Introduce cuántas conversaciones espera atender el asistente en un día normal o en el escenario que quieras dimensionar.
  2. Estima la profundidad de cada conversación. Añade el número medio de turnos que requieren respuesta del modelo.
  3. Indica los tokens por turno. Usa medias representativas para la entrada del usuario y la respuesta de la IA, no el máximo teórico del modelo.
  4. Añade el contexto fijo. Incluye instrucciones, datos comerciales o fragmentos de CRM que se envían una vez por conversación.
  5. Revisa el total y el desglose. Compara entrada, salida y proyección de 30 días para planificar límites o costes.
Tokens/día = Conversaciones × [Turnos × (Tokens entrada + Tokens salida) + Contexto fijo]

La entrada diaria se calcula como Conversaciones × (Turnos × Tokens de entrada + Contexto fijo). La salida diaria es Conversaciones × Turnos × Tokens de salida.

Se supone que el contexto fijo se añade una vez por conversación y que las medias introducidas ya representan el comportamiento habitual. Si el historial completo se reenvía en cada turno, conviene incorporar ese crecimiento dentro de los tokens de entrada por turno.

Qué significa el resultado

El valor principal representa el presupuesto aproximado de tokens que generaría un día de uso con las medias introducidas.

La cifra es una estimación operativa; la tokenización real depende del modelo, el idioma y el contenido de cada solicitud.

Datos: 250 conversaciones/día, 6 turnos por conversación, 550 tokens de entrada por turno, 180 de salida y 700 de contexto fijo.

Cálculo: entrada = 250 × (6 × 550 + 700) = 1.000.000 tokens. Salida = 250 × 6 × 180 = 270.000 tokens. Total = 1.270.000 tokens/día.

Resultado: unos 1,27 millones de tokens al día, equivalentes a 38,1 millones en 30 días si la carga se mantiene.

¿Debo contar el historial de la conversación en cada turno?

Sí, si tu implementación lo vuelve a enviar al modelo. En ese caso, inclúyelo en la media de tokens de entrada por turno para evitar infravalorar el consumo.

¿Qué diferencia hay entre contexto fijo y tokens de entrada por turno?

El contexto fijo representa información añadida una vez por conversación en este modelo. Los tokens de entrada por turno corresponden al contenido que se procesa cada vez que el asistente responde.

¿Puedo usar caracteres o palabras en lugar de tokens?

La calculadora trabaja con tokens. Si solo tienes palabras o caracteres, conviértelos primero con una estimación adecuada al modelo y al idioma que vayas a usar.

¿La proyección de 30 días equivale a la factura mensual?

No necesariamente. Solo proyecta tokens; la factura depende de las tarifas de entrada y salida, caché, herramientas y otros cargos del proveedor.

¿Para qué sirve separar entrada y salida?

Muchos proveedores aplican precios distintos a cada dirección. Mantener el desglose facilita convertir después el presupuesto de tokens en un coste más realista.