Planificador de presupuesto de tokens para agentes de voz con IA

Este planificador estima cuántos tokens puede necesitar un agente de voz con IA durante un periodo mensual a partir de la duración de las sesiones, el consumo medio de tokens por minuto y el número previsto de sesiones. También permite añadir un margen de seguridad para absorber variaciones de conversación, instrucciones más largas o picos de uso.

El cálculo es útil para preparar presupuestos de capacidad y comparar diseños de prompts o estrategias de contexto antes de desplegar a mayor escala. No presupone un modelo concreto: el objetivo es convertir una carga conversacional esperada en un volumen de tokens que después pueda relacionarse con costes o límites operativos reales.

Datos de cálculo

min
tokens/min
tokens/min
sesiones
%
Resultado
tokens presupuestados al mes
Tokens por sesión
Tokens mensuales sin margen
Reserva añadida

1. Estima la duración media

Introduce los minutos que suele durar una sesión de voz completa.

2. Define el consumo por minuto

Añade los tokens de entrada y de salida que esperas consumir por minuto de conversación.

3. Indica el volumen mensual

Introduce el número de sesiones previstas en el mes.

4. Añade un margen

Usa el margen de seguridad para cubrir dispersión entre conversaciones o crecimiento no planificado.

5. Revisa el presupuesto

Consulta los tokens por sesión y el presupuesto total mensual ajustado.

Tokens mensuales presupuestados = minutos por sesión × (tokens de entrada/min + tokens de salida/min) × sesiones/mes × (1 + margen/100)

Variables:

  • Minutos por sesión: duración media de una interacción de voz
  • Tokens de entrada/min: consumo medio de entrada por minuto
  • Tokens de salida/min: consumo medio generado por minuto
  • Sesiones/mes: número previsto de sesiones mensuales
  • Margen: porcentaje adicional de reserva

Supuestos: El consumo por minuto es un promedio representativo y las sesiones se tratan de forma homogénea para presupuestar capacidad.

Qué significa el resultado

El resultado es una reserva mensual de tokens basada en el consumo medio esperado y el margen introducido.

El consumo real puede variar por modelo, longitud del contexto, turnos, audio y comportamiento de los usuarios.

Datos:

  • 6 minutos por sesión
  • 900 tokens de entrada por minuto
  • 350 tokens de salida por minuto
  • 12.000 sesiones al mes
  • 15 % de margen

Cálculo:
6 × (900 + 350) = 7.500 tokens/sesión; 7.500 × 12.000 × 1,15 = 103.500.000 tokens

Resultado: Presupuesto = 103,5 millones de tokens al mes

Interpretación: El margen eleva el presupuesto por encima del consumo medio esperado para reducir el riesgo de quedarse corto ante sesiones más largas o verbosas.

¿Los tokens de audio siempre se contabilizan igual?

No. La forma de contabilizar audio, texto intermedio y salida depende de la arquitectura y del proveedor. Usa una estimación de tokens equivalente a lo que realmente mida o facture tu sistema.

¿Cómo obtengo tokens por minuto fiables?

Lo más útil es medir una muestra real de sesiones y dividir el consumo total entre los minutos procesados. Si todavía no tienes datos, trabaja con varios escenarios.

¿El margen de seguridad aumenta el uso real?

No; solo aumenta el presupuesto previsto. Sirve para reservar capacidad financiera u operativa por encima del promedio esperado.

¿Qué ocurre si las sesiones tienen duraciones muy distintas?

Un único promedio puede ocultar colas largas. En ese caso conviene calcular por segmentos de duración o usar un percentil operativo como escenario conservador.

¿Este presupuesto sirve también para calcular coste?

Sí, pero necesitas aplicar las tarifas reales de entrada y salida del modelo correspondiente. El planificador se centra en volumen de tokens, no en precios.