Planificador de presupuesto de tokens para flujos multiagente

Este planificador estima el consumo de tokens de un flujo en el que varios agentes colaboran sobre cada tarea. En lugar de tratar el sistema como una única conversación, multiplica el consumo medio de cada agente por el número de participantes y rondas, y añade una sobrecarga para mensajes de coordinación, síntesis o traspasos.

La estimación ayuda a presupuestar experimentos multiagente y a detectar cuándo el coste de coordinación crece más rápido que el trabajo útil. Es un modelo agregado: si los agentes tienen roles con contextos muy distintos, conviene calcular cada rol por separado y sumar los resultados.

Datos de entrada

tareas
agentes
rondas
tokens
tokens
%
Resultado
Presupuesto multiagente
Tokens por tarea
Tokens de coordinación
Tokens base

1. Define las tareas
Indica cuántos flujos completos quieres ejecutar en el periodo presupuestado.

2. Cuenta los agentes
Introduce el número de agentes que participan de forma activa en una tarea típica.

3. Cuenta las rondas
Especifica cuántas rondas de intercambio realiza cada agente de media.

4. Estima entrada y salida
Añade los tokens medios que consume cada agente en una ronda, separando lo recibido de lo generado.

5. Incluye coordinación
Usa el porcentaje de sobrecarga para cubrir mensajes compartidos, resúmenes y traspasos entre agentes.

6. Comprueba el total
Revisa tanto el presupuesto total como los tokens por tarea para comparar diseños de colaboración.

Tokens base = tareas × agentes × rondas × (entrada por agente + salida por agente)
Tokens totales = tokens base × (1 + coordinación / 100)

Variables:

  • tareas: flujos completos ejecutados
  • agentes: participantes activos por tarea
  • rondas: ciclos medios de interacción por agente
  • entrada y salida: tokens por agente en cada ronda
  • coordinación: porcentaje adicional para intercambio y síntesis

Supuesto: Se supone que todos los agentes tienen un consumo medio similar y participan en todas las rondas. Para topologías asimétricas, calcula cada rol de forma independiente.

Qué significa el resultado

El resultado es una estimación operativa basada en los valores introducidos. Úsalo para comparar escenarios y dimensionar capacidad, no como sustituto de mediciones en producción.

Si la carga tiene mucha variabilidad, repite el cálculo con valores medios y conservadores para entender el rango posible.

Datos:

  • 50 tareas
  • 5 agentes
  • 3 rondas por tarea
  • 1.200 tokens de entrada por agente y ronda
  • 350 tokens de salida por agente y ronda
  • 12 % de coordinación

Cálculo:
Tokens base = 50 × 5 × 3 × (1.200 + 350) = 1.162.500. Coordinación = 1.162.500 × 12 % = 139.500. Total = 1.302.000 tokens.

Resultado: 1.302.000 tokens

Interpretación: El flujo presupuestado consume unos 26.040 tokens por tarea, incluidos los intercambios de coordinación estimados.

¿Qué se considera una ronda?

Una ronda es un ciclo de participación definido por tu arquitectura, por ejemplo análisis, crítica y actualización. Debe contarse de forma coherente con cómo mides los tokens por agente.

¿Cómo modelo un supervisor que usa más contexto que los demás?

Calcula el supervisor como un rol separado y suma su consumo al de los agentes. La media uniforme de esta calculadora es más adecuada cuando los participantes son parecidos.

¿Los mensajes entre agentes siempre generan sobrecarga?

No necesariamente en la misma proporción. El porcentaje es una forma práctica de representar coordinación cuando no tienes una medición directa.

¿Puedo usar el resultado para fijar límites por tarea?

Sí. El valor por tarea puede servir como punto de partida para cuotas, aunque conviene añadir margen si la variabilidad entre tareas es elevada.

¿Por qué un flujo multiagente puede consumir mucho más que uno de un solo agente?

Porque varios participantes pueden repetir contexto, producir salidas intermedias y coordinarse en varias rondas. El aumento depende de la topología y de cuánto contenido se comparte.