Estimador de utilización de API Gateway

Este estimador mide la utilización de un API Gateway comparando el pico observado de solicitudes por segundo con la capacidad o cuota disponible. El porcentaje resultante permite ver cuánto margen existe antes de alcanzar el límite de referencia y si el sistema se está aproximando a una zona de saturación.

La métrica es útil para revisiones de capacidad, preparación de eventos de tráfico y seguimiento de cuotas. Debe leerse junto con datos de throttling, errores y latencia: una utilización moderada a nivel global no descarta límites más bajos en rutas concretas o servicios posteriores. Si el pico supera la capacidad introducida, el resultado será superior al 100 %.

Introduce los datos

req/s
req/s
Resultado
utilización de la capacidad disponible
Margen en req/s
Exceso sobre capacidad
Margen porcentual

1. Introduce el pico observado
Usa el máximo de solicitudes por segundo relevante para el periodo analizado.

2. Indica la capacidad disponible
Introduce la cuota, límite o capacidad efectiva con la que quieres comparar ese pico.

3. Comprueba la utilización
El porcentaje muestra qué parte de la capacidad se consumió en el pico.

4. Revisa el margen
El desglose calcula el espacio restante o el exceso si se supera el 100 %.

Utilización (%) = Pico observado ÷ Capacidad disponible × 100

Pico observado: máximo de solicitudes por segundo medido

Capacidad disponible: límite o capacidad de referencia en req/s

Supuestos: Ambos valores deben representar el mismo ámbito: región, entorno y conjunto de rutas. La fórmula no incorpora duración de solicitudes ni límites secundarios.

Qué significa el resultado

Queda un margen del 20 %, equivalente a 1.800 req/s antes de alcanzar la capacidad de referencia.

El resultado es una estimación basada en los valores introducidos y en los supuestos indicados.

Datos:

  • Pico observado: 7.200 req/s
  • Capacidad disponible: 9.000 req/s

Cálculo:
Utilización = 7.200 ÷ 9.000 × 100 = 80 %
Margen = 9.000 - 7.200 = 1.800 req/s

Resultado: 80 % de utilización.

Interpretación: Queda un margen del 20 %, equivalente a 1.800 req/s antes de alcanzar la capacidad de referencia.

¿Qué significa superar el 100 %?

El pico observado es mayor que la capacidad que has introducido. Dependiendo de la plataforma, esto puede traducirse en throttling, errores, escalado automático o simplemente indicar que la cuota usada como referencia no era un límite rígido.

¿Debo usar promedio o pico?

Para capacidad, el pico suele ser más informativo que el promedio porque los límites se alcanzan en intervalos breves. El intervalo de medición debe ser lo bastante corto para no ocultar ráfagas.

¿Puedo usar una cuota documentada como capacidad?

Sí, pero conviene confirmar que corresponde a tu región, cuenta y configuración actuales. Una cuota teórica puede diferir de la capacidad efectiva de toda la cadena.

¿Una utilización baja garantiza buena latencia?

No. La latencia depende también de integraciones, funciones, bases de datos y red. Este cálculo solo mide la relación entre throughput observado y capacidad.

¿Cómo se relaciona con el estimador de capacidad necesaria?

La utilización analiza la situación actual. El estimador de capacidad parte de un pico futuro y añade margen para definir un objetivo de dimensionamiento.