1. Introduce el pico de solicitudes
Usa la demanda máxima que el servicio debe poder atender en solicitudes por segundo.
2. Define la capacidad sostenible de un pod
Introduce el throughput observado en pruebas o producción para una réplica con la configuración de recursos prevista.
3. Fija utilización y margen
La utilización objetivo reserva holgura dentro de cada pod; el margen adicional protege frente a crecimiento o ráfagas sobre el pico estimado.
4. Indica cuántos pods caben por nodo
Usa una estimación realista después de reservar recursos para sistema, daemonsets y otras cargas.
5. Revisa réplicas y nodos
El resultado redondea hacia arriba tanto las réplicas como los nodos necesarios para no quedarse por debajo de la capacidad calculada.