Estimador de capacidad de procesamiento de calidad de datos

Este estimador calcula la capacidad práctica de un proceso de calidad de datos a partir de cuatro palancas: número de unidades de procesamiento o trabajadores, ritmo nominal por unidad, utilización efectiva y duración disponible. El resultado principal expresa registros por hora y se complementa con el rendimiento por segundo y la capacidad total del periodo.

Puede utilizarse para dimensionar validaciones, reconciliaciones, perfilados o revisiones automáticas antes de una carga. La utilización permite descontar esperas, coordinación, pausas, bloqueos de E/S y otros tiempos en los que la capacidad nominal no se convierte en trabajo útil. El modelo es lineal y está pensado como una primera aproximación; si el sistema sufre cuellos de botella compartidos, escalado no lineal o límites de almacenamiento, la capacidad real puede ser menor.

Recursos y rendimiento

%
h
Resultado
Capacidad efectiva por hora
Registros por segundo
Capacidad del periodo
Capacidad nominal por hora
Utilización aplicada

1. Define las unidades activas

Indica cuántos trabajadores, procesos o ejecutores pueden realizar controles en paralelo.

2. Introduce el ritmo nominal

Usa la cantidad de registros que una unidad puede procesar por segundo en condiciones normales.

3. Ajusta la utilización

Reduce el 100 % para reflejar tiempo no productivo, esperas o contención observada.

4. Indica la ventana disponible

Añade las horas del lote, turno o ventana de procesamiento para obtener capacidad total.

5. Contrasta con la demanda

Compara la capacidad estimada con los registros previstos para detectar margen o déficit.

Capacidad efectiva (reg/s) = Unidades × Ritmo por unidad × Utilización Capacidad por hora = Capacidad efectiva × 3.600 Capacidad del periodo = Capacidad por hora × Horas

La utilización se introduce como porcentaje y se convierte a decimal. El modelo presupone que las unidades pueden trabajar en paralelo sin perder rendimiento por recursos compartidos.

Qué significa el resultado

La capacidad efectiva indica el volumen aproximado que puede atravesar el control de calidad en una unidad de tiempo bajo la utilización indicada. Sirve para comparar demanda y capacidad antes de una ventana de ejecución.

No sustituye una prueba de carga. Redes, bases de datos, límites de API, memoria y dependencia entre tareas pueden impedir un escalado lineal.

Datos: 8 unidades, 120 registros/s por unidad, 75 % de utilización y 6 horas disponibles.

Cálculo: 8 × 120 × 0,75 = 720 registros/s. Por hora: 720 × 3.600 = 2.592.000. En 6 horas: 15.552.000 registros.

Resultado: capacidad efectiva de 2.592.000 registros por hora.

Interpretación: el sistema podría revisar unos 15,55 millones de registros durante la ventana si mantiene las condiciones introducidas.

¿Qué representa la utilización efectiva?

Es la fracción del tiempo y capacidad nominal que realmente se convierte en procesamiento útil. Puede reflejar esperas, pausas, bloqueos o ineficiencias.

¿Puedo usar hilos o pods como unidades de procesamiento?

Sí, si el ritmo por unidad se mide de forma coherente para esa unidad. No mezcles, por ejemplo, el rendimiento de un pod completo con un recuento de hilos.

¿La capacidad escala siempre de forma lineal?

No. El cálculo asume escalado lineal, pero recursos compartidos y cuellos de botella pueden hacer que añadir unidades produzca menos capacidad de la prevista.

¿Cómo uso el resultado para una ventana de carga?

Compara la capacidad del periodo con el volumen esperado. Si la demanda supera la cifra estimada, necesitas más tiempo, más rendimiento o más recursos.

¿En qué se diferencia de medir el throughput real?

El throughput real se observa en ejecución. Esta herramienta proyecta capacidad a partir de un ritmo unitario y una utilización supuestos o medidos previamente.