1. Cuenta los fragmentos
Estima cuántos chunks tendrá el corpus después de dividir los documentos.
2. Indica la dimensión
Usa el número de componentes que tenga cada embedding.
3. Define bytes por dimensión
Selecciona el tamaño del tipo numérico utilizado para almacenar cada componente.
4. Añade metadatos
Estima bytes medios para ids, texto, referencias y atributos guardados con cada vector.
5. Aplica sobrecarga
Reserva un porcentaje para índices y estructuras internas y revisa el total en GB.