1. Introduce los tokens de entrada
Incluye el prompt, instrucciones, historial y cualquier contexto que se envíe al modelo por solicitud.
2. Añade la salida prevista
Usa una media realista de tokens generados, no necesariamente el máximo configurado.
3. Escribe las tarifas vigentes
Introduce por separado el precio por millón de tokens de entrada y salida del modelo o modalidad elegidos.
4. Define el volumen
Indica cuántas solicitudes quieres presupuestar para convertir el coste unitario en coste total.
5. Compara el desglose
Observa cuánto procede de la entrada y cuánto de la salida antes de optimizar el prompt o la longitud de respuesta.