- Introduce las llamadas previstas. Elige un periodo coherente, por ejemplo un mes.
- Estima la entrada media. Cuenta instrucciones, contexto e historial enviados por petición.
- Estima la salida media. Usa la longitud típica de las respuestas generadas.
- Añade las tarifas aplicables. Introduce el precio por millón de tokens para entrada y salida.
- Analiza el coste unitario. El coste por solicitud ayuda a trasladar la estimación a usuarios, sesiones o funciones.
Estimador de coste de la API de Claude
Este estimador ayuda a traducir el uso previsto de la API de Claude a un presupuesto. Puedes partir de llamadas mensuales, tokens medios por petición y las tarifas aplicables al modelo que utilices. El diseño evita fijar precios en el código, de modo que puedes actualizar la estimación cuando cambie el modelo, la modalidad de facturación o tu patrón de tráfico.
El resultado muestra el gasto total, los tokens procesados y el coste medio por solicitud. Es especialmente útil al comparar longitudes de contexto, respuestas más extensas o diferentes volúmenes de usuarios.
Datos de cálculo
N es el número de solicitudes; Tin y Tout son los tokens medios de entrada y salida por solicitud; Pin y Pout son las tarifas por millón. La fórmula no incorpora automáticamente descuentos de caché, lotes u otras modalidades.
Qué significa el resultado
El valor principal estima el gasto del patrón de llamadas definido.
Si varios tipos de solicitud tienen tamaños muy diferentes, calcúlalos por grupos y suma los resultados.
Datos: 8.000 solicitudes, 1.800 tokens de entrada, 500 de salida, 3 USD/M de entrada y 15 USD/M de salida.
Cálculo: entrada: 14,4 M × 3 = 43,20 USD. Salida: 4 M × 15 = 60 USD.
Resultado: 103,20 USD, aproximadamente 0,0129 USD por solicitud.
¿Puedo usar distintos modelos de Claude?
Sí. Sustituye las tarifas por las del modelo concreto que estés evaluando y conserva el mismo patrón de tráfico para comparar.
¿Cómo afectan los contextos largos?
Aumentan los tokens de entrada por solicitud y, por tanto, el coste de entrada. Conviene medir la longitud real del contexto que se reenvía.
¿Debo contar respuestas fallidas?
Si una llamada genera consumo facturable, inclúyela en el volumen o en los tokens medios. Consulta tus registros para reflejar reintentos y errores.
¿Qué hago si tengo varias clases de petición?
Calcula cada clase por separado cuando sus tamaños o tarifas difieran mucho. Después suma los costes para obtener el presupuesto global.
¿Este resultado sustituye la factura real?
No. Es una estimación basada en promedios y tarifas introducidas; la facturación real depende del consumo registrado y de las condiciones aplicables.