- Define el volumen de solicitudes. Usa el número previsto para el periodo que quieras presupuestar.
- Estima los tokens por solicitud. Introduce por separado el promedio de entrada y de salida.
- Introduce el precio del modelo. Copia las tarifas actuales por millón de tokens de entrada y salida del modelo que vayas a utilizar.
- Comprueba el total. El resultado combina el tráfico con las tarifas y muestra el coste medio por llamada.
- Prueba alternativas. Modifica tokens, tráfico o precios para comparar modelos o límites de respuesta.
Estimador de coste de la API de OpenAI
Este estimador convierte un patrón de uso de la API de OpenAI en un coste aproximado a partir del número de solicitudes, los tokens medios de entrada y salida por solicitud y las tarifas que introduzcas. Está pensado para presupuestar prototipos, funciones de producción o pruebas de carga sin depender de una tarifa codificada que pueda quedarse obsoleta.
El cálculo permite ver el coste agregado y el coste medio por solicitud. Para obtener una previsión útil, toma los tokens medios de tus registros o de una muestra representativa y usa los precios vigentes del modelo concreto que vayas a emplear.
Datos de cálculo
El modelo supone que los valores por solicitud son promedios representativos. Cargos por herramientas, almacenamiento, imágenes, audio, lotes o caché deben añadirse aparte cuando corresponda.
Qué significa el resultado
El total representa el gasto aproximado de las solicitudes indicadas con los precios que hayas introducido.
Verifica siempre las tarifas del modelo y modalidad concretos antes de convertir la estimación en presupuesto.
Datos: 10.000 solicitudes, 1.200 tokens de entrada y 350 de salida por solicitud, con tarifas de 2,50 y 10 USD por millón.
Cálculo: entrada = 12.000.000 tokens → 30 USD; salida = 3.500.000 tokens → 35 USD.
Resultado: 65 USD en total, o 0,0065 USD por solicitud.
¿La calculadora conoce automáticamente el precio del modelo?
No. Introduces la tarifa para que puedas usar el modelo, modalidad y precio vigentes que correspondan a tu cuenta.
¿Qué promedio de tokens por solicitud debería usar?
Lo ideal es calcularlo con registros reales o una muestra de tráfico. Para una fase temprana, utiliza varios escenarios en vez de una única cifra optimista.
¿Incluye llamadas a herramientas o funciones?
Solo en la medida en que sus tokens estén incluidos en los valores que introduces. Otros cargos específicos deben sumarse por separado.
¿Cómo trato una tasa de caché distinta?
Calcula los tokens con caché como un bloque separado usando su propia tarifa efectiva y súmalo al resultado principal.
¿Qué diferencia hay respecto al estimador genérico de tokens?
Este enfoque parte de solicitudes y tokens medios por llamada, lo que facilita convertir métricas de una API en un coste operativo.