Calculadora de prompts de Claude

Calcula el tamaño total de un prompt de Claude sumando sus componentes: instrucciones del sistema, mensaje del usuario, ejemplos, contexto adicional y definiciones de herramientas. Esto ayuda a detectar qué parte del prompt domina el consumo de entrada. También puedes introducir una tarifa de entrada por millón de tokens y un volumen mensual para estimar el coste asociado al prompt antes de contar la salida del modelo. El resultado es especialmente útil para comparar versiones de un prompt largo o decidir qué contenido conviene resumir, recuperar bajo demanda o almacenar en caché.

Datos de cálculo

USD
Resultado
tokens de entrada por solicitud
Tokens de entrada/mes
Coste de entrada/solicitud
Coste de entrada/mes
Componente mayor

1. Separa el prompt
Mide sistema, usuario, ejemplos, documentos y herramientas por separado.

2. Introduce tokens
Usa conteos reales siempre que puedas.

3. Añade el tráfico
Indica cuántas solicitudes reutilizarán esa estructura al mes.

4. Configura la tarifa
Introduce el precio vigente de entrada del modelo.

5. Optimiza
Observa qué componente aporta más tokens y prueba versiones más compactas.

tokens del prompt = sistema + usuario + ejemplos + contexto + herramientas
coste mensual de entrada = tokens del prompt × solicitudes / 1.000.000 × tarifa

Qué significa el resultado

El valor principal es el tamaño de entrada de una solicitud antes de que Claude genere la respuesta.

El coste mostrado no incluye tokens de salida ni posibles precios específicos de caché, contexto largo o herramientas del servidor.

Datos: 500 sistema + 250 usuario + 1.000 ejemplos + 3.000 contexto + 250 herramientas = 5.000 tokens; 8.000 solicitudes; 3 USD/M.

Cálculo: 40 M tokens de entrada × 3 USD/M.

Resultado: 120 USD/mes de entrada.

¿Las definiciones de herramientas cuentan como entrada?

Sí, el uso de herramientas puede añadir tokens de entrada, incluidas definiciones y bloques relacionados. Inclúyelos si forman parte de tu solicitud.

¿Debo sumar la respuesta del asistente?

No en esta calculadora. Está centrada en el prompt de entrada; el coste de salida se puede modelar con la calculadora de chatbot o una calculadora de inferencia.

¿Qué hago con un documento recuperado por RAG?

Añade solo los tokens que realmente se insertan en el contexto de cada solicitud, no necesariamente el tamaño completo de tu base documental.

¿La caché de prompts cambia el número de tokens?

El contenido sigue ocupando contexto, pero la facturación de lecturas y escrituras de caché puede usar tarifas distintas. Modela esos tramos por separado si necesitas un presupuesto de facturación exacto.

¿Cómo sé qué parte recortar primero?

Mira el componente mayor y evalúa si puede resumirse o cargarse bajo demanda sin perder información necesaria para la tarea.