YettyBeta abierta
Herramienta gratuita

Calculadora de costes
de LLM API

Pega un prompt de ejemplo o escribe las cuentas de tokens, fija tu volumen y mira cuánto cuesta un mes en Claude, GPT, Gemini, Llama y DeepSeek; lado a lado, con cada precio editable.

Gratis, sin registro 100% privado, nada sale de tu navegador Precios editables, nunca desactualizados
Modela la factura

¿Cuánto costará un mes de llamadas?

100% privado, nada sale de tu navegador.

Estimación de tokens = caracteres / 4. Los tokenizadores reales varían según el modelo y el idioma, normalmente un 10-15%; bueno para presupuestar, no para facturas.

%
Los precios se mueven; edita cualquier celda. Estos valores por defecto de 2026 son un punto de partida, no dogma; revisa la página de precios de tu proveedor.
Modelo Entrada $/1M Salida $/1M Coste / mes Comparar Si se multiplica x10
Pégala directo en un documento, incidencia o chat.
¿Estás construyendo algo con esa IA?

Cuando tu IA construye un sitio web, Yetty lo pone en vivo y sigue conectada por MCP; tu IA continúa editando, publicando y leyendo contactos.

Por qué la factura sorprende

Cómo funciona de verdad
la facturación de LLM

Dos contadores, no uno

La entrada y la salida se facturan por separado, y la salida suele costar unas 5 veces más por token. Un modelo hablador en un plan barato puede facturar más que un modelo escueto en uno caro.

Reenvías todo el chat

La API no tiene estado: cada turno reenvía el historial completo como entrada. Una conversación de 20 turnos paga el turno 1 veinte veces; por eso los chats largos se encarecen rápido.

El caché es la gran palanca

Un prefijo de prompt estable (prompt de sistema, documentos, herramientas) se puede cachear; entonces los proveedores facturan la entrada cacheada con un fuerte descuento, a menudo cerca del 90%. Actívalo arriba para ver el efecto.

El tamaño del modelo es un rango de x25

Entre un modelo pequeño y uno insignia la misma llamada puede variar 25 veces en precio. Dirige las llamadas simples (clasificar, extraer, reformatear) al pequeño y reserva el insignia para el trabajo difícil.

Los tokens no son palabras

El inglés promedia unos 4 caracteres por token, pero el código, JSON y los idiomas no latinos se tokenizan más pesado. El mismo prompt "corto" en hebreo o japonés puede costar bastante más.

El éxito es el peligro

Los costes escalan de forma lineal con el uso; la columna x10 de arriba es el escenario "nuestra función despegó". Presupuéstalo antes del lanzamiento, no en el correo de la factura después.

Respuestas rápidas

La gente también pregunta

¿Cuánto cuesta la Claude API por millón de tokens?

A mediados de 2026 las tarifas de referencia son de unos 5$ por millón de tokens de entrada y 25$ por millón de tokens de salida en Claude Opus, 3$/15$ en Claude Sonnet y 1$/5$ en Claude Haiku. Los proveedores cambian precios y lanzan promociones a menudo, y por eso cada celda de precio de esta calculadora es editable; toma los valores por defecto como punto de partida y pega las cifras actuales de la página de precios de tu proveedor.

¿Cómo estimo cuántos tokens tiene mi texto?

Una regla rápida para el inglés es un token por cada 4 caracteres, o unas 750 palabras por cada 1,000 tokens. Los tokenizadores reales varían según el modelo y el idioma; el código, las escrituras no latinas y el formato inusual pueden mover la cuenta un 10-15% o más, así que usa la estimación para presupuestar y el contador de tokens del proveedor cuando necesites una factura exacta.

¿Cómo reduzco mis costes de LLM API?

Las tres palancas que más importan: usa un modelo más pequeño para llamadas simples (clasificar y extraer rara vez necesitan un modelo insignia), cachea el prefijo de prompt que se repite (los proveedores descuentan mucho la entrada cacheada, a menudo cerca del 90%) y recorta lo que envías; prompts de sistema más cortos y un historial resumido bajan la factura de entrada en cada solicitud. Las Batch APIs suelen añadir otro ~50% de descuento para trabajos que pueden esperar.

Tu turno

Trae el sitio que ya tienes.

Gasta los tokens en un sitio que rinde.

Tu IA construye el sitio, Yetty lo aloja y le entrega las llaves a tu IA por MCP: publicar, editar, SEO y contactos, todo con solo pedirlo.