¿Cuánto cuesta la API de OpenAI? 3 ejemplos reales (2026)
2026-09-17
"¿Cuánto me va a costar realmente la API de OpenAI?" es la primera pregunta de todo founder — y la página de precios sola no la responde, porque OpenAI cobra por token, no por solicitud. Esta guía recorre el modelo de facturación y tres escenarios realistas para que los traduzcas a tu producto. Para tus números exactos, usa nuestra calculadora gratuita.
Cómo te cobra OpenAI
Cada modelo tiene tres tarifas, cobradas por 1 millón de tokens (un token ≈ ¾ de una palabra):
- Tokens de entrada — todo lo que envías: system prompt, mensaje del usuario, contexto, historial.
- Tokens de entrada cacheados — prefijos repetidos servidos desde caché, a ~10% de la tarifa de entrada.
- Tokens de salida — todo lo que el modelo escribe. Siempre la tarifa más cara.
Verificado el 17-09-2026 contra las tarifas estándar de contexto corto de OpenAI: GPT-6 Astra cuesta $10 entrada / $50 salida por 1M de tokens, GPT-5.6 Sol $4 / $20, Terra $2 / $12 y Luna $0.20 / $1.20. El precio de Sol es promocional al menos hasta el 21-11-2026; contexto largo y modo Fast tienen tarifas distintas.
Ejemplo 1: chatbot de soporte
Un SaaS B2B añade un asistente: 500 usuarios activos mensuales, 10 preguntas por usuario al día, 30 días. Son 150.000 solicitudes. Cada una lleva ~400 tokens de entrada (system prompt + pregunta + algo de historial) y produce ~300 de salida. Volumen mensual: 60M de entrada + 45M de salida.
En Terra: 60 × $2 + 45 × $12 = ~$660/mes. En Luna: 60 × $0.20 + 45 × $1.20 = ~$66/mes. La misma carga, 10× más barata — por eso las pruebas de calidad y el enrutado por dificultad importan más que usar un solo modelo para todas las solicitudes.
Ejemplo 2: generador de contenido
Una herramienta de marketing redacta descripciones de producto: 20.000 generaciones/mes, briefs cortos de entrada (~200 tokens), texto largo de salida (~700). Volumen: 4M entrada + 14M salida. En Terra: 4 × $2 + 14 × $12 = ~$176/mes. La salida supera el 95% de la factura, así que limitar la longitud y ajustar el formato paga de inmediato.
Ejemplo 3: clasificador de alto volumen
Un equipo de operaciones enruta 1M de tickets/mes, ~300 tokens de entrada cada uno, ~10 de salida (una etiqueta). Volumen: 300M entrada + 10M salida. En Luna: 300 × $0.20 + 10 × $1.20 = ~$72/mes. En Astra el mismo medidor sería ~$3.500. La clasificación es el caso más claro para probar primero un modelo pequeño.
Las trampas que inflan la factura real
- Crecimiento del prompt — los equipos añaden instrucciones; la entrada se duplica en meses.
- Reintentos — las llamadas fallidas también consumen tokens.
- Acumulación de contexto — el historial crece en cada turno salvo que lo recortes o resumas.
- Entornos olvidados — loops de dev/staging quemando tokens en silencio.
Por eso recomendamos presupuestar con un margen de seguridad del 20–30% — la calculadora lo aplica automáticamente y muestra un rango bajo/esperado/alto.
Estima tu costo en dos minutos
Mete tus usuarios, frecuencia de solicitudes y tamaños de token en la Calculadora de Costos de APIs de IA — modela caché, extras de infraestructura y punto de equilibrio, y compara OpenAI lado a lado con Claude, Gemini y Mistral. Las estimaciones son solo para planificar; verifica siempre el precio vigente con OpenAI.