Claude vs GPT vs Gemini: comparativa de precios de API (2026)
2026-09-17
Comparar proveedores de LLM por precio es más difícil de lo que parece: cada uno mide entrada, salida y caché de forma distinta, y un modelo "barato" puede perder con una carga real. Aquí pasamos una carga idéntica por las tarifas estándar vigentes, verificadas el 17-09-2026 en la página oficial de cada proveedor.
La carga de prueba
Una función de asistente típica: 150.000 solicitudes/mes, ~400 tokens de entrada y ~300 de salida por solicitud → 60M entrada + 45M salida mensuales. Sin caché ni extras. Factura estimada de tokens por modelo:
- Gemini 2.5 Flash ($0.30 ent / $2.50 sal): ~$131/mes
- Gemini 2.5 Flash-Lite ($0.10 / $0.40): ~$24/mes
- GPT-5.6 Luna ($0.20 / $1.20): ~$66/mes
- Claude Haiku 4.5 ($1 / $5): ~$285/mes
- Claude Sonnet 5 ($2 / $10): ~$570/mes
- Gemini 3.1 Pro Preview ($2 / $12): ~$660/mes
- GPT-5.6 Terra ($2 / $12): ~$660/mes
Más de 25× separa las entradas más barata y más cara de esta lista — por eso la elección del modelo, no la lealtad al proveedor, es la mayor decisión de costo. Corre tu propia carga en la calculadora y compara Terra vs Sonnet 5 y Luna vs Haiku 4.5.
El caché cambia el ranking
Si tus solicitudes comparten un prefijo largo y estable (system prompt, definiciones de herramientas, fragmentos de conocimiento), el precio de entrada cacheada importa tanto como el precio de lista:
- OpenAI: entrada cacheada a ~10% de la tarifa (p. ej. Terra: $0.20 vs $2), aplicada a prefijos repetidos elegibles.
- Anthropic: las lecturas de caché al 10% de la entrada, pero las escrituras cuestan 1.25× — el caché compensa tras un solo reuso dentro de la ventana de 5 minutos.
- Google Gemini: caché de contexto explícito a ~10% de la entrada, con facturación por tiempo de almacenamiento en algunos niveles.
Una app RAG intensiva en entrada con 60–80% de aciertos de caché puede voltear la tabla por completo. Ajusta el campo de caché en la calculadora a tu tasa esperada y observa el cambio.
Cuándo conviene cada proveedor
- Claude (Anthropic) — contexto largo, workflows de agentes y redacción cuidada; la tarifa de lanzamiento $2/$10 de Sonnet 5 es ahora su precio estándar.
- GPT (OpenAI) — una escalera amplia de modelos; Luna, Terra, Sol y Astra permiten enrutar por dificultad de la carga.
- Gemini (Google) — las gamas Flash están entre los modelos capaces más baratos que existen, e integran natural con un stack de Google Cloud.
La respuesta honesta
No existe un proveedor universalmente más barato — existe el más barato para tu forma de tokens (mucha entrada o salida, cacheable o no). Modélalo en dos minutos con la Calculadora de Costos de APIs de IA y revísalo trimestralmente porque los proveedores cambian precios con frecuencia. Estimaciones solo para planificación — verifica siempre los precios vigentes en la página oficial de cada proveedor.