Costos de IA

Claude vs GPT vs Gemini: comparativa de precios de API (2026)

2026-09-17

Comparar proveedores de LLM por precio es más difícil de lo que parece: cada uno mide entrada, salida y caché de forma distinta, y un modelo "barato" puede perder con una carga real. Aquí pasamos una carga idéntica por las tarifas estándar vigentes, verificadas el 17-09-2026 en la página oficial de cada proveedor.

La carga de prueba

Una función de asistente típica: 150.000 solicitudes/mes, ~400 tokens de entrada y ~300 de salida por solicitud → 60M entrada + 45M salida mensuales. Sin caché ni extras. Factura estimada de tokens por modelo:

  • Gemini 2.5 Flash ($0.30 ent / $2.50 sal): ~$131/mes
  • Gemini 2.5 Flash-Lite ($0.10 / $0.40): ~$24/mes
  • GPT-5.6 Luna ($0.20 / $1.20): ~$66/mes
  • Claude Haiku 4.5 ($1 / $5): ~$285/mes
  • Claude Sonnet 5 ($2 / $10): ~$570/mes
  • Gemini 3.1 Pro Preview ($2 / $12): ~$660/mes
  • GPT-5.6 Terra ($2 / $12): ~$660/mes

Más de 25× separa las entradas más barata y más cara de esta lista — por eso la elección del modelo, no la lealtad al proveedor, es la mayor decisión de costo. Corre tu propia carga en la calculadora y compara Terra vs Sonnet 5 y Luna vs Haiku 4.5.

El caché cambia el ranking

Si tus solicitudes comparten un prefijo largo y estable (system prompt, definiciones de herramientas, fragmentos de conocimiento), el precio de entrada cacheada importa tanto como el precio de lista:

  • OpenAI: entrada cacheada a ~10% de la tarifa (p. ej. Terra: $0.20 vs $2), aplicada a prefijos repetidos elegibles.
  • Anthropic: las lecturas de caché al 10% de la entrada, pero las escrituras cuestan 1.25× — el caché compensa tras un solo reuso dentro de la ventana de 5 minutos.
  • Google Gemini: caché de contexto explícito a ~10% de la entrada, con facturación por tiempo de almacenamiento en algunos niveles.

Una app RAG intensiva en entrada con 60–80% de aciertos de caché puede voltear la tabla por completo. Ajusta el campo de caché en la calculadora a tu tasa esperada y observa el cambio.

Cuándo conviene cada proveedor

  • Claude (Anthropic) — contexto largo, workflows de agentes y redacción cuidada; la tarifa de lanzamiento $2/$10 de Sonnet 5 es ahora su precio estándar.
  • GPT (OpenAI) — una escalera amplia de modelos; Luna, Terra, Sol y Astra permiten enrutar por dificultad de la carga.
  • Gemini (Google) — las gamas Flash están entre los modelos capaces más baratos que existen, e integran natural con un stack de Google Cloud.

La respuesta honesta

No existe un proveedor universalmente más barato — existe el más barato para tu forma de tokens (mucha entrada o salida, cacheable o no). Modélalo en dos minutos con la Calculadora de Costos de APIs de IA y revísalo trimestralmente porque los proveedores cambian precios con frecuencia. Estimaciones solo para planificación — verifica siempre los precios vigentes en la página oficial de cada proveedor.