Costos de IA

GPT-5.6 Luna vs Gemini 2.5 Flash: comparativa de costos de API (2026)

¿GPT-5.6 Luna o Gemini 2.5 Flash? En vez de comparar precios de lista, calculamos la misma carga de trabajo en ambos (precios verificados 2026-09-17). Spoiler: en la mayoría de los escenarios gana GPT-5.6 Luna en costo puro — pero el "cuándo elegir cada uno" importa más que el ganador. Compáralos en vivo en la calculadora.

Tarifa por 1M tokensGPT-5.6 LunaGemini 2.5 Flash
Entrada$0.20$0.30
Entrada cacheada$0.02$0.03
Salida$1.20$2.50

La misma carga, los dos modelos

Escenario mensualGPT-5.6 LunaGemini 2.5 FlashDiferencia
Chatbot de soporte (150k solicitudes, 400 ent / 300 sal tokens)$66.00$130.5049% a favor de GPT-5.6 Luna
Workflow de documentos (22k ejecuciones, 3.000 ent / 400 sal)$23.76$41.8043% a favor de GPT-5.6 Luna
Clasificador de alto volumen (1M solicitudes, 300 ent / 10 sal)$72.00$115.0037% a favor de GPT-5.6 Luna

La forma de tus tokens decide: cargas intensivas en entrada (documentos, RAG) amplifican la diferencia en la tarifa de input; cargas de salida larga (generación de contenido) pesan la tarifa de output. Corre tu mezcla exacta en la calculadora con ambos preseleccionados.

Cuándo elegir cada uno

  • GPT-5.6 Luna — cuando el costo por token manda: alto volumen, tareas verificables, presupuesto ajustado. En estos escenarios sale 49–49% más barato.
  • Gemini 2.5 Flash — cuando el precio extra compra algo que necesitas (calidad en tu tarea concreta, contexto, ecosistema). La única forma honesta de saberlo: probar tu caso real en ambos con una muestra pequeña.
  • Los dos — el patrón ganador en producción suele ser enrutar: lo fácil al barato, lo difícil al fuerte.

Guías relacionadas: cómo funciona el pricing de las APIs de IA y cómo reducir costos de LLM.

Nuestra lectura: Luna es más barata para texto tanto en entrada como en salida, mientras Gemini Flash añade entrada económica de imagen y video y un encaje natural con Google Cloud. La clasificación solo de texto favorece a Luna por precio; los pipelines multimodales dan a Flash una razón más allá de la tabla de tokens.

No compares una sola solicitud promedio. Separa el tráfico solo de texto del multimodal, incluye los tokens de razonamiento que Google factura como salida y calcula cada ruta por separado.

Precios verificados el 2026-09-17 contra la página oficial del proveedor. Las estimaciones son solo para planificación — confirma siempre el precio vigente con el proveedor.

Compáralos con tus números →