Comparativa de modelos · 2026-10-06

Gemini Flash o Pro: guía para elegir y controlar costes

Compara Gemini Flash y Pro en LLMTR: precios por 1M tokens, tareas recomendadas, fechas de cambio y una ruta práctica entre ambos modelos.

Diagrama simple de enrutamiento: la mayoría de las solicitudes va a Gemini Flash y solo los casos difíciles se envían a Gemini Pro, con comparación de coste.

Respuesta corta: Flash o Pro, según la tarea

Para volumen alto y herramientas, Flash es la opción inicial; Pro entra para razonamiento difícil cuando Flash falla tus pruebas. LLMTR (llmtr.com) es una pasarela que da acceso a modelos de lenguaje alojados en Turquía y en proveedores globales a través de una única API compatible con OpenAI. Usa https://llmtr.com/v1: compara google/gemini-3.7-flash y google/gemini-3.1-pro-preview.

En el catálogo del 2026-10-06, ambos tienen 1.048.576 tokens de contexto. Por 1M tokens, 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida; Pro Preview cuesta 2,00 $ y 12,00 $. Flash favorece volumen alto y Pro se reserva para razonamiento difícil.

Gemini Flash y Pro en LLMTR, USD por 1M tokens (2026-10-06)
Id del modeloEntradaSalidaNota
google/gemini-3.5-flash-lite$0.30$2.50volumen alto; entrada $0.30
google/gemini-3.7-flash$0.75$3.75precio introductorio hasta 2026-12-31
google/gemini-3.8-flash$0.75$3.75precio introductorio hasta 2026-12-31
google/gemini-3.6-flash$1.50$7.50Flash estable
google/gemini-3.1-pro-preview$2.00$12.00prompts de hasta 200K tokens

¿Qué es mejor, Gemini Flash o Pro?

Con el catálogo del 2026-10-06, Flash es más barato: 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida por 1M tokens. Pro Preview cuesta 2,00 $ y 12,00 $, y conviene para razonamiento más difícil que Flash en tu producto.

Google orienta Pro Preview a software, investigación y razonamiento difícil, con resultados más consistentes en tareas complejas; Flash, a herramientas y ciclos de codificación. Valida ambos con 20-50 prompts reales, compara corrección y coste y envía a Pro solo la clase que Flash falle.

Dónde Flash basta: volumen alto y tareas repetitivas

Usa Flash para volumen alto, agentes con herramientas, ciclos de codificación, extracción y clasificación. Google posiciona 3.7 Flash para aplicaciones de producción y análisis de imagen, vídeo, audio o PDF, y 3.8 Flash para programación de largo alcance y agentes autónomos.

Los modelos 3.7 Flash y 3.8 Flash ofrecen niveles de pensamiento low, medium y high; el predeterminado es medium. Evalúa el nivel junto con la longitud de la solicitud, porque los tokens de pensamiento se facturan como tokens de salida y afecta al coste total.

En tareas difíciles, 3.8 Flash puede usar más pasos de razonamiento y llamadas a herramientas que 3.7 Flash, por lo que puede consumir más tokens para el mismo trabajo. Conserva 3.8 Flash si mejora tus respuestas; compara ambos con 20-50 prompts reales si solo aumenta el gasto.

La diferencia de precio y cuándo cambia

Pro cuesta 2,67 veces la entrada y 3,2 veces la salida de 3.7 Flash. Flash mantiene su precio introductorio de 0,75 $ de entrada y 3,75 $ de salida hasta 2026-12-31; desde 2027-01-01 pasa al doble: 1,50 $ y 7,50 $. Aun así, Pro costará 1,33 veces en entrada y 1,6 en salida.

Para prompts de más de 200K tokens, Pro cambia de 2,00 $ de entrada y 12,00 $ de salida por 1M tokens a 4,00 $ y 18,00 $. Los tokens de pensamiento se cobran como salida. La tabla muestra 1.000 solicitudes con 4.000 tokens de entrada y 1.000 de salida por solicitud.

1.000 solicitudes con 4.000 tokens de entrada y 1.000 tokens de salida cada una
Id del modeloEntradaSalidaTotal
google/gemini-3.7-flash4M x $0.75 = $3.001M x $3.75 = $3.75$6.75
google/gemini-3.1-pro-preview4M x $2.00 = $8.001M x $12.00 = $12.00$20.00

Enrutar en vez de elegir una vez

En lugar de fijar un modelo, envía la mayor parte del tráfico a google/gemini-3.7-flash y reserva google/gemini-3.1-pro-preview para cuando Flash falle tus pruebas. La función ask del ejemplo usa Pro cuando hard=True y Flash en los demás casos. Cambiar de modelo solo exige cambiar el identificador.

En LLMTR, desde el 2026-10-16, las solicitudes a google/gemini-2.5-pro devuelven 410 model_retired; empieza las nuevas integraciones en google/gemini-3.1-pro-preview. Para texto a voz, Gemini TTS Flash frente a Gemini TTS Pro se explica en otro artículo separado de LLMTR, como guía independiente para Gemini TTS.

Ejemplo en Python para enviar los casos difíciles a Pro.

import os

from openai import OpenAI

client = OpenAI(base_url="https://llmtr.com/v1", api_key=os.environ["LLMTR_API_KEY"])

FLASH = "google/gemini-3.7-flash"
PRO = "google/gemini-3.1-pro-preview"


def ask(prompt: str, hard: bool = False) -> str:
    response = client.chat.completions.create(
        model=PRO if hard else FLASH,
        messages=[{"role": "user", "content": prompt}],
    )
    return response.choices[0].message.content


print(ask("Classify this support ticket as billing, bug or question: ..."))
print(ask("Find the contradiction between these two contract clauses: ...", hard=True))

Empezar en LLMTR: cuenta, crédito, clave y primera solicitud

Paso 1: crea una cuenta en llmtr.com y verifica tu correo. Paso 2: recarga crédito desde el Dashboard mediante el pago seguro. Se añade una vez, sobre la cantidad solicitada, un margen de plataforma del 8 %: una recarga de 10,00 $ de crédito se cobra 10,80 $. El margen no se añade a los precios de modelos; cada llamada se descuenta al precio de catálogo.

Paso 3: crea una clave de API en Dashboard > API Keys. La clave solo se muestra una vez; guárdala en una variable de entorno como LLMTR_API_KEY. Paso 4: envía la primera solicitud a https://llmtr.com/v1 con cualquier SDK compatible con OpenAI y cambia solo base_url y api_key. En la página de uso del Dashboard aparecen el uso y el gasto por clave. La misma clave y el mismo saldo sirven para cada modelo del catálogo; cambiar de modelo significa cambiar la cadena del modelo.

Configurar y probar Gemini en LLMTR

Crea una cuenta, recarga crédito, genera una clave y envía tu primera solicitud a https://llmtr.com/v1.

  1. Crear la cuenta. Regístrate en llmtr.com y verifica tu correo electrónico.
  2. Recargar crédito. Recarga crédito desde el Dashboard mediante el pago seguro. El margen del 8 % se añade una sola vez; por ejemplo, 10,00 $ de crédito se cobran 10,80 $.
  3. Crear la clave de API. Abre Dashboard > API Keys, genera una clave y guárdala como LLMTR_API_KEY porque solo se muestra una vez.
  4. Enviar la primera solicitud. Configura base_url como https://llmtr.com/v1 y api_key con LLMTR_API_KEY. Envía la solicitud a /v1/chat/completions con un SDK compatible con OpenAI.

Frequently asked questions

¿Gemini Flash o Pro es más barato?

Flash. Por 1M tokens, 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida; Pro Preview cuesta 2,00 $ y 12,00 $.

¿Qué hago con gemini-2.5-pro?

En LLMTR, desde el 2026-10-16, las solicitudes a google/gemini-2.5-pro devuelven 410 model_retired; empieza las nuevas integraciones en google/gemini-3.1-pro-preview.

¿Cuándo cambia el precio de Gemini Flash?

El precio introductorio de Gemini 3.7 Flash y 3.8 Flash termina el 2026-12-31. Desde 2027-01-01, la entrada cuesta 1,50 $ y la salida 7,50 $ por 1M tokens.

Artículos relacionados