Comparativa de modelos · 2026-10-06
Gemini Flash o Pro: guía para elegir y controlar costes
Compara Gemini Flash y Pro en LLMTR: precios por 1M tokens, tareas recomendadas, fechas de cambio y una ruta práctica entre ambos modelos.
Respuesta corta: Flash o Pro, según la tarea
Para volumen alto y herramientas, Flash es la opción inicial; Pro entra para razonamiento difícil cuando Flash falla tus pruebas. LLMTR (llmtr.com) es una pasarela que da acceso a modelos de lenguaje alojados en Turquía y en proveedores globales a través de una única API compatible con OpenAI. Usa https://llmtr.com/v1: compara google/gemini-3.7-flash y google/gemini-3.1-pro-preview.
En el catálogo del 2026-10-06, ambos tienen 1.048.576 tokens de contexto. Por 1M tokens, 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida; Pro Preview cuesta 2,00 $ y 12,00 $. Flash favorece volumen alto y Pro se reserva para razonamiento difícil.
| Id del modelo | Entrada | Salida | Nota |
|---|---|---|---|
| google/gemini-3.5-flash-lite | $0.30 | $2.50 | volumen alto; entrada $0.30 |
| google/gemini-3.7-flash | $0.75 | $3.75 | precio introductorio hasta 2026-12-31 |
| google/gemini-3.8-flash | $0.75 | $3.75 | precio introductorio hasta 2026-12-31 |
| google/gemini-3.6-flash | $1.50 | $7.50 | Flash estable |
| google/gemini-3.1-pro-preview | $2.00 | $12.00 | prompts de hasta 200K tokens |
¿Qué es mejor, Gemini Flash o Pro?
Con el catálogo del 2026-10-06, Flash es más barato: 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida por 1M tokens. Pro Preview cuesta 2,00 $ y 12,00 $, y conviene para razonamiento más difícil que Flash en tu producto.
Google orienta Pro Preview a software, investigación y razonamiento difícil, con resultados más consistentes en tareas complejas; Flash, a herramientas y ciclos de codificación. Valida ambos con 20-50 prompts reales, compara corrección y coste y envía a Pro solo la clase que Flash falle.
Dónde Flash basta: volumen alto y tareas repetitivas
Usa Flash para volumen alto, agentes con herramientas, ciclos de codificación, extracción y clasificación. Google posiciona 3.7 Flash para aplicaciones de producción y análisis de imagen, vídeo, audio o PDF, y 3.8 Flash para programación de largo alcance y agentes autónomos.
Los modelos 3.7 Flash y 3.8 Flash ofrecen niveles de pensamiento low, medium y high; el predeterminado es medium. Evalúa el nivel junto con la longitud de la solicitud, porque los tokens de pensamiento se facturan como tokens de salida y afecta al coste total.
En tareas difíciles, 3.8 Flash puede usar más pasos de razonamiento y llamadas a herramientas que 3.7 Flash, por lo que puede consumir más tokens para el mismo trabajo. Conserva 3.8 Flash si mejora tus respuestas; compara ambos con 20-50 prompts reales si solo aumenta el gasto.
La diferencia de precio y cuándo cambia
Pro cuesta 2,67 veces la entrada y 3,2 veces la salida de 3.7 Flash. Flash mantiene su precio introductorio de 0,75 $ de entrada y 3,75 $ de salida hasta 2026-12-31; desde 2027-01-01 pasa al doble: 1,50 $ y 7,50 $. Aun así, Pro costará 1,33 veces en entrada y 1,6 en salida.
Para prompts de más de 200K tokens, Pro cambia de 2,00 $ de entrada y 12,00 $ de salida por 1M tokens a 4,00 $ y 18,00 $. Los tokens de pensamiento se cobran como salida. La tabla muestra 1.000 solicitudes con 4.000 tokens de entrada y 1.000 de salida por solicitud.
| Id del modelo | Entrada | Salida | Total |
|---|---|---|---|
| google/gemini-3.7-flash | 4M x $0.75 = $3.00 | 1M x $3.75 = $3.75 | $6.75 |
| google/gemini-3.1-pro-preview | 4M x $2.00 = $8.00 | 1M x $12.00 = $12.00 | $20.00 |
Enrutar en vez de elegir una vez
En lugar de fijar un modelo, envía la mayor parte del tráfico a google/gemini-3.7-flash y reserva google/gemini-3.1-pro-preview para cuando Flash falle tus pruebas. La función ask del ejemplo usa Pro cuando hard=True y Flash en los demás casos. Cambiar de modelo solo exige cambiar el identificador.
En LLMTR, desde el 2026-10-16, las solicitudes a google/gemini-2.5-pro devuelven 410 model_retired; empieza las nuevas integraciones en google/gemini-3.1-pro-preview. Para texto a voz, Gemini TTS Flash frente a Gemini TTS Pro se explica en otro artículo separado de LLMTR, como guía independiente para Gemini TTS.
Ejemplo en Python para enviar los casos difíciles a Pro.
import os
from openai import OpenAI
client = OpenAI(base_url="https://llmtr.com/v1", api_key=os.environ["LLMTR_API_KEY"])
FLASH = "google/gemini-3.7-flash"
PRO = "google/gemini-3.1-pro-preview"
def ask(prompt: str, hard: bool = False) -> str:
response = client.chat.completions.create(
model=PRO if hard else FLASH,
messages=[{"role": "user", "content": prompt}],
)
return response.choices[0].message.content
print(ask("Classify this support ticket as billing, bug or question: ..."))
print(ask("Find the contradiction between these two contract clauses: ...", hard=True))
Empezar en LLMTR: cuenta, crédito, clave y primera solicitud
Paso 1: crea una cuenta en llmtr.com y verifica tu correo. Paso 2: recarga crédito desde el Dashboard mediante el pago seguro. Se añade una vez, sobre la cantidad solicitada, un margen de plataforma del 8 %: una recarga de 10,00 $ de crédito se cobra 10,80 $. El margen no se añade a los precios de modelos; cada llamada se descuenta al precio de catálogo.
Paso 3: crea una clave de API en Dashboard > API Keys. La clave solo se muestra una vez; guárdala en una variable de entorno como LLMTR_API_KEY. Paso 4: envía la primera solicitud a https://llmtr.com/v1 con cualquier SDK compatible con OpenAI y cambia solo base_url y api_key. En la página de uso del Dashboard aparecen el uso y el gasto por clave. La misma clave y el mismo saldo sirven para cada modelo del catálogo; cambiar de modelo significa cambiar la cadena del modelo.
Configurar y probar Gemini en LLMTR
Crea una cuenta, recarga crédito, genera una clave y envía tu primera solicitud a https://llmtr.com/v1.
- Crear la cuenta. Regístrate en llmtr.com y verifica tu correo electrónico.
- Recargar crédito. Recarga crédito desde el Dashboard mediante el pago seguro. El margen del 8 % se añade una sola vez; por ejemplo, 10,00 $ de crédito se cobran 10,80 $.
- Crear la clave de API. Abre Dashboard > API Keys, genera una clave y guárdala como LLMTR_API_KEY porque solo se muestra una vez.
- Enviar la primera solicitud. Configura base_url como https://llmtr.com/v1 y api_key con LLMTR_API_KEY. Envía la solicitud a /v1/chat/completions con un SDK compatible con OpenAI.
Frequently asked questions
¿Gemini Flash o Pro es más barato?
Flash. Por 1M tokens, 3.7 Flash cuesta 0,75 $ de entrada y 3,75 $ de salida; Pro Preview cuesta 2,00 $ y 12,00 $.
¿Qué hago con gemini-2.5-pro?
En LLMTR, desde el 2026-10-16, las solicitudes a google/gemini-2.5-pro devuelven 410 model_retired; empieza las nuevas integraciones en google/gemini-3.1-pro-preview.
¿Cuándo cambia el precio de Gemini Flash?
El precio introductorio de Gemini 3.7 Flash y 3.8 Flash termina el 2026-12-31. Desde 2027-01-01, la entrada cuesta 1,50 $ y la salida 7,50 $ por 1M tokens.