Guías de integración · 2026-09-30

MiniMax M3.1 Flash Preview en la API de LLMTR: acceso gratuito, límites y primera solicitud

Gracias a nuestra colaboración con MiniMax, MiniMax M3.1 Flash Preview, en beta cerrada, es gratuito en la API de LLMTR hasta el 6 de octubre de 2026 a las 23:59 (hora de Turquía). Condición de acceso, primera solicitud, contexto de 1M y reasoning_effort.

Esquema de LLMTR con el identificador del modelo, el endpoint de la solicitud y el fin del periodo gratuito de MiniMax M3.1 Flash Preview.

Respuesta corta: gratis hasta el 6 de octubre con MiniMax

Gracias a la colaboración entre LLMTR y MiniMax, MiniMax M3.1 Flash Preview está disponible en la API de LLMTR desde el 30 de septiembre de 2026 con el identificador minimax/minimax-m3.1-flash-preview. El modelo es gratuito: las solicitudes no se descuentan de tu saldo. El periodo gratuito termina el 6 de octubre de 2026 a las 23:59 (hora de Turquía).

La documentación de la API de MiniMax describe esta versión como un modelo de programación multimodal con una ventana de contexto de 1.000.000 de tokens y profundidad de razonamiento ajustable. Según la misma página, por ahora los únicos canales públicos de MiniMax para esta versión son su propio plan de suscripción y MiniMax Code. Como el modelo está en beta cerrada, su comportamiento puede cambiar durante este periodo.

Hay una sola condición: para usar el modelo, tu cuenta debe haber recargado saldo al menos una vez. La recarga mínima es de 5 $. El saldo que añades no se gasta en este modelo; queda en tu cuenta para otros modelos.

Envía tu primera solicitud

Crea una clave de API de LLMTR y envía la solicitud al endpoint /v1/chat/completions. Si usas el SDK de OpenAI, configura la URL base de LLMTR y escribe el identificador completo, con el prefijo del proveedor, en el campo model.

El cuerpo de abajo reduce la profundidad de razonamiento a low; basta para una tarea de programación corta y la respuesta llega antes. El campo usage de la respuesta muestra prompt_tokens y completion_tokens; los tokens dedicados al razonamiento se cuentan dentro de completion_tokens.

Primer cuerpo de prueba para POST /v1/chat/completions

{
  "model": "minimax/minimax-m3.1-flash-preview",
  "messages": [
    {
      "role": "system",
      "content": "Responde de forma breve y clara."
    },
    {
      "role": "user",
      "content": "Encuentra el error en esta función de Python y escribe la versión corregida: def media(x): return sum(x) / len(x) - 1"
    }
  ],
  "reasoning_effort": "low",
  "max_tokens": 8000
}

Límites y tipos de entrada

La ficha ofrece una ventana de contexto de 1.000.000 de tokens y genera como máximo 524.288 tokens por respuesta. Si envías un valor mayor de max_tokens, la solicitud se rechaza antes de llegar al modelo y el mensaje de error indica el límite.

Se aceptan entradas de texto e imagen; envía las imágenes como partes image_url con el formato de OpenAI. Funcionan las llamadas a herramientas y el modo de objeto JSON. La salida ajustada a un esquema (json_schema) no está garantizada, así que valida la respuesta por tu cuenta. La entrada de vídeo aparece en la documentación de MiniMax, pero no figura en esta ficha; para vídeo, consulta minimax/minimax-m3.

Límites de la ficha minimax/minimax-m3.1-flash-preview
CaracterísticaValor
Ventana de contexto1.000.000 de tokens
Salida máxima por respuesta524.288 tokens
EntradaTexto e imagen
Llamadas a herramientas y modo JSONCompatibles
reasoning_effortlow, medium, high, xhigh, max
Condición de accesoCuenta con al menos una recarga (mínimo 5 $)
Fin del periodo gratuito6 de octubre de 2026, 23:59 (hora de Turquía)

El razonamiento siempre está activo: reasoning_effort y max_tokens

El modelo razona antes de cada respuesta y este paso no se puede desactivar. Con el campo reasoning_effort eliges la profundidad entre low, medium, high, xhigh y max. Según la documentación de MiniMax, si omites el campo el modelo trabaja en max, el nivel más profundo; los niveles altos implican más tokens de razonamiento y más espera. Si envías none, la solicitud se rechaza con un 400.

Los tokens de razonamiento cuentan para el límite de salida. Si fijas max_tokens muy bajo, la respuesta se corta durante el razonamiento y finish_reason muestra length. Deja unos miles de tokens incluso para respuestas cortas; si la respuesta llega vacía, primero sube max_tokens o elige un reasoning_effort más bajo.

Condición de acceso y respuestas de error

Si tu cuenta nunca ha recargado saldo, la solicitud recibe una respuesta 402 y el campo error.details.reason del cuerpo de error indica top_up_required. Después de recargar, espera un minuto y repite la solicitud. El crédito concedido al registrarse, en una campaña o como regalo no cumple la condición; las cuentas con contrato empresarial pueden usar el modelo sin ningún paso adicional.

Los modelos gratuitos de LLMTR tienen una cuota de uso diaria. Cuando se agota recibes un 429 y puedes volver a intentarlo al día siguiente. Una ráfaga de solicitudes también puede dar un 429 temporal; usa reintentos con espera exponencial. Al estar en beta cerrada, el modelo puede responder 503 model_unavailable temporalmente antes de la fecha de fin. En los modelos gratuitos el proveedor puede registrar las instrucciones, así que no envíes datos personales ni confidenciales.

Qué pasa después del 6 de octubre

Desde el 7 de octubre de 2026, las solicitudes a minimax/minimax-m3.1-flash-preview reciben una respuesta 410 model_retired, y la respuesta sugiere el modelo de pago minimax/minimax-m3. El cambio no es automático: ninguna solicitud llega al modelo de pago y no se cobra nada hasta que tú cambies el identificador. Tu aplicación no debe reintentar un 410 como si fuera un error pasajero.

minimax/minimax-m3 es la versión anterior de la misma familia y su precio aparece en la página de precios. El modo JSON y reasoning_effort no figuran en esa ficha, así que revisa las solicitudes que usan response_format o reasoning_effort antes de cambiar. Para probarlo sin programar, también puedes elegirlo en el selector de modelos de LLMTR Chat; allí se aplica la misma condición de acceso.

Frequently asked questions

¿Tiene coste usar MiniMax M3.1 Flash Preview?

No. Las solicitudes no se descuentan de tu saldo. Para usarlo basta con que tu cuenta haya recargado saldo una vez; la recarga mínima es de 5 $ y el saldo se usa en otros modelos.

Recibo una respuesta 402 top_up_required. ¿Qué hago?

Recarga al menos 5 $ en tu cuenta y repite la solicitud pasado un minuto. El crédito de registro, de campaña o de regalo no cumple la condición.

¿Qué pasa cuando termina el periodo gratuito?

Después del 6 de octubre de 2026 a las 23:59 (hora de Turquía), las solicitudes reciben un 410 model_retired y se sugiere minimax/minimax-m3.

Artículos relacionados