Guías de integración · 2026-10-01

Cómo usar MiniMax M3.1 Flash Preview con Claude Code y agentes de programación

Gracias a nuestra colaboración con MiniMax, MiniMax M3.1 Flash Preview es gratuito hasta el 6 de octubre de 2026. Cómo conectarlo a Claude Code y a agentes de programación compatibles con OpenAI a través de LLMTR: variables de entorno, el sufijo :low, cuota y cambio de modelo.

Esquema de una solicitud que va de Claude Code al endpoint /v1/messages de LLMTR y de ahí a MiniMax M3.1 Flash Preview.

Respuesta corta: una URL base y el identificador completo

LLMTR es una pasarela de API de IA que ofrece los formatos de OpenAI y de Anthropic con una sola clave de API (llmtr.com). Gracias a nuestra colaboración con MiniMax, MiniMax M3.1 Flash Preview, en beta cerrada, es gratuito aquí hasta el 6 de octubre de 2026 a las 23:59 (hora de Turquía) con el identificador minimax/minimax-m3.1-flash-preview. Para conectarlo a un agente hacen falta la URL base del formato que habla el agente y el identificador completo, con el prefijo del proveedor. Claude Code habla el formato Anthropic Messages: URL base https://llmtr.com y solicitudes a /v1/messages. Los agentes con formato OpenAI usan la URL base https://llmtr.com/v1 y /v1/chat/completions. Ambos caminos comparten clave de API, condición de acceso y cuota diaria. Este modelo no se ofrece en /v1/responses; una herramienta que exige la API Responses recibe un 400 unsupported_operation.

Configuración de agentes para minimax/minimax-m3.1-flash-preview
Tipo de agenteURL baseEndpointCampo model
Claude Code (formato Anthropic)https://llmtr.com/v1/messagesminimax/minimax-m3.1-flash-preview:low
Agentes compatibles con OpenAIhttps://llmtr.com/v1/v1/chat/completionsminimax/minimax-m3.1-flash-preview
Herramientas que exigen la API ResponsesNo compatible/v1/responses400 unsupported_operation

Configurar Claude Code

Define estas variables antes de iniciar Claude Code. ANTHROPIC_MODEL fija el modelo principal y ANTHROPIC_DEFAULT_HAIKU_MODEL el modelo pequeño que Claude Code usa en segundo plano; con el mismo identificador en ambas, todas las solicitudes de la sesión van a este modelo. En Windows PowerShell usa la forma $env:ANTHROPIC_BASE_URL = "https://llmtr.com".

Claude Code no reconoce este identificador, así que supone una ventana de 200K y muestra un aviso; CLAUDE_CODE_MAX_CONTEXT_TOKENS=1000000 indica la ventana real de 1.000.000 de tokens. El selector /model solo muestra identificadores que contienen claude o anthropic; indica este modelo con ANTHROPIC_MODEL.

Variables de entorno que dirigen Claude Code a LLMTR y a MiniMax M3.1 Flash Preview

export ANTHROPIC_BASE_URL=https://llmtr.com
export ANTHROPIC_AUTH_TOKEN=llmtr-your_key
export ANTHROPIC_MODEL=minimax/minimax-m3.1-flash-preview:low
export ANTHROPIC_DEFAULT_HAIKU_MODEL=minimax/minimax-m3.1-flash-preview:low
export CLAUDE_CODE_MAX_CONTEXT_TOKENS=1000000
claude

Comprueba la configuración: la tarea que probamos

El 1 de octubre de 2026 iniciamos Claude Code 2.1.286 con esta configuración en una carpeta vacía y le pedimos escribir un archivo de Python y ejecutarlo. Claude Code creó hello.py, lo ejecutó con python e informó la salida correcta. En dos intentos la tarea necesitó 4 y 5 turnos del modelo y terminó en entre 16 y 19 segundos; las llamadas a herramientas y sus resultados viajaron por /v1/messages sin problemas.

En esta prueba las instrucciones de sistema y las herramientas de Claude Code sumaron unos 25.000 tokens y se reenviaron en cada solicitud. El modelo es gratuito y esos tokens no se descuentan de tu saldo, pero incluso una tarea corta requiere varias solicitudes y cada una cuenta para la cuota diaria. La estimación en dólares que muestra Claude Code sale de su propia tabla de precios y no se aplica a este modelo; el uso real aparece en la página de uso de tu panel de LLMTR.

Profundidad de razonamiento: el sufijo :low

El modelo razona antes de cada respuesta. Según la documentación de la API de MiniMax, si no se envía reasoning_effort se usa el nivel más profundo, max. Los ajustes propios de razonamiento y esfuerzo de Claude Code no llegan a este modelo; la forma de elegir el nivel es un sufijo al final del identificador: :low, :medium, :high, :xhigh o :max. Un sufijo fuera de la lista, como :turbo, se rechaza con 400 invalid_request y el mensaje de error enumera los niveles válidos.

Empieza con :low para pasos cortos como editar archivos o ejecutar comandos, y prueba :high o :max para depuración en varios pasos; los niveles altos implican más tokens de razonamiento y más espera. La respuesta con formato Anthropic no devuelve el razonamiento como bloque thinking; solo contiene bloques text y tool_use.

Agentes de programación compatibles con OpenAI

En un agente que ofrezca un proveedor compatible con OpenAI, rellena tres campos: la URL base https://llmtr.com/v1, tu clave de API de LLMTR y el identificador minimax/minimax-m3.1-flash-preview. Escribe el identificador completo, con el prefijo minimax/.

Si el agente permite añadir campos al cuerpo, usa reasoning_effort; si no, usa el sufijo: minimax/minimax-m3.1-flash-preview:low. Si se envían ambos, gana reasoning_effort. Si el agente tiene un ajuste de salida máxima, deja unos miles de tokens: el razonamiento cuenta para ese límite y, si es bajo, la respuesta se corta mientras el modelo aún razona.

Condición de acceso, cuota y después del 6 de octubre

Si tu cuenta nunca ha recargado saldo, la primera solicitud del agente recibe un 402; en el cuerpo de error con formato OpenAI, el campo error.details.reason es top_up_required. Recarga al menos 5 $ y vuelve a intentarlo pasado un minuto; el modelo no se descuenta de tu saldo. Cuando se agota la cuota diaria recibes un 429. En los modelos gratuitos el proveedor puede registrar las instrucciones; tenlo en cuenta antes de abrir un código confidencial.

Desde el 7 de octubre de 2026 este identificador devuelve 410 model_retired y el agente se detiene. Para pasar al modelo de pago minimax/minimax-m3, cambia los valores de ANTHROPIC_MODEL y ANTHROPIC_DEFAULT_HAIKU_MODEL y quita el sufijo :low, porque la ficha de M3 no incluye niveles de reasoning_effort. El cambio no es automático: ninguna solicitud llega al modelo de pago hasta que tú lo cambies.

Conectar MiniMax M3.1 Flash Preview a Claude Code

Pasos para usar Claude Code con MiniMax M3.1 Flash Preview a través del endpoint /v1/messages compatible con Anthropic de LLMTR.

  1. Crea una clave de API. Crea una clave de API en el panel de LLMTR.
  2. Cumple la condición de acceso. Recarga saldo al menos una vez; la recarga mínima es de 5 $ y este modelo no se descuenta de tu saldo.
  3. Define las variables de entorno. Define ANTHROPIC_BASE_URL, ANTHROPIC_AUTH_TOKEN, ANTHROPIC_MODEL, ANTHROPIC_DEFAULT_HAIKU_MODEL y CLAUDE_CODE_MAX_CONTEXT_TOKENS.
  4. Comprueba con una tarea corta. Inicia Claude Code y pídele escribir un archivo y ejecutarlo.

Frequently asked questions

¿Funciona MiniMax M3.1 Flash Preview con Claude Code?

Sí. Funciona con ANTHROPIC_BASE_URL=https://llmtr.com y ANTHROPIC_MODEL=minimax/minimax-m3.1-flash-preview:low. El 1 de octubre de 2026 Claude Code 2.1.286 completó con esta configuración una tarea de escribir y ejecutar un archivo.

¿Cómo cambio la profundidad de razonamiento en Claude Code?

Cambia el sufijo al final del identificador: :low, :medium, :high, :xhigh o :max. Sin sufijo se usa el valor por defecto de MiniMax, max.

¿Pagaré el coste que muestra Claude Code?

No. Es una estimación propia de Claude Code. Este modelo es gratuito hasta el 6 de octubre de 2026 a las 23:59 (hora de Turquía).

Artículos relacionados