Comparativa de modelos · 2026-09-11
¿Qué es Sakana Fugu Max? La orquestación multiagente explicada
Sakana Fugu Max no es un modelo único, sino un orquestador entrenado que reparte el trabajo entre un grupo de agentes expertos. Cómo funciona, qué dicen las cifras publicadas, qué capacidades ha medido LLMTR y en qué se diferencia de Fugu Ultra.
¿Qué es Fugu Max?
Sakana Fugu Max no es un único modelo de lenguaje. Es un orquestador entrenado para recibir una solicitud, dividir el trabajo y enrutar cada parte a un modelo experto del grupo. Las salidas de los agentes se combinan y se devuelven como una sola respuesta compatible con OpenAI; en el lado del cliente no hay ningún protocolo adicional.
El grupo se apoya sobre todo en modelos de pesos abiertos, y Sakana menciona por su nombre a la familia NVIDIA Nemotron. Qué solicitud va a qué agente no se publica: la decisión de enrutado es cerrada del lado del proveedor. Por eso Fugu Max debe evaluarse como una capa de decisión y no como una lista de modelos.
En la práctica, esto significa que una solicitud sencilla y otra difícil enviadas con el mismo identificador pueden poner a trabajar equipos de tamaños distintos. Esa es la ventaja en calidad. En coste abre una cuestión aparte, y esa cuestión se responde con cifras medidas en el artículo de precios de esta serie.
Ficha del modelo
Los valores siguientes son los de la propia fila del catálogo. LLMTR fija el identificador upstream a una versión: una llamada a sakana/fugu-max llega a fugu-max-v1.0 en el lado de Sakana. El atajo fugu-max del proveedor es un alias y puede apuntar a otra versión más adelante, mientras que la tarjeta de precios está ligada a la versión. Fijarlo evita una divergencia silenciosa entre la tarifa que facturamos y el modelo que realmente se ejecuta.
El identificador público no cambia: usted siempre llama a sakana/fugu-max.
| Campo | Valor |
|---|---|
| Identificador de modelo en LLMTR | sakana/fugu-max |
| Identificador de modelo en Sakana | fugu-max-v1.0 |
| Ventana de contexto | 1.000.000 tokens |
| Precio de entrada | $2 / 1M tokens |
| Precio de salida | $6 / 1M tokens |
| Lectura de caché | $0.25 / 1M tokens |
| Endpoints | /v1/chat/completions, /v1/responses |
| Niveles de reasoning | high, xhigh |
Las cifras publicadas y cómo leerlas
Sakana informa de que Fugu Max obtiene la mejor puntuación general en seis pruebas: Terminal Bench 2.1, GPQA Diamond, AA-LCR, GDP.pdf, AutomationBench y SWEFish. La misma página afirma que amplía la frontera coste-rendimiento en siete de diez pruebas.
Son mediciones del propio proveedor y no han sido verificadas de forma independiente. Una tabla de resultados no demuestra que el modelo vaya a rendir igual en su trabajo. Al evaluar un modelo nuevo, compare los candidatos con las mismas tareas, el mismo material de partida y el mismo criterio de aceptación.
- Ponga una tarea corriente junto a una difícil; un modelo tiene que funcionar en el caso medio, no solo en el extremo.
- Mida el trabajo terminado y no la primera respuesta: una respuesta que hay que corregir cuesta tiempo y tokens.
- Registre el coste total incluyendo los reintentos; un precio de token bajo no significa por sí solo un coste bajo por tarea completada.
Capacidades: medidas, no citadas
Ninguna de las filas siguientes se ha tomado de una tabla de características del proveedor; cada una se probó contra fugu-max-v1.0 el 11 de septiembre de 2026.
La diferencia en json_object importa especialmente. Fugu Max devuelve JSON puro. Fugu Ultra acepta la misma petición sin error, pero envuelve la respuesta en un bloque de código, de modo que quien llama solo detecta el problema al analizar el JSON. Por eso la fila de Fugu Ultra no declara la capacidad json_mode en el catálogo y la salida estructurada en ese modelo se hace con json_schema.
| Capacidad | Estado | Cómo se verificó |
|---|---|---|
| Entrada de imagen | Sí | Se envió un PNG real y la descripción devuelta coincidía con la imagen |
| Llamada a funciones | Sí | tool_choice: required devolvió un array tool_calls bien formado |
| Salida estructurada (json_schema) | Sí | Se pidió un esquema estricto y se recibió exactamente ese objeto |
| Modo JSON (json_object) | Sí | Devolvió JSON puro, sin bloque de código alrededor |
| Caché de prompt | Sí | Un prefijo repetido informó cached_tokens por encima de cero |
| Reasoning effort | high, xhigh | low y medium se rechazan con 400; max es un alias de xhigh |
| Límite de salida publicado | Ninguno | El campo max_tokens no se valida; no hay límite anunciado |
¿Fugu Max o Fugu Ultra?
Ambas filas usan el mismo enfoque de agentes; se separan en el precio, en las bandas de contexto y en el comportamiento de la salida estructurada. Fugu Max es la opción por defecto para la mayoría del trabajo de programación, investigación y análisis. Cuando la calidad de la respuesta pesa más que el coste, sobre todo en problemas largos de varios pasos, la opción es Fugu Ultra.
La diferencia de precio no es pequeña: la misma solicitud cuesta 2,5 veces más en entrada y 5 veces más en salida con Fugu Ultra. Además, Fugu Ultra pasa a una segunda banda de precios por encima de 272.000 tokens de entrada, mientras que la tarifa de Fugu Max es independiente de la longitud del contexto.
| Comparación | sakana/fugu-max | sakana/fugu-ultra |
|---|---|---|
| Entrada ($/1M tokens) | $2 | $5 (por encima de 272K: $10) |
| Salida ($/1M tokens) | $6 | $30 (por encima de 272K: $45) |
| Lectura de caché ($/1M tokens) | $0.25 | $0.50 (por encima de 272K: $1.00) |
| Bandas de contexto | Tarifa única, independiente de la longitud | Pasa a una segunda banda en 272K tokens de entrada |
| Ventana de contexto | 1.000.000 tokens | 1.000.000 tokens |
| json_object | Compatible | No compatible |
| json_schema | Compatible | Compatible |
| Campos de tokens de orquestación | Devuelven cero | Devuelven por encima de cero |
Qué leer a continuación
Lea el artículo de precios antes de presupuestar un trabajo repetido: en un modelo multiagente el número de tokens visibles y el número de tokens facturados no siempre coinciden, y esa diferencia se comporta de forma distinta en Fugu Max y en Fugu Ultra.
Pase después a la guía de integración para enviar una primera solicitud. Mantenga el primer experimento acotado, escriba antes su criterio de aceptación y amplíe el volumen solo cuando la calidad medida y el coste medido cumplan sus expectativas.
Frequently asked questions
¿Fugu Max es un único modelo?
No. Fugu Max es un orquestador entrenado que reparte la solicitud entre un grupo de agentes expertos. Usted recibe una sola respuesta compatible con OpenAI, pero puede haber trabajado más de un modelo.
¿Qué modelos forman el grupo de Fugu Max?
Sakana indica que el grupo se apoya en modelos de pesos abiertos y menciona a la familia NVIDIA Nemotron. La lista completa y la decisión de enrutado por solicitud no se publican.
¿Fugu Max acepta imágenes?
Sí. La entrada de imagen se probó con un archivo PNG real el 11 de septiembre de 2026 y la descripción devuelta por el modelo coincidía con la imagen. En Chat Completions se usa la parte image_url compatible con OpenAI.
¿Cuál es la diferencia de precio entre Fugu Max y Fugu Ultra?
Fugu Ultra cuesta 2,5 veces más en entrada y 5 veces más en salida, y pasa a una segunda banda de precios por encima de 272.000 tokens de entrada. La tarifa de Fugu Max es única e independiente de la longitud del contexto.