Fugu Max y Fugu Ultra v2 coordinan modelos abiertos y especializados: uno prioriza el coste y el otro el rendimiento en programación, investigación y tareas con varios pasos.
Sakana AI ha lanzado Fugu Max y Fugu Ultra v2, dos configuraciones de su sistema de orquestación que combinan diferentes modelos para resolver una tarea. En lugar de enviar todo el trabajo a un único modelo, Fugu puede repartirlo y elegir qué modelo especializado utilizar en cada parte.
Fugu Max está orientado a reducir el coste sin renunciar a una capacidad alta. Amplía el conjunto de modelos abiertos y especializados disponibles, incluidos modelos de la familia Nemotron de NVIDIA, y dirige cada operación al modelo más ligero que considera capaz de completarla.
Sakana fija el precio de Fugu Max en 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida. La empresa afirma que su precio de salida es entre un 40 % y un 60 % inferior al de varios modelos avanzados con los que lo compara; los resultados proceden de sus propias pruebas y pueden variar según la tarea.
Fugu Ultra v2 adopta la prioridad contraria: busca el máximo rendimiento en razonamiento prolongado, investigación autónoma, interpretación de información visual y desarrollo de software. Según Sakana, logra sus resultados coordinando modelos abiertos y especializados sin utilizar Claude Fable 5, Fable 5.1 ni GPT-6 Astra en su conjunto de agentes.
Ambas opciones están disponibles desde el lanzamiento mediante una API compatible con el formato de OpenAI. Los usuarios actuales de Fugu pueden cambiar a Max o Ultra v2 modificando el nombre del modelo en una línea, sin migrar la integración ni sustituir la API existente.