← SCRAM AI Lab
Sakana AI lanzó Fugu (jun 2026): un foundation model que enruta cada tarea al mejor LLM de un pool intercambiable. Fugu Ultra rivaliza con Fable 5. Qué cambia para quien construye sistemas multi-modelo.
June 23, 2026
204 lecturas

El 22 de junio de 2026, Sakana AI presentó Fugu: un sistema completo de orquestación multi-agente entregado como un único foundation model. En vez de elegir tú el modelo para cada tarea, Fugu enruta dinámicamente cada paso al mejor LLM disponible de un pool intercambiable, todo accesible a través de una sola API.
Según Sakana, Fugu Ultra se codea con modelos líderes como Fable 5 de Anthropic en benchmarks de ingeniería, ciencia y razonamiento, entregando capacidad frontera sin el riesgo de controles de exportación.
Fugu se construye sobre dos papers de Sakana AI presentados en ICLR 2026: TRINITY (un coordinador de LLMs evolucionado) y Conductor (aprender a orquestar agentes en lenguaje natural). La idea de fondo es la misma que está moviendo a todo el ecosistema en 2026: el valor ya no está solo en el mejor modelo, sino en cómo coordinas varios.
Fugu apunta al mismo problema que los dynamic workflows de Claude Code o la Gemini Enterprise Agent Platform de Google, pero desde otro ángulo: en lugar de que tú escribas la orquestación, el propio modelo decide qué modelo usar para qué. Para equipos que ya manejan ruteo multi-modelo (elegir entre Claude, Gemini o GPT según la tarea y el costo), Fugu propone delegar esa decisión a un orquestador entrenado. Vale la pena seguirlo de cerca si construyes sistemas que combinan varios proveedores.
Artículos relacionados
Kimi K3, GLM-5.3 y DeepSeek V4-Flash: la frontera abierta de agosto 2026
El ranking open-weight se reordenó en tres semanas: Kimi K3 (Moonshot, 27 jul) lidera como todo-terreno con 2.8T de parámetros, 1M de contexto y 88.3 en Terminal-Bench 2.1; Z.ai lanzó GLM-5.3 el 14 de agosto con post-training escalado; y DeepSeek V4-Flash queda a 2.3 puntos de Opus 4.8 costando $0.14/$0.28 por millón de tokens. Análisis de cuál conviene según tu carga — y qué licencia trae cada uno.
GLM-5.2: la apuesta de Z.ai por 1M de contexto para agentes de coding
Z.ai lanzó GLM-5.2 el 13 de junio de 2026: contexto extendido de 200K a 1M tokens sin pérdida y dos niveles de thinking effort. Pensado para codebases enormes en una sola pasada. Aquí qué cambia para quien enruta varios modelos en producción.
RPA REPSE/IMSS con Playwright + undetected-chromedriver
Los portales SAT/IMSS detectan headless browsers. Combinación ganadora: undetected-chromedriver para Python + Playwright para flow control. 2captcha y nunca almacenar credenciales del cliente.