Sakana Fugu: orquestração multiagente como modelo

Sakana AI logoSakana AIImportante22 de junho de 2026Modelos
O que aconteceu
Sakana AI launched Fugu, a multi-agent orchestration model that coordinates frontier models behind a single API — two tiers, OpenAI-compatible, backed by two ICLR 2026 papers.
Porque é importante
Fugu Ultra beats GPT 5.5, Opus 4.8, and Gemini 3.1 Pro on SWE Bench Pro and Humanity's Last Exam at $5/$30 per 1M tokens — it's a new category of model that competes on coordination, not parameter count.
O que fazer
Try Fugu in any OpenAI-compatible client as a complement to your stack; don't switch your primary model yet — EU teams should wait for GDPR compliance.

A Sakana AI lançou o Fugu em 22 de junho de 2026 — um modelo de orquestração multiagente que coordena modelos de ponta atrás de uma única API compatível com OpenAI. O Fugu Ultra registra pontuações que superam GPT 5.5, Opus 4.8 e Gemini 3.1 Pro no SWE Bench Pro (73,7 vs. 58,6) e no Humanity's Last Exam (50,0 vs. 41,4), a $5 por 1M tokens de entrada e $30 por 1M tokens de saída. Nosso veredito: Watch. Dois artigos da ICLR 2026 respaldam a arquitetura, mas é o primeiro dia — sem histórico em produção, sem disponibilidade na UE, e os preços introduzem um novo modelo mental para cálculo de custos. Vamos testar e retornar com uma recomendação.

O que aconteceu

A Sakana AI lançou o Fugu fundamentado em dois artigos da ICLR 2026: TRINITY (um coordenador LLM evoluído) e Conductor (orquestração de agentes baseada em aprendizado por reforço). Em vez de prescrever papéis fixos de equipe ou fluxos de trabalho projetados manualmente, o Fugu aprende a montar dinamicamente agentes a partir de um pool, atribuir-lhes papéis de Thinker, Worker ou Verifier e coordená-los através de padrões de colaboração que humanos não projetariam.

Dois tiers são lançados:

  • Fugu — latência e qualidade balanceadas. Projetado para codificação cotidiana e trabalho interativo. Você pode configurar quais modelos entram no pool, excluindo provedores específicos para atender a restrições de privacidade e compliance.
  • Fugu Ultra — pool de agentes mais profundo, tempos de resposta mais longos, otimizado para raciocínio complexo de múltiplas etapas. Pool fixo e proprietário — você não pode ver quais modelos foram usados.

Ambos os tiers expõem um único endpoint compatível com OpenAI.

Benchmarks que exigem atenção

As pontuações do Fugu Ultra em benchmarks rigorosos de engenharia e raciocínio superam ou empatam com modelos de ponta disponíveis publicamente:

BenchmarkFugu UltraOpus 4.8Gemini 3.1 ProGPT 5.5
SWE Bench Pro73,769,254,258,6
LiveCodeBench93,287,888,585,3
Humanity's Last Exam50,049,844,441,4
GPQA-D95,592,094,393,6

Por que isso importa

O Fugu não é mais um LLM — é uma nova categoria. Ele não compete em contagem de parâmetros; compete em coordenação. O modelo aprende quais agentes implantar para cada subtarefa e como interpretar suas saídas, produzindo resultados que superam qualquer modelo individual do pool.

Dois limites importam agora. Primeiro, o Fugu não está disponível nos estados-membros da UE/EEE enquanto a Sakana trabalha para atender à conformidade com o GDPR. Segundo, o pool do Fugu Ultra é fixo e proprietário — você não pode auditar quais modelos processaram sua consulta.

O que muda para você

  1. Experimente o Fugu (não o Ultra) primeiro. O tier balanceado oferece a sensação da orquestração sem a latência e o custo mais altos do Ultra.
  2. Mantenha seu modelo principal. Use o Fugu como complemento até que ele se prove em produção.
  3. Equipes da UE/EEE: esperem. A Sakana bloqueia explicitamente o serviço nessas regiões enquanto aguarda conformidade com o GDPR.
  4. Acompanhe nossos resultados de teste. Retornaremos com uma recomendação.

FAQ

O que torna o Fugu diferente de usar múltiplos modelos por conta própria? O Fugu aprende estratégias de coordenação por treinamento, não por engenharia manual de prompts — você obtém o benefício sem a sobrecarga de engenharia.

Posso ver quais modelos subjacentes o Fugu Ultra usou? Não. A seleção e o roteamento de modelos são proprietários.

Como os preços do Fugu se comparam ao uso direto de modelos de ponta? Os $5/$30 do Fugu Ultra se comparam favoravelmente aos preços diretos de APIs de ponta, especialmente considerando a orquestração de múltiplos modelos atrás de um único endpoint.

O que fazer

  1. 1 Try Fugu in any OpenAI-compatible client — same API, no SDK migration
  2. 2 Keep your primary model; use Fugu as a complement until it proves itself in production
  3. 3 Wait for EU/EEA availability if you operate in those regions
  4. 4 Watch for our test results — we'll return with a recommendation

Ferramentas e modelos afetados

Sakana Fugu

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.