Sakana Fugu é lançado com pontuação de 93,2 no LiveCodeBench após banimento do Claude
Aprofundamento CEVIU
Aprofundamento
O Sakana Fugu é um sistema de orquestração multiagente lançado em 22 de junho de 2026 pela Sakana AI, com sede em Tóquio. Ele não é um modelo de linguagem único, mas um coordenador que roteia tarefas entre LLMs existentes, incluindo GPT-5.5, Claude Opus 4.8 e Gemini 3.1 Pro, por trás de uma única API compatível com OpenAI. O lançamento foi impulsionado pela suspensão abrupta dos modelos Claude Fable 5 e Mythos 5 pela Anthropic em 12 de junho de 2026, após ordem do governo dos EUA com base em controles de exportação e segurança nacional. A Sakana usa como base duas pesquisas apresentadas no ICLR 2026: TRINITY (coordenador evoluído) e Conductor (orquestração dinâmica de agentes).
O Fugu Ultra obteve 93,2 no LiveCodeBench, benchmark atualizado com problemas reais de LeetCode, Codeforces e AtCoder, ficando em segundo lugar no ranking até 29 de junho de 2026, atrás apenas do DeepSeek V4 Pro (Max), com 93,5%. No SWE-Bench Pro, marcou 73,7%, superando o Claude Opus 4.8 (69,2%) e o GPT-5.5 (58,6%). Em GPQA-Diamond, atingiu 95,5%, acima do Claude Mythos Preview (94,6%). Nenhuma dessas pontuações foi validada por avaliação independente até hoje.
Por que isso importa
Esse lançamento responde a uma dor real de desenvolvedores e equipes de IA: dependência crítica de um único fornecedor. Com restrições geopolíticas afetando acesso a modelos como Fable 5 e Mythos 5, o Fugu oferece uma camada de resiliência, não substituindo modelos, mas gerenciando sua combinação de forma adaptativa. Isso muda o jogo para quem precisa de estabilidade operacional em ambientes regulatórios voláteis, especialmente fora dos EUA. Mas há um trade-off: o sistema é um 'black box', os usuários não sabem qual modelo específico executou cada etapa da requisição, nem têm visibilidade sobre o pipeline interno.
A abordagem também desafia a narrativa dominante de 'maior modelo = melhor resultado'. Ao priorizar orquestração inteligente em vez de escala bruta, o Fugu mostra que desempenho em benchmarks como LiveCodeBench pode ser alcançado com composição estratégica, não apenas com treinamento monolítico. Isso abre espaço para novos padrões arquiteturais em produção, mas exige confiança na camada de coordenação, algo ainda sem auditoria pública.
Impacto para desenvolvedores
Para devs, o Fugu funciona como uma API drop-in compatível com OpenAI: basta trocar a URL base e a chave. Não há necessidade de reescrever prompts ou ajustar pipelines. As duas versões, Fugu (para chat, código simples e baixa latência) e Fugu Ultra (para pesquisa científica, análise de vulnerabilidades, busca de patentes), têm preços distintos: US$ 5/milhão de tokens de entrada e US$ 30/milhão de saída para o Ultra, com escalonamento para contextos acima de 272 mil tokens. Planos mensais também estão disponíveis: Standard ($20), Pro ($100) e Max ($200).
Mas atenção: o serviço não está disponível na UE ou EEE por questões de conformidade com o GDPR. Testes reais mostram ganhos tangíveis, como redução de 79 para 22 minutos em uma tarefa de construção de jogo Three.js , , mas também limitações práticas: o Claude Opus 4.8 ainda superou o Fugu Ultra na qualidade final do aplicativo. Isso indica que orquestração otimiza eficiência, não necessariamente excelência absoluta em todas as dimensões.
Perguntas frequentes
O que é o Sakana Fugu?
O Sakana Fugu é um sistema de orquestração multiagente lançado em 22 de junho de 2026 pela Sakana AI. Ele não é um modelo de linguagem próprio, mas um coordenador que roteia tarefas entre LLMs existentes, como GPT-5.5, Claude Opus 4.8 e Gemini 3.1 Pro, por meio de uma única API compatível com OpenAI. Baseia-se nas pesquisas TRINITY e Conductor, apresentadas no ICLR 2026.
Qual é a pontuação do Fugu Ultra no LiveCodeBench?
O Fugu Ultra obteve 93,2 no LiveCodeBench, conforme divulgado pela Sakana AI. Essa pontuação foi registrada até 29 de junho de 2026 e o coloca em segundo lugar no ranking, logo atrás do DeepSeek V4 Pro (Max), com 93,5%. Nenhuma replicação independente desses resultados foi publicada até hoje.
Por que o Fugu foi lançado logo após o banimento do Claude?
O lançamento do Fugu ocorreu em 22 de junho de 2026, uma semana após a Anthropic suspender o acesso ao Claude Fable 5 e Mythos 5 em 12 de junho de 2026. A suspensão foi determinada por ordem do governo dos EUA com base em controles de exportação e revisão de segurança nacional. A Sakana posicionou o Fugu como uma alternativa resiliente a essa dependência de fornecedor único.
O Fugu Ultra usa o Claude Fable 5 ou o GPT-6?
Não. O Fugu Ultra não inclui o Claude Fable 5 nem o GPT-6 em seu pool de modelos, pois ambos não são acessíveis publicamente. A Sakana confirmou que Fable 5 e Mythos Preview estão excluídos da orquestração. Os modelos confirmados como parte do pool incluem GPT-5.5, Claude Opus 4.8 e Gemini 3.1 Pro. Rumores sobre uso de GPT-6 ou Fable 6 não foram verificados e não constam de nenhuma fonte oficial.
Fontes
- implicator.aifonte original
- Categoria
- CEVIU IA
- Publicado
- 01 de julho de 2026
- Editoria
- CEVIU IA

