Você usa a API Sakana Fugu criando uma chave em console.sakana.ai, copiando a URL base exibida em seu console e apontando seu cliente OpenAI existente para esse endpoint. Nenhuma migração de SDK é necessária. O Fugu é fornecido como uma API única compatível com OpenAI, então as mesmas bibliotecas openai Python e JavaScript que você já usa se comunicarão com ele assim que você trocar a URL base e a chave. Por trás desse único endpoint, o Fugu é um sistema de orquestração multiagente: conforme a página de lançamento do Sakana, ele decide se deve responder diretamente ou montar uma equipe de modelos, e seu código nunca vê essa decisão. Se você já configurou outros gateways antes, como em nosso guia para a API Claude Fable 5, esta configuração parecerá familiar.
Este guia descreve como obter uma chave, configurar o cliente em duas linguagens, escolher o campo do modelo e lidar com streaming, para que você possa enviar sua primeira conclusão de chat em poucos minutos.
O que a API Sakana Fugu realmente é
Fugu não é um modelo único no sentido usual. Sakana o descreve como um modelo de linguagem treinado especializado em delegação, comunicação de agentes e síntese de trabalho. A manchete de lançamento é “Um Modelo para Comandar Todos Eles.” Quando você envia uma solicitação, um condutor treinado lê seu prompt e responde por conta própria ou coordena dinamicamente vários LLMs, incluindo instâncias recursivas de si mesmo, então sintetiza o resultado em uma única resposta.

Do ponto de vista do seu código, nada disso importa. Você chama um endpoint compatível com OpenAI e recebe de volta uma conclusão de chat normal. O gráfico de orquestração permanece no lado do servidor. Você nunca monta agentes, roteia entre provedores ou gerencia uma equipe. Essa é toda a proposta: a complexidade vive por trás da API, não em seu cliente.
Existem duas variantes. “Fugu” é a opção equilibrada e de baixa latência construída para o trabalho diário, codificação, revisão de código, chatbots e serviços interativos. “Fugu Ultra” visa a máxima qualidade de resposta para pesquisa de IA, reprodução de artigos, análise de segurança cibernética e investigação de literatura ou patentes. Durante a fase beta e em grande parte da imprensa inicial, a variante menor era chamada de “Fugu Mini”. Use os nomes atuais, Fugu e Fugu Ultra, e trate “Mini” como o rótulo antigo da versão beta.

A linhagem de pesquisa é real e pública. Dois artigos da ICLR 2026 fundamentam a abordagem: Trinity, um coordenador com menos de 20 mil parâmetros otimizado por evolução sem derivada com papéis de Thinker, Worker e Verifier, e Conductor, um modelo de 7B treinado com aprendizado por reforço que aprende a estrutura de comunicação entre agentes. Eles usam métodos e tamanhos diferentes, então não os confunda. A contagem exata de parâmetros do produto final não é publicada.
Passo 1: Crie uma chave de API Fugu em console.sakana.ai
Acesse console.sakana.ai. O acesso passa por um muro de login, então você faz login com Google ou e-mail antes de chegar ao painel. A versão beta funcionou com aproximadamente 500 usuários a partir do final de abril de 2026. Se o registro de autoatendimento para disponibilidade geral está totalmente aberto ou ainda restrito pode mudar, então verifique o estado atual ao acessar a página. Uma restrição de disponibilidade na UE/EEE também foi divulgada; verifique se sua região é suportada antes de desenvolver para a API.

Uma vez dentro, procure a seção de chaves de API. Gere uma chave e armazene-a em um local seguro, como uma variável de ambiente ou um gerenciador de segredos. Trate-a da mesma forma que trataria qualquer outra chave de provedor: nunca a envie para o controle de versão e gire-a se for comprometida.
Enquanto estiver no console, encontre e copie a URL base da sua conta. Este é o passo mais importante, e é o único detalhe que você não pode adivinhar. A URL base para o endpoint Fugu não está publicada em nenhuma página pública da Sakana até o momento desta escrita. Copie o valor exato que o console mostra a você. Não presuma que ele segue algum padrão de outro provedor, e não cole um host que você viu em uma postagem de fórum. O console é a fonte da verdade.
Passo 2: Aponte seu cliente OpenAI existente para o Fugu
Como o Fugu é compatível com OpenAI, você mantém seu SDK atual. Você só muda duas coisas: a base_url e a api_key. Todo o resto em sua solicitação permanece na mesma forma de uma conclusão de chat OpenAI padrão.
Nos trechos abaixo, <YOUR_FUGU_BASE_URL_FROM_CONSOLE> é um espaço reservado. Copie a URL base real do seu console; não a adivinhe. O mesmo vale para a string do modelo, que abordaremos na próxima seção.
Python
from openai import OpenAI
client = OpenAI(
api_key="YOUR_FUGU_API_KEY",
base_url="<YOUR_FUGU_BASE_URL_FROM_CONSOLE>", # copy from console.sakana.ai, do not guess
)
response = client.chat.completions.create(
model="fugu", # confirm the exact model string in your console
messages=[
{"role": "system", "content": "You are a helpful engineering assistant."},
{"role": "user", "content": "Refactor this function to remove the nested loop."},
],
)
print(response.choices[0].message.content)
JavaScript
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.FUGU_API_KEY,
baseURL: "<YOUR_FUGU_BASE_URL_FROM_CONSOLE>", // copy from console.sakana.ai, do not guess
});
const response = await client.chat.completions.create({
model: "fugu", // confirm the exact model string in your console
messages: [
{ role: "system", content: "You are a helpful engineering assistant." },
{ role: "user", content: "Refactor this function to remove the nested loop." },
],
});
console.log(response.choices[0].message.content);
Essa é a migração completa. Se você já roteou um cliente OpenAI através de um gateway de terceiros antes, o padrão é idêntico a configurações como Claude Code com OpenRouter: mesmo cliente, nova URL base, nova chave. A diferença é o que acontece no lado do servidor, o que abordaremos abaixo.
Passo 3: Escolha o campo do modelo
O campo model seleciona a variante. As strings relatadas são fugu para o modelo balanceado e fugu-ultra para o modelo de qualidade máxima. Algumas fontes também relataram um identificador datado, algo como fugu-ultra-20260615. Identificadores como esse podem mudar entre os lançamentos, então confirme a string exata listada em seu console em vez de copiar um ID datado de um artigo. É por isso também que este guia mantém IDs datados fora dos títulos: eles se tornam obsoletos, e seu console é a autoridade.
Uma regra prática: comece com fugu para cargas de trabalho interativas, codificação e chat, onde a latência importa. Mude para fugu-ultra quando a qualidade da resposta superar a velocidade, por exemplo, pesquisa aprofundada, reprodução de artigos ou uma revisão de segurança. Ambas as variantes vivem por trás do mesmo endpoint, então a troca é uma alteração de uma linha no valor de model.
# Equilibrado, baixa latência
fast = client.chat.completions.create(
model="fugu",
messages=[{"role": "user", "content": "Summarize this changelog in three bullets."}],
)
# Qualidade máxima de resposta
deep = client.chat.completions.create(
model="fugu-ultra", # confirm the exact string in your console
messages=[{"role": "user", "content": "Reproduce the main result of this paper and flag any gaps."}],
)
Passo 4: Transmita respostas
O streaming funciona exatamente como com o OpenAI. Defina stream=True (ou stream: true) e itere sobre os blocos. Isso é útil para interfaces de usuário de chat e respostas longas onde você deseja que os tokens apareçam à medida que chegam.
Streaming em Python
stream = client.chat.completions.create(
model="fugu",
messages=[{"role": "user", "content": "Walk me through setting up a CI pipeline."}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta.content
if delta:
print(delta, end="", flush=True)
Streaming em JavaScript
const stream = await client.chat.completions.create({
model: "fugu",
messages: [{ role: "user", content: "Walk me through setting up a CI pipeline." }],
stream: true,
});
for await (const chunk of stream) {
const delta = chunk.choices[0]?.delta?.content;
if (delta) process.stdout.write(delta);
}
Algo a entender sobre o streaming com Fugu: mesmo quando a resposta é transmitida token por token, a orquestração ainda ocorreu primeiro no lado do servidor. Se o condutor montou uma equipe para sua solicitação, essa coordenação foi resolvida antes ou durante a geração, e seu stream carrega apenas a saída sintetizada. Você não verá conversas intermediárias de agentes ou um gráfico de roteamento no stream. Você obtém texto limpo, o mesmo que uma API de modelo único.
O que acontece por trás de uma solicitação
Esta é a parte que torna o Fugu diferente de uma API de modelo simples, e vale a pena entender, mesmo que seu código permaneça simples. Quando sua solicitação chega, o condutor a lê e toma uma decisão: responder diretamente ou construir uma equipe. Se ele constrói uma equipe, pode envolver vários LLMs, incluindo recursivamente mais instâncias de Fugu, e então mesclar o trabalho deles em uma única resposta.
Alguns mecanismos da página de lançamento são importantes saber se você tem requisitos de governança. Os agentes no pool são intercambiáveis. As equipes podem excluir agentes específicos, o que ajuda quando uma regra de dados ou conformidade significa que um determinado provedor não deve lidar com certas cargas de trabalho. O Fugu também pode rotear dinamicamente em torno de restrições de provedores. Isso torna a camada de orquestração uma alavanca de conformidade, não apenas de qualidade.
Aqui está a contextualização honesta, porque ela importa para como você lê qualquer benchmark. Fugu é um orquestrador que chama modelos de ponta de outros fornecedores, incluindo-se recursivamente. Assim, quando a Sakana relata que o Fugu Ultra “está ombro a ombro com modelos líderes como Fable 5 e Mythos Preview” em benchmarks de engenharia, científicos e de raciocínio, leia isso como uma alegação de paridade, atribuída à Sakana, de um modelo de modelos, não uma vitória de modelo único. A Sakana também relata que o Fugu “supera consistentemente” Gemini 3.1 Pro, Opus 4.8 e GPT 5.5 em aplicações específicas como AutoResearch, xadrez de uma jogada e previsão de séries temporais financeiras. Um resultado como “supera Opus 4.8” pode vir do Fugu chamando Opus e sintetizando sua saída. Essa é uma capacidade real, e é diferente de um modelo autônomo liderando uma classificação. Se você quiser se aprofundar nos modelos Anthropic únicos com os quais o Fugu é medido, nosso guia da API Claude Fable 5 aborda o Fable 5 diretamente. Para mais sobre a linhagem do modelo e a história da orquestração, veja o que é Sakana Fugu.
Uma nota sobre acesso, preços e alternativas
A estrutura de preços é confirmada na página de lançamento: Sakana oferece planos de assinatura para uso diário e um plano pay-as-you-go para cargas de trabalho mais pesadas e empresariais. Os valores específicos em dólares circulando para os níveis, promoções e taxas por token vêm de fontes secundárias, renderizadas em JavaScript, não da própria página de lançamento. Como esses números mudam e não estavam na página oficial, este guia não os cita. Verifique os preços ao vivo em seu console a partir de hoje, 22-06-2026, antes de se comprometer com um plano.
Se você estiver avaliando o Fugu em comparação com gateways de roteamento, mantenha as categorias claras. Roteadores como OpenRouter e Martian escolhem um modelo por solicitação. O Fugu, em vez disso, executa uma topologia aprendida e adaptativa que pode usar vários modelos e a si mesmo. Se você estiver comparando gateways para sua pilha, nossa compilação das melhores alternativas ao OpenRouter é um ponto de partida útil, pois enquadra as compensações entre roteamento de modelo único e orquestração.
Como isso se encaixa no seu fluxo de trabalho Apidog
Como o Fugu fala o formato de chat-completions do OpenAI, você pode testá-lo da mesma forma que testa qualquer API HTTP. Insira a URL base do seu console em uma nova solicitação no Apidog, adicione sua chave como um token de portador (bearer token), defina o corpo JSON com seu model e messages, e envie. Você verá a resposta bruta, incluindo o uso de tokens e a mensagem sintetizada, sem escrever uma linha de código cliente. Isso facilita a confirmação de que sua URL base está correta, a verificação da string do modelo e a observação de como os blocos de streaming chegam antes de você conectar o Fugu a um aplicativo.

O Apidog também permite que você salve a solicitação, parametrize a chave entre ambientes e compartilhe um exemplo de trabalho com sua equipe. Para um passo a passo focado, veja nosso guia sobre como testar a API Sakana Fugu com Apidog. Quando estiver pronto para construir, Baixe o Apidog e comece de uma solicitação verificada em vez de adivinhar o contrato.
Perguntas Frequentes
Preciso de um novo SDK para chamar a API Sakana Fugu?
Não. O Fugu expõe um endpoint compatível com OpenAI, então você mantém seu cliente openai Python ou JavaScript existente. Altere a base_url para o valor do seu console e defina sua chave de API Fugu. Os formatos de solicitação e resposta correspondem às conclusões de chat padrão do OpenAI.
Onde encontro a URL base do Fugu?
Copie-a do seu painel em console.sakana.ai depois de fazer login com Google ou e-mail. A URL base não é publicada em nenhuma página pública da Sakana, então não a adivinhe nem reutilize um host de outro provedor. O valor do console é a única fonte confiável.
Qual a diferença entre Fugu e Fugu Ultra?
Fugu é a variante equilibrada e de baixa latência para trabalho diário, codificação, revisão de código e chat. Fugu Ultra visa a máxima qualidade de resposta para pesquisa, reprodução de artigos e análise de segurança. Ambos funcionam por trás do mesmo endpoint, então você alterna mudando o campo model. A variante menor era chamada de “Fugu Mini” durante a fase beta.
O Fugu supera modelos únicos como o Fable 5?
Trate isso com cautela. A Sakana posiciona o Fugu Ultra como estando lado a lado com o Fable 5 e o Mythos Preview, o que é uma afirmação de paridade, não uma afirmação de "superação". O Fugu é um orquestrador que pode chamar modelos de ponta de outros fornecedores, então seus números refletem um modelo de modelos, e não uma vitória de modelo único. Consulte nosso guia da API Claude Fable 5 para o ponto de comparação de modelo único.
Quanto custa a API Sakana Fugu?
A página de lançamento confirma os níveis de assinatura e um plano pay-as-you-go, mas os valores específicos em dólar circulando vêm de fontes secundárias e mudam com o tempo. Verifique os preços ao vivo em seu console a partir de 22-06-2026 antes de assinar. Este guia não cita números não verificados.
Como testo o Fugu antes de escrever código?
Envie uma solicitação de um cliente de API como o Apidog: cole sua URL base do console, adicione sua chave, defina o model e messages, e inspecione a resposta. Isso confirma que sua configuração funciona antes de integrar. O guia testar a API Sakana Fugu com Apidog mostra o fluxo completo.
O Fugu condensa um sistema multiagente em uma chamada compatível com OpenAI, o que significa que a parte mais difícil de começar é apenas copiar a URL base correta do seu console. Uma vez que isso esteja configurado, seu cliente existente faz o resto, e o Apidog oferece uma maneira rápida de verificar o contrato antes de você lançar. Baixe o Apidog e envie sua primeira solicitação Fugu a partir de uma solicitação limpa e repetível.
