Sakana Fugu Preisgestaltung: Abonnement-Modelle, nutzungsbasierte Abrechnung und das Passthrough-Kostenmodell

Wie die Preisgestaltung von Sakana Fugu funktioniert: Abonnementstufen für den täglichen Gebrauch, nutzungsbasierte Abrechnung für hohe Arbeitslasten und das Durchleitungs-Kostenmodell erklärt.

INEZA Felin-Michel

INEZA Felin-Michel

22 June 2026

Sakana Fugu Preisgestaltung: Abonnement-Modelle, nutzungsbasierte Abrechnung und das Passthrough-Kostenmodell

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Die Preisgestaltung von Sakana Fugu basiert auf zwei bestätigten Strukturen: Abonnement-Stufen für den täglichen Gebrauch und einem Pay-as-you-go-Plan für größere und Unternehmens-Workloads. Die wirklich neue Mechanik ist die Passthrough-Abrechnung, die es mehreren Agenten ermöglicht, in einer Anfrage zu feuern, ohne eine separate Gebühr pro Agent zu stapeln. Jede unten angegebene Dollarzahl wird aus Sekundärquellen gemeldet, da Sakana’s eigene Release-Seite die Struktur beschreibt, aber die Zahlen nicht direkt nennt. Beachten Sie, dass Fugu ein Orchestrierungssystem ist, das als einzelnes Modell präsentiert wird, was diese Abrechnungsmechanik erst möglich macht.

Button

Wie Fugu preislich strukturiert ist

Fugu wird nicht wie ein normales Chat-Modell bepreist. Es ist ein Dirigent: ein trainiertes Sprachmodell, das auf Delegation spezialisiert ist und entscheidet, ob es Ihre Anfrage direkt beantwortet oder ein Team von Arbeitsmodellen zusammenstellt, einschließlich rekursiver Instanzen seiner selbst. Diese Designentscheidung prägt die Abrechnung.

Sakana bestätigt auf der Release-Seite zwei Kaufwege:

Sowohl die ausgewogene „Fugu“-Variante als auch die hochwertigere „Fugu Ultra“-Variante sind über einen OpenAI-kompatiblen Endpunkt erreichbar. Sie wählen die Variante über eine Modell-ID-Zeichenfolge aus; Fugu entscheidet dann intern, wie viel Rechenleistung eingesetzt werden soll.

Es wird keine eigenständige kostenlose Stufe gemeldet. Am nächsten kommt eine Startaktion, die unten behandelt wird.

Wenn Sie die Wirtschaftlichkeit vor einer Verpflichtung testen möchten, richten Sie einen bestehenden OpenAI-Client auf Fugu und beobachten Sie Ihre Token-Ausgaben in Echtzeit. Apidog bietet Ihnen eine anfragebasierte Ansicht, was hier wichtiger ist als bei einer Einzelmodell-API, da ein Fugu-Aufruf intern in mehrere Modellaufrufe verzweigen kann.

Gemeldete Preise: vor der Budgetierung live überprüfen

Gemeldete Abonnement-Stufen

Plan Gemeldeter Monatspreis Zielgruppe
Einstieg gemeldet $20 / Monat Einzelne Entwickler, leichte tägliche Nutzung
Mittel gemeldet $100 / Monat Teams, konstante Codierungs- und Überprüfungs-Workloads
Top gemeldet $200 / Monat Power-User, interaktive Dienste mit hohem Volumen

Dieselbe Stufenleiter gilt Berichten zufolge sowohl für Fugu als auch für Fugu Ultra. Eine Startaktion bietet Berichten zufolge einen kostenlosen zweiten Monat, wenn Sie vor Ende Juli 2026 abonnieren. Sollte dieses Angebot für Ihre Entscheidung relevant sein, überprüfen Sie es zuerst in der Konsole, da sich Startangebote schnell ändern und dieses auf der Release-Seite nicht bestätigt ist.

Gemeldete Pay-as-you-go-Tarife

Token-Typ Gemeldeter Tarif (pro 1 Mio. Tokens) Gemeldeter Aufschlag über 272K Kontext
Eingabe gemeldet $5 gemeldet $10
Ausgabe gemeldet $30 gemeldet $45
Gecachter Input gemeldet $0.50 gemeldet $1.00

Die Spalte für den Aufschlag ist der Teil, auf den man achten sollte. Anfragen mit langem Kontext über etwa 272K Tokens kosten Berichten zufolge ungefähr das Doppelte pro Million. Orchestrierungs-Prompts neigen dazu, zu wachsen, da der Dirigent den Kontext zwischen den Worker-Agenten weitergibt, sodass ein Fugu Ultra-Lauf auf Forschungsniveau schneller in diesen Bereich geraten kann, als Sie erwarten.

Um ein Gefühl dafür zu bekommen, wo diese PAYG-Tarife liegen, vergleichen Sie sie mit Modellen, die Sie bereits kaufen können. Wenn Sie Claude Fable 5 bepreist haben, kennen Sie bereits die Form der Grenzmodell-Abrechnung.

Sie zahlen immer noch eine Sakana-Marge zusätzlich zu den Kosten der Worker-Modelle

Lesen Sie den Passthrough-Anspruch sorgfältig. Die Basis-Fugu-Variante nutzt den Tarif des zugrunde liegenden Modells, aber die Premium-Fugu-Ultra-Variante und die PAYG-Tarife liegen aus gutem Grund höher als die billigsten Worker-Modelle. Sie bezahlen Sakana dafür, den Dirigenten zu betreiben: die Routing-Entscheidung, die Agent-zu-Agent-Kommunikation und die Synthese der endgültigen Antwort.

Die ehrliche Darstellung ist diese:

Einfach ausgedrückt: Ein günstiger Dirigent, der teure Arbeitskräfte einstellt, präsentiert Ihnen trotzdem eine teure Rechnung. Fugu’s Sparargument ist, dass es teure Arbeitskräfte nur dann einsetzt, wenn das Problem es erfordert, und einfache Prompts selbst günstig beantwortet. Ob das insgesamt günstiger ist, als ein Frontier-Modell direkt aufzurufen, hängt ausschließlich von Ihrem Traffic-Mix ab.

Verankerung an realen Grenzmodellpreisen

Sie können die gemeldeten Zahlen von Fugu nicht isoliert beurteilen. Vergleichen Sie sie mit Modellen, deren Preise veröffentlicht und belegt sind. Diese Zahlen stammen von Anthropic’s Preisgestaltung vom 2026-06-09 und sind nicht gemeldet oder abgesichert:

Modell Eingabe (pro 1 Mio.) Ausgabe (pro 1 Mio.) Was es ist
Fable 5 $10 $50 Anthropic’s leistungsstärkstes allgemein verfügbares Modell, eine Stufe über Opus 4.8
Mythos 5 $10 $50 Gleiche Preisspanne wie Fable 5
Mythos Preview $25 $125 Das im April 2026 zurückgehaltene Grenzmodell, das als „zu gefährlich zur Veröffentlichung“ galt

Vergleichen Sie dies nun mit Fugu’s gemeldeten PAYG-Tarifen von etwa 5 $ Eingabe und 30 $ Ausgabe pro Million Tokens. Auf dem Papier sieht der Fugu-Basistarif pro Token günstiger aus als Fable 5, aber dieser Vergleich ist irreführend, wenn man dort aufhört.

Sakana behauptet, dass Fugu Ultra „auf Augenhöhe mit führenden Modellen wie Fable 5 und Mythos Preview“ bei technischen, wissenschaftlichen und logischen Benchmarks steht. Laut Sakana ist dies eine Gleichwertigkeitsbehauptung, keine „Übertrifft“-Behauptung. Und erinnern Sie sich an die Architektur: Fugu ist ein Orchestrator, der die Grenzmodelle anderer Anbieter aufruft, einschließlich rekursiver Aufrufe seiner selbst. Wenn also ein Fugu-Lauf eine Antwort von Frontier-Qualität liefert, könnte dies durch den Aufruf eines Frontier-Modells und die Synthese des Ergebnisses geschehen sein. Die angegebene Token-Zahl ist für den Dirigenten; die Aufrufe des Dirigenten werden zusätzlich abgerechnet.

Wenn Sie Fugu mit den Modellen vergleichen, neben denen es steht, führt unser Leitfaden zu wie man Sakana Fugu zugreift durch die Anmeldebarriere, und die Unterscheidung zwischen Modell-von-Modellen und Einzelmodell ist hier wichtig. Fable 5 und Mythos sind einzelne Anthropic-Modelle mit einem veröffentlichten Tarif. Fugu ist ein System, dessen effektive Kosten davon abhängen, welche Modelle es entscheidet aufzuwecken.

Fugu über einen OpenAI-kompatiblen Client aufrufen

Fugu stellt einen OpenAI-kompatiblen Endpunkt bereit, sodass Sie einen bestehenden OpenAI-Client mit Ihrem Schlüssel darauf richten und eine SDK-Migration überspringen können. Die Basis-URL ist auf keiner öffentlichen Seite veröffentlicht, kopieren Sie also die echte aus Ihrer Konsole und hardcodieren Sie niemals einen vermuteten Host.

from openai import OpenAI

# Kopieren Sie die echte Basis-URL von console.sakana.ai, nachdem Sie sich angemeldet haben.
client = OpenAI(
    api_key="YOUR_SAKANA_API_KEY",
    base_url="<YOUR_FUGU_BASE_URL_FROM_CONSOLE>",
)

# "fugu" leitet die ausgewogene, passthrough-abgerechnete Variante.
# "fugu-ultra" leitet die Variante mit maximaler Qualität.
response = client.chat.completions.create(
    model="fugu",
    messages=[
        {"role": "user", "content": "Review this function for security issues."},
    ],
)

print(response.choices[0].message.content)
print(response.usage)  # Token-Zählungen beobachten; hier zeigen sich die Kosten

Die Modell-ID-Strings (fugu und fugu-ultra, möglicherweise mit einem datierten Suffix) werden gemeldet und sollten in Ihrer Konsole bestätigt werden. Protokollieren Sie das Feld response.usage: Bei einem Orchestrator ist die Nutzung das einzige ehrliche Signal dafür, was eine Anfrage gekostet hat, da die internen Aufrufe des Dirigenten in dieser Zählung zusammengefasst werden. Die Form der Anfrage und Antwort folgt dem Standard-OpenAI Chat Completions-Vertrag, sodass alles, was dieses Protokoll spricht, ohne Änderungen funktioniert. Eine vollständige Einrichtungsanleitung finden Sie in unserem Leitfaden zu wie man die Sakana Fugu API verwendet.

Häufig gestellte Fragen

Hat Fugu eine kostenlose Stufe?

Es wurde keine eigenständige kostenlose Stufe gemeldet. Das nächstgelegene Angebot ist eine Startaktion, die Berichten zufolge einen kostenlosen zweiten Monat gewährt, wenn Sie vor Ende Juli 2026 abonnieren. Diese Aktion ist auf der Release-Seite nicht bestätigt, überprüfen Sie sie also live in Ihrer Konsole unter console.sakana.ai, bevor Sie sich darauf verlassen.

Warum erscheint Fugu pro Token günstiger, könnte aber mehr kosten?

Der gemeldete Pro-Token-Preis gilt für den Dirigenten, nicht für die Frontier-Modelle, die er aufruft. Fugu ist ein Orchestrator, der schwierige Probleme an Modelle anderer Anbieter delegiert und diese zusätzlich abrechnet. Ein einzelnes Frontier-Modell hat einen veröffentlichten Tarif ohne versteckte Verzweigung, weshalb unsere Claude Fable 5 Preisaufschlüsselung einen saubereren Kostenvergleich darstellt.

Was ist Passthrough-Abrechnung bei Fugu?

Die Basis-Fugu-Variante wird Berichten zufolge zum Standardtarif des zugrunde liegenden Modells abgerechnet, das sie aufruft, ohne eine separate Orchestrierungsgebühr pro Agent obendrauf. Sie zahlen immer noch eine Sakana-Marge für die Premium-Variante und für den Pro-Token-Plan.

Sollte ich ein Abonnement oder Pay-as-you-go wählen?

Wählen Sie ein Abonnement für konstante tägliche Arbeit wie Codierung, Überprüfung und Chatbots, bei der eine feste monatliche Preisgestaltung vorhersehbar ist. Wählen Sie Pay-as-you-go für sprunghafte, hohe oder Forschungs-Workloads und budgetieren Sie den gemeldeten Aufschlag für langen Kontext über etwa 272K Tokens.

Wie verfolge ich, was eine Fugu-Anfrage kostet?

Protokollieren Sie das Feld usage bei jeder Antwort, da dies die internen Modellaufrufe des Dirigenten in einer Token-Anzahl zusammenfasst. Das Routen von Anfragen über ein Tool, das die Nutzung pro Aufruf aufzeichnet, macht Eskalation sichtbar. Wenn Sie Fugu mit Routing-Aggregatoren vergleichen, behandelt unser Leitfaden zu den besten OpenRouter-Alternativen, wie man die Kosten für Routing im Vergleich zur Orchestrierung misst.

Fugu’s Preisgestaltung belohnt Traffic, der größtenteils einfach ist mit gelegentlichen schwierigen Problemen, und bestraft Traffic, der durchweg Frontier-Qualität hat. Messen Sie Ihre tatsächlichen Anfragen, bevor Sie sich für eine Stufe entscheiden, bestätigen Sie jede gemeldete Zahl in Ihrer Konsole, und Sie werden wissen, auf welcher Seite dieser Linie Ihre Arbeitslast liegt. Um Ihre Fugu-Token-Ausgaben Anfrage für Anfrage beim Testen zu verfolgen, laden Sie Apidog herunter und leiten Sie Ihre OpenAI-kompatiblen Aufrufe darüber.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen