Google hat Nano Banana 2.1 am 6. Oktober 2026 veröffentlicht, und es ist bereits über die Gemini API als gemini-nano-banana-2.1 aufrufbar. Es ist ein Update von Nano Banana 2 (Gemini 3.1 Flash Image) mit besserer visueller Qualität, maskenartiger Bearbeitung und stärkerer Zeichenkonsistenz über mehrere Durchgänge hinweg. Zudem kostet es pro Bild nur halb so viel wie Nano Banana 2 bei jeder gemeinsamen Auflösung.
Dieser Leitfaden führt Sie von einem leeren Terminal zu einem gespeicherten Bild und behandelt dann Seitenverhältnisse, 2K- und 4K-Ausgabe, Bearbeitung, Änderungen über mehrere Schritte hinweg, Referenzbilder, Suchgrundlagen und Kosten. Jede Anfrage unten kann in Apidog gespeichert und wiedergegeben werden, sodass Sie 2.1 mit dem Modell vergleichen können, das Sie heute verwenden.
Möchten Sie zuerst den Hintergrund wissen? Lesen Sie Was ist Nano Banana 2.1, um zu erfahren, was sich geändert hat und was Google noch nicht veröffentlicht hat.
Was Sie benötigen
| Element | Wert |
|---|---|
| Basis-URL | https://generativelanguage.googleapis.com/v1beta |
| Auth-Header | x-goog-api-key: $GEMINI_API_KEY |
| Modell-ID | gemini-nano-banana-2.1 |
| Endpunkt | POST /v1beta/interactions |
| Auflösungen | 1K (Standard), 2K, 4K |
| Eingaben | Text, Bilder (bis zu 14 Referenzen), Video |
| Python SDK | pip install google-genai |
| JavaScript SDK | npm install @google/genai |
Alle Beispiele verwenden die Interactions API, die in Googles Bildgenerierungs-Dokumentation fĂĽr 2.1 verwendet wird.
Schritt 1: Einen Gemini API-SchlĂĽssel erhalten
- Ă–ffnen Sie Google AI Studio und melden Sie sich an.
- Gehen Sie zu API-SchlĂĽssel abrufen und erstellen Sie einen SchlĂĽssel in einem Google Cloud-Projekt.
- Aktivieren Sie die Abrechnung für dieses Projekt. Googles Preisgestaltungsseite listet die kostenlose Stufe für Nano Banana 2.1 als „Nicht verfügbar“ auf, daher erfordern API-Aufrufe ein kostenpflichtiges Projekt.
- Exportieren Sie den SchlĂĽssel:
export GEMINI_API_KEY="your-key-here"
Google verknüpft 2.1 mit dem AI Studio Playground, was zum Testen von Prompts praktisch ist, hat aber nicht veröffentlicht, wie viel ein kostenloses Konto dort generieren kann. Unser Leitfaden zum kostenlosen Verwenden von Nano Banana 2.1 behandelt diesen Weg, und einen Gemini API-Schlüssel erhalten erklärt die Schlüsseleinrichtung detaillierter.
Schritt 2: Ihr erstes Bild generieren
curl
curl -s -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-nano-banana-2.1",
"input": [
{"type": "text", "text": "Create a picture of a nano banana dish in a fancy restaurant with a Gemini theme"}
]
}'
Die Antwort ist JSON. Das Bild kommt als Base64-Daten innerhalb eines Bildinhaltsblocks an, daher benötigen Sie ein SDK (oder ein Skript), um es zu dekodieren.
Python
from google import genai
import base64
client = genai.Client() # reads GEMINI_API_KEY
interaction = client.interactions.create(
model="gemini-nano-banana-2.1",
input="Create a picture of a nano banana dish in a fancy restaurant with a Gemini theme",
)
with open("generated_image.png", "wb") as f:
f.write(base64.b64decode(interaction.output_image.data))
interaction.output_image gibt den zuletzt generierten Bildblock zurĂĽck. Sein data-Feld ist Base64, dekodieren Sie es also, bevor Sie die Datei schreiben.
JavaScript
import { GoogleGenAI } from "@google/genai";
import * as fs from "node:fs";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-nano-banana-2.1",
input: "Create a picture of a nano banana dish in a fancy restaurant with a Gemini theme",
});
const image = interaction.output_image;
if (image) {
fs.writeFileSync("nano-banana.png", Buffer.from(image.data, "base64"));
}
Gemini 3 Bildmodelle denken, bevor sie zeichnen. Das Modell kann bis zu zwei vorläufige „Gedankenbilder“ erzeugen, während es die Komposition plant. Diese werden Ihnen nicht berechnet, und das Nachdenken kann in der API nicht deaktiviert werden.
Schritt 3: Seitenverhältnis, Auflösung und reine Bildausgabe festlegen
Verwenden Sie response_format, um die Ausgabe zu steuern. Das Setzen von "type": "image" gibt nur das Bild zurück und lässt den Konversationstext weg, was die Antworten kleiner und das Parsen einfacher macht.
interaction = client.interactions.create(
model="gemini-nano-banana-2.1",
input="A product shot of a matte black coffee grinder on a marble counter",
response_format={
"type": "image",
"mime_type": "image/png",
"aspect_ratio": "16:9",
"image_size": "2K",
},
)
Wissenswertes:
image_sizeakzeptiert1K,2Kund4K. Verwenden Sie ein GroßbuchstabenK; Kleinbuchstaben wie2kwerden abgelehnt.- 2.1 hat keine 512px-Stufe. Diese gehört zu Nano Banana 2.
- Unterstützte Verhältnisse sind
1:1,2:3,3:2,3:4,4:3,4:5,5:4,9:16,16:9,21:9, sowie die extremen1:4,4:1,1:8und8:1. Ein 16:9 Bild bei 2K ist 2752x1536; bei 4K ist es 5504x3072. - Wenn Sie sowohl Text als auch ein Bild wĂĽnschen, ĂĽbergeben Sie eine Liste:
response_format=[{"type": "text"}, {"type": "image"}].
Schritt 4: Ein bestehendes Bild bearbeiten
Senden Sie Ihr Bild als Base64-image-Block neben der Textanweisung:
with open("living_room.png", "rb") as f:
image_b64 = base64.b64encode(f.read()).decode("utf-8")
interaction = client.interactions.create(
model="gemini-nano-banana-2.1",
input=[
{"type": "text", "text": "Using the provided image of a living room, change only the blue sofa to be a vintage, brown leather chesterfield sofa. Keep the rest of the room, including the pillows on the sofa and the lighting, unchanged."},
{"type": "image", "data": image_b64, "mime_type": "image/png"},
],
)
Maskenartiges Inpainting ohne Maskendatei
Es gibt keinen separaten Masken-Upload. Sie definieren die Maske in Worten. Googles Vorlage:
Verwenden Sie das bereitgestellte Bild, ändern Sie nur das [spezifische Element] zu [neuem Element/Beschreibung]. Behalten Sie alles andere im Bild genau gleich bei, bewahren Sie den ursprünglichen Stil, die Beleuchtung und die Komposition.
Nennen Sie ein Element, beschreiben Sie den Ersatz konkret und wiederholen Sie, was gleich bleiben muss. Vage Prompts wie „mach das Sofa schöner“ verleiten das Modell dazu, den ganzen Raum neu zu zeichnen.
Schritt 5: Iterieren mit mehrstufiger Bearbeitung
Die mehrstufige Bearbeitung ist Googles empfohlener Weg, ein Bild zu verfeinern. Übergeben Sie die id der vorherigen Interaktion als previous_interaction_id und senden Sie nur die gewünschte Änderung:
interaction_2 = client.interactions.create(
model="gemini-nano-banana-2.1",
input="Update this infographic to be in Spanish. Do not change any other elements of the image.",
previous_interaction_id=interaction.id,
response_format={"type": "image", "mime_type": "image/png", "aspect_ratio": "16:9", "image_size": "2K"},
)
Ăśber REST wird dasselbe Feld im Body ĂĽbergeben: "previous_interaction_id": "<PREVIOUS_INTERACTION_ID>". Hier spielt die verbesserte Zeichenkonsistenz von 2.1 ĂĽber mehrere Schritte hinweg eine Rolle: Eine Figur oder ein Produkt sollte ĂĽber mehrere Bearbeitungsrunden hinweg erkennbar bleiben.
Schritt 6: Bis zu 14 Referenzbilder kombinieren
Fügen Sie der input-Liste weitere image-Blöcke hinzu. Für 2.1 dokumentiert Google bis zu 10 hochauflösende Objektbilder und bis zu 4 Charakterbilder, insgesamt 14:
interaction = client.interactions.create(
model="gemini-nano-banana-2.1",
input=[
{"type": "text", "text": "An office group photo of these people, they are making funny faces."},
{"type": "image", "data": person_1_b64, "mime_type": "image/png"},
{"type": "image", "data": person_2_b64, "mime_type": "image/png"},
{"type": "image", "data": person_3_b64, "mime_type": "image/png"},
],
response_format={"type": "image", "aspect_ratio": "5:4", "image_size": "2K"},
)
Referenzbilder sind Eingabe-Tokens, und die 2.1-Eingabe kostet dreimal so viel wie bei Nano Banana 2. Workflows mit vielen Referenzen verringern den Preisunterschied, messen Sie also, bevor Sie wechseln.
Schritt 7: Bilder mit Google Suche fundieren
Fügen Sie für Bilder, die von aktuellen Fakten abhängen, wie z.B. eine Wetterkarte oder ein aktuelles Ereignis, das Suchwerkzeug hinzu:
interaction = client.interactions.create(
model="gemini-nano-banana-2.1",
input="A detailed painting of a Timareta butterfly resting on a flower",
tools=[{"type": "google_search", "search_types": ["web_search", "image_search"]}],
)
{"type": "google_search"} allein ermöglicht die Websuche. Das Hinzufügen von image_search lässt das Modell Webbilder als visuellen Kontext nutzen, was nur 2.1 und Nano Banana 2 unterstützen. Die Fundierung kann keine realen Bilder von Personen aus der Suche verwenden. Wenn Sie Benutzern fundierte Ergebnisse anzeigen, verlangt Google, dass Sie die im Schritt google_search_result zurückgegebenen search_suggestions anzeigen.
Schritt 8: In Apidog testen
Skripte eignen sich gut fĂĽr die Generierung. Um zu ĂĽberprĂĽfen, ob ein Prompt, ein SchlĂĽssel und ein Modell noch funktionieren, ist eine gespeicherte Anfrage schneller. In Apidog:
- Erstellen Sie eine Umgebung und fĂĽgen Sie eine Variable
GEMINI_API_KEYmit Ihrem SchlĂĽssel hinzu. - Erstellen Sie eine Anfrage:
POST https://generativelanguage.googleapis.com/v1beta/interactions. - FĂĽgen Sie den Header
x-goog-api-key: {{GEMINI_API_KEY}}hinzu. - FĂĽgen Sie einen JSON-Body mit
model,inputundresponse_formatein und klicken Sie dann auf Senden. - FĂĽgen Sie ein Post-Response-Skript mit zwei Assertions hinzu:
pm.test("status is 200", () => {
pm.response.to.have.status(200);
});
pm.test("response contains an image block", () => {
const steps = pm.response.json().steps || [];
const hasImage = steps.some(s =>
s.type === "model_output" &&
(s.content || []).some(c => c.type === "image" && c.data)
);
pm.expect(hasImage).to.be.true;
});
- Duplizieren Sie die Anfrage und ändern Sie
modelingemini-3.1-flash-image. Senden Sie beide mit demselben Prompt.
Sie haben nun einen direkten Vergleich von 2.1 mit Nano Banana 2, wobei Status, Zeitpunkt und Antwortgröße für jeden Durchlauf angezeigt werden. Für einen breiteren Funktionsvergleich siehe Nano Banana 2.1 vs. Nano Banana 2 vs. Pro.
Was es kostet
Kostenpflichtige Stufe, gemäß Googles Preisgestaltungsseite vom 7. Oktober 2026:
| Modell | Eingabe / 1M | 1K Bild | 2K Bild | 4K Bild | Batch 1K |
|---|---|---|---|---|---|
| Nano Banana 2.1 | $1.50 | $0.0336 | $0.0504 | $0.0756 | $0.0168 |
| Nano Banana 2 | $0.50 | $0.067 | $0.101 | $0.151 | $0.034 |
| Nano Banana Pro | $2.00 | $0.134 | $0.134 | $0.24 | $0.067 |
Die Bildausgabe fĂĽr 2.1 kostet 30 $ pro 1 Mio. Tokens. Ein 1K-Bild sind 1.120 Tokens, 2K sind 1.680 und 4K sind 2.520, woraus sich die Preise pro Bild ergeben. Text- und Denkprozess-Ausgabe kostet 7,50 $ pro 1 Mio. Die Suchgrundlagen umfassen 5.000 kostenlose Anfragen pro Monat, die ĂĽber Gemini 3.x Modelle geteilt werden, danach 14 $ pro 1.000.
Beispielrechnung: 1.000 Produktbilder in 2K aus kurzen Text-Prompts (jeweils ca. 100 Eingabe-Tokens).
- Ausgabe: 1.000 x $0.0504 = $50.40
- Eingabe: 100.000 Tokens x $1.50 / 1M = $0.15
- Gesamt: ca. $50.55, zuzĂĽglich eventueller Denkprozess-Text-Tokens
Dieselbe Aufgabe auf Nano Banana 2 kostet etwa 101 $. Über die Batch API sinkt der 2K-Preis von 2.1 auf 0,0252 $, sodass die Ausgabeseite auf 25,20 $ fällt, wenn Sie warten können. Batch-Jobs tauschen eine Bearbeitungszeit von bis zu 24 Stunden gegen höhere Ratenlimits ein. Weitere Details zur Preisgestaltung von Nano Banana 2 finden Sie in unserer Aufschlüsselung der Nano Banana 2 API-Preise.
Häufige Fehler
Dies sind generische Gemini API-Verhaltensweisen, keine dokumentierten 2.1-spezifischen Fehler:
| Fehler | Wahrscheinliche Ursache | Lösung |
|---|---|---|
400 INVALID_ARGUMENT |
Kleinbuchstaben bei image_size, nicht unterstütztes Verhältnis, fehlerhafte input |
Verwenden Sie 2K statt 2k; überprüfen Sie die Verhältnisliste |
403 PERMISSION_DENIED |
Falscher SchlĂĽssel oder Projekt ohne Abrechnung | ĂśberprĂĽfen Sie den SchlĂĽssel und aktivieren Sie die Abrechnung |
404 NOT_FOUND |
Tippfehler in der Modell-ID | Verwenden Sie gemini-nano-banana-2.1 exakt |
429 RESOURCE_EXHAUSTED |
Ratenlimit erreicht | ZurĂĽckziehen und erneut versuchen, oder Batch verwenden |
500 / 503 |
Temporäres Serverproblem | Mit exponentiellem Backoff erneut versuchen |
| 200, aber kein Bild | Prompt blockiert oder reine Textantwort | Setzen Sie "type": "image" und formulieren Sie neu |
FAQ
Gibt es eine kostenlose Stufe für die Nano Banana 2.1 API? Nein. Google listet die kostenlose API-Stufe als „Nicht verfügbar“ auf. Der AI Studio Playground verweist auf 2.1, aber Google hat kein kostenloses Limit dafür veröffentlicht.
Ist 2.1 ein Drop-in-Ersatz fĂĽr Nano Banana 2? Meistens. Tauschen Sie die Modell-ID auf gemini-nano-banana-2.1 aus. Sie verlieren die 512px-Stufe, und Eingabe-Tokens kosten mehr, daher erfordern referenzlastige Bearbeitungen eine KostenprĂĽfung.
Tragen generierte Bilder ein Wasserzeichen? Ja. Alle Ausgaben enthalten ein SynthID-Wasserzeichen.
Kann ich ein Bild aus einem Video generieren? Ja. 2.1 akzeptiert einen video-Eingabeblock, wie z.B. eine YouTube-URL, zusammen mit Ihrem Text-Prompt.
Gilt der alte Nano Banana 2 API-Leitfaden noch? Die Konzepte schon. Siehe unseren Nano Banana 2 API-Leitfaden fĂĽr das frĂĽhere Modell.
Zusammenfassung
Nano Banana 2.1 verspricht bessere Bilder zum halben Preis pro Bild von Nano Banana 2, mit derselben Interactions API-Struktur. Besorgen Sie sich einen kostenpflichtigen SchlĂĽssel, generieren Sie ein Bild und speichern Sie dann die Anfrage in Apidog mit Status- und Bild-Assertions. Duplizieren Sie sie mit der alten Modell-ID, und Sie werden innerhalb eines Nachmittags wissen, ob 2.1 den Wechsel fĂĽr Ihre Prompts wert ist.
