Kurz gesagt: DeepSeeks Chat-App kostet nichts, die API ist kostenpflichtig, aber günstig, und die Modellgewichte sind offen, sodass Sie sie selbst ausführen können, ohne DeepSeek einen Cent zu zahlen. Die längere Antwort hängt davon ab, welche Oberfläche Sie meinen, und das erläutert dieser Leitfaden. Wenn Sie eine vollständige Anleitung zu allen Zugriffspfaden wünschen, deckt unser Leitfaden zum DeepSeek V4 nutzen Web-Chat, API und Self-Hosting ausführlich ab.
Hier bleiben wir bei der Geldfrage: Was ist kostenlos, was nicht und was jede Option im August 2026 kostet, mit echten Zahlen von DeepSeeks Preisliste. Und wenn Sie den API-Weg einschlagen, hilft Ihnen ein Tool wie Apidog dabei, DeepSeeks Endpunkte zu testen und zu simulieren, sodass Sie nur für die Aufrufe zahlen, die wirklich wichtig sind.
Ist DeepSeek kostenlos? Die kurze Antwort
Ja und nein, je nach Oberfläche:
- Chat (Web- und Mobil-App): kostenlos. Kein Abonnement, kein Plus-Plan, keine Paywall. Sie melden sich an und chatten.
- API: kostenpflichtig, aber gehört zu den günstigsten APIs der Spitzenklasse. Output-Tokens des Budget-Modells kosten 0,66 $ pro Million außerhalb der Spitzenzeiten. Es gibt kein kostenloses Guthaben für neue Konten, daher müssen Sie vor Ihrem ersten Aufruf aufladen.
- Modellgewichte: kostenlos zum Download und zur Ausführung. Die V4-Familie wird unter einer MIT-Lizenz auf Hugging Face bereitgestellt. Ihre einzigen Kosten sind Hardware und Strom.
Die Frage „Ist DeepSeek kostenlos?“ hat also drei ehrliche Antworten: kostenlos zum Chatten, günstig zum Entwickeln und kostenlos im Sinne von Open Source für das Selbst-Hosting. Der Rest dieses Artikels gibt Zahlen und Grenzen für jede Option an.
Die kostenlose Chat-App und ihre Grenzen
Der DeepSeek-Assistent unter chat.deepseek.com und die iOS/Android-Apps kosten nichts. Das beinhaltet den Reasoning-Modus, Dateiuploads und die Websuche. Im Gegensatz zu ChatGPT oder Claude gibt es keinen kostenpflichtigen Consumer-Plan, auf den man Sie hochstufen könnte; kostenlos ist der einzige Plan.
Die Grenzen sind operativ, nicht kommerziell. DeepSeek veröffentlicht kein tägliches Nachrichtenkontingent, aber bei Traffic-Spitzen können Sie auf „Server busy“-Antworten und langsamere Generierungen stoßen. Es gibt auch keinen API-Zugriff, keinen Team-Arbeitsbereich und keine Verfügbarkeitsgarantie. Für persönliche Recherchen, Entwürfe und Programmierfragen deckt die kostenlose App jedoch viel ab.
Noch ein Vorbehalt: Die Consumer-App ist ein gehosteter Dienst in China, und Ihre Prompts werden auf DeepSeeks Servern gemäß DeepSeeks Datenschutzrichtlinie verarbeitet. Wenn das ein Hinderungsgrund für Ihre Arbeit ist, springen Sie zur lokalen Option.
DeepSeek API-Preise in einfachen Zahlen
Die API ist nicht kostenlos, und ab dem 16. August 2026 rechnet DeepSeek nach Spitzen- und Nebenzeiten ab. Spitzenzeiten sind wochentags von 01:00-04:00 und 06:00-10:00 UTC; jede andere Stunde ist Nebenzeiten mit dem halben Spitzentarif. Hier ist die aktuelle Tabelle pro 1 Mio. Tokens:
| Modell | Cache-Treffer-Eingabe | Cache-Fehler-Eingabe | Ausgabe |
|---|---|---|---|
| deepseek-v4-flash | $0.007 (Nebenzeiten) / $0.014 (Spitzenzeiten) | $0.22 / $0.44 | $0.66 / $1.32 |
| deepseek-v4-pro | $0.022 / $0.044 | $0.66 / $1.32 | $1.98 / $3.96 |
| deepseek-v4-flash-vision-exp | $0.007 / $0.014 | $0.22 / $0.44 | $0.66 / $1.32 |
Drei Details sind wichtiger als die Schlagzeilent-Tarife. Erstens ist das Kontext-Caching automatisch: Wiederholte Prompt-Präfixe (ein fester System-Prompt, Few-Shot-Beispiele) werden zum Cache-Treffer-Tarif abgerechnet, der etwa 31-mal günstiger ist als ein Cache-Fehler bei Flash. Zweitens halbiert die Zeitplanung Ihrer Batch-Jobs in Nebenzeiten die Rechnung ohne Code-Änderungen. Drittens kostet selbst in Spitzenzeiten der V4 Flash-Output 1,32 $ pro Million Tokens; vergleichbare Aufrufe an Flaggschiff-Modelle der GPT-Klasse kosten ein Vielfaches davon.
Um ein konkretes Gefühl für die Größenordnung zu bekommen: Ein Chatbot, der 10 Mio. Eingabe-Tokens (größtenteils zwischengespeichert) und 2 Mio. Ausgabe-Tokens pro Monat auf Flash verarbeitet und außerhalb der Spitzenzeiten läuft, kostet etwa 1,50 $. Das ist nicht kostenlos, aber nah genug dran, dass Hobbyprojekte es selten bemerken. Wenn Sie sich zwischen den beiden Modellen entscheiden, erläutert unser V4 Pro-0813 API-Leitfaden, wann das Flaggschiff seinen 3-fachen Premium-Preis wert ist.
Kostenlose und nahezu kostenlose API-Wege
DeepSeeks eigene Plattform gewährt neuen Konten kein Testguthaben, daher muss ein wirklich kostenloser API-Schlüssel von woanders kommen. Ihre realistischen Optionen:
- OpenRouters kostenloser Modell-Pool. OpenRouter bietet über 20 Modelle für 0 $ ohne Kreditkarte an. Der Haken: DeepSeeks kostenlose Varianten wurden Mitte 2026 aus dem Pool entfernt, sodass OpenRouters DeepSeek-Angebote heute kostenpflichtig sind und bei etwa 0,035 $ pro Million Eingabe-Tokens für V4 Flash beginnen. Das ist immer noch günstiger als viele Ersthersteller-Tarife, und die 50 kostenlosen Anfragen pro Tag für andere Modelle ermöglichen es Ihnen, die Implementierung zu prototypisieren, bevor Sie etwas ausgeben.
- Cloud-Plattform-Guthaben. Allgemeine Anmeldeguthaben von Cloud-Anbietern und Inferenz-Hosts (die Art, die Sie beim Erstellen eines Kontos erhalten) können für gehostete DeepSeek-Modelle ausgegeben werden. Die Modelle sind nicht kostenlos; Ihre Guthaben machen sie für eine Weile kostenlos für Sie.
- Eine minimale Aufladung auf DeepSeeks Plattform. Da die Preise so niedrig sind, reicht ein Guthaben von 2 $ sehr weit. Es ist fast kostenlos, nicht kostenlos, aber es ist der einfachste Weg zur echten API des Erstanbieters.
Wir halten eine regelmäßig aktualisierte Übersicht dieser Wege unter DeepSeek kostenlosen API-Schlüssel erhalten bereit, einschließlich welche Aggregatoren derzeit kostenlose Varianten anbieten.
DeepSeek lokal ohne Kosten ausführen
Dies ist der Weg, wo „kostenlos“ wörtlich gemeint ist. DeepSeek veröffentlicht seine Modellgewichte auf Hugging Face unter einer MIT-Lizenz, die die kommerzielle Nutzung, Feinabstimmung und Weiterverteilung erlaubt. Die V4-Generation wird in zwei Größen ausgeliefert: V4 Flash (insgesamt 284B Parameter, 13B aktiv) und V4 Pro, dessen vollständige Gewichte im August 2026 mit rund 1,7T Parametern die Vorschau verlassen haben.
Der Kompromiss ist die Hardware. V4 Flash benötigt grob 33 GB VRAM stark quantisiert oder eine einzelne 80 GB H100 bei FP8; die vollen Gewichte von V4 Pro nähern sich 900 GB und sind ein Datacenter-Vorschlag. Auf einem normalen Desktop ist der praktische Weg ein kleineres destilliertes Modell oder ein Modell früherer Generation. Unser Walkthrough zum lokalen Ausführen von DeepSeek R1 mit Ollama lässt ein Reasoning-Modell auf Consumer-Hardware in etwa zehn Minuten antworten, ohne API-Schlüssel.
Lokal bedeutet keine Pro-Token-Gebühren, keine Ratenbegrenzungen und keine Daten, die Ihre Maschine verlassen. Es bedeutet auch, dass Sie die Operationen selbst verantworten: Quantisierungsentscheidungen, Serving-Stack (vLLM oder SGLang für alles Ernsthafte) und GPU-Kosten, die die API-Ausgaben übersteigen können, es sei denn, Ihr Volumen ist hoch.
Chat vs. API vs. lokal: Die Entscheidung auf einen Blick
- Wählen Sie die Chat-App, wenn Sie Fragen stellen, Entwürfe erstellen oder die Qualität des Modells bewerten. Kosten: 0 $. Aufwand: keiner.
- Wählen Sie die API, wenn Sie ein Produkt oder eine Automatisierung entwickeln. Kosten: Cent bis ein paar Dollar pro Monat im Hobby-Maßstab. Aufwand: gering; die API ist OpenAI-kompatibel, sodass die meisten SDKs durch Ändern der Basis-URL funktionieren.
- Wählen Sie lokale Gewichte, wenn Sie Datenschutz, Offline-Nutzung benötigen oder bereits GPUs besitzen. Kosten: 0 $ an Gebühren, echtes Geld für Hardware. Aufwand: am höchsten.
Die meisten Entwickler landen bei der API, was eine praktische Frage aufwirft: Wie entwickelt man damit, ohne bei jedem Testlauf Tokens zu verbrennen?
Einen Aufruf testen, den Rest mit Apidog simulieren
DeepSeeks API folgt dem OpenAI-Format, sodass Apidog sie in Sekundenschnelle importiert: Fügen Sie die OpenAI-kompatible Spezifikation hinzu, richten Sie die Basis-URL auf https://api.deepseek.com, legen Sie Ihren Schlüssel in eine Umgebungsvariable und senden Sie eine Anfrage. Sie erhalten die geparste Antwort, das Timing und gestreamte Tokens in einer Ansicht, was besser ist, als auf die Curl-Ausgabe zu schielen.
Der Kostenfaktor ist Apidogs Mocking-Funktion. Sobald Sie eine echte DeepSeek-Antwort erfasst haben, starten Sie einen Mock-Server, der realistische Vervollständigungen für jeden Frontend- und Integrationstest danach wiedergibt. Ihre CI, Ihre UI-Zustände, Ihre Fehlerbehandlung: alles wird gegen den Mock für 0 $ getestet, während die tatsächliche API nur die wenigen Aufrufe sieht, die das reale Modellverhalten validieren. Während Entwicklungszeiten in Spitzenstunden, wenn DeepSeeks Tarife sich verdoppeln, ist diese Disziplin der Unterschied zwischen einer Rechnung, die Sie bemerken, und einer, die Sie nicht bemerken.
Häufig gestellte Fragen (FAQ)
Ist DeepSeek Chat unbegrenzt? DeepSeek veröffentlicht keine Nachrichtenbegrenzung für die Chat-App, sodass Sie in der Praxis durch die Serverkapazität und nicht durch ein Kontingent begrenzt sind. Erwarten Sie gelegentlich „Server busy“-Antworten zu Stoßzeiten. Wenn Sie immer wieder darauf stoßen, werden in DeepSeek V4 kostenlos nutzen verschiedene Problemumgehungen behandelt.
Bietet die DeepSeek API eine kostenlose Testphase an? Nein. Neue Plattformkonten beginnen mit einem Nullsaldo und ohne Werbeguthaben, daher müssen Sie vor Ihrer ersten Anfrage aufladen. Die nahezu kostenlosen Alternativen sind Aggregator-Plattformen und Cloud-Anmeldeguthaben.
Ist DeepSeek Open Source? Die Gewichte sind unter einer MIT-Lizenz offen, was die meisten Leute meinen. Trainingsdaten und die vollständige Pipeline werden nicht veröffentlicht, daher bezeichnen Puristen es als „Open Weight“ statt Open Source. So oder so ist Self-Hosting kostenlos und kommerziell erlaubt.
Kann ich DeepSeek kostenlos zum Codieren verwenden? Ja, auf zwei Arten: Die kostenlose Chat-App bearbeitet ad-hoc Programmierfragen, und DeepSeek Harness, das agentische CLI des Unternehmens, kann ohne API-Kosten gegen ein lokales Modell ausgeführt werden. Unter Was ist DeepSeek Harness finden Sie die Einrichtung.
Das Fazit
DeepSeek ist kostenlos, wo es für die Bewertung wichtig ist (Chat), nahezu kostenlos, wo es für die Entwicklung wichtig ist (die API, für Bruchteile eines Cents pro Anfrage außerhalb der Spitzenzeiten), und wirklich kostenlos für das Self-Hosting, wenn Sie die Hardware mitbringen. Beginnen Sie mit der Chat-App, um die Qualität zu beurteilen, wechseln Sie zur API, wenn Sie entwickeln, und halten Sie Ihre Token-Rechnung unauffällig, indem Sie alles simulieren, was Sie können. Laden Sie Apidog herunter, um DeepSeeks API zu importieren, einen echten Aufruf zu verifizieren und den Rest kostenlos zu simulieren.
