Ist DeepSeek kostenlos?
Kurz gesagt: DeepSeeks Chat-App ist kostenlos, die API ist kostenpflichtig, aber günstig, und die Modellgewichte sind offen, sodass Sie sie selbst ausführen können, ohne DeepSeek zu bezahlen. Welche Option passt, hängt von Ihrer Oberfläche ab. Der Leitfaden zum DeepSeek V4 nutzen behandelt Web-Chat, API und Self-Hosting ausführlich.
Probieren Sie Apidog noch heute aus
Dieser Artikel klärt, was im August 2026 kostenlos ist und was die Optionen kosten – mit Zahlen aus DeepSeeks Preisliste. Für API-Tests und Mocks hilft Apidog, nur für die Aufrufe zu zahlen, die echtes Modellverhalten prüfen.
Die Kurzantwort
- Web- und Mobil-Chat: kostenlos. Kein Abonnement, Plus-Plan oder Paywall.
- API: kostenpflichtig, aber preiswert. Output-Tokens für das Budget-Modell kosten außerhalb der Spitzenzeiten 0,66 $ pro Million Tokens. Neue Konten erhalten kein kostenloses Guthaben.
- Modellgewichte: kostenlos herunterladbar und ausführbar. Die V4-Familie steht auf Hugging Face unter der MIT-Lizenz bereit. Sie zahlen nur für Hardware und Strom.
DeepSeek ist also kostenlos zum Chatten, günstig für die Entwicklung und kostenlos im Open-Weight-Sinn für Self-Hosting.
Kostenlose Chat-App: Was enthalten ist
Der Assistent unter chat.deepseek.com sowie die iOS- und Android-Apps sind kostenlos. Enthalten sind:
- Reasoning-Modus
- Dateiuploads
- Websuche
DeepSeek veröffentlicht kein tägliches Nachrichtenlimit. Bei hoher Auslastung können jedoch „Server busy“-Antworten oder langsamere Generierungen auftreten. Es gibt keine API, keinen Team-Arbeitsbereich und keine Verfügbarkeitsgarantie.
Die Consumer-App ist ein gehosteter Dienst in China. Prompts werden gemäß DeepSeeks Datenschutzrichtlinie auf DeepSeek-Servern verarbeitet. Wenn das für Ihre Daten nicht geeignet ist, sollten Sie lokal ausführen.
DeepSeek-API-Preise
Ab dem 16. August 2026 rechnet DeepSeek nach Spitzen- und Nebenzeiten ab:
- Spitzenzeiten: werktags 01:00–04:00 und 06:00–10:00 UTC
- Nebenzeiten: alle übrigen Stunden, zum halben Spitzentarif
Preise pro 1 Mio. Tokens:
| Modell | Cache-Treffer-Eingabe | Cache-Fehler-Eingabe | Ausgabe |
|---|---|---|---|
| deepseek-v4-flash | $0.007 (Nebenzeiten) / $0.014 (Spitzenzeiten) | $0.22 / $0.44 | $0.66 / $1.32 |
| deepseek-v4-pro | $0.022 / $0.044 | $0.66 / $1.32 | $1.98 / $3.96 |
| deepseek-v4-flash-vision-exp | $0.007 / $0.014 | $0.22 / $0.44 | $0.66 / $1.32 |
Worauf Sie achten sollten:
- Kontext-Caching ist automatisch. Wiederkehrende Prompt-Präfixe, etwa System-Prompts oder Few-Shot-Beispiele, werden zum Cache-Treffer-Tarif abgerechnet. Bei Flash ist das rund 31-mal günstiger als ein Cache-Fehler.
- Batch-Jobs außerhalb der Spitzenzeiten halbieren die Kosten, ohne dass Sie Code ändern müssen.
- Flash bleibt günstig: Selbst zu Spitzenzeiten kostet V4-Flash-Output 1,32 $ pro Million Tokens.
Ein Beispiel: Ein Flash-Chatbot mit 10 Mio. Eingabe-Tokens, größtenteils aus dem Cache, und 2 Mio. Output-Tokens monatlich kostet außerhalb der Spitzenzeiten etwa 1,50 $ pro Monat. Wann sich das dreimal teurere Modell lohnt, erklärt der V4 Pro-0813 API-Leitfaden.
Kostenlose und nahezu kostenlose API-Optionen
DeepSeek selbst gibt neuen Konten kein Testguthaben. Für kostenlose oder fast kostenlose API-Tests bleiben diese Wege:
- OpenRouters kostenloser Modell-Pool: OpenRouter bietet mehr als 20 Modelle kostenlos und ohne Kreditkarte. DeepSeeks kostenlose Varianten wurden Mitte 2026 entfernt; OpenRouters DeepSeek-Angebote sind heute kostenpflichtig und beginnen bei etwa 0,035 $ pro Million Flash-Eingabe-Tokens. Die 50 kostenlosen Anfragen täglich für andere Modelle reichen jedoch zum Prototyping.
- Cloud-Guthaben: Anmeldeguthaben von Cloud- oder Inferenz-Anbietern können gehostete DeepSeek-Modelle vorübergehend für Sie kostenlos machen.
- Kleine DeepSeek-Aufladung: Bereits 2 $ Guthaben reichen bei diesen Preisen weit. Das ist nicht kostenlos, aber der einfachste Weg zur API des Erstanbieters.
Eine aktuelle Übersicht bietet DeepSeek kostenlosen API-Schlüssel erhalten.
DeepSeek lokal kostenlos ausführen
Für echtes kostenloses Ausführen laden Sie die Modellgewichte von Hugging Face herunter. Sie stehen unter der MIT-Lizenz, einschließlich kommerzieller Nutzung, Fine-Tuning und Weiterverteilung.
Die V4-Generation umfasst:
- V4 Flash: 284B Parameter insgesamt, 13B aktiv
- V4 Pro: vollständige Gewichte mit rund 1,7T Parametern, seit August 2026 verfügbar
Der limitierende Faktor ist Hardware:
- V4 Flash benötigt stark quantisiert etwa 33 GB VRAM oder eine einzelne 80-GB-H100 bei FP8.
- Die vollständigen V4-Pro-Gewichte benötigen fast 900 GB und sind für Rechenzentren gedacht.
- Für Desktop-Systeme sind kleinere destillierte Modelle oder frühere Generationen praktischer.
Der Leitfaden zum lokalen Ausführen von DeepSeek R1 mit Ollama zeigt, wie Sie ein Reasoning-Modell in rund zehn Minuten ohne API-Schlüssel auf Consumer-Hardware starten.
Lokal bedeutet keine Token-Gebühren, keine Ratenlimits und keine Datenübertragung an externe Server. Dafür verantworten Sie Quantisierung, Serving-Stack – etwa vLLM oder SGLang – sowie GPU-Kosten selbst.
Chat, API oder lokal?
- Chat-App: für Fragen, Entwürfe und Modellbewertung. Kosten: 0 $. Aufwand: keiner.
- API: für Produkte und Automatisierungen. Kosten: bei Hobbyprojekten Cent bis wenige Dollar monatlich. Aufwand: gering; die API ist OpenAI-kompatibel, sodass meist ein Wechsel der Basis-URL genügt.
- Lokale Gewichte: für Datenschutz, Offline-Nutzung oder vorhandene GPUs. Kosten: keine Gebühren, aber Hardwarekosten. Aufwand: hoch.
Für die meisten Entwickler ist die API der pragmatische Weg. Die nächste Frage lautet: Wie testen Sie, ohne bei jedem Durchlauf Tokens zu verbrauchen?
Einen echten Aufruf testen, den Rest simulieren
Die DeepSeek-API folgt dem OpenAI-Format. Mit Apidog können Sie sie schnell einrichten:
- Importieren Sie die OpenAI-kompatible Spezifikation.
- Setzen Sie die Basis-URL auf
https://api.deepseek.com. - Speichern Sie Ihren API-Schlüssel in einer Umgebungsvariable.
- Senden Sie eine Anfrage und prüfen Sie geparste Antwort, Timing und gestreamte Tokens.
Der entscheidende Kostenvorteil ist Mocking: Erfassen Sie eine echte DeepSeek-Antwort und starten Sie daraus einen Mock-Server. Frontend-Tests, CI, UI-Zustände und Fehlerbehandlung laufen danach kostenlos gegen realistische Antworten. Die echte API verwenden Sie nur noch für wenige Aufrufe, die tatsächlich Modellverhalten validieren müssen.
Das reduziert besonders während der Spitzenzeiten die Token-Rechnung deutlich.
FAQ
Ist DeepSeek Chat unbegrenzt?
DeepSeek veröffentlicht kein Nachrichtenlimit. Praktisch begrenzt die Serverkapazität Ihre Nutzung; zu Stoßzeiten sind „Server busy“-Antworten möglich. DeepSeek V4 kostenlos nutzen beschreibt mögliche Alternativen.
Bietet die DeepSeek-API eine kostenlose Testphase?
Nein. Neue Konten starten ohne Guthaben. Nutzen Sie Aggregatoren, Cloud-Guthaben oder eine kleine Aufladung.
Ist DeepSeek Open Source?
Die Gewichte stehen unter einer MIT-Lizenz bereit. Trainingsdaten und die vollständige Trainingspipeline sind nicht veröffentlicht; präziser ist deshalb „Open Weight“. Self-Hosting bleibt kostenlos und kommerziell erlaubt.
Kann ich DeepSeek kostenlos zum Programmieren verwenden?
Ja. Nutzen Sie die kostenlose Chat-App für einzelne Programmierfragen oder führen Sie DeepSeek Harness lokal gegen ein Modell aus. Die Einrichtung erklärt Was ist DeepSeek Harness.
Fazit
DeepSeek ist kostenlos für Chat, nahezu kostenlos für API-Entwicklung und kostenlos für Self-Hosting, sofern Sie die Hardware bereitstellen. Starten Sie mit der Chat-App, wechseln Sie für Produkte zur API und simulieren Sie alles, was kein echtes Modellverhalten benötigt.
Laden Sie Apidog herunter, importieren Sie die DeepSeek-API, prüfen Sie einen echten Aufruf und mocken Sie den Rest kostenlos.
Top comments (0)