DeepSeek-V4-Pro offiziell gestartet: Das neue Peak- und Off-Peak-Preisschema verstehen

WI
Wilan
3 Min. Lesezeit
Deepseek Price increase

DeepSeek hat offiziell die DeepSeek-V4-Pro-Version veröffentlicht. Mit dieser neuesten Veröffentlichung kündigte DeepSeek eine Aktualisierung der API-Preisstruktur an, die Peak-Hours- und Off-Peak-Hours-Modelle einführt.

Diese neue Preisrichtlinie tritt am 17. August 2026 um 00:00 Uhr Pekinger Zeit (bzw. 16. August 2026 um 16:00 Uhr UTC) in Kraft. Nach den neuen Regeln erhalten API-Nutzungen während Off-Peak-Zeiten einen 50% Rabatt im Vergleich zu Peak-Tarifen.


Modellspezifikationen und Hauptfunktionen

DeepSeek-V4 ist in zwei Hauptvarianten erhältlich: DeepSeek-V4-Flash für Geschwindigkeit und Effizienz und DeepSeek-V4-Pro für hohe Reasoning-Leistung. Beide Modelle unterstützen Thinking Mode und Non-Thinking Mode (wobei Thinking Mode standardmäßig aktiviert ist).

Modell-Detailübersicht

Parameter / Funktion DeepSeek-V4-Flash DeepSeek-V4-Pro
Modellversion DeepSeek-V4-Flash-0731 DeepSeek-V4-Pro-0813
Basis-URL (OpenAI) https://api.deepseek.com https://api.deepseek.com
Basis-URL (Anthropic) https://api.deepseek.com/anthropic https://api.deepseek.com/anthropic
Kontextlänge 1,000,000 Tokens (1M) 1,000,000 Tokens (1M)
Max. Ausgabetokens Bis zu 384,000 Tokens (384K) Bis zu 384,000 Tokens (384K)
Parallelitätslimit 2,500 500
Unterstützte Funktionen JSON Output, Tool Calls, Responses API, Anthropic API, Chat Prefix Completion (Beta), FIM Completion (Beta)* JSON Output, Tool Calls, Responses API, Anthropic API, Chat Prefix Completion (Beta), FIM Completion (Beta)*

*\FIM Completion (Beta) ist nur im Non-Thinking-Modus verfügbar.


Änderungen der API-Preisstruktur (Pro 1M Tokens)

Die Abrechnung basiert auf der kumulierten Anzahl von Input- und Output-Tokens. Die Context-Caching-Funktion bietet weiterhin erhebliche Einsparungen für Input-Tokens, die erfolgreich im Cache gespeichert werden (Cache Hit).

1. Aktuelle Standardpreise

Modellvariante 1M Input (Cache Hit) 1M Input (Cache Miss) 1M Output-Tokens
DeepSeek-V4-Flash $0.0028 $0.14 $0.28
DeepSeek-V4-Pro $0.003625 $0.435 $0.87

2. Neue Preise: Peak- & Off-Peak-Modell

Ab 16. August 2026 um 16:00 UTC (17. August 2026 um 00:00 WIB/Peking) wird die Abrechnung basierend auf dem Zeitpunkt der API-Aufrufe angepasst.

Zeitplan der Peak-Stunden:

  • 01:00 – 04:00 UTC (08:00 – 11:00 WIB)
  • 06:00 – 10:00 UTC (13:00 – 17:00 WIB)

Alle Stunden außerhalb dieses Bereichs gelten als Off-Peak-Zeiten mit 50% günstigeren Tarifen.

Preistabelle nach Nutzungsstunden

Modell Stundenstatus Input (Cache Hit) / 1M Input (Cache Miss) / 1M Output / 1M
deepseek-v4-flash OFF-PEAK $0.007 $0.22 $0.66
PEAK $0.014 $0.44 $1.32
deepseek-v4-pro OFF-PEAK $0.022 $0.66 $1.98
PEAK $0.044 $1.32 $3.96

Regeln zur Guthabenabrechnung & Spar-Tipps

  1. Automatisches Abrechnungssystem: Die Kosten werden mit der Formel Kosten = Anzahl der Tokens x Preis berechnet. Diese Kosten werden direkt vom Einzahlungsguthaben (aufgeladenes Guthaben) oder Bonusguthaben (gewährtes Guthaben) abgezogen. Wenn beide verfügbar sind, priorisiert das System den Abzug vom gewährten Guthaben.
  2. Optimierung der Anrufzeit (Batch-Jobs): Für umfangreiche Arbeitslasten wie Massendokumentverarbeitung, Datenextraktion oder Indexierung sollten Sie die Ausführung während Off-Peak-Zeiten planen, um die Betriebskosten um bis zur Hälfte zu senken.
  3. Context Caching nutzen: Maximieren Sie die Verwendung wiederholter Prompts (lange System-Prompts oder Referenzdokumente), um Cache Hits zu einem viel günstigeren Tarif auszulösen.
  4. Preise regelmäßig prüfen: DeepSeek behält sich das Recht vor, Produktpreise jederzeit anzupassen. Entwicklern wird empfohlen, ihr Guthaben basierend auf dem tatsächlichen Bedarf aufzuladen und die offizielle Preisdokumentationsseite regelmäßig zu überwachen.
W

Geschrieben von

Wilan

Kontributor tetap Bali Island Tekno yang aktif berbagi pengetahuan seputar teknologi, pemrograman, dan dunia rekayasa perangkat lunak.

Zurück zur Startseite Aktualisiert am: 13. August 2026