Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Zurück zum Blog

DeepSeek-V4-Pro-0813 Guide 2026: API, Codex & Preis

DeepSeek-V4-Pro-0813DeepSeek V4 ProCodexResponses APICoding-Agent

DeepSeek-V4-Pro-0813 ist die aktuelle offizielle Version hinter der stabilen API-Modell-ID deepseek-v4-pro. DeepSeeks aktuelle Dokumentation bestätigt ein Kontextfenster von 1M Tokens, bis zu 384K Output, Modi mit und ohne Thinking, JSON-Ausgabe, Tool-Aufrufe, Responses API, Anthropic API und offiziellen Codex-Support.

Das genaue Keyword ist wichtig: DeepSeek-V4-Pro-0813 bezeichnet die bereitgestellte Modellversion, während API-Anfragen normalerweise weiterhin deepseek-v4-pro verwenden sollten. Auf diesem Gateway ist die Route mit 7,5x, etwa 3 CNY je Million Tokens, und einem 1M-Kontext gelistet.

Prüfen Sie die Live-Route vor einer langen Agentenaufgabe: Öffnen Sie die Modellpreise oder starten Sie mit einem kleinen Guthaben auf der Kaufseite.

DeepSeek-V4-Pro-0813: die wichtigsten Daten

Merkmal Verifizierte Angabe
Aktuelle offizielle Version DeepSeek-V4-Pro-0813
Stabile API-Modell-ID deepseek-v4-pro
Kontextfenster 1M Tokens; Codex-Metadaten nutzen 1.048.576
Maximale Ausgabe 384K Tokens
Standardmodus Thinking
Weiterer Modus Non-Thinking
Offizieller Cache-Hit-Inputpreis 0,003625 $/M Tokens
Offizieller Cache-Miss-Inputpreis 0,435 $/M Tokens
Offizieller Outputpreis 0,87 $/M Tokens
Gateway-Multiplikator 7,5x, etwa 3 CNY/M Tokens
Offizielle Schnittstellen Chat Completions, Responses, Anthropic
Bildeingabe In aktuellen Codex-Metadaten nur Text

Zuletzt geprüft: 13. August 2026. DeepSeek weist auf der Preisseite auf eine geplante allgemeine API-Preiserhöhung in naher Zukunft hin; der endgültige Plan bleibt einer offiziellen Mitteilung vorbehalten. Prüfen Sie die Preise vor jeder Produktionskalkulation erneut.

Was bedeutet der Versionsname 0813?

DeepSeek-V4-Pro-0813 ist die Versionsbezeichnung, die am 13. August in DeepSeeks offizieller Tabelle „Models & Pricing“ erschien. Der öffentliche Anfragename bleibt deepseek-v4-pro. So kann DeepSeek die Version hinter einer stabilen Route aktualisieren, ohne jede Integration umkonfigurieren zu müssen.

Zum Zeitpunkt dieses Artikels enthält das öffentliche Änderungsprotokoll keinen eigenen Eintrag vom 13. August mit Architekturdetails oder einer Vorher-Nachher-Benchmark-Tabelle für V4 Pro. Das Update vom 31. Juli behandelte ausdrücklich DeepSeek-V4-Flash-0731 und erklärte V4 Pro damals für unverändert. Die aktuellen Preis- und Codex-Seiten bestätigen nun die Version 0813 und Pro-Unterstützung, liefern aber keine Grundlage für eine bestimmte prozentuale Verbesserung.

Diese Unterscheidung ist für SEO-Leser und Produktionsteams wichtig: Die neue Versions-ID ist bestätigt, unbelegte Leistungsbehauptungen sind es nicht.

Offizielle Funktionen von DeepSeek V4 Pro

Die aktuelle offizielle Modelltabelle zeigt für V4 Pro und V4 Flash dieselbe breite Protokollabdeckung:

  • Modi mit und ohne Thinking, standardmäßig ist Thinking aktiv
  • JSON-Ausgabe und strukturierte Tool-Aufrufe
  • OpenAI-kompatible Chat Completions
  • Unterstützung der OpenAI Responses API
  • Unterstützung des Anthropic-API-Formats
  • Chat Prefix Completion als Beta
  • Fill-in-the-Middle Completion im Non-Thinking-Modus
  • 1M Kontext und bis zu 384K generierter Output

DeepSeeks Codex-Leitfaden beschreibt V4 Pro als sein leistungsfähigstes agentisches Frontier-Coding-Modell. Die Metadaten kennzeichnen es als reines Textmodell und bieten low, high und max als Reasoning-Aufwand; Standard ist high. Da optionale Felder je nach Client und Gateway abweichen können, beginnen Sie mit der kleinsten Payload und ergänzen Regler einzeln.

Preis von DeepSeek-V4-Pro-0813 erklärt

DeepSeeks direkte API und dieses Gateway verwenden unterschiedliche Abrechnungssysteme:

Abrechnungsweg Cache-Hit-Input Cache-Miss-Input Output Hinweise
Direkte DeepSeek API 0,003625 $/M 0,435 $/M 0,87 $/M Aktueller offizieller Listenpreis
Dieses Gateway 7,5x, etwa 3 CNY/M Aktuelles Kontobuch prüfen Plattform-Multiplikator

Rechnen Sie die Zeilen nicht ineinander um, als nutzten sie denselben Zähler. Gateway-Kontogruppen, Output-Gewichtung, Aktionen, Caching und spätere Preisänderungen können den Rechnungsbetrag verändern. Für dieses Gateway sind die Live-Preisseite und das tatsächliche Kontobuch maßgeblich.

DeepSeek veröffentlicht in der aktuellen Tabelle außerdem ein Parallelitätslimit von 500 für V4 Pro. Das ist ein direktes Upstream-API-Limit, keine garantierte Parallelität pro Konto auf einem Drittanbieter-Gateway.

Kosten und Kompatibilität gemeinsam prüfen: Senden Sie nach einem Kauf auf der Kaufseite eine kurze Anfrage. Prüfen Sie Route, Token-Nutzung, Antwortformat und Kontobuch, bevor Sie Kontext oder Parallelität erhöhen.

DeepSeek V4 Pro über die API aufrufen

Für normales OpenAI-kompatibles Chatten verwenden Sie die stabile Modell-ID deepseek-v4-pro:

curl https://api.llm-token.cn/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "user", "content": "Entwirf einen sicheren Migrationsplan und liste die Rollback-Prüfungen auf."}
    ]
  }'

Testen Sie für Codex und Agenten-Clients mit Responses-Protokoll /v1/responses separat:

curl https://api.llm-token.cn/v1/responses \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "input": "Untersuche das Repository und erkläre den fehlerhaften Test. Ändere keine Dateien."
  }'

Beginnen Sie mit einer kurzen schreibgeschützten Anfrage. Eine erfolgreiche Chat-Antwort beweist nicht, dass Streaming, Responses-Events, Tool-Aufrufe oder eine lange Codex-Sitzung identisch funktionieren. Prüfen Sie jede Ebene und bewahren Sie für Support-Anfragen die Request-ID auf.

DeepSeek V4 Pro in Codex konfigurieren

DeepSeeks offizielle Codex-Anleitung enthält nun deepseek-v4-pro. Eine Gateway-Konfiguration kann einen benutzerdefinierten Responses-Anbieter nutzen:

model_provider = "llm-token"
model = "deepseek-v4-pro"
model_reasoning_effort = "high"

[model_providers.llm-token]
name = "LLM Token"
base_url = "https://api.llm-token.cn/v1"
wire_api = "responses"
requires_openai_auth = true

Übergeben Sie den API-Schlüssel mit der sicheren Authentifizierungsmethode Ihrer Codex-Version. Speichern Sie keinen echten Schlüssel in config.toml, wenn die Datei synchronisiert oder eingecheckt wird. Starten Sie mit einem schreibgeschützten Repository-Inventar und validieren Sie anschließend Suche, Patches, Shell, Tests, MCP und langen Kontext separat.

Die offiziellen Metadaten reservieren etwa 5 % des Kontexts für System- und Ausführungsaufwand. „1M Kontext“ bezeichnet das gesamte Modellfenster, nicht die Garantie, dass ein komplettes Repository mit 1M Tokens als Nutzereingabe eingefügt werden kann.

DeepSeek V4 Pro im Vergleich zu V4 Flash

Entscheidungskriterium DeepSeek V4 Pro 0813 DeepSeek V4 Flash 0731
Positionierung Leistungsfähigste agentische DeepSeek-Coding-Route Schnellere und günstigere Agenten-Route
Stabile Modell-ID deepseek-v4-pro deepseek-v4-flash
Kontext 1M 1M
Offizieller Outputpreis 0,87 $/M 0,28 $/M
Gateway-Multiplikator 7,5x 2,5x
Bester Einstieg Schwieriges Coding, Planung, Analyse Hohes Volumen oder kostensensible Agenten

Nutzen Sie V4 Flash als Kostenbasis und wechseln Sie zu V4 Pro, wenn sich der Wert der leistungsfähigeren Route messen lässt. Vergleichen Sie beide auf demselben Repository mit identischem Prompt, Tools, Timeout und Akzeptanztests.

Eine Premium-Alternative mit 500K Kontext und einem anderen Coding- und Agentenprofil finden Sie im Grok-4.6-API-Test.

Checkliste für den Produktiveinsatz

  1. Senden Sie deepseek-v4-pro und nicht die Versionsbezeichnung im API-Modellfeld.
  2. Prüfen Sie zurückgegebene Version und Route, sofern die Antwort diese enthält.
  3. Testen Sie den Thinking-Standard und Reasoning-Regler mit einer kurzen Anfrage.
  4. Validieren Sie Chat Completions und Responses unabhängig voneinander.
  5. Begrenzen Sie maximale Ausgabe, Timeout, Tool-Aufrufe und Gesamtkosten.
  6. Sichern Sie destruktive Tools, Deployments, Zahlungen und Infrastruktur durch Freigaben ab.
  7. Messen Sie Quote akzeptierter Aufgaben, Latenz, Token-Nutzung und Nacharbeit.
  8. Prüfen Sie DeepSeeks offizielle Preiswarnung vor einer Budgetzusage erneut.

Häufig gestellte Fragen

Was ist DeepSeek-V4-Pro-0813?

Es ist der aktuelle offizielle Versionsname hinter DeepSeeks V4-Pro-API-Route. Es ist nicht die übliche Modellzeichenfolge für API-Anfragen.

Welche Modell-ID soll ich senden?

Verwenden Sie deepseek-v4-pro. Der Dienst ordnet diese stabile Route derzeit DeepSeek-V4-Pro-0813 zu.

Unterstützt DeepSeek V4 Pro jetzt Codex?

Ja. DeepSeeks aktueller Codex-Integrationsleitfaden listet V4 Flash und V4 Pro und beschreibt Pro als sein leistungsfähigstes agentisches Frontier-Coding-Modell.

Wie groß ist das DeepSeek-V4-Pro-Kontextfenster?

Die offizielle Modelltabelle nennt 1M Tokens. Die Codex-Metadaten verwenden insgesamt 1.048.576 Tokens und einen effektiven Kontextanteil von 95 %.

Was kostet DeepSeek-V4-Pro-0813?

DeepSeek listet derzeit 0,003625 $/M Cache-Hit-Input-Tokens, 0,435 $/M Cache-Miss-Input-Tokens und 0,87 $/M Output-Tokens. Dieses Gateway führt deepseek-v4-pro mit 7,5x beziehungsweise etwa 3 CNY/M; prüfen Sie das aktuelle Kontobuch.

Ist DeepSeek V4 Pro multimodal?

Die aktuellen offiziellen Codex-Metadaten beschreiben es als reines Textmodell; dieses Gateway markiert Bildeingabe als nicht unterstützt. Verwenden Sie für Bild-Prompts ein eigenes Vision-Modell.

Gibt es offizielle 0813-Benchmark-Verbesserungen?

Bei der Prüfung war kein eigener öffentlicher Benchmark-Bericht vom 13. August in DeepSeeks Änderungsprotokoll verfügbar. Wiederholen Sie keine prozentualen Verbesserungen, bevor DeepSeek eine Quelle veröffentlicht.

Wo kann ich Zugang kaufen oder aufladen?

Neue Nutzer verwenden die Kaufseite. Bestehende Nutzer können über Aufladen Guthaben ergänzen.

Primärquellen