DeepSeek-V4-Pro-0813 Guide 2026: API, Codex & Preis
DeepSeek-V4-Pro-0813 ist die aktuelle offizielle Version hinter der stabilen API-Modell-ID deepseek-v4-pro. DeepSeeks aktuelle Dokumentation bestätigt ein Kontextfenster von 1M Tokens, bis zu 384K Output, Modi mit und ohne Thinking, JSON-Ausgabe, Tool-Aufrufe, Responses API, Anthropic API und offiziellen Codex-Support.
Das genaue Keyword ist wichtig: DeepSeek-V4-Pro-0813 bezeichnet die bereitgestellte Modellversion, während API-Anfragen normalerweise weiterhin deepseek-v4-pro verwenden sollten. Auf diesem Gateway ist die Route mit 7,5x, etwa 3 CNY je Million Tokens, und einem 1M-Kontext gelistet.
Prüfen Sie die Live-Route vor einer langen Agentenaufgabe: Öffnen Sie die Modellpreise oder starten Sie mit einem kleinen Guthaben auf der Kaufseite.
DeepSeek-V4-Pro-0813: die wichtigsten Daten
| Merkmal | Verifizierte Angabe |
|---|---|
| Aktuelle offizielle Version | DeepSeek-V4-Pro-0813 |
| Stabile API-Modell-ID | deepseek-v4-pro |
| Kontextfenster | 1M Tokens; Codex-Metadaten nutzen 1.048.576 |
| Maximale Ausgabe | 384K Tokens |
| Standardmodus | Thinking |
| Weiterer Modus | Non-Thinking |
| Offizieller Cache-Hit-Inputpreis | 0,003625 $/M Tokens |
| Offizieller Cache-Miss-Inputpreis | 0,435 $/M Tokens |
| Offizieller Outputpreis | 0,87 $/M Tokens |
| Gateway-Multiplikator | 7,5x, etwa 3 CNY/M Tokens |
| Offizielle Schnittstellen | Chat Completions, Responses, Anthropic |
| Bildeingabe | In aktuellen Codex-Metadaten nur Text |
Zuletzt geprüft: 13. August 2026. DeepSeek weist auf der Preisseite auf eine geplante allgemeine API-Preiserhöhung in naher Zukunft hin; der endgültige Plan bleibt einer offiziellen Mitteilung vorbehalten. Prüfen Sie die Preise vor jeder Produktionskalkulation erneut.
Was bedeutet der Versionsname 0813?
DeepSeek-V4-Pro-0813 ist die Versionsbezeichnung, die am 13. August in DeepSeeks offizieller Tabelle „Models & Pricing“ erschien. Der öffentliche Anfragename bleibt deepseek-v4-pro. So kann DeepSeek die Version hinter einer stabilen Route aktualisieren, ohne jede Integration umkonfigurieren zu müssen.
Zum Zeitpunkt dieses Artikels enthält das öffentliche Änderungsprotokoll keinen eigenen Eintrag vom 13. August mit Architekturdetails oder einer Vorher-Nachher-Benchmark-Tabelle für V4 Pro. Das Update vom 31. Juli behandelte ausdrücklich DeepSeek-V4-Flash-0731 und erklärte V4 Pro damals für unverändert. Die aktuellen Preis- und Codex-Seiten bestätigen nun die Version 0813 und Pro-Unterstützung, liefern aber keine Grundlage für eine bestimmte prozentuale Verbesserung.
Diese Unterscheidung ist für SEO-Leser und Produktionsteams wichtig: Die neue Versions-ID ist bestätigt, unbelegte Leistungsbehauptungen sind es nicht.
Offizielle Funktionen von DeepSeek V4 Pro
Die aktuelle offizielle Modelltabelle zeigt für V4 Pro und V4 Flash dieselbe breite Protokollabdeckung:
- Modi mit und ohne Thinking, standardmäßig ist Thinking aktiv
- JSON-Ausgabe und strukturierte Tool-Aufrufe
- OpenAI-kompatible Chat Completions
- Unterstützung der OpenAI Responses API
- Unterstützung des Anthropic-API-Formats
- Chat Prefix Completion als Beta
- Fill-in-the-Middle Completion im Non-Thinking-Modus
- 1M Kontext und bis zu 384K generierter Output
DeepSeeks Codex-Leitfaden beschreibt V4 Pro als sein leistungsfähigstes agentisches Frontier-Coding-Modell. Die Metadaten kennzeichnen es als reines Textmodell und bieten low, high und max als Reasoning-Aufwand; Standard ist high. Da optionale Felder je nach Client und Gateway abweichen können, beginnen Sie mit der kleinsten Payload und ergänzen Regler einzeln.
Preis von DeepSeek-V4-Pro-0813 erklärt
DeepSeeks direkte API und dieses Gateway verwenden unterschiedliche Abrechnungssysteme:
| Abrechnungsweg | Cache-Hit-Input | Cache-Miss-Input | Output | Hinweise |
|---|---|---|---|---|
| Direkte DeepSeek API | 0,003625 $/M | 0,435 $/M | 0,87 $/M | Aktueller offizieller Listenpreis |
| Dieses Gateway | — | 7,5x, etwa 3 CNY/M | Aktuelles Kontobuch prüfen | Plattform-Multiplikator |
Rechnen Sie die Zeilen nicht ineinander um, als nutzten sie denselben Zähler. Gateway-Kontogruppen, Output-Gewichtung, Aktionen, Caching und spätere Preisänderungen können den Rechnungsbetrag verändern. Für dieses Gateway sind die Live-Preisseite und das tatsächliche Kontobuch maßgeblich.
DeepSeek veröffentlicht in der aktuellen Tabelle außerdem ein Parallelitätslimit von 500 für V4 Pro. Das ist ein direktes Upstream-API-Limit, keine garantierte Parallelität pro Konto auf einem Drittanbieter-Gateway.
Kosten und Kompatibilität gemeinsam prüfen: Senden Sie nach einem Kauf auf der Kaufseite eine kurze Anfrage. Prüfen Sie Route, Token-Nutzung, Antwortformat und Kontobuch, bevor Sie Kontext oder Parallelität erhöhen.
DeepSeek V4 Pro über die API aufrufen
Für normales OpenAI-kompatibles Chatten verwenden Sie die stabile Modell-ID deepseek-v4-pro:
curl https://api.llm-token.cn/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "user", "content": "Entwirf einen sicheren Migrationsplan und liste die Rollback-Prüfungen auf."}
]
}'
Testen Sie für Codex und Agenten-Clients mit Responses-Protokoll /v1/responses separat:
curl https://api.llm-token.cn/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"input": "Untersuche das Repository und erkläre den fehlerhaften Test. Ändere keine Dateien."
}'
Beginnen Sie mit einer kurzen schreibgeschützten Anfrage. Eine erfolgreiche Chat-Antwort beweist nicht, dass Streaming, Responses-Events, Tool-Aufrufe oder eine lange Codex-Sitzung identisch funktionieren. Prüfen Sie jede Ebene und bewahren Sie für Support-Anfragen die Request-ID auf.
DeepSeek V4 Pro in Codex konfigurieren
DeepSeeks offizielle Codex-Anleitung enthält nun deepseek-v4-pro. Eine Gateway-Konfiguration kann einen benutzerdefinierten Responses-Anbieter nutzen:
model_provider = "llm-token"
model = "deepseek-v4-pro"
model_reasoning_effort = "high"
[model_providers.llm-token]
name = "LLM Token"
base_url = "https://api.llm-token.cn/v1"
wire_api = "responses"
requires_openai_auth = true
Übergeben Sie den API-Schlüssel mit der sicheren Authentifizierungsmethode Ihrer Codex-Version. Speichern Sie keinen echten Schlüssel in config.toml, wenn die Datei synchronisiert oder eingecheckt wird. Starten Sie mit einem schreibgeschützten Repository-Inventar und validieren Sie anschließend Suche, Patches, Shell, Tests, MCP und langen Kontext separat.
Die offiziellen Metadaten reservieren etwa 5 % des Kontexts für System- und Ausführungsaufwand. „1M Kontext“ bezeichnet das gesamte Modellfenster, nicht die Garantie, dass ein komplettes Repository mit 1M Tokens als Nutzereingabe eingefügt werden kann.
DeepSeek V4 Pro im Vergleich zu V4 Flash
| Entscheidungskriterium | DeepSeek V4 Pro 0813 | DeepSeek V4 Flash 0731 |
|---|---|---|
| Positionierung | Leistungsfähigste agentische DeepSeek-Coding-Route | Schnellere und günstigere Agenten-Route |
| Stabile Modell-ID | deepseek-v4-pro |
deepseek-v4-flash |
| Kontext | 1M | 1M |
| Offizieller Outputpreis | 0,87 $/M | 0,28 $/M |
| Gateway-Multiplikator | 7,5x | 2,5x |
| Bester Einstieg | Schwieriges Coding, Planung, Analyse | Hohes Volumen oder kostensensible Agenten |
Nutzen Sie V4 Flash als Kostenbasis und wechseln Sie zu V4 Pro, wenn sich der Wert der leistungsfähigeren Route messen lässt. Vergleichen Sie beide auf demselben Repository mit identischem Prompt, Tools, Timeout und Akzeptanztests.
Eine Premium-Alternative mit 500K Kontext und einem anderen Coding- und Agentenprofil finden Sie im Grok-4.6-API-Test.
Checkliste für den Produktiveinsatz
- Senden Sie
deepseek-v4-pround nicht die Versionsbezeichnung im API-Modellfeld. - Prüfen Sie zurückgegebene Version und Route, sofern die Antwort diese enthält.
- Testen Sie den Thinking-Standard und Reasoning-Regler mit einer kurzen Anfrage.
- Validieren Sie Chat Completions und Responses unabhängig voneinander.
- Begrenzen Sie maximale Ausgabe, Timeout, Tool-Aufrufe und Gesamtkosten.
- Sichern Sie destruktive Tools, Deployments, Zahlungen und Infrastruktur durch Freigaben ab.
- Messen Sie Quote akzeptierter Aufgaben, Latenz, Token-Nutzung und Nacharbeit.
- Prüfen Sie DeepSeeks offizielle Preiswarnung vor einer Budgetzusage erneut.
Häufig gestellte Fragen
Was ist DeepSeek-V4-Pro-0813?
Es ist der aktuelle offizielle Versionsname hinter DeepSeeks V4-Pro-API-Route. Es ist nicht die übliche Modellzeichenfolge für API-Anfragen.
Welche Modell-ID soll ich senden?
Verwenden Sie deepseek-v4-pro. Der Dienst ordnet diese stabile Route derzeit DeepSeek-V4-Pro-0813 zu.
Unterstützt DeepSeek V4 Pro jetzt Codex?
Ja. DeepSeeks aktueller Codex-Integrationsleitfaden listet V4 Flash und V4 Pro und beschreibt Pro als sein leistungsfähigstes agentisches Frontier-Coding-Modell.
Wie groß ist das DeepSeek-V4-Pro-Kontextfenster?
Die offizielle Modelltabelle nennt 1M Tokens. Die Codex-Metadaten verwenden insgesamt 1.048.576 Tokens und einen effektiven Kontextanteil von 95 %.
Was kostet DeepSeek-V4-Pro-0813?
DeepSeek listet derzeit 0,003625 $/M Cache-Hit-Input-Tokens, 0,435 $/M Cache-Miss-Input-Tokens und 0,87 $/M Output-Tokens. Dieses Gateway führt deepseek-v4-pro mit 7,5x beziehungsweise etwa 3 CNY/M; prüfen Sie das aktuelle Kontobuch.
Ist DeepSeek V4 Pro multimodal?
Die aktuellen offiziellen Codex-Metadaten beschreiben es als reines Textmodell; dieses Gateway markiert Bildeingabe als nicht unterstützt. Verwenden Sie für Bild-Prompts ein eigenes Vision-Modell.
Gibt es offizielle 0813-Benchmark-Verbesserungen?
Bei der Prüfung war kein eigener öffentlicher Benchmark-Bericht vom 13. August in DeepSeeks Änderungsprotokoll verfügbar. Wiederholen Sie keine prozentualen Verbesserungen, bevor DeepSeek eine Quelle veröffentlicht.
Wo kann ich Zugang kaufen oder aufladen?
Neue Nutzer verwenden die Kaufseite. Bestehende Nutzer können über Aufladen Guthaben ergänzen.
Primärquellen
- DeepSeek Models & Pricing:
DeepSeek-V4-Pro-0813, Kontext, Output-Limit, Funktionen, direkter Preis, Parallelität und Preiswarnung - DeepSeeks Codex-Integrationsleitfaden: aktuelle Pro-Metadaten, Codex-Support, Kontext und Reasoning-Stufen
- DeepSeek-Änderungsprotokoll: Abgrenzung zwischen der Flash-Veröffentlichung vom 31. Juli und aktueller Pro-Dokumentation
- Gateway-Modellleitfaden: aktuelle
deepseek-v4-pro-Route, Multiplikator, Kontext und Bildeingabestatus