DeepSeek-V4-Pro-0813 2026: API, Codex e preço
DeepSeek-V4-Pro-0813 é a versão oficial atual servida pelo ID estável deepseek-v4-pro. A documentação confirma contexto de 1M tokens, saída de até 384K, modos com e sem thinking, JSON, ferramentas, Responses API, API Anthropic e suporte oficial ao Codex.
A palavra-chave exata importa: DeepSeek-V4-Pro-0813 identifica a versão implantada, enquanto as chamadas devem normalmente usar deepseek-v4-pro. Neste gateway, a rota está listada a 7,5x, cerca de CNY 3 por milhão de tokens, com contexto 1M.
Confira a rota antes de uma tarefa longa: veja os preços dos modelos ou comece com um pequeno saldo na página de compra.
Dados do DeepSeek-V4-Pro-0813
| Item | Informação verificada |
|---|---|
| Versão oficial atual | DeepSeek-V4-Pro-0813 |
| ID estável da API | deepseek-v4-pro |
| Janela de contexto | 1M tokens; metadados do Codex usam 1.048.576 |
| Saída máxima | 384K tokens |
| Modo padrão | Thinking |
| Outro modo | Sem thinking |
| Entrada com cache oficial | US$ 0,003625/M tokens |
| Entrada sem cache oficial | US$ 0,435/M tokens |
| Saída oficial | US$ 0,87/M tokens |
| Multiplicador do gateway | 7,5x, cerca de CNY 3/M tokens |
| Interfaces oficiais | Chat Completions, Responses, Anthropic |
| Imagens | Somente texto nos metadados atuais do Codex |
Última verificação: 13 de agosto de 2026. A DeepSeek avisa que planeja aumentar os preços gerais da API em breve, sujeito a comunicado oficial. Sempre confira antes de estimar produção.
O que significa 0813?
DeepSeek-V4-Pro-0813 é o nome exibido na tabela oficial Models & Pricing em 13 de agosto. O nome público de chamada continua deepseek-v4-pro, permitindo atualizar a versão atrás de uma rota estável sem reconfigurar cada integração.
Até a publicação, o changelog não traz uma nota separada de 13 de agosto com arquitetura ou uma tabela comparativa de benchmarks. A atualização de 31 de julho tratava de DeepSeek-V4-Flash-0731 e dizia que o Pro permanecia inalterado naquele momento. As páginas atuais de preço e Codex confirmam 0813 e o suporte Pro, mas não sustentam uma porcentagem específica de melhoria.
A distinção é importante: o novo identificador está confirmado; alegações de desempenho sem fonte não estão.
Recursos oficiais do DeepSeek V4 Pro
A tabela oficial mostra a mesma cobertura geral de protocolos para Pro e Flash:
- Modos com e sem thinking, com thinking padrão
- Saída JSON e chamadas estruturadas de ferramentas
- Chat Completions compatível com OpenAI
- OpenAI Responses API
- Formato de API Anthropic
- Chat prefix completion em beta
- Fill-in-the-middle no modo sem thinking
- Contexto 1M e saída gerada de até 384K
O guia do Codex descreve o Pro como seu modelo frontier mais capaz para agentes de coding. Os metadados o marcam como somente texto e oferecem low, high e max, com high padrão. Campos opcionais podem variar por cliente e gateway; comece com o payload mínimo e adicione controles um a um.
Preço do DeepSeek-V4-Pro-0813
A API direta e este gateway têm cobranças diferentes:
| Superfície | Entrada com cache | Entrada sem cache | Saída | Observações |
|---|---|---|---|---|
| API DeepSeek direta | US$ 0,003625/M | US$ 0,435/M | US$ 0,87/M | Preço oficial atual |
| Este gateway | — | 7,5x, cerca de CNY 3/M | Confira o registro | Modelo por multiplicador |
Não converta uma linha na outra como se usassem o mesmo medidor. Grupo de conta, peso da saída, promoções, cache e atualizações podem mudar a cobrança. A página atual e o registro real são a referência do gateway.
A DeepSeek também publica limite de concorrência 500 para Pro na API direta. É um limite upstream, não uma garantia por conta em gateway externo.
Valide custo e compatibilidade: após comprar na página, faça uma chamada curta e confira rota, tokens, formato e registro antes de aumentar contexto ou concorrência.
Chamar DeepSeek V4 Pro pela API
Use o ID estável deepseek-v4-pro:
curl https://api.llm-token.cn/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "user", "content": "Crie um plano seguro de migração e liste as verificações de rollback."}
]
}'
Para Codex e clientes Responses, teste /v1/responses separadamente:
curl https://api.llm-token.cn/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"input": "Inspecione o repositório e explique o teste com falha. Não modifique arquivos."
}'
Comece com uma chamada curta e somente leitura. Chat bem-sucedido não prova que streaming, eventos Responses, ferramentas ou uma sessão longa funcionem igualmente. Verifique cada camada e guarde o request ID.
Configurar no Codex
As instruções oficiais agora incluem deepseek-v4-pro. Um gateway pode usar um provedor Responses personalizado:
model_provider = "llm-token"
model = "deepseek-v4-pro"
model_reasoning_effort = "high"
[model_providers.llm-token]
name = "LLM Token"
base_url = "https://api.llm-token.cn/v1"
wire_api = "responses"
requires_openai_auth = true
Forneça a chave pelo método seguro da sua versão do Codex. Não salve chave real em config.toml se o arquivo for sincronizado ou versionado. Comece com inventário somente leitura e valide busca, patches, shell, testes, MCP e contexto longo separadamente.
Os metadados reservam cerca de 5% do contexto para sistema e execução. “Contexto 1M” é a janela total, não garantia de que um repositório inteiro de 1M possa ser usado como entrada.
DeepSeek V4 Pro vs V4 Flash
| Fator | DeepSeek V4 Pro 0813 | DeepSeek V4 Flash 0731 |
|---|---|---|
| Posição | Rota mais capaz para agentes de coding | Rota mais rápida e econômica |
| ID estável | deepseek-v4-pro |
deepseek-v4-flash |
| Contexto | 1M | 1M |
| Saída oficial | US$ 0,87/M | US$ 0,28/M |
| Multiplicador | 7,5x | 2,5x |
| Melhor início | Coding, planejamento e análise difíceis | Alto volume ou custo sensível |
Use Flash como referência de custo e migre para Pro quando o ganho for mensurável. Compare mesmo repositório, prompt, ferramentas, timeout e testes.
Como alternativa premium de 500K com outro perfil, leia a análise da API Grok 4.6.
Checklist de produção
- Envie
deepseek-v4-pro, não o rótulo de versão. - Confirme versão e rota retornadas quando disponíveis.
- Teste thinking padrão e controles com chamada curta.
- Valide Chat Completions e Responses separadamente.
- Limite saída, timeout, ferramentas e custo.
- Exija aprovação para ferramentas destrutivas, deploy, pagamentos e infraestrutura.
- Meça tarefas aceitas, latência, tokens e retrabalho.
- Reveja o alerta de preço antes de assumir orçamento.
Perguntas frequentes
O que é DeepSeek-V4-Pro-0813?
É o nome oficial atual da versão atrás da rota V4 Pro, não a string habitual enviada na API.
Qual ID devo enviar?
Use deepseek-v4-pro. O serviço mapeia essa rota para DeepSeek-V4-Pro-0813.
O V4 Pro aceita Codex?
Sim. O guia lista Flash e Pro e descreve o Pro como o modelo frontier mais capaz para agentes de coding.
Qual o contexto?
A tabela oficial informa 1M tokens. Os metadados Codex usam 1.048.576 no total e 95% efetivo.
Qual é o preço?
A DeepSeek lista US$ 0,003625/M com cache, US$ 0,435/M sem cache e US$ 0,87/M de saída. O gateway lista deepseek-v4-pro a 7,5x, cerca de CNY 3/M; confira o registro.
É multimodal?
Os metadados o descrevem como somente texto e o gateway marca imagens como incompatíveis. Use um modelo de visão.
Há benchmarks oficiais de melhoria 0813?
Não havia uma tabela pública específica de 13 de agosto no changelog. Não repita percentuais sem fonte da DeepSeek.
Onde comprar ou recarregar?
Novos usuários podem comprar. Usuários atuais podem recarregar.
Fontes primárias
- DeepSeek Models & Pricing:
DeepSeek-V4-Pro-0813, contexto, saída, recursos, preço, concorrência e aviso - Guia de integração Codex: metadados Pro, Codex, contexto e raciocínio
- Changelog da DeepSeek: limite entre Flash de 31 de julho e a documentação Pro atual
- Guia de modelos do gateway: rota, multiplicador, contexto e imagem