Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

Voltar ao blog

DeepSeek-V4-Pro-0813 2026: API, Codex e preço

DeepSeek-V4-Pro-0813DeepSeek V4 ProCodexResponses APIagente de coding

DeepSeek-V4-Pro-0813 é a versão oficial atual servida pelo ID estável deepseek-v4-pro. A documentação confirma contexto de 1M tokens, saída de até 384K, modos com e sem thinking, JSON, ferramentas, Responses API, API Anthropic e suporte oficial ao Codex.

A palavra-chave exata importa: DeepSeek-V4-Pro-0813 identifica a versão implantada, enquanto as chamadas devem normalmente usar deepseek-v4-pro. Neste gateway, a rota está listada a 7,5x, cerca de CNY 3 por milhão de tokens, com contexto 1M.

Confira a rota antes de uma tarefa longa: veja os preços dos modelos ou comece com um pequeno saldo na página de compra.

Dados do DeepSeek-V4-Pro-0813

Item Informação verificada
Versão oficial atual DeepSeek-V4-Pro-0813
ID estável da API deepseek-v4-pro
Janela de contexto 1M tokens; metadados do Codex usam 1.048.576
Saída máxima 384K tokens
Modo padrão Thinking
Outro modo Sem thinking
Entrada com cache oficial US$ 0,003625/M tokens
Entrada sem cache oficial US$ 0,435/M tokens
Saída oficial US$ 0,87/M tokens
Multiplicador do gateway 7,5x, cerca de CNY 3/M tokens
Interfaces oficiais Chat Completions, Responses, Anthropic
Imagens Somente texto nos metadados atuais do Codex

Última verificação: 13 de agosto de 2026. A DeepSeek avisa que planeja aumentar os preços gerais da API em breve, sujeito a comunicado oficial. Sempre confira antes de estimar produção.

O que significa 0813?

DeepSeek-V4-Pro-0813 é o nome exibido na tabela oficial Models & Pricing em 13 de agosto. O nome público de chamada continua deepseek-v4-pro, permitindo atualizar a versão atrás de uma rota estável sem reconfigurar cada integração.

Até a publicação, o changelog não traz uma nota separada de 13 de agosto com arquitetura ou uma tabela comparativa de benchmarks. A atualização de 31 de julho tratava de DeepSeek-V4-Flash-0731 e dizia que o Pro permanecia inalterado naquele momento. As páginas atuais de preço e Codex confirmam 0813 e o suporte Pro, mas não sustentam uma porcentagem específica de melhoria.

A distinção é importante: o novo identificador está confirmado; alegações de desempenho sem fonte não estão.

Recursos oficiais do DeepSeek V4 Pro

A tabela oficial mostra a mesma cobertura geral de protocolos para Pro e Flash:

  • Modos com e sem thinking, com thinking padrão
  • Saída JSON e chamadas estruturadas de ferramentas
  • Chat Completions compatível com OpenAI
  • OpenAI Responses API
  • Formato de API Anthropic
  • Chat prefix completion em beta
  • Fill-in-the-middle no modo sem thinking
  • Contexto 1M e saída gerada de até 384K

O guia do Codex descreve o Pro como seu modelo frontier mais capaz para agentes de coding. Os metadados o marcam como somente texto e oferecem low, high e max, com high padrão. Campos opcionais podem variar por cliente e gateway; comece com o payload mínimo e adicione controles um a um.

Preço do DeepSeek-V4-Pro-0813

A API direta e este gateway têm cobranças diferentes:

Superfície Entrada com cache Entrada sem cache Saída Observações
API DeepSeek direta US$ 0,003625/M US$ 0,435/M US$ 0,87/M Preço oficial atual
Este gateway 7,5x, cerca de CNY 3/M Confira o registro Modelo por multiplicador

Não converta uma linha na outra como se usassem o mesmo medidor. Grupo de conta, peso da saída, promoções, cache e atualizações podem mudar a cobrança. A página atual e o registro real são a referência do gateway.

A DeepSeek também publica limite de concorrência 500 para Pro na API direta. É um limite upstream, não uma garantia por conta em gateway externo.

Valide custo e compatibilidade: após comprar na página, faça uma chamada curta e confira rota, tokens, formato e registro antes de aumentar contexto ou concorrência.

Chamar DeepSeek V4 Pro pela API

Use o ID estável deepseek-v4-pro:

curl https://api.llm-token.cn/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "user", "content": "Crie um plano seguro de migração e liste as verificações de rollback."}
    ]
  }'

Para Codex e clientes Responses, teste /v1/responses separadamente:

curl https://api.llm-token.cn/v1/responses \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "input": "Inspecione o repositório e explique o teste com falha. Não modifique arquivos."
  }'

Comece com uma chamada curta e somente leitura. Chat bem-sucedido não prova que streaming, eventos Responses, ferramentas ou uma sessão longa funcionem igualmente. Verifique cada camada e guarde o request ID.

Configurar no Codex

As instruções oficiais agora incluem deepseek-v4-pro. Um gateway pode usar um provedor Responses personalizado:

model_provider = "llm-token"
model = "deepseek-v4-pro"
model_reasoning_effort = "high"

[model_providers.llm-token]
name = "LLM Token"
base_url = "https://api.llm-token.cn/v1"
wire_api = "responses"
requires_openai_auth = true

Forneça a chave pelo método seguro da sua versão do Codex. Não salve chave real em config.toml se o arquivo for sincronizado ou versionado. Comece com inventário somente leitura e valide busca, patches, shell, testes, MCP e contexto longo separadamente.

Os metadados reservam cerca de 5% do contexto para sistema e execução. “Contexto 1M” é a janela total, não garantia de que um repositório inteiro de 1M possa ser usado como entrada.

DeepSeek V4 Pro vs V4 Flash

Fator DeepSeek V4 Pro 0813 DeepSeek V4 Flash 0731
Posição Rota mais capaz para agentes de coding Rota mais rápida e econômica
ID estável deepseek-v4-pro deepseek-v4-flash
Contexto 1M 1M
Saída oficial US$ 0,87/M US$ 0,28/M
Multiplicador 7,5x 2,5x
Melhor início Coding, planejamento e análise difíceis Alto volume ou custo sensível

Use Flash como referência de custo e migre para Pro quando o ganho for mensurável. Compare mesmo repositório, prompt, ferramentas, timeout e testes.

Como alternativa premium de 500K com outro perfil, leia a análise da API Grok 4.6.

Checklist de produção

  1. Envie deepseek-v4-pro, não o rótulo de versão.
  2. Confirme versão e rota retornadas quando disponíveis.
  3. Teste thinking padrão e controles com chamada curta.
  4. Valide Chat Completions e Responses separadamente.
  5. Limite saída, timeout, ferramentas e custo.
  6. Exija aprovação para ferramentas destrutivas, deploy, pagamentos e infraestrutura.
  7. Meça tarefas aceitas, latência, tokens e retrabalho.
  8. Reveja o alerta de preço antes de assumir orçamento.

Perguntas frequentes

O que é DeepSeek-V4-Pro-0813?

É o nome oficial atual da versão atrás da rota V4 Pro, não a string habitual enviada na API.

Qual ID devo enviar?

Use deepseek-v4-pro. O serviço mapeia essa rota para DeepSeek-V4-Pro-0813.

O V4 Pro aceita Codex?

Sim. O guia lista Flash e Pro e descreve o Pro como o modelo frontier mais capaz para agentes de coding.

Qual o contexto?

A tabela oficial informa 1M tokens. Os metadados Codex usam 1.048.576 no total e 95% efetivo.

Qual é o preço?

A DeepSeek lista US$ 0,003625/M com cache, US$ 0,435/M sem cache e US$ 0,87/M de saída. O gateway lista deepseek-v4-pro a 7,5x, cerca de CNY 3/M; confira o registro.

É multimodal?

Os metadados o descrevem como somente texto e o gateway marca imagens como incompatíveis. Use um modelo de visão.

Há benchmarks oficiais de melhoria 0813?

Não havia uma tabela pública específica de 13 de agosto no changelog. Não repita percentuais sem fonte da DeepSeek.

Onde comprar ou recarregar?

Novos usuários podem comprar. Usuários atuais podem recarregar.

Fontes primárias