Todos os modelos
DeepSeek

DeepSeek-V4-Pro

O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.

Visão geral em inglês simples

O que DeepSeek-V4-Pro realmente é

DeepSeek-V4-Pro é a opção V4 maior, projetada para tarefas em que a confiabilidade do agente e o raciocínio mais profundo são mais importantes do que o preço mais baixo do token. Ele suporta controles de pensamento, chamadas de ferramentas, JSON estruturado, uma interface compatível com respostas e uma saída máxima grande o suficiente para códigos ou documentos substanciais.

DeepSeek publica taxas separadas de pico, fora de pico, armazenadas em cache e não armazenadas em cache. Esse preço pode recompensar cargas de trabalho programadas ou repetitivas, mas torna enganoso um único preço de token de título; estime a taxa de acertos do cache, o comprimento da saída e a combinação de horário do dia para o aplicativo real.

Bom ajuste para

  • Agentes complexos de codificação e uso de ferramentas
  • Repositórios e conjuntos de documentos com milhões de tokens
  • Equipes que podem se beneficiar do roteamento nos horários de pico/fora de pico

Comparação de categorias

Os fatos que importam para os modelos texto

Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.

Janela de contexto
1 milhão de tokensMáximo combinado de prompt e contexto de trabalho documentado pelo provedor.
Saída máxima
Até 384 mil tokensLimite de resposta publicado pelo provedor, quando disponível.
Corte de conhecimento
Não publicadoÚltima data de conhecimento confiável publicada explicitamente pelo fornecedor do modelo. As ferramentas de pesquisa e conectadas podem recuperar informações mais recentes, mas não alteram o corte integrado do modelo.
Preço de entrada
pico de US$ 1,32/1 milhão sem cache; US$ 0,66 fora do horário de picoPreço de lista padrão atual por milhão de tokens de entrada, salvo indicação em contrário.
Preço de saída
US$ 3,96/pico de 1 milhão; US$ 1,98 fora do horário de picoPreço de lista padrão atual por milhão de tokens de saída, salvo indicação em contrário.
Entradas
TextoTipos de mídia aceitos pelo endpoint do modelo listado.
Ferramentas e agentes
Ferramentas, saída JSON, API de respostas, esforço de pensamento, FIM betaFerramentas nativas selecionadas e recursos de criação de agentes, não uma lista exaustiva.

Preços e comparações

Estime seu custo

Defina seu uso. A estimativa é atualizada enquanto você digita.

Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.

Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.

Opções avançadas

DeepSeek-V4-Pro

DeepSeek

Total estimado (USD)

Sem preço revisado

Para o uso indicado · USD · Preço de API, não de assinatura

Como funciona esta estimativa

Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.

Acesso à API e ao provedor

Onde obter DeepSeek-V4-Pro

Disponibilidade

Regiões e estágio de acesso

Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses.

As páginas de modelo público do DeepSeek não enumeram uma lista global de países ou regiões de processamento específicas do modelo; confirmar a elegibilidade da conta e a lei aplicável.

Verifique a disponibilidade ao vivo

Dados e treinamento

A rota é importante.

DeepSeek documenta sua API de respostas como sem estado e diz que as respostas e conversas não são armazenadas por esse endpoint. Esta não é uma promessa completa de retenção ou uso de treinamento para toda a conta; revise os termos atuais da plataforma e o comportamento do cache automático para dados confidenciais.

Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.

Leia a política do provedor

Perguntas frequentes

Perguntas frequentes sobre DeepSeek-V4-Pro

O que é DeepSeek-V4-Pro?

O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes. DeepSeek-V4-Pro é a opção V4 maior, projetada para tarefas em que a confiabilidade do agente e o raciocínio mais profundo são mais importantes do que o preço mais baixo do token. Ele suporta controles de pensamento, chamadas de ferramentas, JSON estruturado, uma interface compatível com respostas e uma saída máxima grande o suficiente para códigos ou documentos substanciais.

Quando o DeepSeek-V4-Pro foi lançado?

DeepSeek-V4-Pro foi lançado em 13 de agosto de 2026 de acordo com os materiais do fornecedor citado.

Onde posso acessar DeepSeek-V4-Pro?

Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses. As rotas de acesso listadas neste guia são DeepSeek API e DeepSeek.

Quanto custa DeepSeek-V4-Pro?

Pico: entrada de $ 1,32 · saída de $ 3,96 / 1 milhão de tokens. A entrada e a saída sem cache fora do horário de pico custam US$ 0,66 e US$ 1,98 por milhão. A entrada em cache é mais barata e DeepSeek pode alterar a programação e os preços de pico.

Onde o DeepSeek-V4-Pro está disponível?

Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses. As páginas de modelo público do DeepSeek não enumeram uma lista global de países ou regiões de processamento específicas do modelo; confirmar a elegibilidade da conta e a lei aplicável.

Os dados da minha API DeepSeek-V4-Pro são usados ​​para treinamento?

DeepSeek documenta sua API de respostas como sem estado e diz que as respostas e conversas não são armazenadas por esse endpoint. Esta não é uma promessa completa de retenção ou uso de treinamento para toda a conta; revise os termos atuais da plataforma e o comportamento do cache automático para dados confidenciais. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.

Comparação de preços

USD por milhão de tokens nas APIs indicadas com contexto padrão. Tarifas de cache e contexto longo podem variar. Modelos sem preços revisados compatíveis são omitidos; menor custo não significa melhor qualidade.

Custo dos tokens de entradapor 1 milhão de tokens · USD
  1. US$ 0,15
    Mistral Small 4

    Mistral AI

  2. US$ 0,75
    Gemini 3.8 Flash

    Google

  3. US$ 4,00
    GPT-5.6 Sol

    OpenAI

  4. US$ 10,00
    GPT-6 Astra

    OpenAI

  5. US$ 10,00
    Claude Fable 5.1

    Anthropic

Custo dos tokens de saídapor 1 milhão de tokens · USD
  1. US$ 0,60
    Mistral Small 4

    Mistral AI

  2. US$ 3,75
    Gemini 3.8 Flash

    Google

  3. US$ 20,00
    GPT-5.6 Sol

    OpenAI

  4. US$ 50,00
    GPT-6 Astra

    OpenAI

  5. US$ 50,00
    Claude Fable 5.1

    Anthropic

Comparações relacionadas

Comparações lado a lado

  1. DeepSeek-V4-Pro vs GPT-6 Astra

    O modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.

    Abrir comparação completa
  2. DeepSeek-V4-Pro vs GPT-5.6 Sol

    O principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.

    Abrir comparação completa
  3. DeepSeek-V4-Pro vs Claude Fable 5.1

    O modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.

    Abrir comparação completa
  4. DeepSeek-V4-Pro vs Gemini 3.8 Flash

    Modelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.

    Abrir comparação completa
  5. DeepSeek-V4-Pro vs Grok 4.6

    Modelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.

    Abrir comparação completa
  6. DeepSeek-V4-Pro vs Grok 4.20 Multi-Agent Beta

    Um modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.

    Abrir comparação completa
  7. DeepSeek-V4-Pro vs Inkling

    Modelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.

    Abrir comparação completa
  8. DeepSeek-V4-Pro vs Mistral Medium 3.5

    O modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.

    Abrir comparação completa
  9. DeepSeek-V4-Pro vs Mistral Small 4

    O modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.

    Abrir comparação completa
  10. DeepSeek-V4-Pro vs Qwen3.8 Max

    Modelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.

    Abrir comparação completa
  11. DeepSeek-V4-Pro vs MiniMax M3

    Modelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.

    Abrir comparação completa
  12. DeepSeek-V4-Pro vs GLM-5.3

    Modelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.

    Abrir comparação completa
  13. DeepSeek-V4-Pro vs Kimi K3

    Modelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.

    Abrir comparação completa
  14. DeepSeek-V4-Pro vs Falcon-H1R-7B

    Modelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.

    Abrir comparação completa
  15. DeepSeek-V4-Pro vs Falcon-H1-34B-Instruct

    Modelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.

    Abrir comparação completa
  16. DeepSeek-V4-Pro vs Muse Spark 1.3

    O mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.

    Abrir comparação completa
  17. DeepSeek-V4-Pro vs Celeris-1 Magnus

    Modelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.

    Abrir comparação completa
  18. DeepSeek-V4-Pro vs NVIDIA Nemotron 3 Ultra

    O maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.

    Abrir comparação completa
  19. DeepSeek-V4-Pro vs NVIDIA Nemotron 3.5 Lightning

    Modelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.

    Abrir comparação completa
  20. DeepSeek-V4-Pro vs Qwen3.8-Flash

    Modelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.

    Abrir comparação completa
  21. DeepSeek-V4-Pro vs DeepSeek-V4-Flash

    Modelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.

    Abrir comparação completa