Em 13 de agosto de 2026, DeepSeek moveu DeepSeek-V4-Pro de preview para disponibilidade geral em seu aplicativo, experiência web e API. O lançamento de produção é designado V4 Pro 0813 e marca o final de um período de preview de quase quatro meses. A versão de disponibilidade geral foca em capacidades de agente — tarefas onde sistemas de IA usam ferramentas, executam código e completam fluxos de trabalho multi-etapas sem intervenção humana.
Os resultados de benchmark lançados pela DeepSeek mostraram o modelo marcando 87,9 em Terminal Bench 2.1, 62,7 em DeepSWE e 61,5 em NL2Repo, entre outros testes focados em agentes. O modelo é capaz de lidar com uma janela de contexto de até 1 milhão de tokens e pode produzir saídas tão longas quanto 384.000 tokens, com a opção de executar em modo de pensamento ou não pensamento. A orientação oficial posiciona esforço baixo para trabalho direto, alto para tarefas de agente diário e máximo para cenários mais difíceis.
Um aumento de preço para a família do modelo V4 está definido para entrar em vigor em 16:00 UTC em 16 de agosto. DeepSeek também está introduzindo cobrança de pico e fora de pico, com taxas fora de pico em metade do preço de pico. Tokens de saída V4-Pro subindo para $3,96 por milhão nas horas de pico da taxa plana atual de $0,87 por milhão. Mesmo nas taxas de pico, DeepSeek permanece substancialmente mais barato do que Fable 5 da Anthropic ($50 por milhão de tokens de saída).
Para equipes de produção, V4 Pro GA sinaliza um checkpoint estável após meses de iteração de preview. A mudança de preço reflete a mudança de DeepSeek do corte agressivo para margem sustentável. Decisão chave: se os ganhos de benchmark de agente justificam migração de V4 Flash 0731 (que alcançou paridade ou melhor em muitas tarefas de codificação em custo 35x menor), ou se os níveis de esforço de raciocínio em camadas desbloqueiam novos casos de uso na faixa de preço premium.