aiexpert
Início / Notícias / Nota
Research · 18 de ago. de 2026, 16:33 · 4 fontes

DeepSeek lança V4-Pro GA: otimizado para agentes, contexto 1M, preço de pico $3,96/M output tokens

DeepSeek GA'd DeepSeek-V4-Pro-0813 em 13 de agosto após uma fase de prévia de quatro meses, otimizando para tarefas de IA agentic: uso de ferramentas, execução de código e fluxos de trabalho multi-etapas. O modelo alcançou 87,9 em Terminal Bench 2.1, 62,7 em DeepSWE (engenharia de software) e 61,5 em NL2Repo. Suporta contexto de 1M-token com saídas de até 384K-token, modos de think e non-thinking duais e três níveis de esforço configuráveis (low/high/max). O acesso à API está em tempo real; os preços escalam de taxa de $0,87/M output tokens para $3,96/M em horas de pico (16 de agosto), com descontos de 50% fora do pico.

O lançamento de disponibilidade geral marca uma mudança estratégica em relação à prévia de abril, que foi superada pelo próprio modelo mais barato DeepSeek V4-Flash em alguns testes independentes—um resultado incomum que criou momento inicial para Flash. Com o GA 0813, DeepSeek agora está precificando V4-Pro em 14× o custo de output de Flash ($3,96 vs $0,28) enquanto alega melhorias substanciais de agentes em cargas de trabalho de produção. A empresa também anunciou suporte ao formato de API OpenAI, integração Codex e compatibilidade nativa com API de Respostas, posicionando o modelo para fluxos de trabalho agentic empresariais.

Para construtores, a relevância está no roteamento de custo-versus-capacidade: Together AI benchmarked a cascata (execute Pro primeiro, escale para GPT-5.6 Sol em falha de teste) em $3,35 por tarefa resolvida—superando Sol sozinho (72,7% pass@1) por menos da metade do preço por tarefa. Em 1/35 do custo unitário de GPT-5.6 Sol e com cobertura forte de agente agentic em benchmarks abertos (80,6% em SWE-Bench Verified), DeepSeek V4-Pro está forçando um repricing fundamental da economia de coding-agent.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source qz.com
  2. 02 qz.com qz.com “DeepSeek-V4-Pro-0813 focuses on agent capabilities — tasks where AI systems use tools, execute code, and complete multi-step workflows. Benchmark results: 87.9 on Terminal Bench 2.1, 62.7 on DeepSWE, 61.5 on NL2Repo.”
  3. 03 qz.com qz.com “V4-Pro output tokens rising to $3.96 per million at peak hours from the current flat rate of $0.87 per million. Even at the new peak rates, DeepSeek's prices remain below Anthropic's Fable 5 at $50 per million output tokens.”
  4. 04 huggingface.co huggingface.co “Structera X (memory expansion) and Structera A (near-memory compute) are already shipping. The 1M-token context supports up to 384,000-token outputs with thinking/non-thinking modes.”