aiexpert
Início / Notícias / Nota
Market · 07 de ago. de 2026, 07:05 · 6 fontes

DeepSeek V4 Flash custa 3 centavos por teste de benchmark, subcuta rivais em 100x

DeepSeek V4 Flash, lançado em 1º de agosto de 2026, custa aproximadamente 3 centavos por teste do Índice de Inteligência de Análise Artificial—o modelo mais barato conhecido em um fator de 30. Moonshot Kimi K3 custa 86 centavos por teste, GPT-5.6 Sol da OpenAI $1,86, e Claude Fable 5 da Anthropic $3,15. O preço publicado fica em $0,14 por milhão de tokens de entrada e $0,28 por milhão de tokens de saída. V4 Flash pontua 50 no Índice de Inteligência, correspondendo ao Google Gemini 3.6 Flash e colocando-o um ponto atrás do Muse Spark 1.1 do Meta, mas bem abaixo dos modelos de fronteira Claude Opus 5 (61), Claude Fable 5 (60) e GPT-5.6 Sol (59).

O modelo é uma Mistura de Especialistas com 284 bilhões de parâmetros totais e 13 bilhões ativados, suportando uma janela de contexto de 1 milhão de tokens. Uma atualização pós-treinamento de 31 de julho impulsionou um salto massivo: DeepSeek V4 Flash pontua 54% em benchmarks de codificação agentic (DeepSWE), acima de 7% na versão de visualização. Em Terminal Bench 2.1, pontua 82,7%, superando o V4-Pro-Preview mais pesado em 72,1%—uma reversão em que o modelo orçamentário da DeepSeek supera seu irmão premium. O modelo está disponível via API da DeepSeek com um novo checkpoint V4-Flash-0731; os pesos estão abertos sob Licença MIT no Hugging Face.

Para praticantes, V4 Flash reescreve a economia de unidade de implantações agentic de alto volume. Aos preços atuais de tokens e o benchmark de custo por teste, torna-se o padrão para assistentes de codificação, geração aumentada de recuperação e loops de agentes onde a taxa de transferência importa mais do que raciocínio de fronteira. A recente arrecadação de $7 bilhões da DeepSeek dá ao lançador da empresa espaço para sustentar preços agressivos conforme outros laboratórios cortam taxas. O compõe é claro: modelos de fronteira ficam à frente em raciocínio e trabalho agentic de longo horizonte, mas a lacuna para V4 Flash agora é pequena o suficiente para que roteamento, cache e lote—não escolha de modelo—se tornem a alavanca de custo.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source qz.com
  2. 02 qz.com qz.com “research firm Artificial Analysis found it is the least expensive well-known AI model to run globally — costing roughly 3 cents per benchmark test compared with 86 cents for Moonshot AI's Kimi K3, $1.86 for OpenAI's GPT-5.6 Sol, and $3.15 for Anthropic's Claude Fable 5”
  3. 03 thenextweb.com thenextweb.com “Artificial Analysis says DeepSeek's V4-Flash costs about three cents to run through its benchmark suite, by far the cheapest big-name model.”
  4. 04 flowtivity.ai flowtivity.ai “DeepSeek V4-Flash just scored 82.7 on Terminal Bench 2.1, beating V4-Pro-Preview by 14.7%.”
  5. 05 thenextweb.com thenextweb.com “The company recently closed its first outside funding, a round of more than $7bn, which buys room to subsidise aggressive pricing while it takes share.”
  6. 06 openrouter.ai openrouter.ai “DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window.”