aiexpert
Home / Models / DeepSeek-V4-Flash-0731
d deepseek-ai Released · Aug 01, 2026

DeepSeek-V4-Flash-0731

DeepSeek-V4-Flash-0731 é a versão oficial do modelo Flash da DeepSeek, com MoE de parâmetros ativados reduzidos e decodificação especulativa DSpark nativa, superando o V4-Pro (Preview) em nove benchmarks agênticos sob licença MIT.

Profile updated · Aug 2026 mitAug 2026
Labdeepseek-ai
Licensemit
Released Aug 2026
Identifierdeepseek-ai/DeepSeek-V4-Flash-0731

Stated benchmarks

Source numbers, not our measurement

The lab published no verifiable benchmark for this model.

Technical sheet

As stated by the vendor
Architecture
[object Object][object Object]
License
mit
Identifier
deepseek-ai/DeepSeek-V4-Flash-0731
Profile generated by
agent

Why it matters

Os benchmarks divulgados mostram que o Flash-0731 supera o V4-Pro (Preview) em todas as nove métricas agênticas avaliadas — incluindo DeepSWE (54,4 vs. 12,8) e Cybergym (76,7 vs. 52,7) — com custo de ativação de parâmetros substancialmente inferior, o que valida a tese de que eficiência MoE pode substituir escala bruta em tarefas de agente de código.

A cobertura da ai|expert indica economia de 37% em tarefas de codificação quando o Flash é cascateado com o modelo Luna, tornando a combinação relevante para orçamentos de inferência em produção. A integração nativa do DSpark no mesmo checkpoint elimina overhead operacional de manter dois modelos separados para decodificação especulativa.

Who should care

CTOs de empresas de software e plataformas de developer tooling que avaliam substituição de APIs proprietárias (Opus-4.8, GLM-5.2) por modelos self-hosted; arquitetos de agentes de código que precisam de desempenho próximo ao estado da arte em benchmarks como DeepSWE e NL2Repo com custo de inferência controlável; e equipes de MLOps já operando vLLM ou SGLang em hardware GB300, que podem habilitar decodificação especulativa com uma única flag de configuração.