Google lançou Gemini 3.6 Flash em 21 de julho de 2026 como seu modelo workhorse para agentic coding, trabalho conhecimento, e tarefas multimodal. Preço token output caiu de $9.00 para $7.50 por milhão (entrada mantida em $1.50), e o modelo consome 17% menos output tokens por tarefa que Gemini 3.5 Flash no Índice Artificial Analysis, alcançando ganhos eficiência 65% em benchmarks agentic específicos como DeepSWE. O corte preço adesivo combinado mais eficiência token se compõe para redução custo efetivo 31% por tarefa completada, com até 71% poupança em workloads agentic coding.
Google também enviou Gemini 3.5 Flash-Lite em $0.30/$2.50 por milhão tokens para tarefas alto-throughput e anunciou Gemini 3.5 Flash Cyber, modelo tuned-segurança restrito acesso governo e parceiros. Corte conhecimento Mço 2026 representa avanço 14 meses sobre 3.5 Flash janeiro 2025 data. Em benchmarks agentic aplicados, 3.6 Flash ganhou terreno: DeepSWE melhorou 37% para 49%, MLE Bench 49.7% para 63.9%, OSWorld computer-use 78.4% para 83.0%.
Contudo, Índice Artificial Analysis Intelligence independente, Gemini 3.6 Flash pontua exatamente 50—inalterado 3.5 Flash. Isto eficiência release, não salto capacidade. O modelo negocia razão bruta poder eficiência token e latência menor, otimizando econômica específica workflows agentic em vez razão profundidade fronteira. Artificial Analysis independentemente mediu tempo completão tarefa média caindo 2.7 minutos 1.3 minutos e custo médio tarefa $0.59 para $0.50.
Notably ausente: Gemini 3.5 Pro permanece teste de parceiro sem data disponição pública, tendo perdido promessa I/O maio 2026 e alvo posterior junho. Enquanto Google envia três modelos, flagship 3.5 geração é travado. Pré-treino Gemini 4 iniciado e enviará depois. Para equipes executando inferência agentic alto-volume, preço 3.6 Flash e ganhos eficiência importam; para aqueles avaliando capacidade flagship, linha entrega Google continua atraso Anthropic OpenAI.