AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14871.42 ARTIGOS HOJE 9 TOKENS TOTAL 9.57B
aiexpert
Na linha
Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20%
Research

Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes

Google lançou três novos modelos Gemini em 21 de julho: Gemini 3.6 Flash como o principal cavalo de batalha, Gemini 3.5 Flash-Lite para inferência de alto volume, e Gemini 3.5 Flash Cyber para descoberta de vulnerabilidades controlada. O anúncio marca uma mudança de ganhos de capacidade bruta para otimização de eficiência de token e custo para cargas de trabalho agentes de produção.

Gemini 3.6 Flash reduz o uso de tokens de saída em 17% em comparação com 3.5 Flash no Índice de Análise Artificial, com alguns benchmarks como Datacurve DeepSWE mostrando reduções de até 65%. O modelo é precificado em $1.50/1M tokens de entrada e $7.50/1M tokens de saída, abaixo de $9/1M saída do Flash 3.5. Leva menos passos de raciocínio e chamadas de ferramentas para realizar fluxos de trabalho multi-etapas, tornando-o mais econômico por tarefa de agente concluída.

Em benchmarks de codificação e trabalho de conhecimento, 3.6 Flash marca 49% em DeepSWE versus 37% para 3.5 Flash, 63.9% em MLE Bench versus 49.7%, e 83% em uso de computador OSWorld-Verified versus 78.4%. A data de corte de conhecimento avança de janeiro de 2025 para março de 2026. 3.5 Flash-Lite visa tarefas de alto throughput em 350 tokens de saída/segundo e preços de $0.30/$2.50, enquanto 3.5 Flash Cyber (restrito a governos e parceiros confiáveis) lida com correlação de vulnerabilidade a um custo de token mais baixo do que modelos maiores.

Para construtores, Gemini 3.6 Flash é mais barato que GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max em preço por tarefa, sinalizando a mudança do Google para econômica de agentes sobre posicionamento de leaderboard. O lançamento ocorre enquanto o flagship 3.5 Pro do Google permanece em testes com parceiros, com pré-treinamento Gemini 4 já em andamento. Para arquitetos, os ganhos de eficiência de token e reduções de custo tornam 3.6 Flash competitivo para cargas de trabalho de agentes de alto volume, embora as tradeoffs de profundidade de raciocínio versus latência permaneçam importantes para seleção de aplicação.

Fontes