AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14871.42 ARTIGOS HOJE 9 TOKENS TOTAL 9.57B
aiexpert
Na linha
Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20%
Chips

Google desenvolve chip Frozen v2 para codificar arquitetura Gemini em silício; almeja eficiência de inferência 6–10x até 2028

Google está desenvolvendo "Frozen v2", um chip específico de inferência que incorpora a arquitetura de rede neural de Gemini diretamente em silício, de acordo com fontes citadas pela The Information em 20 de julho. O chip é projetado para entregar 6 a 10 vezes mais tokens por watt do que a geração atual de Tensor Processing Units do Google (TPU 8i), com implantação alvo já em 2028. Diferente dos aceleradores de propósito geral de NVIDIA ou da linha TPU do Google, Frozen v2 codificará a lógica estrutural de Gemini na circuiteria do chip, eliminando sobrecarga de tempo de execução para decisões arquiteturais.

O design muda de um conceito anterior "totalmente codificado" que teria congelado pesos do modelo (tornando o chip obsoleto a cada atualização de modelo) para uma abordagem "codificada flexível" que bloqueia apenas a fundação arquitetural estável. Isso preserva ganhos de eficiência arquitetural mantendo um ciclo de vida de chip de múltiplos anos. O gargalo de computação interno do Google impulsionou o projeto; a empresa enfrenta sérios gargalos ao servir Gemini na escala necessária para cargas de trabalho atuais e planejadas.

Frozen v2 é posicionado como uma faixa paralela à linha TPU de propósito geral do Google, não como substituto. Uma aposta de $2 bilhões em capex sem cronograma confirmado, o projeto troca versatilidade por especialização extrema—uma aposta de que a estrutura transformer de Gemini permanece estável até 2028 e além. Se Gemini sofrer revisão arquitetural importante (p.ex., mudança para modelos de espaço de estado), o hardware poderia se tornar parcialmente obsoleto.

Para planejadores de infraestrutura: o movimento do Google sinaliza uma mudança mais ampla em direção a silício específico de modelo sobre aceleradores de propósito geral. Competidores sem integração vertical equivalente—incluindo provedores de nuvem dependentes de NVIDIA—enfrentam pressão de margem se Frozen v2 atingir produção e baixar o custo de atendimento de Gemini. Observe os ganhos Q2 da Alphabet (22 de julho) e qualquer divulgação pública sobre o status do projeto.

Fontes