AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14871.42 ARTIGOS HOJE 9 TOKENS TOTAL 9.57B
aiexpert
Na linha
Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20%
Market

AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória

A AWS aumentou os preços horaérios de suas instâncias GPU mais poderosas em 20% a partir de 1º de julho de 2026, com P6-B300 agora em $14,04/hora, P6-B200 em $12,36/hora e P5 em $5,19/hora. Este é o segundo aumento de preço GPU da AWS em 2026, seguindo um aumento de 15% no início do ano, trazendo aumentos cumulativos para aproximadamente 38% em seis meses. Para um trabalho de treinamento de 32-GPU em instâncias P6-B200 por duas semanas, a conta saltou de ~$99,5K para $119,4K antes de descontos.

Os custos de memória estão impulsionando os aumentos: os preços spot de DRAM e GDDR6 aproximadamente triplicaram desde o final de 2025 conforme os data centers de IA consomem a maioria do suprimento de memória global. AMD aumentou os preços do kit de memória GDDR em 10% em julho de 2026 (segundo aumento em seis meses), e os contratos de preço fixo de longo prazo que isolaram os fabricantes de GPU até 2025 agora expiraram com as renovações de 2026 chegando a taxas significativamente mais altas. Os consumidores de gamers estão pagando danos colaterais: RTX 5090s estão sendo vendidos em $2,9-5K (50% acima do MSRP), e a memória agora representa 80%+ da conta de um GPU.

Para arquitetos: o aumento de 20% da AWS se aplica apenas aos mercados on-demand e spot; clientes de instância reservada e contrato de médio/longo prazo NÃO veem esses aumentos, ampliando a bifurcação entre labs apoiados por hiperscalers (Apple, Meta, OpenAI a taxas negociadas) e labs menores comprando por hora. CME e ICE estão lançando contratos de futuros de GPU em 2026 para permitir hedge nessa camada spot volátil. A restrição estrutural é o suprimento de memória: a nova capacidade da Micron e SK Hynix não chegará ao volume até 2027-2028, portanto, o alivír de preço é improvável antes disso.

Fontes