AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14867.95 ARTIGOS HOJE 8 TOKENS TOTAL 9.57B
aiexpert
Na linha
Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4 Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4
Chips

NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86

A NVIDIA detalhou sua CPU Vera na GTC terça-feira, revelando um design baseado em Arm de 88 cores com 176 threads usando Spatial Multithreading proprietário. O chip é engenheiro para workloads de IA com agentes—onde CPUs orquestram chamadas de ferramentas, execução de código e concorrência de sandbox—e afirma 1,5x melhor desempenho por sandbox e 1,8x maior throughput de agentes do que competidores x86 (Intel Xeon, AMD EPYC). Vera está entrando em produção completa com entregas já enviadas para OpenAI, Anthropic e SpaceX em junho.

Ao contrário de Intel e AMD, que focalizaram designs de CPU em contagem bruta de cores para workloads paralelos, NVIDIA otimizou Vera para velocidade de core único, largura de banda de memória e latência. O chip consome 250–450 watts e suporta até 1,5 terabytes de memória de baixa potência por socket. Benchmarks Phoronix mostraram Vera 11% mais rápido que o EPYC mais recente da AMD e 55% mais rápido que o melhor Xeon de socket único da Intel em um subconjunto de carga de trabalho curado. A Wolfe Research estima preço médio de venda de $5.000 e entregas de 1,3 milhão de unidades em 2026.

Vera abre um mercado de CPU de servidor de $200 bilhões que NVIDIA nunca abordou. A CFO da NVIDIA Colette Cress disse que a empresa espera $20 bilhões em receita de CPU Grace e Vera em FY2027, potencialmente tornando NVIDIA o maior fornecedor de CPU do mundo por receita. Para arquitetos, Vera reduz o gargalo da camada de CPU que trava GPUs caras aguardando orquestração de agentes, tornando-a crítica para aprendizado por reforço, inferência com agentes e stacks de geração de código onde densidade de tokens depende de latência da CPU.

Fontes