AO VIVO · TER., 04 DE AGO. DE 2026 --:--:-- ET
Edição Nº 105 GASTO TOTAL $15058.97 ARTIGOS HOJE 3 TOKENS TOTAL 9.80B
aiexpert
Na linha
Chips Kioxia e SanDisk atingem densidade record de 3D NAND: 332 camadas, 37 Gb/mm², 4.800 MT/s I/O Research Alibaba Qwen 3.8-Max (2.4T) e Modelos 27B de Pesos Abertos Lançados; Visa Trabalho de Codificação e Agentico de Longo Horizonte Breaking Databricks Adere à Open Secure AI Alliance como Membro Fundador; Contribui com Meta-Harness Omnigent, Framework de Segurança DASF 3.0 Chips NVIDIA Abre Código das APIs cuFile para Acesso Direto GPU-para-Storage; Lança Iniciativa Storage-Next Chips Modelo de raciocíno aberto NVIDIA Alpamayo 2 Super agora disponível para implantação comercial de AV Funding Fundo Scaleup Europe de €5B da UE agora operacional; visa IA, quântica, energia limpa Market Texas para aprovações de 1.800 data centers; fila de 474 GW paralisa no aguardo de auditorias Breaking Hack Tata Electronics expõe segredos da cadeia de suprimentos Apple; riscos de pivot India em meio à competição da China Funding Fundo de Scaleup da UE de €5bn abre janela de investimento; Mistral, Exploration Company rumores de alvos Chips SanDisk & SK hynix revelam especificação HBF: memória GPU de 512GB a 3 TB/s de largura de banda via UCIe Market Texas paralisa 1.800 projetos de data center aguardando auditoria de energia; 474 GW de pedidos pendentes 5x pico Funding HappyRobot atinge status de unicórnio de $1,2B com Series C de $150M da Prysm & Eurazeo Funding Julho quebrou recordes de venture capital: 14 rodadas de bilhão de dólares, $65B de capital, 53% para IA Chips Kioxia e SanDisk atingem densidade record de 3D NAND: 332 camadas, 37 Gb/mm², 4.800 MT/s I/O Research Alibaba Qwen 3.8-Max (2.4T) e Modelos 27B de Pesos Abertos Lançados; Visa Trabalho de Codificação e Agentico de Longo Horizonte Breaking Databricks Adere à Open Secure AI Alliance como Membro Fundador; Contribui com Meta-Harness Omnigent, Framework de Segurança DASF 3.0 Chips NVIDIA Abre Código das APIs cuFile para Acesso Direto GPU-para-Storage; Lança Iniciativa Storage-Next Chips Modelo de raciocíno aberto NVIDIA Alpamayo 2 Super agora disponível para implantação comercial de AV Funding Fundo Scaleup Europe de €5B da UE agora operacional; visa IA, quântica, energia limpa Market Texas para aprovações de 1.800 data centers; fila de 474 GW paralisa no aguardo de auditorias Breaking Hack Tata Electronics expõe segredos da cadeia de suprimentos Apple; riscos de pivot India em meio à competição da China Funding Fundo de Scaleup da UE de €5bn abre janela de investimento; Mistral, Exploration Company rumores de alvos Chips SanDisk & SK hynix revelam especificação HBF: memória GPU de 512GB a 3 TB/s de largura de banda via UCIe Market Texas paralisa 1.800 projetos de data center aguardando auditoria de energia; 474 GW de pedidos pendentes 5x pico Funding HappyRobot atinge status de unicórnio de $1,2B com Series C de $150M da Prysm & Eurazeo Funding Julho quebrou recordes de venture capital: 14 rodadas de bilhão de dólares, $65B de capital, 53% para IA
Funding

Groq levanta $650M para cloud de inferência AI após deal de licenciamento de $20B de Nvidia

Startup de chip de inferência AI Groq anunciou uma rodada de financiamento de $650 milhões liderada por Disruptive e fundo de hedge Infinitum, marcando uma das maiores rodadas de infraestrutura AI de 2026. A arrecadação vem aproximadamente seis meses após Nvidia assinar um acordo de licenciamento não exclusivo para a arquitetura Language Processing Unit (LPU) de Groq em dezembro de 2025 e recrutar o CEO fundador de Groq Jonathan Ross e outros executivos-chave. Groq está pivotando do design de hardware para operar uma plataforma cloud para inferência, escalando para 200 megawatts de capacidade global até final de 2027.

Groq reconstruiu suas fileiras executivas para executar esse pivot: Alan Rice (ex-Meta, ex-xAI) entra como COO; Sinclair Schuller do TensorFlow entra como CTO próximo mês; Rakesh Malhotra entra como diretor de produto chefe. A empresa permanece como o único operador com experiência prática de executar LPUs em produção em escala através de 13 data centers operacionais. Novo capital vai financiar expansão de cluster GPU, distribuição geográfica, e contratação de engenharia de software empresarial para competir com jogadores neocloud como CoreWeave e Nebius bem como ofertas de inferência de hyperscaler.

A situação de Groq testa se expertise operacional e infraestrutura de produção importam mais do que IP de chip subjacente no mercado de inferência. Cargas de trabalho de inferência agora representam aproximadamente dois-terços de toda computador AI (acima de um-terço em 2023), impulsionando demanda explosiva por infraestrutura especializada. Mas Nvidia agora detém licenciamento não exclusivo da arquitetura LPU e já enviou sua própria plataforma de inferência LPX baseada em designs de Groq. Para praticantes: observe se o prêmio de serviço de inferência gerenciado de Groq (reclamado em ~30% de equivalentes de código fechado) sustenta uma vez mais provedores ganham acesso aos sistemas LPX. Expectativa de linha de base é que fragmentação de neocloud acelera através de 2027.

Fontes