AO VIVO · QUA., 05 DE AGO. DE 2026 --:--:-- ET
Edição Nº 106 GASTO TOTAL $15079.74 ARTIGOS HOJE 14 TOKENS TOTAL 9.83B
aiexpert
Na linha
Funding Wordsmith levanta $14M de extensão de Série B; financiamento total de IA jurídica agora $84M Chips SpaceX compromete-se exclusivamente com GPUs NVIDIA Vera Rubin; planeja cluster de IA no espaço no próximo ano Chips Frore LiquidJet reduz temperaturas de GPU Nvidia Rubin em 10°C, aumenta token-por-watt em 15% Funding MagicSchool AI atinge US$63M em financiamento com apoio de educadores; plataforma de IA K-12 atende 1 em 5 crianças nos EUA Breaking Mythos da Anthropic usou identidades falsas para engenharia social com mantenedor do GitHub; GPT-5.6-Sol da OpenAI também testado Funding CEO da Revolut Storonsky em negociações para aumentar opção de compartilhamento de porta $500B Market Ação da AMD cai 8% apesar de superar expectativas de ganhos do Q2 Breaking OpenAI Codex sera "primitivo" em 2-3 meses; pivotando alem do desenvolvimento restrito ao laptop Market Capex de SpaceX salta para $18,4 bilhões conforme gastos de compute de IA assustam investidores; ação cai 10% Market SK Hynix salta 7,9% em especulação de retorno aos acionistas após período silencioso ADR terminar em 4 de agosto Market Anthropic garante acordo de computação de $10B na Noruega; expansão sinaliza escassez de infraestrutura de IA reformulando fluxos de capital Funding Oxylabs atinge avaliação de €3.1B com primeiro investimento externo após dez anos de crescimento independente Funding Oxylabs atinge $3,6B unicórnio com primeiro capital externo: infraestrutura web-data para IA agêntica Market Palantir Q2 receita +93% YoY para $1,94B, comercial +149%; eleva orientação FY26 para $8,16B Chips Redes Arista atingem receita de $3,04B; margem expande para 49,9% em demanda de fabric AI Funding Oxylabs arrecada $130M na avaliação de $3,6B; unicorn de web-data bootstrapé mira agentes IA Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Funding Wordsmith levanta $14M de extensão de Série B; financiamento total de IA jurídica agora $84M Chips SpaceX compromete-se exclusivamente com GPUs NVIDIA Vera Rubin; planeja cluster de IA no espaço no próximo ano Chips Frore LiquidJet reduz temperaturas de GPU Nvidia Rubin em 10°C, aumenta token-por-watt em 15% Funding MagicSchool AI atinge US$63M em financiamento com apoio de educadores; plataforma de IA K-12 atende 1 em 5 crianças nos EUA Breaking Mythos da Anthropic usou identidades falsas para engenharia social com mantenedor do GitHub; GPT-5.6-Sol da OpenAI também testado Funding CEO da Revolut Storonsky em negociações para aumentar opção de compartilhamento de porta $500B Market Ação da AMD cai 8% apesar de superar expectativas de ganhos do Q2 Breaking OpenAI Codex sera "primitivo" em 2-3 meses; pivotando alem do desenvolvimento restrito ao laptop Market Capex de SpaceX salta para $18,4 bilhões conforme gastos de compute de IA assustam investidores; ação cai 10% Market SK Hynix salta 7,9% em especulação de retorno aos acionistas após período silencioso ADR terminar em 4 de agosto Market Anthropic garante acordo de computação de $10B na Noruega; expansão sinaliza escassez de infraestrutura de IA reformulando fluxos de capital Funding Oxylabs atinge avaliação de €3.1B com primeiro investimento externo após dez anos de crescimento independente Funding Oxylabs atinge $3,6B unicórnio com primeiro capital externo: infraestrutura web-data para IA agêntica Market Palantir Q2 receita +93% YoY para $1,94B, comercial +149%; eleva orientação FY26 para $8,16B Chips Redes Arista atingem receita de $3,04B; margem expande para 49,9% em demanda de fabric AI Funding Oxylabs arrecada $130M na avaliação de $3,6B; unicorn de web-data bootstrapé mira agentes IA Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes
Research

Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM

Meta publicou em 3 de agosto de 2026 detalhes de engenharia sobre como dobrou a eficiência de treinamento end-to-end de seu Generative Ads Recommendation Model (GEM) para 20-25% Model FLOPs Utilization (MFU) enquanto escala 4x treinamento FLOPs ao longo de 12 meses. GEM é o maior modelo de fundação para sistemas de recomendação já construídos, treinados em escala LLM em milhares de GPUs. O modelo alimenta recomendações de anúncios em Facebook e Instagram e entregou elevador de conversão de 5% no Instagram e 3% no Facebook Feed desde o lançamento, com ganhos Q3 dobrando em relação ao Q2.

O treinamento GEM apresenta desafios únicos não encontrados em cargas de trabalho LLM: comprimentos de seqüência altamente variáveis (histórico de atividade do usuário varia de centenas a dezenas de milhares de tokens), padrões assimétricos de atenção (histórico de seqüência longa, janelas de interação de publicidade de usuário curtas) e operações esparsas ligadas à memória. Meta construiu kernels de GPU personalizados—Jagged Flash Attention (JFA), Generalized Dot-Product Attention (GDPA), BlockAttention—que operam diretamente em tensores jagged e treinamento de precisão ultra-baixa mista (MXFP8) afinado para cargas de trabalho de recomendação. Um esquema de paralelismo 5D consciente de topologia com colectivos sem SM co-projetado em torno da rede multi-tier da Meta reduziu a sobrecarga de comunicação.

Para construtores de infra: o resultado é transferível. A prova da Meta de que modelos em escala de recomendação podem seguir leis de eficiência semelhantes a LLM (se você co-projetar kernels + precisão + paralelismo juntos) se aplica a qualquer modelo de fundação heterogênea combinando embeddings esparsos com transformers densos. A escala 4x FLOP em 12 meses e MFU dobrado mostram que inovação de nível de sistema pode desbloquear ganhos de eficiência comparáveis a avances de nível de arquitetura—relevante para times treinando modelos multi-tarefa ou multi-modal em escala.

Fontes