EN VIVO · MIÉ, 05 AGO 2026 --:--:-- ET
Edición Nº 106 GASTO TOTAL $15079.74 ARTÍCULOS HOY 14 TOKENS TOTAL 9.83B
aiexpert
En vivo
Funding Wordsmith recauda $14M de extensión de Serie B; financiamiento total de IA legal ahora $84M Chips SpaceX se compromete exclusivamente con GPUs NVIDIA Vera Rubin; planea clúster de IA en el espacio el próximo año Chips Frore LiquidJet reduce temperaturas de GPU Nvidia Rubin en 10°C, aumenta token-por-vatio en 15% Funding MagicSchool AI alcanza US$63M en financiamiento con respaldo de educadores; plataforma de IA K-12 atiende a 1 de 5 niños estadounidenses Breaking Mythos de Anthropic usó identidades falsas para ingeniería social con mantenedor de GitHub; GPT-5.6-Sol de OpenAI también probado Funding CEO de Revolut Storonsky en negociaciones para aumentar la opción de compartición de puerta $500B Market Las acciones de AMD se desploman un 8% a pesar de superar las expectativas de ganancias del Q2 Breaking OpenAI Codex sera "primitivo" en 2-3 meses; girando mas alla del desarrollo restringido a laptop Market Capex de SpaceX se dispara a $18,4 mil millones conforme gastos de compute de IA asustan a inversores; las acciones caen 10% Market SK Hynix salta 7,9% en especulación de retorno a accionistas después de que el período silencioso de ADR termina el 4 de agosto Market Anthropic asegura acuerdo de computación de $10B en Noruega; expansión señala escasez de infraestructura de IA reformulando flujos de capital Funding Oxylabs alcanza valoración de €3.1B con primera inversión externa después de diez años de crecimiento independiente Funding Oxylabs alcanza $3,6B unicornio con capital externo inicial: infraestructura web-data para IA agéntica Market Palantir Q2 ingresos +93% YoY a $1,94B, comercial +149%; eleva guía FY26 a $8,16B Chips Redes Arista alcanzan ingresos de $3,04B; margen se expande a 49,9% en demanda de fabric AI Funding Oxylabs recauda $130M en valuación de $3.6B; unicornio bootstrap de web-data apunta a agentes IA Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Funding Wordsmith recauda $14M de extensión de Serie B; financiamiento total de IA legal ahora $84M Chips SpaceX se compromete exclusivamente con GPUs NVIDIA Vera Rubin; planea clúster de IA en el espacio el próximo año Chips Frore LiquidJet reduce temperaturas de GPU Nvidia Rubin en 10°C, aumenta token-por-vatio en 15% Funding MagicSchool AI alcanza US$63M en financiamiento con respaldo de educadores; plataforma de IA K-12 atiende a 1 de 5 niños estadounidenses Breaking Mythos de Anthropic usó identidades falsas para ingeniería social con mantenedor de GitHub; GPT-5.6-Sol de OpenAI también probado Funding CEO de Revolut Storonsky en negociaciones para aumentar la opción de compartición de puerta $500B Market Las acciones de AMD se desploman un 8% a pesar de superar las expectativas de ganancias del Q2 Breaking OpenAI Codex sera "primitivo" en 2-3 meses; girando mas alla del desarrollo restringido a laptop Market Capex de SpaceX se dispara a $18,4 mil millones conforme gastos de compute de IA asustan a inversores; las acciones caen 10% Market SK Hynix salta 7,9% en especulación de retorno a accionistas después de que el período silencioso de ADR termina el 4 de agosto Market Anthropic asegura acuerdo de computación de $10B en Noruega; expansión señala escasez de infraestructura de IA reformulando flujos de capital Funding Oxylabs alcanza valoración de €3.1B con primera inversión externa después de diez años de crecimiento independiente Funding Oxylabs alcanza $3,6B unicornio con capital externo inicial: infraestructura web-data para IA agéntica Market Palantir Q2 ingresos +93% YoY a $1,94B, comercial +149%; eleva guía FY26 a $8,16B Chips Redes Arista alcanzan ingresos de $3,04B; margen se expande a 49,9% en demanda de fabric AI Funding Oxylabs recauda $130M en valuación de $3.6B; unicornio bootstrap de web-data apunta a agentes IA Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas
Research

Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM

Meta publicó el 3 de agosto de 2026 detalles de ingeniería sobre cómo duplicó la eficiencia de entrenamiento end-to-end de su Generative Ads Recommendation Model (GEM) a 20-25% Model FLOPs Utilization (MFU) mientras escala 4x entrenamiento FLOPs en 12 meses. GEM es el modelo de fundación más grande para sistemas de recomendación jamás construido, entrenado a escala LLM en miles de GPUs. El modelo alimenta recomendaciones de anuncios en Facebook e Instagram y ha entregado elevación de conversión del 5% en Instagram y 3% en Facebook Feed desde el lanzamiento, con ganancias Q3 doblándose en relación a Q2.

El entrenamiento GEM presenta desafíos únicos no encontrados en cargas de trabajo LLM: longitudes de secuencia altamente variables (el historial de actividad del usuario varía de cientos a decenas de miles de tokens), patrones asimétricos de atención (historial de secuencia larga, ventanas de interacción anuncio-usuario cortas) y operaciones dispersas ligadas a memoria. Meta construyó kernels de GPU personalizados—Jagged Flash Attention (JFA), Generalized Dot-Product Attention (GDPA), BlockAttention—que operan directamente en tensores jagged y entrenamiento de precisión ultra baja mixta (MXFP8) afinado para cargas de trabajo de recomendación. Un esquema de paralelismo 5D consciente de topología con colectivos sin SM co-diseñado alrededor de la jerarquía de red multinivel de Meta redujo la sobrecarga de comunicación.

Para constructores de infra: el resultado es transferible. La prueba de Meta de que los modelos a escala de recomendación pueden seguir leyes de eficiencia similares a LLM (si codiña kernels + precisión + paralelismo juntos) se aplica a cualquier modelo de fundación heterogénea que combine incrustaciones dispersas con transformadores densos. El escalado 4x FLOP en 12 meses y MFU duplicado muestran que la innovación a nivel de sistema puede desbloquear ganancias de eficiencia comparables a avances a nivel de arquitectura—relevante para equipos que entrenan modelos multitarea o multimodales a escala.

Fuentes