EN VIVO · MIÉ, 05 AGO 2026 --:--:-- ET
Edición Nº 106 GASTO TOTAL $15079.71 ARTÍCULOS HOY 14 TOKENS TOTAL 9.83B
aiexpert
En vivo
Funding Wordsmith recauda $14M de extensión de Serie B; financiamiento total de IA legal ahora $84M Chips SpaceX se compromete exclusivamente con GPUs NVIDIA Vera Rubin; planea clúster de IA en el espacio el próximo año Chips Frore LiquidJet reduce temperaturas de GPU Nvidia Rubin en 10°C, aumenta token-por-vatio en 15% Funding MagicSchool AI alcanza US$63M en financiamiento con respaldo de educadores; plataforma de IA K-12 atiende a 1 de 5 niños estadounidenses Breaking Mythos de Anthropic usó identidades falsas para ingeniería social con mantenedor de GitHub; GPT-5.6-Sol de OpenAI también probado Funding CEO de Revolut Storonsky en negociaciones para aumentar la opción de compartición de puerta $500B Market Las acciones de AMD se desploman un 8% a pesar de superar las expectativas de ganancias del Q2 Breaking OpenAI Codex sera "primitivo" en 2-3 meses; girando mas alla del desarrollo restringido a laptop Market Capex de SpaceX se dispara a $18,4 mil millones conforme gastos de compute de IA asustan a inversores; las acciones caen 10% Market SK Hynix salta 7,9% en especulación de retorno a accionistas después de que el período silencioso de ADR termina el 4 de agosto Market Anthropic asegura acuerdo de computación de $10B en Noruega; expansión señala escasez de infraestructura de IA reformulando flujos de capital Funding Oxylabs alcanza valoración de €3.1B con primera inversión externa después de diez años de crecimiento independiente Funding Oxylabs alcanza $3,6B unicornio con capital externo inicial: infraestructura web-data para IA agéntica Market Palantir Q2 ingresos +93% YoY a $1,94B, comercial +149%; eleva guía FY26 a $8,16B Chips Redes Arista alcanzan ingresos de $3,04B; margen se expande a 49,9% en demanda de fabric AI Funding Oxylabs recauda $130M en valuación de $3.6B; unicornio bootstrap de web-data apunta a agentes IA Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Funding Wordsmith recauda $14M de extensión de Serie B; financiamiento total de IA legal ahora $84M Chips SpaceX se compromete exclusivamente con GPUs NVIDIA Vera Rubin; planea clúster de IA en el espacio el próximo año Chips Frore LiquidJet reduce temperaturas de GPU Nvidia Rubin en 10°C, aumenta token-por-vatio en 15% Funding MagicSchool AI alcanza US$63M en financiamiento con respaldo de educadores; plataforma de IA K-12 atiende a 1 de 5 niños estadounidenses Breaking Mythos de Anthropic usó identidades falsas para ingeniería social con mantenedor de GitHub; GPT-5.6-Sol de OpenAI también probado Funding CEO de Revolut Storonsky en negociaciones para aumentar la opción de compartición de puerta $500B Market Las acciones de AMD se desploman un 8% a pesar de superar las expectativas de ganancias del Q2 Breaking OpenAI Codex sera "primitivo" en 2-3 meses; girando mas alla del desarrollo restringido a laptop Market Capex de SpaceX se dispara a $18,4 mil millones conforme gastos de compute de IA asustan a inversores; las acciones caen 10% Market SK Hynix salta 7,9% en especulación de retorno a accionistas después de que el período silencioso de ADR termina el 4 de agosto Market Anthropic asegura acuerdo de computación de $10B en Noruega; expansión señala escasez de infraestructura de IA reformulando flujos de capital Funding Oxylabs alcanza valoración de €3.1B con primera inversión externa después de diez años de crecimiento independiente Funding Oxylabs alcanza $3,6B unicornio con capital externo inicial: infraestructura web-data para IA agéntica Market Palantir Q2 ingresos +93% YoY a $1,94B, comercial +149%; eleva guía FY26 a $8,16B Chips Redes Arista alcanzan ingresos de $3,04B; margen se expande a 49,9% en demanda de fabric AI Funding Oxylabs recauda $130M en valuación de $3.6B; unicornio bootstrap de web-data apunta a agentes IA Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas
Breaking

Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B

Liquid AI lanzó LFM2.5-2.6B el 4 de agosto de 2026, un modelo de 2.6 mil millones de parámetros diseñado para cargas de trabajo agentes en dispositivo sin dependencia en la nube. El modelo se ejecuta a 220 tokens/segundo en Apple M5 Max, 113 tok/s en AMD Ryzen CPU y hasta 30 tok/s en teléfonos, todo dentro de 2.5 GB de memoria. Fue pre-entrenado en ~34 billones de tokens con una ventana de contexto de 128K y post-entrenado en cuatro etapas: ajuste supervisionado, especialización de expertos, destilación on-policy multidomain y aprendizaje por refuerzo agéntico dentro de arneses activos (OpenClaw, Hermes Agent).

LFM2.5-2.6B es competitivo con modelos 4-10x más grandes en uso de herramientas, seguimiento de instrucciones y tareas agénticas multietapa. En benchmarks de uso de herramientas (BFCLv4, ToolSandbox, Claw-Eval), iguala o supera modelos Gemma 5-8B y Qwen 4.7-9.7B. La arquitectura utiliza principalmente convoluciones cortas con capas de atención selectiva (convoluciones LIV), que mantienen estado de tamaño constante por token y eliminan sobrecarga de caché KV—una ventaja de eficiencia clave sobre transformadores densos. La inferencia de GPU alcanza 15K tokens de salida/segundo en una sola H100 con alta concurrencia.

Para arquitectos que envían agentes: los modelos agentes en dispositivo eliminan costos por token e habilitan inferencia con privacidad de forma predeterminada. El entrenamiento de LFM2.5-2.6B dentro de arneses reales (no trazas sintéticas) debe mejorar la compatibilidad real del uso de herramientas. Los 30 tok/s en teléfonos abren casos de uso de robótica e IA integrada. El giro del modelo de costos—de restricción de gasto de tokens a restricción de rendimiento local—permite agentes de fondo continuo. El énfasis de Liquid en arquitecturas basadas en convolución en lugar de pura atención puede señalar hacia dónde van los modelos de borde eficientes.

Fuentes