AO VIVO · QUA., 05 DE AGO. DE 2026 --:--:-- ET
Edição Nº 106 GASTO TOTAL $15079.71 ARTIGOS HOJE 14 TOKENS TOTAL 9.83B
aiexpert
Na linha
Funding Wordsmith levanta $14M de extensão de Série B; financiamento total de IA jurídica agora $84M Chips SpaceX compromete-se exclusivamente com GPUs NVIDIA Vera Rubin; planeja cluster de IA no espaço no próximo ano Chips Frore LiquidJet reduz temperaturas de GPU Nvidia Rubin em 10°C, aumenta token-por-watt em 15% Funding MagicSchool AI atinge US$63M em financiamento com apoio de educadores; plataforma de IA K-12 atende 1 em 5 crianças nos EUA Breaking Mythos da Anthropic usou identidades falsas para engenharia social com mantenedor do GitHub; GPT-5.6-Sol da OpenAI também testado Funding CEO da Revolut Storonsky em negociações para aumentar opção de compartilhamento de porta $500B Market Ação da AMD cai 8% apesar de superar expectativas de ganhos do Q2 Breaking OpenAI Codex sera "primitivo" em 2-3 meses; pivotando alem do desenvolvimento restrito ao laptop Market Capex de SpaceX salta para $18,4 bilhões conforme gastos de compute de IA assustam investidores; ação cai 10% Market SK Hynix salta 7,9% em especulação de retorno aos acionistas após período silencioso ADR terminar em 4 de agosto Market Anthropic garante acordo de computação de $10B na Noruega; expansão sinaliza escassez de infraestrutura de IA reformulando fluxos de capital Funding Oxylabs atinge avaliação de €3.1B com primeiro investimento externo após dez anos de crescimento independente Funding Oxylabs atinge $3,6B unicórnio com primeiro capital externo: infraestrutura web-data para IA agêntica Market Palantir Q2 receita +93% YoY para $1,94B, comercial +149%; eleva orientação FY26 para $8,16B Chips Redes Arista atingem receita de $3,04B; margem expande para 49,9% em demanda de fabric AI Funding Oxylabs arrecada $130M na avaliação de $3,6B; unicorn de web-data bootstrapé mira agentes IA Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Funding Wordsmith levanta $14M de extensão de Série B; financiamento total de IA jurídica agora $84M Chips SpaceX compromete-se exclusivamente com GPUs NVIDIA Vera Rubin; planeja cluster de IA no espaço no próximo ano Chips Frore LiquidJet reduz temperaturas de GPU Nvidia Rubin em 10°C, aumenta token-por-watt em 15% Funding MagicSchool AI atinge US$63M em financiamento com apoio de educadores; plataforma de IA K-12 atende 1 em 5 crianças nos EUA Breaking Mythos da Anthropic usou identidades falsas para engenharia social com mantenedor do GitHub; GPT-5.6-Sol da OpenAI também testado Funding CEO da Revolut Storonsky em negociações para aumentar opção de compartilhamento de porta $500B Market Ação da AMD cai 8% apesar de superar expectativas de ganhos do Q2 Breaking OpenAI Codex sera "primitivo" em 2-3 meses; pivotando alem do desenvolvimento restrito ao laptop Market Capex de SpaceX salta para $18,4 bilhões conforme gastos de compute de IA assustam investidores; ação cai 10% Market SK Hynix salta 7,9% em especulação de retorno aos acionistas após período silencioso ADR terminar em 4 de agosto Market Anthropic garante acordo de computação de $10B na Noruega; expansão sinaliza escassez de infraestrutura de IA reformulando fluxos de capital Funding Oxylabs atinge avaliação de €3.1B com primeiro investimento externo após dez anos de crescimento independente Funding Oxylabs atinge $3,6B unicórnio com primeiro capital externo: infraestrutura web-data para IA agêntica Market Palantir Q2 receita +93% YoY para $1,94B, comercial +149%; eleva orientação FY26 para $8,16B Chips Redes Arista atingem receita de $3,04B; margem expande para 49,9% em demanda de fabric AI Funding Oxylabs arrecada $130M na avaliação de $3,6B; unicorn de web-data bootstrapé mira agentes IA Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes
Breaking

Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B

Liquid AI lançou LFM2.5-2.6B em 4 de agosto de 2026, um modelo de 2,6 bilhões de parâmetros projetado para cargas de trabalho agentes em dispositivo sem dependência em nuvem. O modelo executa a 220 tokens/segundo em Apple M5 Max, 113 tok/s em AMD Ryzen CPU e até 30 tok/s em telefones, tudo dentro de 2,5 GB de memória. Foi pré-treinado em ~34 trilhões de tokens com janela de contexto de 128K e pós-treinado em quatro estágios: afinação supervisionada, especialização de especialistas, destilação on-policy multi-domínio e aprendizado por reforço agência dentro de armações ativas (OpenClaw, Hermes Agent).

LFM2.5-2.6B é competitivo com modelos 4-10x maiores em uso de ferramentas, seguimento de instruções e tarefas agências multi-etapas. Em benchmarks de uso de ferramentas (BFCLv4, ToolSandbox, Claw-Eval), ele combina ou supera modelos Gemma 5-8B e Qwen 4,7-9,7B. A arquitetura usa principalmente convoluções curtas com camadas de atenção seletiva (convoluções LIV), que mantêm estado de tamanho constante por token e eliminam sobrecarga de cache KV—uma vantagem de eficiência chave sobre transformers densos. A inferência de GPU atinge 15K tokens de saída/segundo em um único H100 em alta concorrência.

Para arquitetos enviando agentes: modelos agentes em dispositivo eliminam custos por token e permitem inferência com privacidade por padrão. O treinamento LFM2.5-2.6B dentro de armações reais (não traços sintéticos) deve melhorar a compatibilidade de uso de ferramenta real. Os 30 tok/s em telefones abrem casos de uso de robótica e IA incorporada. O flip de modelo de custo—de restrição de gasto de token para restrição de taxa de transferência local—permite agentes de fundo contínuo. A ênfase da Líquida em arquiteturas baseadas em convolução em vez de pura atenção pode sinalizar para onde os modelos de borda eficientes estão indo.

Fontes