AO VIVO · QUA., 05 DE AGO. DE 2026 --:--:-- ET
Edição Nº 106 GASTO TOTAL $15088.19 ARTIGOS HOJE 16 TOKENS TOTAL 9.84B
aiexpert
Na linha
Funding Wordsmith legaltech adiciona $14M de extensão de Series B, atingindo $114M levantado total em 26 meses Policy Projeto Rust publica política de LLM: permite assistência, proíbe autoria; força divulgação para PRs Chips SK hynix, SanDisk publicam primeira especificação High Bandwidth Flash; tier NAND entre HBM e SSDs para inferência de IA Research Mistral lança Shieldstral, classificador de segurança 3B igualando modelos 7x maiores em moderação multimodal Market Fundos de hedge enfrentam pior julho em recorde conforme venda de IA força chamadas de margem, Situational Awareness colapsa para US$ 10 bilhões Chips Samsung visualiza conceitos de memória 3D zHBM e zNAND-O visando 10× maior densidade e 8× desempenho HBM5 até 2030 Market SpaceX gasta US$ 329 milhões em Megapacks da Tesla no H1 2026, concentrando armazenamento de bateria em data centers de IA em Memphis Chips Samsung quebra o terreno Taylor Fab 2 antes do final de 2026; produção em massa 2nm visa 2030 Breaking Etsy corta 12% da força de trabalho (220 funcionários) conforme marketplace visa operações mais enxutas apesar de GMV plano desde 2021 Breaking Meta lança agente Muse Code, mais barato que Claude Codex Market Microsoft padroniza GitHub Copilot para OpenAI GPT-5.6 Sol para eficiência de tokens Funding Yann LeCun se junta a 224 Ventures com $100M para apoiar startups de IA Market Nvidia cancela pedidos RTX 5090 para revisar preço; Asus ROG ultrapassa $4.900 vs MSRP $1.999 Funding Anthropic, Snowflake aprofundam parceria; Claude potencia Cortex Code com mais de 7.100 usuários Research OpenAI nomeia Astra como próxima família de modelos principal; versão interna resolveu 10 problemas matemáticos abertos Market SpaceX compromete-se com NVIDIA Vera Rubin exclusivamente; ação sobe 4% na tese de infraestrutura Breaking Jeff Dean sai do Google após 27 anos; lançando startup de IA com Sanjay Ghemawat Market Prêmios RTX 5090 disparam para 115% acima do MSRP conforme custos de VRAM disparam Breaking Zoox da Amazon lança serviço de robotáxi pago em Las Vegas em 10 de agosto com isenção da NHTSA Chips SK Hynix Q2 recorde: 79,3T won receita, 60,5T lucro operacional, 76% margem; envios HBM4 em massa começam Funding Wordsmith legaltech adiciona $14M de extensão de Series B, atingindo $114M levantado total em 26 meses Policy Projeto Rust publica política de LLM: permite assistência, proíbe autoria; força divulgação para PRs Chips SK hynix, SanDisk publicam primeira especificação High Bandwidth Flash; tier NAND entre HBM e SSDs para inferência de IA Research Mistral lança Shieldstral, classificador de segurança 3B igualando modelos 7x maiores em moderação multimodal Market Fundos de hedge enfrentam pior julho em recorde conforme venda de IA força chamadas de margem, Situational Awareness colapsa para US$ 10 bilhões Chips Samsung visualiza conceitos de memória 3D zHBM e zNAND-O visando 10× maior densidade e 8× desempenho HBM5 até 2030 Market SpaceX gasta US$ 329 milhões em Megapacks da Tesla no H1 2026, concentrando armazenamento de bateria em data centers de IA em Memphis Chips Samsung quebra o terreno Taylor Fab 2 antes do final de 2026; produção em massa 2nm visa 2030 Breaking Etsy corta 12% da força de trabalho (220 funcionários) conforme marketplace visa operações mais enxutas apesar de GMV plano desde 2021 Breaking Meta lança agente Muse Code, mais barato que Claude Codex Market Microsoft padroniza GitHub Copilot para OpenAI GPT-5.6 Sol para eficiência de tokens Funding Yann LeCun se junta a 224 Ventures com $100M para apoiar startups de IA Market Nvidia cancela pedidos RTX 5090 para revisar preço; Asus ROG ultrapassa $4.900 vs MSRP $1.999 Funding Anthropic, Snowflake aprofundam parceria; Claude potencia Cortex Code com mais de 7.100 usuários Research OpenAI nomeia Astra como próxima família de modelos principal; versão interna resolveu 10 problemas matemáticos abertos Market SpaceX compromete-se com NVIDIA Vera Rubin exclusivamente; ação sobe 4% na tese de infraestrutura Breaking Jeff Dean sai do Google após 27 anos; lançando startup de IA com Sanjay Ghemawat Market Prêmios RTX 5090 disparam para 115% acima do MSRP conforme custos de VRAM disparam Breaking Zoox da Amazon lança serviço de robotáxi pago em Las Vegas em 10 de agosto com isenção da NHTSA Chips SK Hynix Q2 recorde: 79,3T won receita, 60,5T lucro operacional, 76% margem; envios HBM4 em massa começam
Chips

SK hynix, SanDisk publicam primeira especificação High Bandwidth Flash; tier NAND entre HBM e SSDs para inferência de IA

SK hynix e SanDisk lançaram a primeira especificação técnica do Open Compute Project (OCP) para High Bandwidth Flash (HBF) em 3–4 de agosto de 2026, apenas seis meses após o workstream HBF ser lançado em fevereiro. HBF é um novo tier de memória posicionado entre High Bandwidth Memory (HBM) e SSDs, projetado para fornecer capacidade NAND de alta largura de banda para cargas de trabalho de inferência de IA. Google e Tenstorrent participaram como membros do consórcio na padronização. A especificação define capacidades até 512GB usando pilhas de die NAND 8-altas e 16-altas, com três graus de largura de banda entregando desempenho de aproximadamente 0,4TB/s a 3,0TB/s, e adota a interface de chiplet UCIe 1 padrão da indústria para integração flexível de processadores.

A especificação HBF descreve características elétricas, diretrizes de confiabilidade, padrões de empacotamento e protocolos de E/S de software para processos de pilha de die. SanDisk simulou previamente o desempenho de inferência do Llama 3.1 405B com HBF, relatando resultados dentro de 2,2% de capacidade HBM ilimitada enquanto oferecia 8–16x mais capacidade ao custo por die similar. SanDisk visa Q4 2026 para as primeiras amostras de HBF, com dispositivos de inferência de IA amostrando no início de 2027. SK hynix também apresentou seu V10 NAND 4D de décima geração com 375 camadas na conferência Future of Memory and Storage, afirmando melhoria de desempenho por watt 2,5x em relação à geração anterior—visando SSDs corporativos para produção em massa em 2027.

Para arquitetos de infraestrutura de IA: a padronização HBF resolve uma lacuna crítica na hierarquia de memória. Inferência de modelo de fronteira (GPT-4 Turbo, Claude 3.5, Llama 405B) exige acesso de baixa latência a tokens ativos e armazenamento vasto para pesos de modelo. HBM é caro e limitado em energia; SSDs convencionais são muito lentos. HBF fecha essa lacuna em ~1/8 do custo por GB enquanto mantém largura de banda próxima a HBM. A especificação aberta via OCP sinaliza uma mudança em toda o mercado em direção a topologias de memória modulares e reutilizáveis—espere que designs de 2027 padronizem HBM para conjuntos de trabalho ativos e HBF para armazenamento de peso, reduzindo significativamente o TCO por inferência.

Fontes