AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14860.82 ARTIGOS HOJE 5 TOKENS TOTAL 9.56B
aiexpert
Na linha
Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4 Chips Z.ai alimenta data center de IA de 1GW inteiramente com chips chineses, zero Nvidia Chips Nó Intel 4 ganha primeiro cliente externo nomeado com acordo de ASIC Fortinet Funding Mistral levanta €3bn a avaliação de €20bn, maior captação de IA europeia Chips NVIDIA revela Cosmos 3 Edge em SIGGRAPH; modelo de mundo de 4B-parâmetros para inferência de IA física on-device Market Together AI e Y Combinator lançam primeiro cluster de GPU dedicado para portfólio de YC; aborda gargalo de computação de startup Market Bristol Myers Squibb implanta segundo DGX SuperPOD em Vera Rubin; dobra computação de IA para plataforma unificada de descoberta de drogas Chips Google desenvolve chip Frozen v2 para codificar arquitetura Gemini em silício; almeja eficiência de inferência 6–10x até 2028 Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4 Chips Z.ai alimenta data center de IA de 1GW inteiramente com chips chineses, zero Nvidia Chips Nó Intel 4 ganha primeiro cliente externo nomeado com acordo de ASIC Fortinet Funding Mistral levanta €3bn a avaliação de €20bn, maior captação de IA europeia Chips NVIDIA revela Cosmos 3 Edge em SIGGRAPH; modelo de mundo de 4B-parâmetros para inferência de IA física on-device Market Together AI e Y Combinator lançam primeiro cluster de GPU dedicado para portfólio de YC; aborda gargalo de computação de startup Market Bristol Myers Squibb implanta segundo DGX SuperPOD em Vera Rubin; dobra computação de IA para plataforma unificada de descoberta de drogas Chips Google desenvolve chip Frozen v2 para codificar arquitetura Gemini em silício; almeja eficiência de inferência 6–10x até 2028
Breaking

Modelo open-weight Mistral lançando julho com acesso antecipado; ARR ultrapassa $400M, visando $1B em 2026

CEO Mistral Arthur Mensch confirmou 4 de julho de 2026 que um modelo 'open-weight emocionante' será lançado neste verão com acesso antecipado abrindo em julho, descrito como uma nova família Mixture-of-Experts (MoE) que é 'gorda mas esparsa.' Mensch se recusou a nomear publicamente (brincando que não será chamado 'Le Chaton Fat'), mas indicou que o modelo irá fechar a lacuna de desempenho com laboratórios de fronteira dos EUA. O lançamento vem quando a receita anual recorrente da Mistral subiu de $20 milhões um ano antes para acima de $400 milhões em fevereiro de 2026, com a empresa no caminho para superar $1 bilhão de ARR no final do ano.

Contexto: Mistral fechou uma Série C de €1,7 bilhão liderada pelo ASML em setembro de 2025 em uma avaliação de €11,7 bilhão; relatórios separados sugerem discussões de rodada em andamento em avaliações acima de €20 bilhão. A empresa está se comprometendo com €4 bilhões em uma construção de centro de dados na França e Suécia, com €1,2 bilhão através de parceria com EcoDataCenter em Borånge, Suécia (com suporte de energia hidráulica). Em fevereiro de 2026, Mistral adquiriu a startup de infraestrutura Koyeb para ancorar sua estratégia de 'verdadeira nuvem de IA'. A empresa enfatiza licenças Apache 2.0 em seus modelos abertos, permitindo que organizações downstream baixem, ajustem e redistribuam comercialmente sem termos de licença personalizados ou caps de escala de usuário.

A amostra de infraestrutura soberana da Mistral ressoa na Europa, particularmente em setores regulados (serviços financeiros, saúde, setor público) onde a residência de dados e a implantação on-premise importam. Os poderes de execução da Lei de IA da UE ativam 2 de agosto de 2026, criando pressão regulatória para modelos implementáveis fora de nuvem governada pelos EUA. A família Mixtral anterior da Mistral estabeleceu arquiteturas MoE esparsas como competitivas com transformadores densos em escala. Um 'sucessor significativamente maior—ainda aberto, ainda auditável, implementável em infraestrutura soberana' visa empresas que se padronizam em APIs fechadas de OpenAI, Anthropic, Google.

Para arquitetos: este é um jogo de soberania europeia. Se o modelo de verão genuinamente fecha a lacuna com Llama e DeepSeek em benchmarks enquanto envia pesos licenciados Apache 2.0, equipes padronizando em APIs de fronteira dos EUA ganham um testbed credível. O crescimento 20x de ARR da Mistral em um ano e trajetória de bilhões de dólares sugerem confiança de clientes iniciais. A contagem de parâmetros real do modelo, comparações de benchmark e licença exata permanecem inanunciados; monitorar a janela de acesso antecipado de julho para detalhes técnicos. CEO Mistral declarou que a empresa 'não está à venda' e se posicionando para um IPO, uma postura de saída significativa para apostas de infraestrutura de longo prazo.

Fontes