AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14867.95 ARTIGOS HOJE 8 TOKENS TOTAL 9.57B
aiexpert
Na linha
Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4 Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Chips Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada Market AWS aumenta preços da instância GPU 20%; lacuna spot-vs-reservado se amplia com gargalo de memória Chips AMD envia sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeiros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parâmetros) sem benchmarks; afirma segundo apenas Fable 5 Breaking Anthropic recebe multa de $1,5B em acordo de direitos autorais; corte confirma que treinamento de IA em livros é uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado Chips Intel garante Fortinet como primeiro cliente externo nomeado de fundição no Intel 4
Breaking

Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo apenas para Fable 5" — nenhum benchmark publicado

O time Qwen da Alibaba visualizou o Qwen3.8-Max em 19 de julho na Conferência Mundial de IA em Shangai, afirmando que classifica segundo apenas o Fable 5 da Anthropic. O modelo carrega 2,4 trilhões de parâmetros totais em um design esparso de Mixture-of-Experts (MoE) e é o primeiro modelo Qwen acima de 1 trilhão de parâmetros a ser multimídia, manipulando texto, imagens, vídeo e documentos. As ações da Alibaba subiram até 5,4% no anúncio. A afirmação vem três dias após o rival chinês Moonshot lançar Kimi K3, também 2,8 trilhões de parâmetros, marcando uma voleia rápida de lançamentos multi-trilhões de parâmetros de laboratórios chineses.

O problema: Alibaba publicou zero scores de benchmark, nenhum modelo card e nenhuma avaliação independente para apoiar o ranking "segundo apenas para Fable 5". O anúncio permanece como o posicionamento da própria empresa. Para contexto, Qwen3.7-Max, o flagship anterior, marcou 56.6 no Índice de Inteligência da Análise de Inteligência Artificial (5º lugar geral, modelo chinês de melhor classificação) e 60.6 no SWE-Bench Pro—aproximadamente 20 pontos atrás do 80.4 do Fable 5 no mesmo teste. Qwen3.8 é acessível através do Token Plan da Alibaba em 10% do preço padrão, com pesos abertos "prometidos em breve".

Isso espelha um padrão recente: Kimi K3 encabeçou o leaderboard de codificação front-end da Arena.ai mas depois mostrou taxas de alucinação de ~51% em tarefas de recuperação de conhecimento, ilustrando a lacuna entre benchmarks de anúncio e confiabilidade de produção. Nenhum leaderboard independente—não o Open LLM da Hugging Face, Análise de Inteligência ou Arena.ai—tem marcado Qwen3.8 ainda. O timing sublinha o impulso da China por afirmações visíveis de paridade de fronteira seguindo anúncios de modelos dos EUA e europeus (GPT-5.6 em 9 de julho, Bristol Myers em Vera Rubin, arrecadação de €3B da Mistral).

Para arquitetos: trate isso como um sinal de capacidade genuína *emparelhado com* uma bandeira de caução. O desempenho anterior de Qwen3.7-Max torna "segundo apenas para Fable 5" não absurdo, mas não verificado até que avaliações de terceiros cheguem. O lançamento de pesos abertos será o ponto de prova. Até então, a contagem real de parâmetros ativos do modelo, custo de inferência e perfil de sobrecarga de token permanecem desconhecidos—críticos para planejamento de custo-por-tarefa em produção.

Fontes