AO VIVO · TER., 21 DE JUL. DE 2026 --:--:-- ET
Edição Nº 91 GASTO TOTAL $14871.42 ARTIGOS HOJE 9 TOKENS TOTAL 9.57B
aiexpert
Na linha
Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20% Market Rebound semicondutor: Micron +12%, Intel +8%, SMH ETF +4,5% conforme dip buyers retornam Market Estreia Nasdaq SK Hynix $26,5B, maior IPO estrangeiro; ação sobe 13% no primeiro dia Chips TSMC se compromete com mais $100bi para expansão dos EUA; aumenta previsão de crescimento de receita FY2026 para 40%+ em meio ao lucro recorde de Q2 de $22bi Funding Databricks levanta financiamento estratégico a avaliação de $188bi; rodada liderada por Coatue financia expansão Unity AI Gateway e Lakebase Funding Mistral fecha rodada Serie D de €3bi a avaliação de €20bi, apoiada pelo fundo europeu Scaleup Market GitHub atinge marco de $100M em financiamento de código aberto; investimento contínuo em suporte a mantenedores e comunidade Market Goldman Sachs lança plataforma de investimentos alternativos; aponta para participações diretas em unicórnios de IA privados pré-IPO Research Google lança Gemini 3.6 Flash com redução de 17% em tokens, preço de saída mais baixo para tarefas agentes Market OpenAI, Anthropic atingem lobbying recorde: $3.17M combinado em Q2 2026, acima de 23% QoQ Funding CuspAI arrecada $450M em valuation de $2.6B para descoberta de materiais com IA; Foundry de 45 empresas é lançado Breaking Irã afirma novo ataque ao data center AWS Bahrain com mísseis de cruzeiro; região ME-SOUTH-1 offline desde março, sem atualizações da Amazon Policy China avalia controles de exportação em modelos de IA de peso aberto, proibição de TSMC para projetos de chips chineses; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete com $100B adicional para Arizona, elevando investimento total dos EUA para $265B para fabs 2nm e embalagem avançada Chips NVIDIA Vera Rubin NVL72 atinge produção com CoreWeave 10x throughput sobre GB200, atrai Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin adiciona gerenciamento de descritor MoE, 2x throughput de dimensão K, 4x softmax para inferência Breaking Google lança Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite e modelo de segurança cibernética Chips NVIDIA Vera CPU entra em produção com 88 cores Olympus, 1,5x aceleração de IA com agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet atinge 102,4 Tbps, implantado por CoreWeave, Microsoft, Nebius para IA em gigaescala Chips Computação quântica muda de laboratório de física para data center—gargalos de resfriamento e modelos de colocação emergem Market Primeiro vencimento de lock-up da SpaceX libera 911,5M ações quando data de resultados em 4 de agosto dispara liberação de 20%
Market

Together AI e Y Combinator lançam primeiro cluster de GPU dedicado para portfólio de YC; aborda gargalo de computação de startup

Together AI e Y Combinator anunciaram uma parceria em 21 de julho para operar o primeiro cluster de GPU dedicado para o portfólio de startups nativas de IA do YC. O cluster habilita acesso flexível de GPU de curto prazo sem compromissos de múltiplos anos em taxas em massa. Startups podem reservar e provisionar capacidade diretamente através do portal self-service da Together e ligar infraestrutura em minutos, com faturamento isolado da camada administrativa do YC.

A parceria aborda um gargalo crítico de startup: capacidade de computação se tornou a maior restrição, com muitos fundadores forçados a escolher entre levantar capital especificamente para contratos de GPU de longo prazo ou renunciar à capacidade inteiramente. Together e YC projetaram acesso flexível que permite startups escalar computação para sprints de desenvolvimento curtos enquanto se beneficiam de taxas de reservação de longo prazo—um modelo que separa compromissos de uso real.

Together AI opera mais de 8.000 clientes em toda a stack de IA generativa, de inferência a fine-tuning e treinamento. A pesquisa da empresa (em mecanismos de atenção e integração de arquitetura Mamba) se concentra em reduzir custo por token. YC está buscando ativamente fundadores trabalhando em avanços de pesquisa requerendo computação de GPU para o ciclo Fall 2026, sinalizando apetite renovado para startups de pesquisa, intensivas em computação.

Para equipes fundadoras: isso remove um ponto de decisão tradicional go/no-go para empresas de IA—escolher entre lock-in custoso de GPU de longo prazo e perder capacidade de competir. Observe se outros aceleradores e nuvens seguem o modelo de YC de pools dedicados e flexíveis para coortes específicas. Para Together: esta é distribuição e prova de conceito para acesso flexível de GPU como um fosso competitivo contra serviços de GPU gerenciados.

Fontes