Hugging Face lançou sua análise de ecossistema bienal cobrindo janeiro–agosto 2026, encontrando uma inversão estrutural no desenvolvimento de fronteira de modelos abertos. Laboratórios chineses publicaram modelos de fronteira variando 754B–2.78T parâmetros a cada mês, enquanto laboratórios americanos ficaram abaixo de 130B por cinco de sete meses, exceto NVIDIA's Nemotron 3 Ultra (561B, maio–junho) e Thinking Machines' Inkling (952B). Os repositórios de modelos públicos do Hub cresceram de 2.43M para 2.96M, conjuntos de dados de 711K para 1M.
Laboratórios chineses adotaram uma estratégia de 'tamanho como intenção': MiniMax, Moonshot, Xiaomi e Z.ai publicam quase nada abaixo de 70B, apostando na quantização da comunidade (4-bit, K-Quant) para acessibilidade, enquanto Tencent e Alibaba cobrem intervalos 1B–multi-trilhão-parâmetros. A liderança de modelo aberto dos EUA mudou para fornecedores de hardware: AMD e NVIDIA lançaram 200+ novos repositórios de modelos cada (triplo dos pares), posicionando modelos abertos como habilitadores de vendas de chips. Na escala de fronteira, a maioria das versões dos EUA acima de 100B são conversões ou otimizações de modelos chineses, não arquiteturas originais.
Para profissionais, a divisão download-vs.-likes expõe a lacuna entre entusiasmo do desenvolvedor (modelos de fronteira) e dependência de produção (modelos estáveis e pequenos). Laboratórios de fronteira chineses impulsionam 'likes'; modelos estabelecidos de 2022 acumulam 99.2% de todos os downloads do Hub ao longo do ano. O sinal do ecossistema: otimização de fronteira acontece em Beijing e Hangzhou; infraestrutura e implantação acontecem no Vale do Silício e região de hardware da China.