Data centers de IA absorveram uma parte sem precedentes da capacidade de memória mundial, criando escassez aguda de GDDR6, GDDR7 e HBM. IDC estima que data centers de IA agora representam aproximadamente 70% da produção de memória global em 2026, acima de 20-30% há alguns anos. O aumento aumentou os preços GDDR7 de $65-80 por unidade 16GB em meados de 2025 para mais de $200 no final de 2025 e em 2026—uma triplicação em menos de nove meses. A memória agora representa mais de 80% da lista de materiais de GPUs de ponta, reformulando a economia de componentes de PC em todo o setor.
A restrição cascateia em hardware consumidor: preço de varejo RTX 5090 subiu de um MSRP $1.999 (maio 2026) para $4.329 no Amazon em julho e para aproximadamente $5.112 em mercados coreanos em agosto—2,5x o preço de lançamento. AMD seguiu com um aumento de preço de 10-17% em agosto. NVIDIA depriorizou a produção de GPU de jogos para consumidor em resposta; a empresa pulou 2026 inteiramente sem uma nova arquitetura e adiou o refresh RTX 5080 Super, terminando uma sequência de 27 anos de lançamentos anuais de GPU de jogos. MSI alertou que a escassez de memória encolherá o mercado de jogos de PC em até 20%.
A restrição se estende além de GPUs discretas: Nintendo aumentou o Switch 2 para $499 (de $449), Sony aumentou o PS5 para $649 em um segundo aumento, e Valve aumentou o Steam Deck por aproximadamente $240 para um ponto de entrada $300—tudo citando a mesma escassez de memória. Fabricantes de consoles competem com data centers de IA para DRAM e armazenamento, e IA está ofertando suprimento. A janela imediata para comprar inventário de preços pré-agosto está fechando; o estoque de canal está virando para inventário de preço mais alto.
Para arquitetos e planejadores de infraestrutura, isso sinaliza uma mudança estrutural: procuração de GPU e memória para IA de fronteira inverteu curvas de suprimento de hardware tradicionais. Onde jogos uma vez definiram a linha de base de volume de mercado, a demanda de data center de IA agora define o piso de preço. Cargas de trabalho de inferência e fine-tuning em hardware de nível consumidor estão se tornando mais caras em relação à inferência em nuvem, deslocando a economia em favor de plataformas de nuvem e longe de implantação local. Disponibilidade de longo prazo para tiers consumidor e SMB permanece incerta pendente de novos FABs de memória.