Dell Pro Max GB10 habilita clusters de IA locais; sistemas Blackwell duplos agrupam para 256GB de VRAM compartilhada
Dell's Pro Max com NVIDIA GB10 habilita clustering de IA local econômico através dos NICs NVIDIA ConnectX 7 200Gbps e Remote Direct Memory Access over Converged Ethernet (RoCE). Um par de sistemas Pro Max GB10, cada um com 128GB de memória unificada LPDDR5X e 6.144 núcleos CUDA em GPU Blackwell, pode ser conectado em rede para criar uma caixa de areia de IA local de 256GB, testada por Tom's Hardware.
Com aproximadamente $6.332 por sistema para a configuração testada de SSD de 4TB, um cluster de sistema duplo custa substancialmente menos do que construir um servidor GPU equivalente com quatro cartões discretos de 48–72GB além da plataforma CPU, placa-mãe e DDR5 necessária—que sozinha exige um soquete Threadripper Pro ou EPYC de alta gama e excede circuitos de energia de 15 amperes padrão em casa. O Pro Max negocia um desempenho absoluto por acessibilidade e praticidade: nenhum host único e poderoso é necessário, e o consumo de energia permanece gerenciável em espaços de escritório ou laboratório compartilhados.
A arquitetura GB10 preserva a abordagem do design de referência DGX Spark focada em clustering. Cada Pro Max inclui um adaptador USB-C de 280W, SSD NVMe PCIe Gen 4 (disponibilidade Gen 5 restrita pela escassez de chips), e ConnectX 7 configurado para Ethernet + RoCE apenas—não Infiniband. Este backbone RoCE-over-Ethernet habilita cargas de trabalho de inferência distribuídas em ambos os sistemas como um pool de computação unificado.
Para pesquisadores, startups e engenheiros que precisam de inferência local em modelos abertos maiores sem gastos de nuvem de data center, o par Pro Max GB10 remove um ponto de fricção importante: caberem modelos com parâmetros multi-bilionários no silício local em custo total inferior a $13K com networking de clustering profissional. A simplicidade de alimentação USB-C e networking IP supera construções de servidor GPU bespoke, embora a taxa de transferência absoluta permaneça abaixo de soluções em escala de rack.