Private AI Cluster
Vários nós GPU, armazenamento compartilhado e uma fabric de alta velocidade. Preço por nó: planeje três nós ou mais.
Aproximadamente ~160B de parâmetros em fp16, ~320B em 8 bits ou ~590B em quantização de 4 bits.
- GPU8× NVIDIA RTX 6000 Adamemory: 48 GB GDDR6 ECC · bandwidth: 960 GB/s · interface: PCIe 4.0 x16$54,400Ver preço ↗
- CPUAMD EPYC 9354cores: 32 · threads: 64 · clock: 3.8 GHz boost$3,200Ver preço ↗
- Placa-mãeSupermicro H13SSL-N (SP5, EPYC 9004)chipset: SoC · memory: 12 x DDR5 RDIMM ECC, up to 3 TB · pcie: 8 x PCIe 5.0 x16 (slots + MCIO fan-out)$850Ver preço ↗
- RAMSamsung 512 GB (8x64) DDR5-4800 ECC RDIMMcapacity: 512 GB (8 x 64) · type: DDR5-4800 RDIMM · ecc: ECC$2,550Ver preço ↗
- ArmazenamentoKioxia CD8-R 3.84 TB U.2 NVMecapacity: 3.84 TB · bus: PCIe 4.0 U.2 · read: 7000 MB/s$620Ver preço ↗Sabrent Rocket 4 Plus 8 TB NVMecapacity: 8 TB · bus: PCIe 4.0 NVMe · read: 7100 MB/s$700Ver preço ↗
- FonteFSP CRPS 2+2 redundant, 4000 W usablecapacity: 4000 W usable (2+2 hot-swap) · rating: 80+ Platinum · standard: CRPS redundant$1,400Ver preço ↗
- RefrigeraçãoGeneric 4U high-static-pressure fan wall + shroudstype: rack forced-air · dissipation: chassis-wide · noise: loud (data-center)$220Ver preço ↗
- RedeNVIDIA ConnectX-6 Dx 100GbEspeed: 100 GbE · ports: 2 (QSFP56) · bus: PCIe 4.0 x16$650Ver preço ↗MikroTik CRS309 8x 10GbE SFP+ switchports: 8 x SFP+ 10 GbE + 1 GbE · throughput: non-blocking · form factor: desktop / 1U$280Ver preço ↗
- NobreakEaton 9PX 3000 RT (online double-conversion, 2U)capacity: 3000 VA / 2700 W · topology: online double-conversion · runtime: ~7 min at full load$1,600Ver preço ↗
- ChassiSupermicro 4U 8-GPU server chassis (CRPS, fan wall)form factor: 4U rack · gpu slots: 8 dual-slot passive · power: 2+2 CRPS redundant$3,200Ver preço ↗
Os preços dos componentes são obtidos à mão e datados (verificados em 2026-09-16), sem scraping. Confirme no site do vendedor antes de comprar.
- · Um nó = 8 RTX 6000 Ada, 384 GB de VRAM. Os números mostrados aqui são para um único nó; um cluster são três ou mais.
- · A fabric 100 GbE (RoCEv2) carrega o tráfego tensor- e pipeline-parallel entre nós e o NVMe-over-fabric até o armazenamento compartilhado: a parte que faz dele um cluster e não uma sala de servidores.
- · O armazenamento compartilhado vive num nó separado (não precificado aqui): cada nó GPU monta o mesmo dataset e o mesmo repositório de modelos.
- · Nessa escala, a colocation costuma ganhar do on-prem: energia medida, climatização e remote hands custam menos do que construir tudo você mesmo.
- · A gestão de cluster (Slurm ou Kubernetes + um scheduler) é pressuposta: o hardware é a metade fácil.
- + Escala horizontalmente: adicione nós, sem refazer tudo
- + 384 GB de VRAM por nó, repositório de modelos compartilhado
- + Fabric pronta para o treinamento multinó
- − Só o preço por nó: armazenamento compartilhado, switch de fabric e colocation à parte
- − Precisa de um time de ops: scheduling, monitoramento, failover
- − GPUs PCIe, não SXM: o pré-treinamento em escala de fronteira ainda quer um cluster H100/B200
Nós A6000: os mesmos 384 GB por nó a cerca de 60% do custo de GPU.
Os nós L40S trocam um pouco de vazão por peças padrão de data center e suporte.
Para treinamento de fronteira, alugue um pod H100/B200: ver GPU cloud pricing.
Ao longo de 36 meses, com o consumo desta configuração e a tarifa de nuvem ao vivo da sua GPU.
- Hardware
- $69,670
- Eletricidade
- $6,606
- Custo total de propriedade
- $76,276
- Nuvem equivalente, mensal
- $2,698/mo
- Nuvem equivalente, total
- $97,131
- Ponto de equilíbrio
- 28 meses
- · Necessidades de alta disponibilidade geralmente mantêm alguma capacidade de nuvem em reserva mesmo quando comprar faz sentido — o híbrido cobre as duas.
- · Ao longo de 36 meses, ter a placa economiza cerca de 20855 $ em relação à nuvem equivalente.
Os links "Comprar na Amazon" são de afiliado — como Associado Amazon, o Obolith ganha com as compras qualificadas.