Dedizierter Knoten mit 4 GPUs
128 GB gesamter GPU-Speicher mit 8 % Rabatt auf jede Karte. Ein Mandant, ein fester Zeitraum von 7 oder 30 Tagen, eine vorhersehbare Gesamtsumme.
Ressourcen aggregieren
Ressourcen skalieren mit jeder dedizierten Karte. Netzwerk und Topologie müssen vor einer echten Reservierung überprüft werden.
4× 32 GB ergibt 128 GB über die Karten hinweg. Die Anwendung muss ihr Modell oder ihre Arbeit explizit verteilen. Unabhängige Replikate, Tensor-Parallelität und verteiltes Training haben unterschiedliche Kommunikationsanforderungen.
Bevor Sie diese Katalogkonfiguration als verbundene Maschine behandeln, bestätigen Sie sichtbare GPUs, PCIe/NUMA-Platzierung, Interconnect, Treiber- und Collective-Library-Versionen. Die Kartenanzahl allein begründet kein NVLink- oder NVSwitch-Fabric.