Serwer z kartą NVIDIA H100 — wynajem miesięczny

H100 to układ generacji Hopper z 80 GB pamięci HBM3 i Transformer Engine, który liczy natywnie w formacie FP8. Występuje w dwóch formach: jako moduł SXM5 na płycie bazowej HGX oraz jako karta PCIe z mostkiem NVLink. W naszym katalogu maszyny z H100 stoją w dziale systemów treningowych — od węzła DGX H100 po platformy partnerskie ASUS, Gigabyte i Supermicro. Cenę podajemy na zapytanie, bo rata zależy od platformy, pamięci systemowej i obsady sieci.

Przeglądaj katalog →
Serwery DGX 6

Do czego to służy

80 GB HBM3 na układ wystarcza, by model klasy 70B w FP8 (około 70 GB wag) pracował na jednej karcie, a model klasy 180B w tej samej precyzji rozłożył się na trzy. Osiem układów w węźle daje 640 GB — pojemność, w której mieści się model produkcyjny wraz z cache kontekstu dla wielu równoczesnych sesji.

Transformer Engine przelicza wybrane warstwy w FP8 z zachowaniem stabilności treningu, co skraca czas dostrajania w porównaniu z BF16 i zmniejsza zajętość pamięci. Zysk pojawia się przy modelach transformerowych — w obliczeniach naukowych czy renderingu układ pracuje jak zwykły akcelerator obliczeniowy.

Typowe zadania na H100 to dostrajanie i produkcyjne serwowanie modeli językowych, wyszukiwanie semantyczne w architekturze RAG oraz trening dużych modeli wizyjnych. Przy pracy ciągłej powyżej mniej więcej stu trzydziestu godzin miesięcznie stała rata za całą maszynę wypada korzystniej niż rozliczenie z licznikiem godzin.

Porównanie i dobór

Wobec A100: pamięć HBM3 o przepustowości 3,35 TB/s zamiast HBM2e i około 2 TB/s, NVLink 900 GB/s zamiast 600 GB/s oraz Transformer Engine z natywnym FP8, którego Ampere nie ma. Pojemność pamięci na układ pozostaje ta sama — 80 GB — więc granica tego, co mieści się na jednej karcie, przesuwa się dopiero przy przejściu na FP8.

Wobec H200: ten sam rdzeń obliczeniowy i ta sama wydajność FP8, ale 141 GB HBM3e i 4,8 TB/s zamiast 80 GB i 3,35 TB/s. H200 bierze się pod modele, którym brakuje pamięci; H100 pozostaje właściwym wyborem, gdy zadanie mieści się w 80 GB i liczy się dostępność sprzętu.

Wewnątrz rodziny H100 wybór dotyczy formy montażu. Moduł H100 SXM5 daje 900 GB/s między układami i topologię z przełącznikami NVSwitch, a karta H100 NVL ma 94 GB pamięci na kartę i wchodzi do standardowego kadłuba PCIe. Pierwsza forma jest pod trening rozproszony, druga pod serwowanie modeli.

Najczęstsze pytania

PCIe czy SXM — co wybrać do własnego projektu?

SXM5 wybiera się pod trening, w którym układy wymieniają dane w trakcie liczenia: łącze 900 GB/s i przełączniki NVSwitch skracają czas kroku treningowego. PCIe wybiera się pod inferencję i zadania niezależne — kadłub jest tańszy w utrzymaniu, a liczbę kart dobiera się swobodniej.

Ile pamięci potrzeba na konkretny model?

Reguła kciuka: w FP8 wagi zajmują mniej więcej tyle gigabajtów, ile model ma miliardów parametrów, w BF16 — dwa razy tyle. Model 70B w FP8 zmieści się na jednym układzie H100, w BF16 potrzebuje dwóch. Do tego dochodzi cache kontekstu, który przy długim oknie potrafi dorównać wielkości wag.

Czy karty w wynajętym serwerze są przypisane wyłącznie do mnie?

Tak. Przedmiotem umowy jest cała fizyczna maszyna z wszystkimi układami, procesorami i dyskami. Sposób podziału jej mocy między własne zadania albo zespoły zostaje po stronie najemcy.

Jak wypada rata miesięczna wobec chmury rozliczanej godzinowo?

Przy pracy dorywczej licznik godzinowy bywa tańszy, przy pracy ciągłej rośnie liniowo, a stała rata pozostaje ta sama. Próg opłacalności leży w okolicach stu trzydziestu godzin pracy miesięcznie; powyżej niego przewidywalny rachunek za całą maszynę wygrywa również dlatego, że nie dochodzą do niego opłaty za transfer danych.

Jakie systemy z H100 są w ofercie?

Węzeł DGX H100 z ośmioma modułami SXM5 i 2 TB pamięci systemowej oraz platformy partnerskie: ASUS ESC N8-E11 z płytą HGX H100 i pamięcią do 4 TB, Gigabyte G593-SD0 i G593-SD1 z 8 TB pamięci oraz Supermicro AS-8125GS-TNHR z 6 TB. Różnią się głównie pamięcią systemową i topologią slotów.

Ile kart można spiąć NVLinkiem?

W węźle z modułami SXM5 wszystkie osiem układów pracuje w jednej domenie NVLink przez przełączniki NVSwitch. W wersji PCIe mostek łączy karty parami — pełną specyfikację tego rozwiązania opisuje strona H100 NVL.

Kiedy serwer H100 będzie gotowy do pracy?

Systemy tej klasy kompletujemy pod zamówienie, więc termin dostawy potwierdzamy w ofercie razem z ceną. Zapytanie z podaną liczbą kart i planowanym okresem najmu skraca ten etap do jednej doby roboczej.

Dlaczego cena H100 nie jest podana wprost w cenniku?

Maszyny z tą kartą różnią się platformą, pamięcią systemową w zakresie od 2 do 8 TB oraz obsadą kart sieciowych, a każdy z tych parametrów istotnie zmienia ratę. Publikujemy jawny cennik tam, gdzie konfiguracja jest zamknięta — na przykład dla serwerów z H200 NVL.