Dział 06

Prywatny LLM na własnej maszynie

Wybierasz rozmiar modelu, który chcesz uruchomić. My dobieramy maszynę, która go uniesie, i pokazujemy opłatę. Jeden klient dostaje jedną fizyczną maszynę na wyłączność: procesory, pamięć, dyski i karty siedzą w tej samej obudowie.

Twój model i Twoje dane zostają na Twojej maszynie.

Jaki model chcesz uruchomić?

Asystent, streszczanie, klasyfikacja, obsługa zgłoszeń

Llama 3.1 8B · Bielik 11B v3.0 (model po polsku, Apache 2.0)

Praca na dokumentach firmy, kod, dłuższe rozumowanie

Mistral Small 3.2 24B · Qwen 2.5 32B

Najwyższa jakość odpowiedzi wśród modeli, które utrzyma jedna maszyna

Llama 3.3 70B · Qwen 2.5 72B

Modele graniczne — mieszanki ekspertów i największe otwarte wydania

Mistral Small 4 (119 mld) · Llama 3.1 405B · Mistral Large 3 (675 mld)

Trzy pytania, po których rozmiar wychodzi sam

Katalog otwartych modeli

Zaznacz, co chcesz uruchomić

Zaznaczenie modelu to plan przygotowania środowiska pod niego: dobór silnika inferencyjnego i maszyny, która go uniesie. Wybór przenosi się do konfiguratora w panelu klienta.

Otwarte modele i licencje — pełne zestawienie →

Odpowiadanie, streszczanie, obsługa zgłoszeń

16 modeli

Podpowiadanie i przegląd kodu na własnym repozytorium

2 modele

Modele trenowane na języku polskim

1 model

Generowanie i przetwarzanie obrazu

2 modele

Transkrypcja i przetwarzanie mowy

1 model

Sprawdź na maszynie z katalogu

Bez wybranej maszyny pokazujemy przy modelu wyłącznie klasę pamięci wyliczoną z jego najlżejszego wariantu.

Modele do zaznaczenia

Czat i asystent
Kod
Polski
Obrazy
Audio

Wymaganie pamięci liczymy regułą działu 06: wagi razy 1,25 (ryczałt na pamięć podręczną kontekstu i narzut przy około 8 tys. tokenów i jednej sesji). To odpowiedź na pytanie „czy się w ogóle zmieści”. Dobór precyzyjny, z rachunkiem pamięci podręcznej kontekstu, robi tabela wariantów wyżej — ten katalog jej nie dubluje.

Modelu nie dostarczamy razem z maszyną — pobiera go klient na własnych warunkach licencyjnych. My dajemy maszynę, stos programowy i łącze.

Nie podajemy liczby tokenów na sekundę ani porównań prędkości. Dopóki nie zmierzymy tego na naszej maszynie, każda taka liczba byłaby obietnicą bez pokrycia.

Zaznaczone modele
0
Zaznacz pozycje z listy — policzymy najcięższy z nich, sumę dla pracy równoległej i maszyny z katalogu, które to uniosą.

Router wielomodelowy (open source) — 0 zł licencji

Pozycja poza grupami — router nie jest modelem, tylko warstwą, która serwuje dowolną ich kombinację.

Stawiamy na Twoim serwerze gotowy router NVIDIA NeMo Switchyard (Apache-2.0) razem z silnikiem vLLM lub Ollama i zestawem otwartych modeli — m.in. Nemotron 3 na licencji NVIDIA Nemotron Open Model License, która wprost dopuszcza użycie komercyjne bez opłat. Cały ten stos jest darmowy licencyjnie: płacisz nam wyłącznie za serwer, nikomu nie płacisz za oprogramowanie ani za modele.

Opcja dodatkowa: jeśli potrzebujesz firmowych kontenerów NVIDIA NIM ze wsparciem producenta, wymagają one subskrypcji NVIDIA AI Enterprise (cennik NVIDIA: od 4 500 USD za GPU rocznie, liczone od każdej karty w maszynie) — kupujesz ją bezpośrednio u partnera NVIDIA, a my wdrażamy ją na Twoim serwerze.

Pułapki, o których mówimy wprost
  • FLUX.1/2 Dev jest na licencji niekomercyjnej — router serwujący obrazy nie wskazuje tego wariantu. W tej samej rodzinie Klein i Schnell są na Apache 2.0.
  • Model na licencji NVIDIA Community Model License w produkcji wymaga runtime’u NIM, czyli subskrypcji NVIDIA AI Enterprise liczonej od KAŻDEJ karty w maszynie (przy ośmiu kartach to 36 000 USD rocznie). Poza katalogiem domyślnym — wyłącznie tor z licencją klienta.
  • Kontenery NIM w wersji rozwojowej i testowej wymagają konta NVIDIA Developer Program KLIENTA i jego klucza NGC. Obrazów NIM nie pobieramy na swoje konto i nie użyczamy swojego klucza.
  • Subskrypcja NVIDIA AI Enterprise nigdy nie jest „w cenie serwera” — to zawsze osobna kwota po stronie klienta, kupowana u partnera NVIDIA.
  • Modele-klasyfikatory, którymi Switchyard rozdziela ruch, nie mają wskazanych licencji w dokumentacji projektu — do odczytu przed publikacją oferty.

DO POTWIERDZENIA Cena do potwierdzenia przed umową.

Źródło brzmienia:

Czego nie wystawiamy w tym katalogu

Te pozycje sąsiadują w katalogach twórców z modelami, które prawo do użycia komercyjnego mają — i dlatego łatwo je pomylić. Posiadanie pliku z wagami nie jest prawem do wystawienia go klientowi.

  • FLUX.1 / FLUX.2 Dev — FLUX.1 [dev] Non-Commercial License. Licencja niekomercyjna. W tej samej rodzinie Klein/Schnell są Apache 2.0 — sam wariant „Dev” jest niekomercyjny. NIE wystawiać i NIE instalować klientowi komercyjnemu.Źródło: dokumentacji wewnętrznej/§B (odczyt 2026-08-29) §B; dokumentacji wewnętrznej §1.4
  • Modele na NVIDIA Community Model License — NVIDIA Community Model License. Produkcja wymaga runtime'u NIM = subskrypcji NVIDIA AI Enterprise (od 4 500 USD/GPU/rok, liczone od KAŻDEJ karty w maszynie). Poza katalogiem domyślnym; dopuszczalne wyłącznie w torze BYOL po stronie klienta (nie mylić z Nemotron Open Model License, która jest darmowa i komercyjna).Źródło: dokumentacji wewnętrznej (odczyt 2026-08-29) poz. 11 (⚠ PUŁAPKA)
  • command-a-plus-fp8 (Cohere) — NIEODCZYTANA (rodzina Cohere Labs historycznie bywała niekomercyjna). MAMY wagi na dysku, ale LICENSE rodziny Command NIEODCZYTANY. Posiadanie wag ≠ prawo do wystawienia klientowi. Droga powrotu: jeden odczyt LICENSE u twórcy i przeniesienie do katalogu.Źródło: dokumentacji wewnętrznej/§B (odczyt 2026-08-29) §A; dokumentacji wewnętrznej §1.4
  • MiniMax-M3 / MiniMax-M2.7 — NIEODCZYTANA (licencja własna MiniMax). MAMY wagi (M3 komplet, M2.7 częściowo), ale LICENSE własna MiniMax NIEODCZYTANA. Posiadanie wag ≠ prawo do wystawienia. M2.7 dodatkowo bez weryfikacji kompletności.Źródło: dokumentacji wewnętrznej/§B (odczyt 2026-08-29) §A; dokumentacji wewnętrznej §1.4
  • gpt-oss-safeguard-20b — Apache 2.0 (deklarowany). Model narzędziowy (klasyfikator bezpieczeństwa), nie pozycja katalogu klienta. Zostaje w danych magazynowych, poza UI oferty.Źródło: dokumentacji wewnętrznej/§B (odczyt 2026-08-29) §A; dokumentacji wewnętrznej §1.4

Qwen 2.5 3B (Qwen RESEARCH LICENSE, niekomercyjna) i Mistral Large 2411 (Mistral Research License, niekomercyjna) są już w window.TRDC_LLM.MODELE_ZAKAZANE — ten słownik ich nie powtarza, tylko odsyła.

Stos programowy

Co instalujemy na maszynie

Katalog oprogramowania

vLLM

Serwer inferencyjny z interfejsem zgodnym z OpenAI — aplikacja, która dziś rozmawia z chmurą, po zmianie jednego adresu rozmawia z Twoją maszyną.

Ollama

Najkrótsza droga do uruchomienia modelu w formacie GGUF — jedna komenda i model zaczyna odpowiadać.

Open WebUI DO DECYZJI

Interfejs w przeglądarce dla zespołu — konta, historia rozmów, własne polecenia.

Cena do potwierdzenia przed umową.

  • Instalacja idzie rolami Ansible po przekazaniu maszyny. Nieudana rola nie blokuje wydania maszyny — pozycja dostaje status „nieudana” i przycisk „ponów” (dokumentacji wewnętrznej i §7.3).
  • Katalog startowy jest w całości darmowy. Oprogramowania płatnego ani licencjonowanego bez jawnej licencji klienta nie instalujemy (§6, zakaz twardy).
  • Modelu nie dostarczamy razem z maszyną — pobiera go klient na własnych warunkach licencyjnych. My dajemy maszynę, stos programowy i łącze.
  • Po zakończeniu najmu dyski są kasowane bezpiecznym trybem kontrolera, zanim maszyna wróci do puli (dokumentacji wewnętrznej pkt 6).
Dlaczego prywatnie

Trzy fakty, które klient sprawdzi w kilka minut

Prawo Unii nie nakazuje nikomu odejścia od dostawców spoza Unii. Nakazuje natomiast umieć odejść — ocenić ryzyko dostawcy, mieć strategię wyjścia i realną możliwość migracji.

Brak transferu poza Unię to brak rozdziału V RODO

Przy przetwarzaniu wyłącznie na terytorium Unii przepisy o przekazywaniu danych osobowych do państwa trzeciego w ogóle nie znajdują zastosowania. Nie ma transferu, więc nie ma czego uzasadniać podstawą transferu.

Podstawa:

Jurysdykcja infrastruktury jest jawna

Dostawca ma obowiązek podać na swojej stronie, jakiej jurysdykcji podlega infrastruktura wykorzystywana do świadczenia usługi, oraz opisać środki przeciwdziałające dostępowi rządów państw trzecich do danych nieosobowych przechowywanych w Unii. Nasza infrastruktura podlega jurysdykcji Unii Europejskiej.

Podstawa:

Stała stawka w złotych, niezależna od kursu

Opłata jest stałą kwotą w złotych netto za miesiąc, rozliczaną krajowo. Kurs waluty jej nie zmienia, a transfer wychodzący jest w cenie. Faktury wystawiamy w systemie KSeF.

Podstawa:

Porównanie z konkurencją

Co dostajesz za tę samą kwotę gdzie indziej

Tabela lustrzana

DostawcaZakres usługiIch cenaNasza cenaRóżnica
RunPodRTX A6000 (Secure Cloud)kontener na współdzielonym hościeJedna karta RTX A6000 48 GB w kontenerze. Procesor i pamięć to przydział z puli hosta, którą klient dzieli z innymi kontenerami: 9 vCPU i 50 GB RAM. Cennik jest liczony za sztukę karty, nie za maszynę. Jedyny publikowany interwał to godzina — abonamentu miesięcznego dostawca nie publikuje.1 444 zł0,53 $/godz. × 730 godz. × kurs NBP 3,7330 = 1 444 zł/mies. — nasze przeliczenieprzy 12 mies.: stawki dla dłuższego okresu nie publikuje2 500 złTRDC-A6000-1 · bez zobowiązaniaprzy 12 mies.: 2 075 złu nas drożej o 1 056 złnasza cena 2 500 zł − ich cena 1 444 zł = 1 056 złprzy 12 mies.: nie porównujemy — dostawca stawki dla dłuższego okresu nie publikuje
Kontener na współdzielonym hoście NIE jest całą maszyną fizyczną — dostawca sam pisze, że kontenery dzielą jądro systemu hosta. To nie jest ta sama usługa, tylko najbliższa referencja cenowa dla tej karty. Nasza pozycja TRDC-A6000-1 jest w katalogu oferowana wyłącznie na 12 miesięcy i wyłącznie klientowi biorącemu drugą maszynę.Dłuższy okres u dostawcy: „reserved capacity” tylko przez kontakt — stawki nie publikujeŹródło okresów: site/trdc-okresy-rywali.js
AIME (Berlin)C24-4X6000ADA-M1cała maszyna fizyczna, abonament miesięczny4× RTX 6000 Ada 48 GB (192 GB łącznie), 24 rdzenie fizyczne, 256 GB ECC, 4 TB NVMe, łącze 500 Mbit/s. To najbliższy nam konkurent w Unii: cała maszyna wielokartowa z opublikowaną ceną miesięczną.11 093 zł2 579 €/mies. × kurs NBP 4,3013 = 11 093 zł/mies. — nasze przeliczenieprzy 12 mies.: 9 226 zł/mies. — ich plan roczny 2 145 €/mies. wobec 2 579 €/mies. za miesiąc7 200 złTRDC-A6000-4 · bez zobowiązaniaprzy 12 mies.: 5 976 złu nas taniej o 3 893 złich cena 11 093 zł − nasza cena 7 200 zł = 3 893 złprzy 12 mies.: u nas taniej o 3 250 złich cena 9 226 zł − nasza cena 5 976 zł = 3 250 zł według ich planu rocznego
Uwaga na nazwy kart: ich RTX 6000 Ada jest o generację nowsza od naszej RTX A6000 przy tej samej pojemności 48 GB. To parytet pamięci, nie parytet techniczny — i tak trzeba to klientowi powiedzieć. Pamięci systemowej mamy tyle samo (256 GB), rdzeni fizycznych więcej (32 wobec 24), a przestrzeni dyskowej blisko dwa razy tyle (7,68 TB wobec 4 TB).Źródło okresów: site/trdc-okresy-rywali.js
IQ.pl (Gdańsk)DELL R7615 NVMe · 1× RTX PRO 6000 Max-Qcała maszyna fizyczna, abonament miesięczny1× RTX PRO 6000 Blackwell Max-Q, EPYC 9334 (32 rdzenie fizyczne), 192 GB DDR5. Maszyna stoi w Polsce. Dostawca publikuje interwał miesięczny.4 200 złcena w złotych u dostawcy — bez przeliczaniaprzy 12 mies.: 4 200 zł/mies. — u dostawcy to nadal stawka miesięczna — dłuższego okresu nie wycenia6 000 złTRDC-6000MQ-1 · bez zobowiązaniaprzy 12 mies.: 4 980 złu nas drożej o 1 800 złnasza cena 6 000 zł − ich cena 4 200 zł = 1 800 złprzy 12 mies.: u nas drożej o 780 złnasza cena 4 980 zł − ich cena 4 200 zł = 780 złu dostawcy to nadal stawka miesięczna — dłuższego okresu nie wycenia
Ta sama klasa karty i ta sama jurysdykcja — jesteśmy tu drożsi. Po naszej stronie stoi więcej pamięci systemowej (256 GB wobec 192 GB) i konsola KVM-over-IP w cenie; po ich stronie więcej rdzeni fizycznych (32 wobec 24). Obie strony rozliczają się miesięcznie, więc okresy są porównywalne wprost.Dłuższy okres u dostawcy: Dostawca publikuje wyłącznie stawkę miesięczną — dłuższego okresu nie wycenia, więc przy 12 miesiącach po jego stronie obowiązuje ta sama kwota co za jeden miesiąc.Źródło okresów: site/trdc-okresy-rywali.js
CloudFerro (Łódź)vgpu.rtx_pro_6000.96gmaszyna wirtualna z kartą graficzną (vGPU) — nie cała maszyna fizyczna1× RTX PRO 6000 Blackwell 96 GB, 32 vCore, 256 GB pamięci. Profil karty ma 96 GB, czyli całą jej pamięć. „vCore” to jednostka przydziału procesora dla maszyny wirtualnej, a nie rdzeń fizyczny — ile takich maszyn stoi na jednym hoście, dostawca nie podaje. Serwerownia w Łodzi. Rozliczenie godzinowe albo miesięczne (1, 6 lub 12 miesięcy).6 094 zł1 416,82 €/mies. × kurs NBP 4,3013 = 6 094 zł/mies. — nasze przeliczenieprzy 12 mies.: stawki dla dłuższego okresu nie publikuje6 000 złTRDC-6000MQ-1 · bez zobowiązaniaprzy 12 mies.: 4 980 złu nas taniej o 94 złich cena 6 094 zł − nasza cena 6 000 zł = 94 złprzy 12 mies.: nie porównujemy — dostawca stawki dla dłuższego okresu nie publikuje
Cała maszyna fizyczna: 24 rdzenie fizyczne, 256 GB pamięci ECC, konsola KVM-over-IP. Ta sama karta, ta sama Unia, prawie ta sama kwota — i inny przedmiot usługi. Pozycja obok to maszyna wirtualna z kartą przypisaną w całości: klasa, którą najłatwiej pomylić z serwerem dedykowanym, bo wygląda jak sprzęt na wyłączność, a procesor, pamięć i dysk pochodzą z hosta dzielonego z innymi maszynami. Dostawca klasyfikuje tę pozycję jako maszynę wirtualną i tak ją tu podajemy.Dłuższy okres u dostawcy: Dostawca sprzedaje okres 12-miesięczny, ale stawki dla tej pozycji nie publikuje — podaje wyłącznie cenę godzinową i miesięczną.Źródło okresów: site/trdc-okresy-rywali.js
LambdaA6000 ×4 (on-demand)maszyna wirtualna (on-demand) — nie cała maszyna fizyczna4× RTX A6000 48 GB (192 GB łącznie) w maszynie wirtualnej: 56 vCPU, 400 GB RAM z hosta, 1 TB SSD. Jedyny publikowany interwał to godzina — 1,09 $ za kartę, czyli 4,36 $ za instancję; abonamentu miesięcznego nie ma. Osobną linię bare metal Lambda ogłasza bez cennika.11 881 zł1,09 $/godz. za kartę × 4 karty × 730 godz. × kurs NBP 3,7330 = 11 881 zł/mies. — nasze przeliczenieprzy 12 mies.: 11 881 zł/mies. — u dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje7 200 złTRDC-A6000-4 · bez zobowiązaniaprzy 12 mies.: 5 976 złu nas taniej o 4 681 złich cena 11 881 zł − nasza cena 7 200 zł = 4 681 złprzy 12 mies.: u nas taniej o 5 905 złich cena 11 881 zł − nasza cena 5 976 zł = 5 905 złu dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje
Cała maszyna fizyczna z czterema kartami RTX A6000: 32 rdzenie fizyczne, 256 GB pamięci ECC i 7,68 TB NVMe. Pozycja obok ma te same cztery karty, ale jest maszyną wirtualną z 56 vCPU przydzielonymi przez hipernadzorcę. Rabatu za zobowiązanie dostawca nie publikuje — dwanaście miesięcy kosztuje dwanaście razy tę samą stawkę godzinową.Dłuższy okres u dostawcy: nie publikuje rabatu za zobowiązanieŹródło okresów: site/trdc-okresy-rywali.js
CoreWeaveHGX H200 ×8węzeł fizyczny pod Kubernetesem — bez konsoli BMC i bez własnego systemu operacyjnego8× H200 141 GB (1 128 GB łącznie), 128 vCPU, 2 048 GB RAM, rozliczenie godzinowe: 50,44 $/godz. za węzeł. Klaster stoi na gołym żelazie bez hipernadzorcy, ale klient dostaje obiekt Kubernetesa, nie serwer dedykowany. Lokalizacji w Unii cennik nie potwierdza — stawki Spot opisane są wyłącznie dla Ameryki Północnej.137 454 zł50,44 $/godz. × 730 godz. × kurs NBP 3,7330 = 137 454 zł/mies. — nasze przeliczenieprzy 12 mies.: stawki dla dłuższego okresu nie publikuje100 300 złTRDC-RACK-H200-8-2048 · bez zobowiązaniaprzy 12 mies.: 83 249 złu nas taniej o 37 154 złich cena 137 454 zł − nasza cena 100 300 zł = 37 154 złprzy 12 mies.: nie porównujemy — dostawca stawki dla dłuższego okresu nie publikuje
Maszyna dedykowana z ośmioma kartami H200 po 141 GB, 96 rdzeniami fizycznymi i pełnym dostępem administracyjnym. Pozycja obok ma te same osiem kart i również węzeł fizyczny, ale dostęp prowadzi przez Kubernetes: bez konsoli BMC i bez własnego systemu operacyjnego. Stawka dostawcy jest godzinowa — miesiąc obok to nasze przeliczenie.Dłuższy okres u dostawcy: „Reserved Compute Capacity” — strona podaje wyłącznie hasło o rabacie za zobowiązanie, bez liczb.Źródło okresów: site/trdc-okresy-rywali.js
OVHcloud (bare metal PL)HGR-AI-2 (24hgrai02-v2)cała maszyna fizyczna, abonament miesięczny2× L40S 48 GB (96 GB łącznie), 2× EPYC 9354 — 64 rdzenie fizyczne, 384 GB DDR5 ECC, 2× 3,84 TB NVMe + 2× 960 GB, łącze 10 Gb/s z prywatną siecią vRack 100 Gb/s. Cennik polski, ceny w złotych; wpisowe równe jednej racie przy taryfie miesięcznej.12 654 złcena w złotych u dostawcy — bez przeliczaniaprzy 12 mies.: 12 021 zł/mies. — ich plan roczny 12 021 zł/mies. wobec 12 654 zł/mies. za miesiąc8 100 złTRDC-RACK-L40S-2 · bez zobowiązaniaprzy 12 mies.: 6 723 złu nas taniej o 4 554 złich cena 12 654 zł − nasza cena 8 100 zł = 4 554 złprzy 12 mies.: u nas taniej o 5 298 złich cena 12 021 zł − nasza cena 6 723 zł = 5 298 zł według ich planu rocznego
Parytet kart: po obu stronach dwie L40S 48 GB. Za wyższą opłatę OVH daje mocniejszą obudowę — 64 rdzenie fizyczne wobec naszych 32 i 384 GB pamięci wobec naszych 256 GB — oraz sieć vRack; różnica w złotych stoi w kolumnie obok. To obok IQ.pl jedyny dostawca z dokumentacji wewnętrznej sprzedający całą maszynę wielokartową w Polsce bez umowy wieloletniej.Dłuższy okres u dostawcy: taryfy półrocznej nie ma — przy 6 miesiącach obowiązuje stawka miesięczna; cennik podaje 144 255,60 zł za 12 mies. (12 021,30 zł/mies.) i 288 511,20 zł za 24 mies.Źródło okresów: site/trdc-okresy-rywali.js
Scaleway (Warszawa)L40S-1-48G (pl-waw-2)maszyna wirtualna z kartą przypisaną przez PCI passthrough — nie cała maszyna fizyczna1× L40S 48 GB, 8 vCPU, 96 GiB RAM, serwerownia pl-waw-2 w Warszawie. Rozliczenie minutowe (0,0244986 €/min); kwota miesięczna 1 073,04 € to przybliżenie samego dostawcy. Całe maszyny (Dedibox GPU, 2× L40S od 1 499,99 €/mies.) Scaleway sprzedaje wyłącznie w Paryżu.4 615 zł1 073,04 €/mies. (przybliżenie dostawcy ze stawki minutowej) × kurs NBP 4,3013 = 4 615 zł/mies. — nasze przeliczenieprzy 12 mies.: 4 615 zł/mies. — u dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje4 300 złTRDC-5000-1 · bez zobowiązaniaprzy 12 mies.: 3 569 złu nas taniej o 315 złich cena 4 615 zł − nasza cena 4 300 zł = 315 złprzy 12 mies.: u nas taniej o 1 046 złich cena 4 615 zł − nasza cena 3 569 zł = 1 046 złu dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje
Cała maszyna fizyczna z kartą 48 GB o generację nowszą (RTX PRO 5000 Blackwell), 24 rdzeniami fizycznymi i 256 GB pamięci ECC — w niższej racie. Pozycja obok ma kartę przypisaną w całości przez PCI passthrough, więc usługa wygląda jak sprzęt na wyłączność, ale maszyna jest wirtualna: 8 vCPU z hosta dzielonego z innymi maszynami.Dłuższy okres u dostawcy: nie daje rabatu za zobowiązanieŹródło okresów: site/trdc-okresy-rywali.js
HetznerGEX131-1 DO POTWIERDZENIAcała maszyna fizyczna (dedicated root server), abonament miesięczny1× RTX PRO 6000 Blackwell Max-Q 96 GB, Xeon Gold 5412U — 24 rdzenie fizyczne, 256 GB DDR5 ECC, 2× 960 GB NVMe, łącze 1 Gbit/s. Bez minimalnego okresu umowy; wpisowe 599,00 €. Serwerownie w Niemczech i Finlandii.5 150 zł1 197,30 €/mies. × kurs NBP 4,3013 = 5 150 zł/mies. — nasze przeliczenieprzy 12 mies.: 5 150 zł/mies. — u dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje6 000 złTRDC-6000MQ-1 · bez zobowiązaniaprzy 12 mies.: 4 980 złu nas drożej o 850 złnasza cena 6 000 zł − ich cena 5 150 zł = 850 złprzy 12 mies.: u nas taniej o 170 złich cena 5 150 zł − nasza cena 4 980 zł = 170 złu dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje
Ta sama karta, tyle samo rdzeni fizycznych (24) i tyle samo pamięci (256 GB) — a ich opłata miesięczna jest o 850 zł niższa od naszej. Po naszej stronie: większy dysk (3,84 TB wobec 2× 960 GB) i niższa opłata startowa (900 zł wobec wpisowego 599,00 €, czyli 2 576 zł po kursie NBP). U dostawcy wiszą dziś dwie sprzeczne kwoty — cennik API podaje 1 197,30 €/mies., komunikat prasowy 889,00 €/mies. — podajemy cennikową i dlatego wiersz nosi znacznik do potwierdzenia.Dłuższy okres u dostawcy: nie daje rabatu za zobowiązanie; nalicza wpisoweŹródło okresów: site/trdc-okresy-rywali.js
Atman (Warszawa)Power RTX6000 Ncała maszyna fizyczna, umowa od 12 miesięcy2× RTX PRO 6000 Blackwell 96 GB (192 GB łącznie), 2× Xeon 6527P — 48 rdzeni fizycznych, 512 GB DDR5, Warszawa. Minimalna umowa to 12 miesięcy: 42 334 zł/mies.; przy 24 miesiącach 26 900 zł/mies., przy 36 — 22 269 zł/mies. Opłaty bez zobowiązania w cenniku nie ma.42 334 złcena w złotych u dostawcy — bez przeliczania; opłata przy ich najkrótszym sprzedawanym okresie (12 mies.)przy 12 mies.: 42 334 zł/mies. — dostawca sprzedaje wyłącznie od 12 miesięcy13 500 złTRDC-RACK-6000-2 · bez zobowiązaniaprzy 12 mies.: 11 205 złu nas taniej o 28 834 złich cena 42 334 zł − nasza cena 13 500 zł = 28 834 złprzy 12 mies.: u nas taniej o 31 129 złich cena 42 334 zł − nasza cena 11 205 zł = 31 129 złdostawca sprzedaje wyłącznie od 12 miesięcy
Dwie karty RTX PRO 6000 Blackwell 96 GB w odmianie serwerowej SE, 64 rdzenie fizyczne i 512 GB pamięci, w racie bez żadnego zobowiązania: 13 500 zł. Parytet kart po obu stronach. Kolumna „Ich cena” to opłata przy najkrótszej umowie dostawcy — 12 miesięcy; najtańsza pozycja tego cennika, 22 269 zł/mies. przy 36 miesiącach, nadal jest wyższa.Dłuższy okres u dostawcy: sprzedaje wyłącznie od 12 miesięcy — krótszego okresu nie ma w cennikuŹródło okresów: site/trdc-okresy-rywali.js
SkillHost (Wrocław)NVIDIA A6000cała maszyna fizyczna (IPMI), wyłącznie umowa 36 miesięcy1× RTX A6000 48 GB, „16 rdzeni lub więcej” (typu procesora dostawca nie podaje), od 128 GB RAM. Jedyna publikowana kwota — 2 699,99 zł/mies. — obowiązuje wyłącznie przy umowie na 36 miesięcy.2 700 złcena w złotych u dostawcy — bez przeliczania; 2 699,99 zł/mies. wyłącznie przy umowie na 36 miesięcyprzy 12 mies.: publikuje jedną cenę — wyłącznie przy umowie na 36 miesięcy2 500 złTRDC-A6000-1 · bez zobowiązaniaprzy 12 mies.: 2 075 złu nas taniej o 200 złich cena 2 700 zł − nasza cena 2 500 zł = 200 złprzy 12 mies.: nie porównujemy — dostawca publikuje jedną cenę — wyłącznie przy umowie na 36 miesięcy
W komplecie 24 rdzenie fizyczne i 256 GB pamięci ECC, wobec deklarowanych „16 rdzeni lub więcej” i 128 GB. Ta sama karta po obu stronach. Warunki mają obie strony i piszemy je wprost: kwota dostawcy wymaga zobowiązania na 36 miesięcy, a nasza TRDC-A6000-1 jest w katalogu oferowana wyłącznie na 12 miesięcy i wyłącznie klientowi biorącemu drugą maszynę.Dłuższy okres u dostawcy: publikuje jedną cenę: przy umowie na 36 miesięcyŹródło okresów: site/trdc-okresy-rywali.js
CodeBotics (Białystok)GPU Enterprisemaszyna wirtualna z kartą (vGPU; w tym planie pełna karta), kontrakt B2B od 2 kart1× RTX PRO 6000 96 GB (pełna karta w tym planie); parametrów procesora i pamięci dostawca nie publikuje. 18,00 zł/godz. albo 14 900 zł/mies. w kontrakcie B2B — minimum dwie karty, więc najmniejszy możliwy rachunek to 29 800 zł/mies.14 900 złcena w złotych u dostawcy — bez przeliczania; stawka za jedną kartę przy kontraktowym minimum dwóchprzy 12 mies.: 14 900 zł/mies. — u dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje6 000 złTRDC-6000MQ-1 · bez zobowiązaniaprzy 12 mies.: 4 980 złu nas taniej o 8 900 złich cena 14 900 zł − nasza cena 6 000 zł = 8 900 złprzy 12 mies.: u nas taniej o 9 920 złich cena 14 900 zł − nasza cena 4 980 zł = 9 920 złu dostawcy to nadal stawka miesięczna — rabatu za zobowiązanie nie daje
Jedna cała maszyna fizyczna: 24 rdzenie fizyczne, 256 GB pamięci ECC i konsola KVM-over-IP, za opłatę bez zobowiązania. Ta sama pojemność karty co w naszej TRDC-6000MQ-1; pozycja obok to maszyna wirtualna z przydziałem vGPU, a kontrakt zaczyna się od dwóch kart.Dłuższy okres u dostawcy: kontrakt 6–12 miesięcy rozliczany tą samą stawką miesięczną — rabatu za dłuższy okres nie publikujeŹródło okresów: site/trdc-okresy-rywali.js
k.pl / Kei.pl (Wrocław)NVIDIA RTX 5090cała maszyna fizyczna, abonament miesięczny1× RTX 5090 32 GB, Ryzen 9 7950X3D — 16 rdzeni fizycznych, 64 GB DDR5, Wrocław. Rozliczenie miesięczne bez umowy terminowej.1 999 złcena w złotych u dostawcy — bez przeliczaniaprzy 12 mies.: 1 999 zł/mies. — u dostawcy to nadal stawka miesięczna — dłuższego okresu nie wycenia1 900 złTRDC-A5000-1 · bez zobowiązaniaprzy 12 mies.: 1 577 złu nas taniej o 99 złich cena 1 999 zł − nasza cena 1 900 zł = 99 złprzy 12 mies.: u nas taniej o 422 złich cena 1 999 zł − nasza cena 1 577 zł = 422 złu dostawcy to nadal stawka miesięczna — dłuższego okresu nie wycenia
Prawie ta sama kwota — i uczciwie: ich karta ma więcej pamięci (32 GB wobec naszych 24 GB) i nowszą architekturę. Po naszej stronie stoi mocniejsza platforma: 24 rdzenie fizyczne wobec ich 16 i 256 GB pamięci ECC wobec ich 64 GB. Do modeli mieszczących się w 24 GB obie maszyny wystarczą — powyżej trzeba wziąć kartę 48 GB, a takiej w ich cenniku nie ma.Dłuższy okres u dostawcy: Dostawca publikuje wyłącznie stawkę miesięczną bez umowy terminowej — dłuższego okresu nie wycenia, więc przy 12 miesiącach po jego stronie obowiązuje ta sama kwota co za jeden miesiąc.Źródło okresów: site/trdc-okresy-rywali.js
Beyond.pl (Poznań)DGX B200cała maszyna fizyczna (węzeł DGX), najem na tygodnieCały węzeł DGX B200: 8× B200 (1 440 GB łącznie), 2× Xeon Platinum 8570 — 112 rdzeni fizycznych, 2 048 GB RAM, Poznań DC2. Jedyna publiczna cena to 5,10 $/godz. za kartę przy najmie na tydzień.111 184 zł5,10 $/godz. za kartę × 8 kart × 730 godz. × kurs NBP 3,7330 = 111 184 zł/mies. — nasze przeliczenie stawki tygodniowej na pełny miesiącprzy 12 mies.: stawki dla dłuższego okresu nie publikuje100 300 złTRDC-RACK-H200-8-2048 · bez zobowiązaniaprzy 12 mies.: 83 249 złu nas taniej o 10 884 złich cena 111 184 zł − nasza cena 100 300 zł = 10 884 złprzy 12 mies.: nie porównujemy — dostawca stawki dla dłuższego okresu nie publikuje
Po naszej stronie 96 rdzeni fizycznych i abonament miesięczny z opublikowaną opłatą; dostawca oferuje najem tygodniowy, a o ceny dłuższych okresów trzeba dopytać. To nie jest parytet techniczny: karty B200 w pozycji obok są o generację nowsze i większe (180 GB wobec 141 GB na kartę). Zestawiamy, bo to jedyna publiczna cena całego węzła ośmiokartowego na rynku polskim.Dłuższy okres u dostawcy: jedyna publiczna cena dotyczy najmu na jeden tydzień; pozostałe okresy — „ZAPYTAJ”Źródło okresów: site/trdc-okresy-rywali.js
Vast.ai — kontener (giełda mocy). To giełda: cenę ustala właściciel sprzętu, nie Vast — stała stawka nie istnieje, a strona cennika nie publikuje żadnej tabeli cen per model karty. Dokumentacja zna wyłącznie kontenery; opcji „cała maszyna” nie ma, a sprzęt należy do anonimowych hostów.Źródło:
Silesia DC (Katowice / Opole) — cała maszyna fizyczna. Cennik to „zapytaj o cenę” — żadnej kwoty publicznie. Przy maszynie 8× A100 ich własna specyfikacja podaje łącze 250 Mbit/s.Źródło:

Kwoty rywali w złotych są NASZYM przeliczeniem po kursie NBP tab. 148/A/NBP/2026 z 03.08.2026, o ile dostawca nie rozlicza się w złotych.

Nasza opłata przy 12 miesiącach jest niższa od opłaty bez zobowiązania, więc porównanie dla tego okresu ma sens tylko wtedy, gdy po drugiej stronie też stoi stawka dla dwunastu miesięcy. Tam, gdzie dostawca taką stawkę publikuje, liczymy przeciw niej i piszemy to wprost. Tam, gdzie nie publikuje, liczby nie ma — nie zestawiamy naszego roku z ich miesiącem i nie przenosimy stosunku cen z innej pozycji cennika.

Różnice podajemy wyłącznie w złotówkach. Procentu w tej tabeli nie ma, bo procent liczony z dwóch różnych usług niczego nie mierzy.

Tabela obejmuje wszystkich dostawców z dokumentacji wewnętrznej §A oferujących całą maszynę albo instancję GPU. Dwóch nie publikuje żadnej kwoty i dlatego stoi wyżej bez liczb — wiersza kwotowego nie zmyślamy. cyber_Folks oferty GPU nie ma w ogóle (odczyt 2026-08-08), więc nie ma go w tabeli.

Inny model rozliczeń — poza tą tabelą: część rynku (OVHcloud AI Endpoints, Together AI, Fireworks AI, OpenAI) rozlicza się za dostęp do modelu przez API, płatny za każdy przetworzony token. Dane klienta trafiają wtedy do systemu dostawcy modelu, a rachunek rośnie z każdym zapytaniem. Nasz produkt to stała opłata za maszynę na wyłączność — dane i tokeny zostają na niej. To są dwa różne produkty, a nie dwie ceny tego samego, dlatego cen za tokeny nie zestawiamy kwotowo z opłatami za maszyny.

Do czego to służy

Zapotrzebowanie liczymy jednym wzorem: liczba parametrów pomnożona przez liczbę bajtów na parametr i przez współczynnik 1,25. Współczynnik pokrywa ryczałtem pamięć podręczną kontekstu, aktywacje i narzut środowiska uruchomieniowego. Para maszyna–model trafia do oferty tylko wtedy, gdy wynik mieści się poniżej progu zajętości 0,90 pamięci karty, żeby konfiguracja nie pracowała na styk.

  • Model 8B w kwantyzacji 4-bitowej: około 5 GB pamięci karty. Mieści się na najmniejszej karcie w katalogu, czyli 24 GB, z dużym zapasem na kontekst.
  • Model 32B w kwantyzacji 4-bitowej: około 20 GB. Karta 48 GB obsługuje go razem z długim kontekstem i drugą sesją.
  • Model 70B w kwantyzacji 4-bitowej: około 44 GB. Na karcie 48 GB zajętość wypada powyżej progu 0,90, więc ta para nie trafia do oferty; właściwym doborem jest karta 96 GB.
  • Model 70B w 8 bitach: około 88 GB. Ta sama reguła wyklucza pojedynczą kartę 96 GB, więc para wymaga dwóch takich kart — 192 GB daje zajętość 0,46 — albo jednej karty H200 NVL 141 GB w serwerze rackowym.

Katalog modeli obejmuje rodziny o sprawdzonej licencji: Llama 3.1 w rozmiarach 8B i 405B oraz Llama 3.3 70B na licencji społecznościowej Meta z wymogiem oznaczenia „Built with Llama", polski Bielik 11B v3.0 na Apache 2.0, modele Mistral Small i Large oraz rodzinę Qwen 2.5 w rozmiarach 32B i 72B. W rodzinie Qwen licencje różnią się między rozmiarami: wariant 32B jest na Apache 2.0, a 72B ma licencję własną twórcy. Rozmiary tej rodziny, których licencja nie dopuszcza użycia komercyjnego, do katalogu nie wchodzą.

Porównanie i dobór

Przy modelach większych niż pamięć jednej karty warto znać jedno ograniczenie sprzętowe. Karty RTX PRO 6000 Blackwell pracują bez mostka NVLink, więc model rozłożony na dwie takie karty wymienia dane magistralą PCIe. Dla inferencji wielu niezależnych sesji jest to układ naturalny, natomiast dla jednego modelu dzielonego między układy lepiej sprawdzają się karty H200 NVL w dziale serwery GPU PCIe albo moduły SXM połączone NVLinkiem w dziale serwery DGX.

Druga oś porównania to zakres usługi u dostawców. Tę samą kartę można wynająć jako całą maszynę, jako maszynę wirtualną z kartą przypisaną w trybie passthrough albo jako kontener na współdzielonym hoście, a każdy z tych wariantów daje inny dostęp do sprzętu. W tabeli porównawczej typ usługi stoi przy każdym wierszu, obok kwoty i daty odczytu cennika. Metodę rozpoznawania typu usługi opisuje analizer ofert.

Najczęstsze pytania

Ile pamięci karty potrzebuje model 70B w kwantyzacji 4-bitowej?

Około 44 GB. Wynika to z rachunku: 70 miliardów parametrów po pół bajta na parametr daje 35 GB wag, a współczynnik 1,25 dokłada zapas na kontekst i aktywacje.

Czy mogę hostować model Llama komercyjnie?

Licencja społecznościowa Meta dopuszcza użycie komercyjne z obowiązkiem oznaczenia produktu formułą „Built with Llama" i zachowania warunków licencji. Szczegóły zależą od wersji modelu, dlatego licencja stoi przy każdej pozycji katalogu.

Kto odpowiada za licencję modelu?

Użytkownik uruchamiający model. My dostarczamy maszynę i podajemy zweryfikowaną licencję każdej pozycji, a wybór modelu oraz zgodność zastosowania z jego warunkami pozostają po stronie klienta.

Czym najem całej maszyny różni się od kontenera z kartą?

Zakresem tego, co obejmuje umowa. W najmie całej maszyny procesory, pamięć, dyski i karta należą do jednego klienta przez cały okres. W kontenerze współdzielony jest host i jego zasoby, a dostępna moc karty zależy od przydziału.

Gdzie leżą wagi modelu i dane wejściowe?

Na dyskach NVMe wynajętej maszyny. Model wgrywasz sam, a jego kopia pozostaje na tej maszynie przez okres najmu.

Czy mogę zmienić model bez zmiany maszyny?

Tak, o ile nowy model mieści się w tej samej pamięci karty. Kalkulator pokazuje zapotrzebowanie dla każdej pary model–kwantyzacja, więc przed zmianą widać, czy konfiguracja wystarczy.