Visas sistēmas darbojas Tavs IP: 216.73.216.38 info@cloudhosting.lv +371 66 66 29 69 Klientu zona
GPU serveri · Pēc pieprasījuma

NVIDIA GPU serveru noma pēc pieprasījuma: HGX B300, B200 un H200

CloudHosting nodrošina fiziskos (bare metal) NVIDIA GPU serverus Eiropas datu centros tavam projektam: no vienas L40S kartes līdz vairāku mezglu HGX B300 klasteriem un GB300 NVL72 statnēm. Noliktavā neko neturam: GPU modeli, atrašanās vietu, piegādes datumu, līguma termiņu un cenu par GPU stundu saskaņojam katram projektam un ierakstām līgumā, pirms tu to paraksti.

  • HGX B300, HGX B200, GB300 NVL72, H200
  • Cena par GPU stundu, saskaņota katram projektam
  • Datu centri Eiropā, līgumi no 12 mēnešiem
Trīs fiziski GPU serveri, katrā astoņi GPU, savienoti ar tīkla komutatoru
Īsumā

Galvenie fakti par mūsu fiziskajiem GPU serveriem

Īsas atbildes uz to, ko pircēji jautā vispirms. Katru punktu vēlreiz apstiprinām rakstiskajā piedāvājumā.

Pakalpojuma sniedzējsCloudHosting SIA, Latvijas hostinga uzņēmums, kas darbojas kopš 2016. gada un kam ir savs Tier 3+ datu centrs Rīgā
GPUNVIDIA HGX B300, HGX B200, GB300 NVL72, HGX H200, H100 SXM un NVL, RTX PRO 6000 Blackwell Server Edition, L40S
PieejamībaPēc pieprasījuma, noliktavā neturam. Aparatūru sagādājam tavam projektam, un rakstisku piegādes datumu tu saņem pirms līguma parakstīšanas.
Minimālais pasūtījumsViena karte PCIe GPU gadījumā, viens 8 GPU mezgls SXM platformām, viena statne GB300 NVL72 sistēmai
TermiņšNo 12 mēnešiem; garākus un vairāku gadu termiņus saskaņojam katram projektam
NorēķiniPar GPU stundu vai par mezglu mēnesī, eiro, pēc katram projektam saskaņota grafika
Atrašanās vietaEiropa. Datu centru katram projektam izvēlamies pēc jaudas un dzesēšanas vajadzībām, un valsti un konkrēto datu centru ierakstām līgumā pirms parakstīšanas.
AtbalstsUzraudzība un incidentu risināšana 24/7. Inženieri atbild darba dienās no 9:00 līdz 17:00 pēc Rīgas laika, latviski, angliski un krieviski.
LīgumsAr CloudHosting SIA saskaņā ar ES tiesībām, rēķini eiro, datu apstrādes līgums pēc pieprasījuma
Platformas

NVIDIA GPU platformas, ko nodrošinām pēc pieprasījuma

Specifikācijas tādas, kādas tās publicē NVIDIA. Katru platformu sagādājam konkrētam projektam, tāpēc visas tabulas platformas ir pēc pieprasījuma; precīzu servera modeli, CPU, RAM un lokālo krātuvi apstiprinām piedāvājumā.

Platforma Formfaktors Atmiņa vienam GPU Savienojums starp GPU Tīkls vienam GPU Enerģijas patēriņš Tipisks lietojums Pieejamība
NVIDIA HGX B300
Blackwell Ultra
8 SXM GPU vienā mezglā līdz 288 GB HBM3e NVLink 5, 1.8 TB/s katram GPU līdz 800 Gb/s (ConnectX-8) DGX B300: aptuveni 14 kW sistēmai Lielāko modeļu apmācība un inference, garš konteksts un FP4 slodzes Pēc pieprasījuma
NVIDIA HGX B200
Blackwell
8 SXM GPU vienā mezglā 180 GB HBM3e NVLink 5, 1.8 TB/s katram GPU līdz 400 Gb/s (ConnectX-7) DGX B200: aptuveni 14.3 kW sistēmai Apmācība, modeļu pielāgošana un inference ar lielu caurlaidspēju Pēc pieprasījuma
NVIDIA GB300 NVL72
Blackwell Ultra
72 GPU un 36 Grace CPU vienā statnē, šķidruma dzesēšana līdz 288 GB HBM3e; 20 TB vienā statnē NVLink 5, viens 72 GPU domēns, kopā 130 TB/s līdz 800 Gb/s (ConnectX-8) aptuveni 120 kW statnei Ļoti lieli modeļi, kam vajadzīgs viens 72 GPU NVLink domēns Pēc pieprasījuma
NVIDIA HGX H200
Hopper
8 SXM GPU vienā mezglā 141 GB HBM3e NVLink 4, 900 GB/s katram GPU līdz 400 Gb/s (ConnectX-7) līdz 700 W katram GPU; DGX H200: maksimāli 10.2 kW sistēmai Inference un modeļu pielāgošana ar nobriedušo Hopper programmatūru Pēc pieprasījuma
NVIDIA H100 SXM
Hopper
8 SXM GPU vienā mezglā 80 GB HBM3 NVLink 4, 900 GB/s katram GPU līdz 400 Gb/s (ConnectX-7) līdz 700 W katram GPU; DGX H100: maksimāli 10.2 kW sistēmai Apmācība un inference uz platformas ar plašu programmatūras atbalstu Pēc pieprasījuma
NVIDIA H100 NVL
Hopper
PCIe karte, viena vai vairākas serverī 94 GB HBM3 NVLink tilts ar vienu blakus esošo karti, 600 GB/s Atkarīgs no servera konfigurācijas līdz 400 W vienai kartei Inference un modeļu pielāgošana standarta PCIe serveros Pēc pieprasījuma
NVIDIA RTX PRO 6000 Blackwell Server Edition
Blackwell
PCIe Gen5 karte, viena vai vairākas serverī 96 GB GDDR7 ar ECC Nav Atkarīgs no servera konfigurācijas līdz 600 W vienai kartei Inference, mazāku modeļu pielāgošana, renderēšana un video Pēc pieprasījuma
NVIDIA L40S
Ada Lovelace
PCIe Gen4 karte, viena vai vairākas serverī 48 GB GDDR6 ar ECC Nav Atkarīgs no servera konfigurācijas 350 W vienai kartei Inference, grafika, renderēšana un video Pēc pieprasījuma

Dati pēc NVIDIA publicētajām specifikācijām. NVLink joslas platums norādīts kopā abos virzienos vienam GPU. Tīkla ātrums ir tīkla kartes (NIC) ātrums uz katru GPU NVIDIA DGX atsauces sistēmās, un sistēmas patēriņš norādīts NVIDIA DGX sistēmām; citu ražotāju serveri ar HGX platēm atšķiras atkarībā no modeļa un dzesēšanas. Galīgo konfigurāciju apstiprinām piedāvājumā. Vajag tikai vienu karti savam serverim? Skati mūsu AI serveru lapu

Specifikācijas pārbaudītas pēc NVIDIA avotiem:

Salīdzinājums

B300, B200 vai H200: kuru izvēlēties

Izvēlies HGX B300, ja izšķirošā ir atmiņa: katram GPU ir līdz 288 GB HBM3e, bet B200 ir 180 GB un H200 141 GB, tāpēc vienā 8 GPU mezglā ietilpst lielāki modeļi un garāks konteksts.

Pēc NVIDIA datiem B300 un B200 ir vienāds piektās paaudzes NVLink savienojums ar 1.8 TB/s katram GPU un vienāda maksimālā retinātā (sparse) FP4 veiktspēja: 144 PFLOPS 8 GPU sistēmai. B300 izvirzās priekšā blīvajā (dense) FP4 veiktspējā (108 pret 72 PFLOPS) un tīklā, kur katram GPU ir 800 Gb/s, nevis 400 Gb/s.

H200 joprojām ir pamatota izvēle inferencei un tādu modeļu pielāgošanai, kas ietilpst 141 GB vienā GPU, bet HPC kodam ar lielu FP64 slodzi B200 vai H200 der labāk nekā B300, jo Blackwell Ultra arhitektūrā NVIDIA dubulto precizitāti krasi samazināja.

Specifikācija NVIDIA HGX B300 NVIDIA HGX B200 NVIDIA HGX H200
Atmiņa vienam GPU līdz 288 GB HBM3e 180 GB HBM3e 141 GB HBM3e
GPU atmiņa 8 GPU sistēmā aptuveni 2.1 TB 1440 GB 1128 GB
Atmiņas joslas platums vienam GPU līdz 8 TB/s līdz 8 TB/s 4.8 TB/s
NVLink vienam GPU 1.8 TB/s (NVLink 5) 1.8 TB/s (NVLink 5) 900 GB/s (NVLink 4)
Blīvā (dense) FP4 veiktspēja 8 GPU sistēmai 108 PFLOPS 72 PFLOPS Nav FP4 atbalsta
NIC vienam GPU 800 Gb/s (ConnectX-8) 400 Gb/s (ConnectX-7) 400 Gb/s (ConnectX-7)
FP64 (dubultā precizitāte) Krasi samazināta, nav piemērota FP64 HPC Piemērota FP64 HPC Piemērota FP64 HPC
Enerģijas patēriņš līdz 1100 W katram GPU; DGX B300: aptuveni 14 kW sistēmai 1000 W katram GPU; DGX B200: aptuveni 14.3 kW sistēmai līdz 700 W katram GPU; DGX H200: maksimāli 10.2 kW sistēmai

Dati pēc NVIDIA. FP4 norādīta blīvā (dense) veiktspēja; retinātajā (sparse) FP4 režīmā NVIDIA norāda 144 PFLOPS gan HGX B300, gan HGX B200. B300 sistēmas atmiņa ir skaitlis no NVIDIA HGX un DGX B300 lapām. NIC un sistēmas patēriņš ir NVIDIA DGX B300, DGX B200 un DGX H200 dati; patēriņš vienam GPU HGX B300 un B200 serveros ņemts no serveru ražotāju dokumentācijas.

Pēc pieprasījuma

Ko saskaņojam katram projektam

Nekas nestāv plauktā, tāpēc katru punktu, kas nosaka izmaksas un riskus, izrunājam jau sākumā un ierakstām piedāvājumā un līgumā.

Atrašanās vieta

Datu centrs Eiropā, kas izvēlēts atbilstoši tava projekta jaudas un dzesēšanas vajadzībām, no viena mezgla līdz statnēm ar šķidruma dzesēšanu. Valsti un datu centru ierakstām līgumā.

Piegādes datums

Rakstisks datums, aiz kura stāv apstiprināta aparatūras piegāde un apstiprināts datu centrs. Atkarībā no platformas un apjoma līdz tam paiet no dažām nedēļām līdz vairākiem mēnešiem.

Līguma termiņš

Vismaz 12 mēneši, līdz pat vairāku gadu līgumam. Termiņš ietekmē cenu, tāpēc laikus pasaki, cik ilgi tev jauda būs vajadzīga.

Norēķini

Par GPU stundu vai par mezglu mēnesī, eiro, ar rēķinu un maksājumu grafiku, ko saskaņojam katram projektam.

Tīkla struktūra

NVLink katra mezgla iekšpusē. Starp mezgliem InfiniBand vai Ethernet, ko projektējam tavam mezglu skaitam un datplūsmai, plus interneta pieslēgumi.

Krātuve

Lokālais NVMe katrā mezglā atbilstoši piedāvājumā norādītajai konfigurācijai un, ja vajag, koplietojama krātuve datu kopām un kontrolpunktiem, ko projektējam katram projektam.

Pārvaldības apjoms

Root piekļuve vienmēr. Pēc pieprasījuma piegādājam OS ar uzstādītu NVIDIA draiveri un CUDA, pievienojam uzraudzību un kārtojam aparatūras nomaiņu; Kubernetes, Slurm un pārējo saskaņojam katram projektam atsevišķi.

Aparatūras nomaiņa

Kā tiek nomainīti bojāti GPU, diski un citas detaļas, saskaņojam tavai platformai un atrašanās vietai un norādām piedāvājumā.

Kā notiek GPU serveru noma

Četri soļi no tavas pirmās ziņas līdz serveriem, kuriem vari pieslēgties.

  1. 1

    Atsūti prasības

    GPU modelis un skaits, līguma termiņš, vēlamā atrašanās vieta un sākuma datums, tīkla un krātuves vajadzības un tas, vai vēlies, lai serverus pārvaldām mēs.

  2. 2

    Saņem variantus rakstiski

    Atsūtām vienu vai vairākus variantus, un katrā ir platforma, atrašanās vieta, rakstisks piegādes datums, termiņš un cena par GPU stundu vai par mezglu mēnesī.

  3. 3

    Paraksti līgumu

    Līgumu slēdz ar CloudHosting SIA saskaņā ar ES tiesībām. Valsti, datu centru un jaudas budžetu rakstiski apstiprinām pirms parakstīšanas.

  4. 4

    Nodošana un darbība

    Uzstādām serverus un nododam tos tev ar root piekļuvi. Uzraudzība un incidentu risināšana notiek 24/7; inženieri atbild darba dienās no 9:00 līdz 17:00 pēc Rīgas laika.

Kāpēc GPU darbiem fiziskais serveris

Fiziskais (bare metal) GPU serveris ir vesels serveris ar NVIDIA videokartēm, ko lieto tikai tu, un starp tavu kodu un GPU nav nekā lieka.

Bez virtualizācijas slāņa

Tava operētājsistēma darbojas tieši uz aparatūras, bez hipervizora starp tavu slodzi un GPU.

Visi GPU, pilns NVLink

Tu saņem katru mezgla GPU un pilnu NVLink topoloģiju starp tiem tieši tā, kā platforma ir projektēta.

Root piekļuve

Uzstādi operētājsistēmu, draiveri un CUDA versiju, kas vajadzīgi tavai programmatūrai, un nomaini tos, kad nepieciešams.

Prognozējama veiktspēja ar vairākiem GPU

Mezglā nestrādā neviens cits klients, tāpēc apmācības un inferences ātrums nav atkarīgs no tā, ko darbina kaimiņš.

Sava programmatūras vide

Darbini Kubernetes, Slurm, vienkāršus konteinerus vai savu plānotāju. Neko neuzspiež platforma, kuru tu nekontrolē.

Aparatūra tikai tev

Tavi dati un modeļi paliek uz mašīnām, kas atvēlētas tikai tev, līgumā norādītā valstī un datu centrā.

Ko komandas darbina uz fiziskajiem GPU serveriem

Tipiskas slodzes, kurām vajag dedicētu GPU jaudu.

Apmācība un pielāgošana

Modeļu priekšapmācība un pielāgošana 8 GPU mezglos vai vairāku mezglu klasteros ar NVLink katrā mezglā un tīklu starp mezgliem, kas projektēts tava uzdevuma apjomam.

Inference lielā apjomā

Darbini modeļus ar vLLM, TensorRT-LLM vai SGLang uz aparatūras, kas piemeklēta tavam modelim, konteksta garumam un pieprasījumu plūsmai.

Privāts LLM tavam uzņēmumam

Vajag gatavu privātu AI serveri, nevis tikai jaudu? Mūsu AI serveru lapā ir gatavas iekārtas privātam LLM un atsevišķas GPU kartes.

Apskatīt AI serverus

Pētniecība, renderēšana un video

Pētniecības slodzes, 3D renderēšana un video apstrāde, parasti uz RTX PRO 6000 Blackwell vai L40S serveriem.

Barošana un dzesēšana

Barošanu un dzesēšanu izrunājam jau sākumā

Mūsdienu GPU serveri patērē daudz vairāk elektrības nekā parastie serveri, un tas nosaka, kur tie var darboties. To izšķiram pirms līguma, nevis pēc tā.

DGX B300 un DGX B200: aptuveni 14 kW vienam mezglam

NVIDIA norāda aptuveni 14 kW DGX B300 sistēmai un aptuveni 14.3 kW DGX B200, abas ir ar gaisa dzesēšanu un 10U augstas. Jau dažiem šādiem mezgliem vajag statni ar barošanu un dzesēšanu, kas krietni pārsniedz parastas serveru statnes iespējas.

GB300 NVL72: aptuveni 120 kW statnei

GB300 NVL72 statnē ir 72 GPU un 36 Grace CPU. Pēc NVIDIA datiem tā patērē aptuveni 120 kW un prasa šķidruma dzesēšanu, tāpēc to izvietojam projektam izvēlētā augsta blīvuma datu centrā ES, kur šāda dzesēšana ir ierīkota.

Rakstiski apstiprinām pirms parakstīšanas

Katram projektam datu centru, jaudas budžetu un dzesēšanu rakstiski apstiprinām, pirms tiek parakstīts līgums. Ja kāda vieta slodzi neiztur, mēs to pasakām un piedāvājam tādu, kas iztur.

Izvieto savus serverus vai pērc, nevis nomā

Divas alternatīvas nomai: izvieto pie mums GPU serverus, kas tev jau pieder, vai nopērc aparatūru savā īpašumā.

Izvieto savus GPU serverus

Tev jau ir HGX vai PCIe GPU serveri? Jautā par serveru izvietošanu: atsūti servera modeli, vienību skaitu un nominālo jaudu, un pirms aparatūras nosūtīšanas mēs pārbaudām pieejamo barošanu un dzesēšanu un saskaņojam izvietojumu katram projektam. Savus serverus vari apvienot ar nomātu jaudu vienā līgumā.

Pērc, nevis nomā

Ja labāk gribi, lai aparatūra pieder tev, pārdodam NVIDIA kartes no L4 līdz H200 NVL taviem serveriem, kā arī pilnus serverus, kas salikti pēc tavas specifikācijas.

Kāpēc CloudHosting

Fakti, ko vari pārbaudīt, pirms paraksti līgumu.

ES uzņēmums kopš 2016. gada

CloudHosting SIA ir Latvijas uzņēmums. Līgums un rēķini ir eiro saskaņā ar ES tiesībām, un mūsu klienti ir visā pasaulē.

Savs Tier 3+ datu centrs

Mēs paši uzturam savu datu centru Bērzaunes ielā 1, Rīgā, ar N+1 barošanu un dzesēšanu.

Savs tīkls, AS58269

Savu IP adrešu telpu anonsējam caur savu BGP tīklu AS58269 ar dublētiem pieslēgumiem.

Datu centri Eiropā

Tavi serveri darbojas projektam izvēlētā Eiropas datu centrā, un valsts un datu centrs ir norādīti līgumā.

Inženieri, kas atbild

Uzraudzība un incidentu risināšana 24/7. Inženieri atbild darba dienās no 9:00 līdz 17:00 pēc Rīgas laika, latviski, angliski un krieviski.

Viens piegādātājs: nomā vai pērc

Nomā jebko no viena GPU servera līdz vairāku mezglu klasteriem, pērc GPU kartes un serverus savā īpašumā vai pēc jaudas pārbaudes izvieto pie mums aparatūru, kas tev jau pieder.

Pastāsti, kas tev vajadzīgs

Atsūti GPU modeli, GPU vai mezglu skaitu, termiņu un vēlamo atrašanās vietu. Atbildēsim ar variantiem, katram ar rakstisku piegādes datumu. Inženieri atbild darba dienās no 9:00 līdz 17:00 pēc Rīgas laika.

Jautājumi par fiziskajiem GPU serveriem

Kur Eiropā var nomāt fiziskus NVIDIA B300 serverus?

CloudHosting SIA, Latvijas hostinga uzņēmums, pēc pieprasījuma nodrošina fiziskos NVIDIA HGX B300 serverus klientiem Eiropā un visā pasaulē. B300 jaudu noliktavā neturam: to sagādājam tavam projektam, un atrašanās vietu, piegādes datumu, līguma termiņu un cenu par GPU stundu saskaņojam pirms parakstīšanas. Serveri darbojas Eiropas datu centrā, kas izvēlēts atbilstoši projekta jaudas un dzesēšanas vajadzībām, sākot no viena 8 GPU mezgla līdz lieliem klasteriem un statnes mēroga sistēmām ar šķidruma dzesēšanu. Valsti un datu centru ierakstām līgumā pirms parakstīšanas, un tu saņem root piekļuvi dedicētai aparatūrai, ko neizmanto neviens cits klients.

Cik maksā NVIDIA B300 noma par GPU stundu?

CloudHosting B300 nomas cenu piedāvājumu gatavo katram projektam atsevišķi, par GPU stundu vai par mezglu mēnesī, eiro, un cenrādi nepublicē; tāpat tiek aprēķināta B200, H200 un H100 GPU noma un GPU klasteru noma. Cena ir atkarīga no līguma termiņa, mezglu skaita, vajadzīgā piegādes datuma, atrašanās vietas un tās elektroenerģijas izmaksām, tīkla starp mezgliem, krātuves, maksājumu grafika un no tā, cik lielu darbības daļu pārvaldām mēs. Ilgāks termiņš un lielāks apjoms parasti samazina cenu par GPU stundu. Lai saņemtu rakstisku piedāvājumu, atsūti GPU modeli un skaitu, termiņu, vēlamo atrašanās vietu un sākuma datumu, vajadzīgo tīklu un krātuvi un norādi, vai vēlies, lai serverus pārvaldām mēs. Atbildēsim ar variantiem, un katrā būs atrašanās vieta, piegādes datums un cena.

Ar ko NVIDIA B300 atšķiras no B200?

B300 (Blackwell Ultra) ir vairāk atmiņas un ātrāks tīkls nekā B200, bet NVLink paaudze abiem ir vienāda. Katram B300 GPU ir līdz 288 GB HBM3e atmiņas, B200 ir 180 GB, un NVIDIA DGX sistēmās katrs B300 GPU saņem 800 Gb/s ConnectX-8 NIC, bet B200 400 Gb/s ConnectX-7. Abiem katram GPU ir 1.8 TB/s piektās paaudzes NVLink. NVIDIA norāda, ka 8 GPU HGX B300 sistēmas blīvā (dense) FP4 veiktspēja ir 108 PFLOPS, bet HGX B200 sistēmas 72 PFLOPS; retinātajā (sparse) FP4 režīmā maksimums abām ir 144 PFLOPS. B300 FP64 veiktspēja ir krasi samazināta, tāpēc dubultās precizitātes HPC darbiem labāk der B200. DGX B300 patērē aptuveni 14 kW, DGX B200 aptuveni 14.3 kW.

Vai NVIDIA B300 ir labāks par H200?

Lieliem modeļiem jā: B300 ir aptuveni divreiz vairāk atmiņas vienam GPU un jaunāka arhitektūra, taču H200 joprojām labi der daudzām slodzēm. B300 GPU ir līdz 288 GB HBM3e ar joslas platumu līdz 8 TB/s, bet H200 ir 141 GB ar 4.8 TB/s. B300 ir arī piektās paaudzes NVLink ar 1.8 TB/s katram GPU, divreiz vairāk nekā H200 900 GB/s. H200 patērē līdz 700 W vienam GPU, un DGX H200 sistēma maksimāli 10.2 kW, tāpēc vienam mezglam vajag mazāk barošanas un dzesēšanas. Ja tavs modelis un pakete (batch) ietilpst 141 GB vienā GPU, H200 ar pārbaudīto Hopper programmatūru var būt praktiskākā izvēle. Piedāvājumu sagatavojam abiem.

Ar ko HGX B300 atšķiras no DGX B300?

HGX B300 ir NVIDIA platforma ar astoņiem Blackwell Ultra SXM GPU uz vienas pamatplates, uz kuras serveru ražotāji būvē savus serverus, bet DGX B300 ir pašas NVIDIA pilna 10U sistēma ar tiem pašiem astoņiem GPU. Abās katram GPU ir līdz 288 GB HBM3e un 1.8 TB/s piektās paaudzes NVLink, tāpēc vienā 8 GPU mezglā pēc NVIDIA datiem ir aptuveni 2.1 TB GPU atmiņas. Atšķiras pārējais serveris: HGX B300 serveros korpusu, procesorus, atmiņu, krātuvi un dzesēšanu izvēlas ražotājs, un ir gan gaisa, gan šķidruma dzesēšanas versijas, bet DGX B300 ir ar gaisa dzesēšanu, diviem Intel Xeon 6776P procesoriem un pēc NVIDIA datiem patērē aptuveni 14 kW. CloudHosting piedāvājumā precīzs servera ražotājs un modelis ir nosaukts pirms parakstīšanas.

Ar ko HGX B300 atšķiras no GB300 NVL72?

HGX B300 ir 8 GPU servera mezgls, bet GB300 NVL72 ir pilna statne ar šķidruma dzesēšanu, kas apvieno 72 Blackwell Ultra GPU un 36 NVIDIA Grace CPU vienā NVLink domēnā. Abos ir tas pats Blackwell Ultra GPU ar līdz 288 GB HBM3e un 1.8 TB/s NVLink katram GPU. HGX B300 mezglā NVLink savieno 8 GPU, un lielāki uzdevumi iet caur tīklu starp mezgliem; GB300 NVL72 statnē pēc NVIDIA datiem visi 72 GPU ir vienā 130 TB/s NVLink domēnā ar 20 TB GPU atmiņas. Atšķirība ir barošanā un dzesēšanā: DGX B300 mezgls patērē aptuveni 14 kW, bet GB300 NVL72 statne aptuveni 120 kW, un tai vajag šķidruma dzesēšanu. Minimālais pasūtījums ir viens 8 GPU mezgls HGX B300 gadījumā un viena pilna statne GB300 NVL72 gadījumā.

Cik daudz atmiņas ir NVIDIA B300?

Katram NVIDIA B300 (Blackwell Ultra) GPU ir līdz 288 GB HBM3e atmiņas ar joslas platumu līdz 8 TB/s. Tāpēc 8 GPU HGX B300 vai DGX B300 sistēmā ir vairāk nekā 2 TB GPU atmiņas; NVIDIA HGX un DGX B300 lapās kopapjoms norādīts aptuveni 2.1 TB. Salīdzinājumam: B200 ir 180 GB vienam GPU un 1440 GB 8 GPU sistēmā, bet H200 ir 141 GB vienam GPU un 1128 GB sistēmā. GB300 NVL72 statnei NVIDIA norāda 20 TB GPU atmiņas uz 72 GPU, un visi tie ir vienā NVLink domēnā. Tieši atmiņa vienam GPU nosaka, cik liels modelis un cik garš konteksts ietilpst vienā mezglā.

Cik daudz elektrības vajag B300 serverim?

Pēc NVIDIA datiem 8 GPU NVIDIA DGX B300 sistēma patērē aptuveni 14 kW, un tā ir ar gaisa dzesēšanu 10U korpusā. Citu ražotāju serveri ar HGX B300 plati atšķiras atkarībā no modeļa: NVIDIA norāda līdz 1400 W vienam Blackwell Ultra čipam, un ražotāju HGX B300 sistēmās katrs GPU strādā ar līdz 1100 W, gaisa vai šķidruma dzesēšanas versijās. Statnes mēroga sistēmai GB300 NVL72 vajag aptuveni 120 kW uz statni un šķidruma dzesēšanu. Tas ir krietni vairāk, nekā paredzēts parastai serveru statnei, tāpēc barošana un dzesēšana nosaka, kur B300 instalācija var darboties. Datu centru un jaudas budžetu rakstiski apstiprinām pirms parakstīšanas.

Kāds ir minimālais pasūtījums un līguma termiņš GPU serveriem?

CloudHosting minimālais pasūtījums PCIe GPU, piemēram, L40S, RTX PRO 6000 Blackwell Server Edition vai H100 NVL, ir viena karte. SXM platformām, piemēram, HGX B300, HGX B200, HGX H200 vai H100 SXM, tas ir viens 8 GPU mezgls, bet GB300 NVL72 gadījumā viena pilna statne. Minimālais līguma termiņš ir 12 mēneši; garākus un vairāku gadu termiņus saskaņojam katram projektam un ierakstām līgumā kopā ar norēķinu vienību un maksājumu grafiku. Rēķinus izrakstām par GPU stundu vai par mezglu mēnesī, eiro. Termiņš ietekmē gan cenu, gan piegādes iespējas, tāpēc laikus pasaki, cik ilgi tev jauda būs vajadzīga.

Cik ilgi jāgaida GPU serveru piegāde?

CloudHosting GPU serveru piegāde aizņem no dažām nedēļām līdz vairākiem mēnešiem, un rakstisku piegādes datumu tu saņem pirms parakstīšanas. Noliktavā neko neturam, tāpēc datums ir atkarīgs no platformas, no NVIDIA un serveru ražotāju piegādēm pieprasījuma brīdī, no mezglu skaita un no tā, vai izvēlētajā datu centrā barošana un dzesēšana jau ir sagatavota. Platformas ar lielu pieprasījumu, piemēram, jauni HGX B300 klasteri vai GB300 NVL72 statnes, parasti prasa ilgāku laiku nekā PCIe konfigurācijas. Mēs nesolām jaudu, kurai nevaram nosaukt datumu: piegādes datums tavā piedāvājumā ir tāds, ko varam pamatot ar apstiprinātu aparatūras piegādi un apstiprinātu datu centru, un tas tiek ierakstīts līgumā.

Vai fiziskais serveris ir labāks par GPU instanci mākonī?

Ilgām apmācībām un stabilai inferencei parasti jā: tu saņem visu fizisko serveri bez virtualizācijas slāņa, visus tā GPU, pilnu NVLink topoloģiju starp tiem un root piekļuvi. Uzdevumi ar vairākiem GPU uzvedas prognozējami, jo mezglā nestrādā neviens cits klients, un tu pats uzstādi operētājsistēmu, draiveri, CUDA versiju, konteineru vidi un plānotāju. Kompromiss ir tāds, ka jauda līguma termiņa laikā ir fiksēta: klusā nedēļā to nevar samazināt līdz nullei, un programmatūru uzturi pats, ja vien neesam saskaņojuši pārvaldības apjomu. Mākoņa GPU instances der īsiem eksperimentiem un svārstīgai slodzei; fiziskais serveris der ilgstošam darbam, kur vajag visu mezglu.

Vai GPU klasterim vajag InfiniBand, vai pietiek ar Ethernet?

Viena 8 GPU mezgla iekšpusē nevajag ne vienu, ne otru: GPU sazinās pa NVLink, un tīkls kļūst svarīgs tikai tad, kad uzdevums aptver vairākus mezglus. Vairāku mezglu apmācībā tīkls starp mezgliem pārnes kolektīvo datplūsmu, piemēram, NCCL all-reduce, tāpēc tam jābūt ātram un bez bloķēšanas (non-blocking). NVIDIA šajās platformās atbalsta gan InfiniBand, gan Ethernet ar RoCE, un tās B300 atsauces sistēmās katram GPU ir ConnectX-8 NIC ar ātrumu līdz 800 Gb/s, kas strādā abos režīmos. InfiniBand ir iedibināta izvēle lieliem apmācību klasteriem; Ethernet labi der, ja tas atbilst tavam esošajam tīklam un rīkiem. Tīklu projektējam katram projektam tavam mezglu skaitam, topoloģijai un krātuves datplūsmai un iekļaujam to piedāvājumā.

Vai pie jums var izvietot savus HGX vai GPU serverus?

Jā, savus GPU serverus vari novietot pie CloudHosting, izmantojot serveru izvietošanas pakalpojumu, bet vispirms pārbaudām, vai tiem pietiek jaudas. Standarta izvietošana mūsu Tier 3+ datu centrā Rīgā der serveriem ar parastu jaudas budžetu. 8 GPU sistēma, piemēram, DGX B300, viena pati var patērēt aptuveni 14 kW, tāpēc blīviem GPU serveriem vispirms pārbaudām pieejamo barošanu un dzesēšanu un izvietojumu saskaņojam katram projektam. Nosauc servera modeli, vienību skaitu un nominālo jaudu, un mēs rakstiski apstiprināsim, kur un kā aparatūru var uzstādīt. Savus serverus vari arī apvienot ar GPU jaudu, ko nomā pie mums, vienā līgumā.

Kur atrodas mani dati, un ar ko es slēdzu līgumu?

Tavs līgums ir ar CloudHosting SIA, Latvijas uzņēmumu, kas darbojas kopš 2016. gada, saskaņā ar ES tiesībām un ar rēķiniem eiro. Valsti un datu centru, kurā darbosies tavi serveri, ierakstām līgumā pirms parakstīšanas, tāpēc tu precīzi zini, kur atrodas tavi dati. Tavi serveri darbojas Eiropas datu centrā, ko izvēlamies pēc jaudas un dzesēšanas, kas vajadzīga taviem GPU, un ņemam vērā tavas vēlmes attiecībā uz valsti. GDPR vajadzībām pēc pieprasījuma parakstām datu apstrādes līgumu. Fiziskajā serverī tev ir root piekļuve, un tu kontrolē, kas uz serveriem darbojas un kur nonāk dati.

Kādu atbalstu saņemšu ar fiziskajiem GPU serveriem?

CloudHosting uzraudzība un incidentu risināšana notiek 24/7, un mūsu inženieri atbild darba dienās no 9:00 līdz 17:00 pēc Rīgas laika, latviski, angliski un krieviski. Root piekļuve serveriem tev ir vienmēr. Pēc pieprasījuma piegādājam serverus ar uzstādītu operētājsistēmu, NVIDIA draiveri un CUDA, pievienojam uzraudzību un kārtojam aparatūras nomaiņu, bet orķestrēšanu, piemēram, Kubernetes vai Slurm, saskaņojam katram projektam atsevišķi. Kā tiek nomainīti bojāti GPU, diski, barošanas bloki un citas detaļas, ir atkarīgs no tavas platformas un atrašanās vietas, tāpēc to norādām piedāvājumā un saskaņojam pirms parakstīšanas. Laikus pasaki, kuras darbības daļas vēlies uzticēt mums, jo pārvaldības apjoms ietekmē cenu.

Vai var pasūtīt NVIDIA Vera Rubin sistēmas?

Jā, pieņemam pieprasījumus NVIDIA Vera Rubin sistēmām, un piegāde ir atkarīga no tā, cik NVIDIA piešķir. Vera Rubin ir NVIDIA platforma, kas seko Blackwell Ultra; NVIDIA sāka sērijveida piegādes 2026. gadā, un pieejamais apjoms joprojām ir ierobežots, tāpēc lielākajai daļai pircēju termiņi ir neskaidri. Pastāsti, kura konfigurācija tevi interesē, cik mezglu vai statņu vajag un kādā laika posmā, un mēs pateiksim, ko un kad varam apstiprināt. Piegādes datumu nesolām, kamēr nevaram to apstiprināt rakstiski. Ja jauda vajadzīga ātrāk, varam sagatavot piedāvājumu HGX B300, HGX B200 vai GB300 NVL72 pagaidu risinājumam un plānot pāreju uz Vera Rubin, tiklīdz to var piegādāt.