Visas sistēmas darbojas Tavs IP: 18.97.14.83 info@cloudhosting.lv +371 66 66 29 69 Klientu zona
AI serveri · GB10 Blackwell

AI serveri: privāts mākslīgais intelekts uz tavas aparatūras

AI serveris, kas darbina privātu ChatGPT stila modeli uz tavas aparatūras: NVIDIA GB10 Blackwell, 128 GB VRAM, Llama 3.3 70B pilnā precizitātē 10 līdz 20 lietotājiem. Jautājumi un dokumenti neatstāj tavu tīklu.

  • Dati paliek uz tavas aparatūras
  • Ar OpenAI saderīgs API un čata UI
  • Tavā birojā vai mūsu datu centrā
AI serveri
Aparatūra

Izvēlies savu iekārtu

Abās iekārtās ir viens un tas pats GB10 Blackwell čips ar 128 GB VRAM. Piegāde Rīgā iekļauta cenā.

Populārākais

NVIDIA GB10 Blackwell

€7410.00 vienreizēji

Pēc pieprasījuma

  • GB10 Blackwell
  • 128 GB VRAM
  • 4 TB NVMe
  • Klastera atbalsts
  • Darbina Llama 3.3 70B pilnā precizitātē
  • 10 līdz 20 vienlaicīgi lietotāji

Sazinies ar mums

ASUS Ascent GX10 128GB

€5902.50 vienreizēji

Noliktavā: 50

  • GB10 Blackwell
  • 128 GB VRAM
  • 1 TB NVMe
  • Tikai viens mezgls
  • Darbina Llama 3.3 70B pilnā precizitātē
  • 10 līdz 20 vienlaicīgi lietotāji

Sazinies ar mums

Aparatūras cenas norādītas bez 21% PVN. Piegāde Rīgā iekļauta, citur pēc vienošanās.

Paātrinātāju kartes

Serveris jau ir? Paņem tikai karti

Tas pats NVIDIA silīcijs, ko liekam savās mašīnās, tikai atsevišķi. Izvēlies pēc atmiņas: tā izšķir, kurš modelis ietilps un cik daudz no tā paliks uz kartes, nevis rāpos caur sistēmas atmiņu.

NVIDIA L4 24GB

24 GB RAM
€3587.26vienreizēji Maz palicis: 1

Klusais darbarūķis: viens slots, 72 W, bez papildu barošanas kabeļa. Ietilpst praktiski jebkurā skapja serverī un mierīgi velk 7B līdz 14B modeli.

NVIDIA RTX PRO 4500 Blackwell 32GB

32 GB RAM
€3915.89vienreizēji Noliktavā: 15

Labākā atmiņa par eiro vidējā klasē. 30B klases modelis ietilpst ar rezervi. Ir ventilatori, tāpēc tās vieta ir tornī, nevis plānā skapja serverī.

Populārākais

NVIDIA L40S 48GB

48 GB RAM
€11700.00vienreizēji Pieejami līdz 50 gab.

Karte, ap kuru ir uzbūvēta lielākā daļa inferences platformu. 48 GB paņem 70B modeli kvantizētu, pasīva dzesēšana, un tā ir drošākā izvēle, ja negribi pārsteigumus.

NVIDIA RTX PRO 6000 96GB

96 GB RAM
€14609.89vienreizēji Pēc pieprasījuma

96 GB velk 70B modeli pilnā kvalitātē vai vairākus mazākus blakus. Pasīva, veidota skapim, un lētāka nekā tās pašas kartes darbstacijas versija.

NVIDIA H200 141GB NVL

141 GB RAM
€35750.00vienreizēji Pēc pieprasījuma

Līnijas augšgals. 141 GB HBM3e ar to atmiņas joslas platumu, uz kura patiesībā dzīvo apmācība un smaga inference. Pasūta projektam, nevis tur noliktavā.

Karšu cenas norādītas bez 21% PVN. Pieejamība ir tiešsaistē no mūsu izplatītāja: kas ir noliktavā, aizbrauc uzreiz, pārējo sagādājam norādītajā termiņā. Pasaki, kāds ir serveris, un pirms maksāšanas apstiprināsim, ka karte tam der.

Mēs to pārvēršam strādājošā servisā

Aparatūra pati par sevi vēl nav produkts. Ieviešana pārvērš kasti privātā mākslīgā intelekta servisā, bet pārvaldītais plāns to uztur ātru, regulāri atjauninātu un aktuālu.

Ieviešana

€5000.00 vienreizēji

  • Izpakošana un uzstādīšana pie tevis vai mūsu datu centrā
  • Modeļa izvietošana uz vLLM vai llama.cpp
  • Ar OpenAI saderīgs API un čata UI tavā LAN/VPN
  • Pēc izvēles RAG: Qdrant/pgvector, SharePoint un citi avoti
  • Drošības nostiprināšana: API atslēgas, audita žurnāls, limiti
  • Rezerves kopiju un atkopšanas plāns

Pārvaldīta uzturēšana

no €500.00 /mēn

  • Uzraudzība 24/7: GPU slodze, VRAM, rinda, aizkave
  • OS un CUDA atjauninājumi ikmēneša apkopes logā
  • Modeļu atjaunošana reizi ceturksnī (Llama 4, Qwen 3...)
  • RAG pārindeksēšana un pieskaņošana katru nakti
  • Lietotāju un piekļuves pārvaldība
  • 4 inženiera darba stundas katru mēnesi

Kāpēc savs mākslīgais intelekts

Patiešām privāts

Jautājumi, dokumenti un embeddings paliek uz iekārtas, kas pieder tev. Nekas netiek sūtīts trešo pušu AI pakalpojumiem.

Prognozējamas izmaksas

Viens aparatūras pirkums, nevis rēķini par tokeniem, kas aug ar katru jaunu lietotāju.

Pie tevis vai pie mums

Darbini savā birojā LAN tīklā vai izvieto mūsu Rīgas datu centrā ar VPN piekļuvi komandai.

Standarta integrācijas

Ar OpenAI saderīgs API nozīmē, ka esošie rīki, SDK un spraudņi strādā bez izmaiņām kodā.

Atbilstība

Rēķiniem un līgumiem nav vietas publiskajā AI

Ielīmējot klientu rēķinus, līgumus vai personāla dokumentus ChatGPT, Claude vai citā publiskā AI, tu nodod personas datus trešajai pusei, bieži ārpus ES. GDPR tam prasa juridisku pamatu un apstrādes līgumu, bet NIS2 liek tev atbildēt par saviem piegādātājiem. Savs GPT šo problēmu noņem: nekas neatstāj iekārtu, kuru kontrolē tu.

GDPR: dati paliek pie tevis

Jautājumi, dokumenti un embeddings tiek apstrādāti uz tavas iekārtas: birojā vai mūsu Rīgas datu centrā. Nekādas nodošanas trešo pušu AI pakalpojumiem un nekā, ko skaidrot regulatoram.

NIS2: piegādātāji kontrolē

ES direktīva prasa pārvaldīt piegādātāju riskus. Viena iekārta, kas pieder tev, ir īsāks piegādātāju saraksts nekā ārvalstu AI API, un mēs to uzturam kā ES pakalpojumu sniedzējs ar atbilstošu dokumentāciju.

Konfidencialitāte pēc noklusējuma

Rēķini, līgumi, medicīnas un personāla dokumenti strādā čatā un RAG tā, ka nekad neatstāj tavu tīklu: komanda iegūst AI palīgu bez klientu datu noplūdes.

Kā tas notiek

  1. 1

    Novērtējam slodzi

    Pārrunājam lietotāju skaitu, modeļus un datu avotus, un tu izvēlies iekārtu un vietu, kur tā dzīvos.

  2. 2

    Mēs ieviešam

    Aparatūra tiek piegādāta, modelis sāk darbu aiz API un čata UI, un RAG pieslēdzas taviem dokumentiem.

  3. 3

    Komanda lieto

    Darbinieki privāti strādā ar uzņēmuma zināšanām, bet pārvaldītais plāns uztur modeļus un indeksus svaigus.

Kur tas darbojas

Mūsu pašu Tier 3+ datu centrs Rīgā

Tavi pakalpojumi darbojas uz mūsu aparatūras Latvijā, ES jurisdikcijā. Otrs reģions Nīderlandē, Dubaija plānota 2026.

  • N+1 dublēta barošana un dzesēšana
  • Savs BGP tīkls ar rezervētiem pieslēgumiem
  • Uzraudzība 24/7, inženieri uz vietas 9:00 līdz 17:00
  • GDPR un datu rezidence ES

Uzzināt vairāk

CloudHosting Tier 3+ datu centrs Rīgā

Jautājumi par savu GPT

Vai to var lietot ar dokumentiem, kuros ir personas dati?

Jā, tieši tam tas ir domāts. Rēķini, līgumi, personāla un medicīnas dokumenti tiek apstrādāti uz iekārtas, kas pieder tev, tāpēc personas dati netiek nodoti trešās puses AI pakalpojumam un pašam modelim nav vajadzīgs atsevišķs apstrādes līgums. Apstrāde paliek tavā GDPR perimetrā, un NIS2 piegādātāju saraksts nekļūst garāks. Viens godīgs piebildums: tu joprojām esi datu pārzinis, tāpēc iekšējie piekļuves noteikumi paliek tavā atbildībā. Ieviešanā ietilpst API atslēgas, audita žurnāls un pieprasījumu limiti, tāpēc vari dokumentēt, kurš, kad un ko modelim jautājis. Ja šaubies par konkrētu dokumentu veidu, uzraksti atbalstam, un izrunāsim to pirms ieviešanas.

Kādus modeļus tas var darbināt?

128 GB VRAM bez problēmām darbina Llama 3.3 70B pilnā precizitātē, tas nozīmē, ka modelis strādā bez kvalitātes zuduma, ko rada kvantizācija. Mazāki lokālie modeļi, piemēram, Qwen vai Mistral, ietilpst ar lielu rezervi, un vieglāku modeli vari izvēlēties tad, ja ātrums tev ir svarīgāks par maksimālo atbilžu dziļumu. Modeļus izvietojam uz vLLM vai llama.cpp, tāpēc viena modeļa nomaiņa pret citu ir ikdienišķa darbība. Pārvaldītajā plānā modeļus atjaunojam reizi ceturksnī, ienesot tādus laidienus kā Llama 4 vai Qwen 3, tiklīdz tie iznāk. Ja nezini, kurš modelis der tavam darbam, uzraksti atbalstam, un piemeklēsim to kopā.

Vai API tiešām ir savietojams ar OpenAI?

Jā. Serviss piedāvā standarta chat-completions API tavā LAN vai VPN, tāpēc bibliotēkas, SDK un spraudņi, kas būvēti OpenAI galapunktiem, strādā, nomainot tikai bāzes URL un API atslēgu. Esošās integrācijas turpina darboties bez izmaiņām kodā, un tieši tāpēc mēs turamies pie šī standarta. Galapunkts ir sasniedzams tikai tava tīkla iekšpusē, nevis no publiskā interneta, un katrai lietotnei var izsniegt savu atslēgu. Papildus API tu saņem čata saskarni darbiniekiem, kuri vienkārši grib uzdot jautājumus pārlūkā. Ja tavā rīku komplektā ir kāds kritisks rīks, nosauc to atbalstam, un mēs pārbaudīsim tā darbību pirms ieviešanas.

Vai tas var atbildēt no mūsu iekšējiem dokumentiem?

Jā. Pēc izvēles pieejamais RAG savieno modeli ar tavām zināšanām. Dokumenti no tādiem avotiem kā SharePoint tiek pārvērsti embeddings un glabāti Qdrant vai pgvector uz tās pašas iekārtas, tāpēc arī indekss neatstāj tavu tīklu. Kad kāds uzdod jautājumu, sistēma atrod atbilstošās vietas dokumentos, un modelis atbild no tām, nevis minot. Pārvaldītajā plānā indekss tiek pārbūvēts katru nakti, tāpēc vakardienas labojumi parādās atbildēs, un mēs pieskaņojam meklēšanu, kad satura kļūst vairāk. Godīgi jāsaka: atbilžu kvalitāte ir atkarīga no tā, cik sakārtoti ir paši dokumenti. Prasot cenas piedāvājumu, uzskaiti savus avotus, un mēs apstiprināsim, ko var pieslēgt.

Kur atrodas aparatūra?

Iekārtai ir divas iespējamās mājas. Tā var stāvēt pie tevis birojā, kur darbinieki to sasniedz pa LAN un darbība nav atkarīga no interneta pieslēguma, vai arī to var izvietot mūsu pašu Tier 3+ datu centrā Rīgā, kur komanda pieslēdzas caur VPN. Abos gadījumos aparatūra ir tavs īpašums, un viss, kas uz tās glabājas, modeļi, indeksi un žurnāli ieskaitot, pieder tev. Tā kā kaste pieder tev, vari sākt birojā un vēlāk pārcelt to uz datu centru vai otrādi. Piegāde Rīgas robežās ir iekļauta pirkumā, citur piegādi saskaņojam atsevišķi, tāpēc, prasot cenu, piemini savu atrašanās vietu.

Vai pārvaldītais plāns ir obligāts?

Nē, pārvaldītais plāns nav obligāts. Jau ieviešana vien nodod tev pilnvērtīgu, nostiprinātu servisu ar rezerves kopiju un atkopšanas plānu, un no pirmās dienas vari to uzturēt pats. Tikai godīgi izvērtē, ko tas nozīmē: kādam tavā pusē tad jāseko GPU slodzei un aizkavei, jāliek OS un CUDA atjauninājumi un pašam jāatjauno modeļi. Pārvaldītais plāns no 500 EUR mēnesī noņem tieši šo darbu un dod klāt 4 inženiera stundas katru mēnesi izmaiņām un pieprasījumiem. Vari arī sākt saviem spēkiem un pieslēgt plānu vēlāk, ja uzturēšana izrādās par smagu; pietiek uzrakstīt atbalstam, un to ieslēgsim.

Cik maksā savs GPT serveris?

Domā par cenu kā par trim daļām. Pirmā ir aparatūra, vienreizējs pirkums; aktuālās iekārtu cenas redzamas šajā lapā un norādītas bez 21% PVN. Otrā ir ieviešana par 5000 EUR vienreizēji, kas ietver izvietošanu, drošības nostiprināšanu un API ar čata saskarni palaišanu darbā. Trešā ir pārvaldītais plāns pēc izvēles, sākot no 500 EUR mēnesī. Maksas par tokeniem nav, tāpēc ikmēneša izmaksas neaug, kad pievieno jaunus lietotājus vai komanda sāk lietot servisu intensīvi. Ja piemērots serveris tev jau pieder, lētākais ceļš var būt paātrinātāja karte atsevišķi. Precīzu summu tavam gadījumam saņemsi, pieprasot piedāvājumu, un mēs to izklāstīsim pa pozīcijām.

Cik lietotāju var strādāt vienlaicīgi?

Viena GB10 iekārta ar 128 GB VRAM apkalpo 10 līdz 20 vienlaicīgus lietotājus ar Llama 3.3 70B pilnā precizitātē. Vienlaicīgi nozīmē cilvēkus, kas sūta pieprasījumus vienā un tajā pašā brīdī, tāpēc kopējais kontu skaits var būt krietni lielāks: parastā birojā vienlaikus čato tikai daļa darbinieku. Ja pīķa slodze tev ir svarīgāka par maksimālo atbilžu kvalitāti, mazāks modelis atstāj vairāk rezerves. Kad komanda vienu kasti patiešām pāraug, NVIDIA GB10 iekārta atbalsta klasterēšanu, tāpēc jaudu palielina, pievienojot mezglus, nevis mainot nopirkto. Slodzes novērtēšanas sarunā pasaki darbinieku skaitu un gaidāmo lietojumu, un mēs ieteiksim piemērotu konfigurāciju.

Ar ko NVIDIA GB10 atšķiras no ASUS GX10?

Modeļu darbināšanā atšķirības nav: abas iekārtas ir būvētas uz viena un tā paša GB10 Blackwell čipa ar 128 GB VRAM, tāpēc inferences ātrums un modeļi, kas tajās ietilpst, ir vienādi. Atšķirības ir visā pārējā ap čipu. NVIDIA iekārtai ir 4 TB NVMe krātuve un klastera atbalsts, ASUS Ascent GX10 ir 1 TB un tikai viens mezgls. Praksē krātuve kļūst svarīga, kad uz kastes glabā vairākus modeļus un augošu RAG indeksu, bet klastera atbalsts der tikai tad, ja vēlāk plāno pievienot mezglus. Stabilai nelielai komandai ASUS iekārta kalpo tikpat labi. Ieviešana un pārvaldītais plāns abām ir vienādi, un piegāde Rīgā ir iekļauta abos gadījumos.

Gatavs sākt?

Palaid dažās minūtēs vai aprunājies ar inženieri par piemērotāko risinājumu.