NVIDIA L4 24GB
Klusais darbarūķis: viens slots, 72 W, bez papildu barošanas kabeļa. Ietilpst praktiski jebkurā skapja serverī un mierīgi velk 7B līdz 14B modeli.
AI serveris, kas darbina privātu ChatGPT stila modeli uz tavas aparatūras: NVIDIA GB10 Blackwell, 128 GB VRAM, Llama 3.3 70B pilnā precizitātē 10 līdz 20 lietotājiem. Jautājumi un dokumenti neatstāj tavu tīklu.
Abās iekārtās ir viens un tas pats GB10 Blackwell čips ar 128 GB VRAM. Piegāde Rīgā iekļauta cenā.
€7410.00 vienreizēji
Pēc pieprasījuma
€5902.50 vienreizēji
Noliktavā: 50
Aparatūras cenas norādītas bez 21% PVN. Piegāde Rīgā iekļauta, citur pēc vienošanās.
Tas pats NVIDIA silīcijs, ko liekam savās mašīnās, tikai atsevišķi. Izvēlies pēc atmiņas: tā izšķir, kurš modelis ietilps un cik daudz no tā paliks uz kartes, nevis rāpos caur sistēmas atmiņu.
Klusais darbarūķis: viens slots, 72 W, bez papildu barošanas kabeļa. Ietilpst praktiski jebkurā skapja serverī un mierīgi velk 7B līdz 14B modeli.
Labākā atmiņa par eiro vidējā klasē. 30B klases modelis ietilpst ar rezervi. Ir ventilatori, tāpēc tās vieta ir tornī, nevis plānā skapja serverī.
Karte, ap kuru ir uzbūvēta lielākā daļa inferences platformu. 48 GB paņem 70B modeli kvantizētu, pasīva dzesēšana, un tā ir drošākā izvēle, ja negribi pārsteigumus.
96 GB velk 70B modeli pilnā kvalitātē vai vairākus mazākus blakus. Pasīva, veidota skapim, un lētāka nekā tās pašas kartes darbstacijas versija.
Līnijas augšgals. 141 GB HBM3e ar to atmiņas joslas platumu, uz kura patiesībā dzīvo apmācība un smaga inference. Pasūta projektam, nevis tur noliktavā.
Karšu cenas norādītas bez 21% PVN. Pieejamība ir tiešsaistē no mūsu izplatītāja: kas ir noliktavā, aizbrauc uzreiz, pārējo sagādājam norādītajā termiņā. Pasaki, kāds ir serveris, un pirms maksāšanas apstiprināsim, ka karte tam der.
Aparatūra pati par sevi vēl nav produkts. Ieviešana pārvērš kasti privātā mākslīgā intelekta servisā, bet pārvaldītais plāns to uztur ātru, regulāri atjauninātu un aktuālu.
€5000.00 vienreizēji
no €500.00 /mēn
Jautājumi, dokumenti un embeddings paliek uz iekārtas, kas pieder tev. Nekas netiek sūtīts trešo pušu AI pakalpojumiem.
Viens aparatūras pirkums, nevis rēķini par tokeniem, kas aug ar katru jaunu lietotāju.
Darbini savā birojā LAN tīklā vai izvieto mūsu Rīgas datu centrā ar VPN piekļuvi komandai.
Ar OpenAI saderīgs API nozīmē, ka esošie rīki, SDK un spraudņi strādā bez izmaiņām kodā.
Ielīmējot klientu rēķinus, līgumus vai personāla dokumentus ChatGPT, Claude vai citā publiskā AI, tu nodod personas datus trešajai pusei, bieži ārpus ES. GDPR tam prasa juridisku pamatu un apstrādes līgumu, bet NIS2 liek tev atbildēt par saviem piegādātājiem. Savs GPT šo problēmu noņem: nekas neatstāj iekārtu, kuru kontrolē tu.
Jautājumi, dokumenti un embeddings tiek apstrādāti uz tavas iekārtas: birojā vai mūsu Rīgas datu centrā. Nekādas nodošanas trešo pušu AI pakalpojumiem un nekā, ko skaidrot regulatoram.
ES direktīva prasa pārvaldīt piegādātāju riskus. Viena iekārta, kas pieder tev, ir īsāks piegādātāju saraksts nekā ārvalstu AI API, un mēs to uzturam kā ES pakalpojumu sniedzējs ar atbilstošu dokumentāciju.
Rēķini, līgumi, medicīnas un personāla dokumenti strādā čatā un RAG tā, ka nekad neatstāj tavu tīklu: komanda iegūst AI palīgu bez klientu datu noplūdes.
Pārrunājam lietotāju skaitu, modeļus un datu avotus, un tu izvēlies iekārtu un vietu, kur tā dzīvos.
Aparatūra tiek piegādāta, modelis sāk darbu aiz API un čata UI, un RAG pieslēdzas taviem dokumentiem.
Darbinieki privāti strādā ar uzņēmuma zināšanām, bet pārvaldītais plāns uztur modeļus un indeksus svaigus.
Tavi pakalpojumi darbojas uz mūsu aparatūras Latvijā, ES jurisdikcijā. Otrs reģions Nīderlandē, Dubaija plānota 2026.
Pamācības par AI aģentiem, privātiem modeļiem un pašhostētu AI no mūsu komandas.
Jā, tieši tam tas ir domāts. Rēķini, līgumi, personāla un medicīnas dokumenti tiek apstrādāti uz iekārtas, kas pieder tev, tāpēc personas dati netiek nodoti trešās puses AI pakalpojumam un pašam modelim nav vajadzīgs atsevišķs apstrādes līgums. Apstrāde paliek tavā GDPR perimetrā, un NIS2 piegādātāju saraksts nekļūst garāks. Viens godīgs piebildums: tu joprojām esi datu pārzinis, tāpēc iekšējie piekļuves noteikumi paliek tavā atbildībā. Ieviešanā ietilpst API atslēgas, audita žurnāls un pieprasījumu limiti, tāpēc vari dokumentēt, kurš, kad un ko modelim jautājis. Ja šaubies par konkrētu dokumentu veidu, uzraksti atbalstam, un izrunāsim to pirms ieviešanas.
128 GB VRAM bez problēmām darbina Llama 3.3 70B pilnā precizitātē, tas nozīmē, ka modelis strādā bez kvalitātes zuduma, ko rada kvantizācija. Mazāki lokālie modeļi, piemēram, Qwen vai Mistral, ietilpst ar lielu rezervi, un vieglāku modeli vari izvēlēties tad, ja ātrums tev ir svarīgāks par maksimālo atbilžu dziļumu. Modeļus izvietojam uz vLLM vai llama.cpp, tāpēc viena modeļa nomaiņa pret citu ir ikdienišķa darbība. Pārvaldītajā plānā modeļus atjaunojam reizi ceturksnī, ienesot tādus laidienus kā Llama 4 vai Qwen 3, tiklīdz tie iznāk. Ja nezini, kurš modelis der tavam darbam, uzraksti atbalstam, un piemeklēsim to kopā.
Jā. Serviss piedāvā standarta chat-completions API tavā LAN vai VPN, tāpēc bibliotēkas, SDK un spraudņi, kas būvēti OpenAI galapunktiem, strādā, nomainot tikai bāzes URL un API atslēgu. Esošās integrācijas turpina darboties bez izmaiņām kodā, un tieši tāpēc mēs turamies pie šī standarta. Galapunkts ir sasniedzams tikai tava tīkla iekšpusē, nevis no publiskā interneta, un katrai lietotnei var izsniegt savu atslēgu. Papildus API tu saņem čata saskarni darbiniekiem, kuri vienkārši grib uzdot jautājumus pārlūkā. Ja tavā rīku komplektā ir kāds kritisks rīks, nosauc to atbalstam, un mēs pārbaudīsim tā darbību pirms ieviešanas.
Jā. Pēc izvēles pieejamais RAG savieno modeli ar tavām zināšanām. Dokumenti no tādiem avotiem kā SharePoint tiek pārvērsti embeddings un glabāti Qdrant vai pgvector uz tās pašas iekārtas, tāpēc arī indekss neatstāj tavu tīklu. Kad kāds uzdod jautājumu, sistēma atrod atbilstošās vietas dokumentos, un modelis atbild no tām, nevis minot. Pārvaldītajā plānā indekss tiek pārbūvēts katru nakti, tāpēc vakardienas labojumi parādās atbildēs, un mēs pieskaņojam meklēšanu, kad satura kļūst vairāk. Godīgi jāsaka: atbilžu kvalitāte ir atkarīga no tā, cik sakārtoti ir paši dokumenti. Prasot cenas piedāvājumu, uzskaiti savus avotus, un mēs apstiprināsim, ko var pieslēgt.
Iekārtai ir divas iespējamās mājas. Tā var stāvēt pie tevis birojā, kur darbinieki to sasniedz pa LAN un darbība nav atkarīga no interneta pieslēguma, vai arī to var izvietot mūsu pašu Tier 3+ datu centrā Rīgā, kur komanda pieslēdzas caur VPN. Abos gadījumos aparatūra ir tavs īpašums, un viss, kas uz tās glabājas, modeļi, indeksi un žurnāli ieskaitot, pieder tev. Tā kā kaste pieder tev, vari sākt birojā un vēlāk pārcelt to uz datu centru vai otrādi. Piegāde Rīgas robežās ir iekļauta pirkumā, citur piegādi saskaņojam atsevišķi, tāpēc, prasot cenu, piemini savu atrašanās vietu.
Nē, pārvaldītais plāns nav obligāts. Jau ieviešana vien nodod tev pilnvērtīgu, nostiprinātu servisu ar rezerves kopiju un atkopšanas plānu, un no pirmās dienas vari to uzturēt pats. Tikai godīgi izvērtē, ko tas nozīmē: kādam tavā pusē tad jāseko GPU slodzei un aizkavei, jāliek OS un CUDA atjauninājumi un pašam jāatjauno modeļi. Pārvaldītais plāns no 500 EUR mēnesī noņem tieši šo darbu un dod klāt 4 inženiera stundas katru mēnesi izmaiņām un pieprasījumiem. Vari arī sākt saviem spēkiem un pieslēgt plānu vēlāk, ja uzturēšana izrādās par smagu; pietiek uzrakstīt atbalstam, un to ieslēgsim.
Domā par cenu kā par trim daļām. Pirmā ir aparatūra, vienreizējs pirkums; aktuālās iekārtu cenas redzamas šajā lapā un norādītas bez 21% PVN. Otrā ir ieviešana par 5000 EUR vienreizēji, kas ietver izvietošanu, drošības nostiprināšanu un API ar čata saskarni palaišanu darbā. Trešā ir pārvaldītais plāns pēc izvēles, sākot no 500 EUR mēnesī. Maksas par tokeniem nav, tāpēc ikmēneša izmaksas neaug, kad pievieno jaunus lietotājus vai komanda sāk lietot servisu intensīvi. Ja piemērots serveris tev jau pieder, lētākais ceļš var būt paātrinātāja karte atsevišķi. Precīzu summu tavam gadījumam saņemsi, pieprasot piedāvājumu, un mēs to izklāstīsim pa pozīcijām.
Viena GB10 iekārta ar 128 GB VRAM apkalpo 10 līdz 20 vienlaicīgus lietotājus ar Llama 3.3 70B pilnā precizitātē. Vienlaicīgi nozīmē cilvēkus, kas sūta pieprasījumus vienā un tajā pašā brīdī, tāpēc kopējais kontu skaits var būt krietni lielāks: parastā birojā vienlaikus čato tikai daļa darbinieku. Ja pīķa slodze tev ir svarīgāka par maksimālo atbilžu kvalitāti, mazāks modelis atstāj vairāk rezerves. Kad komanda vienu kasti patiešām pāraug, NVIDIA GB10 iekārta atbalsta klasterēšanu, tāpēc jaudu palielina, pievienojot mezglus, nevis mainot nopirkto. Slodzes novērtēšanas sarunā pasaki darbinieku skaitu un gaidāmo lietojumu, un mēs ieteiksim piemērotu konfigurāciju.
Modeļu darbināšanā atšķirības nav: abas iekārtas ir būvētas uz viena un tā paša GB10 Blackwell čipa ar 128 GB VRAM, tāpēc inferences ātrums un modeļi, kas tajās ietilpst, ir vienādi. Atšķirības ir visā pārējā ap čipu. NVIDIA iekārtai ir 4 TB NVMe krātuve un klastera atbalsts, ASUS Ascent GX10 ir 1 TB un tikai viens mezgls. Praksē krātuve kļūst svarīga, kad uz kastes glabā vairākus modeļus un augošu RAG indeksu, bet klastera atbalsts der tikai tad, ja vēlāk plāno pievienot mezglus. Stabilai nelielai komandai ASUS iekārta kalpo tikpat labi. Ieviešana un pārvaldītais plāns abām ir vienādi, un piegāde Rīgā ir iekļauta abos gadījumos.
Palaid dažās minūtēs vai aprunājies ar inženieri par piemērotāko risinājumu.