NVIDIA L4 24GB
Klusais darbarūķis: viens slots, 72 W, bez papildu barošanas kabeļa. Ietilpst praktiski jebkurā skapja serverī un mierīgi velk 7B līdz 14B modeli.
AI serveris, kas darbina privātu ChatGPT stila modeli uz tavas aparatūras: NVIDIA GB10 Blackwell, 128 GB VRAM, Llama 3.3 70B pilnā precizitātē 10 līdz 20 lietotājiem. Jautājumi un dokumenti neatstāj tavu tīklu.
Abās iekārtās ir viens un tas pats GB10 Blackwell čips ar 128 GB VRAM. Piegāde Rīgā iekļauta cenā.
€6975.00 vienreizēji
Noliktavā: 35
€5415.00 vienreizēji
Noliktavā: 50
Aparatūras cenas norādītas bez 21% PVN. Piegāde Rīgā iekļauta, citur pēc vienošanās.
Tas pats NVIDIA silīcijs, ko liekam savās mašīnās, tikai atsevišķi. Izvēlies pēc atmiņas: tā izšķir, kurš modelis ietilps un cik daudz no tā paliks uz kartes, nevis rāpos caur sistēmas atmiņu.
Klusais darbarūķis: viens slots, 72 W, bez papildu barošanas kabeļa. Ietilpst praktiski jebkurā skapja serverī un mierīgi velk 7B līdz 14B modeli.
Labākā atmiņa par eiro vidējā klasē. 30B klases modelis ietilpst ar rezervi. Ir ventilatori, tāpēc tās vieta ir tornī, nevis plānā skapja serverī.
Karte, ap kuru ir uzbūvēta lielākā daļa inferences platformu. 48 GB paņem 70B modeli kvantizētu, pasīva dzesēšana, un tā ir drošākā izvēle, ja negribi pārsteigumus.
96 GB velk 70B modeli pilnā kvalitātē vai vairākus mazākus blakus. Pasīva, veidota skapim, un lētāka nekā tās pašas kartes darbstacijas versija.
Līnijas augšgals. 141 GB HBM3e ar to atmiņas joslas platumu, uz kura patiesībā dzīvo apmācība un smaga inference. Pasūta projektam, nevis tur noliktavā.
Karšu cenas norādītas bez 21% PVN. Pieejamība ir tiešsaistē no mūsu izplatītāja: kas ir noliktavā, aizbrauc uzreiz, pārējo sagādājam norādītajā termiņā. Pasaki, kāds ir serveris, un pirms maksāšanas apstiprināsim, ka karte tam der.
Aparatūra pati par sevi vēl nav produkts. Ieviešana pārvērš kasti privātā mākslīgā intelekta servisā, bet pārvaldītais plāns to uztur ātru, regulāri atjauninātu un aktuālu.
€5000.00 vienreizēji
no €500.00 /mēn
Jautājumi, dokumenti un embeddings paliek uz iekārtas, kas pieder tev. Nekas netiek sūtīts trešo pušu AI pakalpojumiem.
Viens aparatūras pirkums, nevis rēķini par tokeniem, kas aug ar katru jaunu lietotāju.
Darbini savā birojā LAN tīklā vai izvieto mūsu Rīgas datu centrā ar VPN piekļuvi komandai.
Ar OpenAI saderīgs API nozīmē, ka esošie rīki, SDK un spraudņi strādā bez izmaiņām kodā.
Ielīmējot klientu rēķinus, līgumus vai personāla dokumentus ChatGPT, Claude vai citā publiskā AI, tu nodod personas datus trešajai pusei, bieži ārpus ES. GDPR tam prasa juridisku pamatu un apstrādes līgumu, bet NIS2 liek tev atbildēt par saviem piegādātājiem. Savs GPT šo problēmu noņem: nekas neatstāj iekārtu, kuru kontrolē tu.
Jautājumi, dokumenti un embeddings tiek apstrādāti uz tavas iekārtas: birojā vai mūsu Rīgas datu centrā. Nekādas nodošanas trešo pušu AI pakalpojumiem un nekā, ko skaidrot regulatoram.
ES direktīva prasa pārvaldīt piegādātāju riskus. Viena iekārta, kas pieder tev, ir īsāks piegādātāju saraksts nekā ārvalstu AI API, un mēs to uzturam kā ES pakalpojumu sniedzējs ar atbilstošu dokumentāciju.
Rēķini, līgumi, medicīnas un personāla dokumenti strādā čatā un RAG tā, ka nekad neatstāj tavu tīklu: komanda iegūst AI palīgu bez klientu datu noplūdes.
Pārrunājam lietotāju skaitu, modeļus un datu avotus, un tu izvēlies iekārtu un vietu, kur tā dzīvos.
Aparatūra tiek piegādāta, modelis sāk darbu aiz API un čata UI, un RAG pieslēdzas taviem dokumentiem.
Darbinieki privāti strādā ar uzņēmuma zināšanām, bet pārvaldītais plāns uztur modeļus un indeksus svaigus.
Tavi pakalpojumi darbojas uz mūsu aparatūras Latvijā, ES jurisdikcijā. Otrs reģions Nīderlandē, Dubaija plānota 2026.
Pamācības par AI aģentiem, privātiem modeļiem un pašhostētu AI no mūsu komandas.
Jā, tieši tāpēc tas ir vajadzīgs. Rēķini, līgumi un personāla dokumenti tiek apstrādāti uz tavas iekārtas, tāpēc personas dati netiek nodoti trešās puses AI pakalpojumam. Apstrāde paliek tavā GDPR perimetrā, un NIS2 piegādātāju saraksts paliek īss, atšķirībā no dokumentu ielīmēšanas publiskā AI.
128 GB VRAM bez problēmām darbina Llama 3.3 70B pilnā precizitātē, un mazāki modeļi, piemēram, Qwen vai Mistral, iet ar lielu rezervi. Pārvaldītajā plānā modeļus atjaunojam reizi ceturksnī, tāpēc jaunie laidieni nonāk pie tevis bez piepūles.
Jā. Standarta chat-completions API ir pieejams tavā LAN vai VPN, tāpēc rīki un bibliotēkas, kas būvētas OpenAI galapunktiem, strādā, nomainot tikai bāzes URL un atslēgu.
Jā. Pēc izvēles RAG indeksē tādus avotus kā SharePoint uz Qdrant vai pgvector, un pārindeksēšana katru nakti tur atbildes aktuālas.
Vai nu pie tevis birojā, vai izvietota mūsu Rīgas datu centrā ar VPN piekļuvi. Abos gadījumos iekārta un visi dati uz tās pieder tev.
Nē. Jau ieviešana vien nodod tev strādājošu, nostiprinātu servisu. Pārvaldītais plāns no 500 EUR mēnesī ir komandām, kas grib uzraudzību, atjauninājumus un modeļu atjaunošanu bez savas piepūles.
Aparatūra ir vienreizējs pirkums, aktuālās cenas redzamas šajā lapā, un tās norādītas bez 21% PVN. Ieviešana maksā 5000 EUR vienreizēji, bet pārvaldītais plāns sākas no 500 EUR mēnesī. Maksas par tokeniem nav, tāpēc izmaksas neaug līdz ar lietošanu.
Viena GB10 iekārta ar 128 GB VRAM apkalpo 10 līdz 20 vienlaicīgus lietotājus ar Llama 3.3 70B pilnā precizitātē. Ja komanda izaug, NVIDIA GB10 atbalsta klasterēšanu, tāpēc vari pievienot mezglus, nevis mainīt aparatūru.
Abās iekārtās ir viens un tas pats GB10 Blackwell čips ar 128 GB VRAM, tāpēc modeļu veiktspēja ir vienāda. NVIDIA iekārtai ir 4 TB NVMe un klastera atbalsts, ASUS Ascent GX10 ir 1 TB NVMe un tikai viens mezgls. Piegāde Rīgā iekļauta abām.
Palaid dažās minūtēs vai aprunājies ar inženieri par piemērotāko risinājumu.