NVIDIA L4 24GB
Тихая рабочая лошадка: один слот, 72 Вт, бездополнительного питания. Влезает практически в любой серверный корпус и спокойно тянет модель на 7-14B.
AI-сервер, который запускает приватную модель уровня ChatGPT на вашем железе: NVIDIA GB10 Blackwell, 128 GB VRAM, Llama 3.3 70B в полной точности для 10-20 пользователей. Запросы и документы не покидают вашу сеть.
Оба устройства построены на одном и том же чипе GB10 Blackwell со 128 GB VRAM. Доставка по Риге включена в цену.
€6975.00 разово
В наличии: 35
€5415.00 разово
В наличии: 50
Цены на оборудование указаны без 21% НДС. Доставка по Риге включена, в другие места по договорённости.
Тот же кремний NVIDIA, что мы ставим в свои машины, но отдельно. Выбирайте по памяти: именно она решает, какая модель поместится и сколько её останется на карте, а не поползёт через системную память.
Тихая рабочая лошадка: один слот, 72 Вт, бездополнительного питания. Влезает практически в любой серверный корпус и спокойно тянет модель на 7-14B.
Лучшая память за евро в середине линейки. Модель класса 30B помещается с запасом. Есть вентиляторы, поэтому её место в башне, а не в тонком сервере.
Карта, вокруг которой построено большинство платформ инференса. 48 ГБ берут модель на 70B в квантовании, охлаждение пассивное. Самый безопасный выбор, если не хотите сюрпризов.
96 ГБ тянут модель на 70B в полном качестве или несколько поменьше разом. Пассивная, сделана под стойку, и дешевле, чем версия той же карты для рабочей станции.
Верх линейки. 141 ГБ HBM3e с той пропускной способностью памяти, на которой и живут обучение и тяжёлый инференс. Заказывается под проект, а не лежит на складе.
Цены на карты указаны без 21% НДС. Наличие живое от нашего дистрибьютора: что на складе, уезжает сразу, остальное привозим в указанный срок. Скажите, какой у вас сервер, и мы подтвердим совместимость до оплаты.
Железо само по себе ещё не продукт. Внедрение превращает коробку в приватный сервис искусственного интеллекта, а управляемый план держит его быстрым, пропатченным и актуальным.
€5000.00 разово
от €500.00 /мес
Запросы, документы и эмбеддинги остаются на машине, которая принадлежит вам. Ничего не уходит сторонним AI-провайдерам.
Одна покупка железа вместо счетов за токены, растущих с каждым новым пользователем.
Работает в офисе в локальной сети или размещается в нашем рижском дата-центре с VPN-доступом для команды.
OpenAI-совместимый API означает, что существующие инструменты, SDK и плагины работают без изменений кода.
Вставляя счета клиентов, договоры или кадровые документы в ChatGPT, Claude или другой публичный ИИ, вы передаёте персональные данные третьей стороне, часто за пределы ЕС. По GDPR для этого нужны правовое основание и договор обработки, а NIS2 требует отвечать за своих поставщиков. Свой GPT снимает проблему: данные не покидают оборудование, которое контролируете вы.
Запросы, документы и эмбеддинги обрабатываются на вашей машине: в офисе или в нашем дата-центре в Риге. Никакой передачи сторонним ИИ-сервисам и ничего, что пришлось бы объяснять регулятору.
Директива ЕС требует управлять рисками поставщиков. Одна машина в вашей собственности - короче список поставщиков, чем зарубежный ИИ-API, а мы обслуживаем её как европейский провайдер с полным комплектом документов.
Счета, договоры, медицинские и кадровые документы работают в чате и RAG, не покидая вашей сети: сотрудники получают помощь ИИ без утечки данных клиентов.
Обсуждаем количество пользователей, модели и источники данных; вы выбираете устройство и место, где оно будет жить.
Железо приезжает, модель запускается за API и чат-интерфейсом, RAG подключается к вашим документам.
Сотрудники приватно работают со знаниями компании, а управляемый план держит модели и индексы свежими.
Ваши сервисы работают на нашем оборудовании в Латвии, в юрисдикции ЕС. Второй регион в Нидерландах, Дубай планируется в 2026.
Инструкции по AI-агентам, приватным моделям и self-hosted AI от нашей команды.
Да, в этом и смысл. Счета, договоры и кадровые документы обрабатываются на вашем оборудовании, поэтому персональные данные не передаются стороннему ИИ-сервису. Обработка остаётся в вашем периметре GDPR, а список поставщиков по NIS2 не растёт, в отличие от вставки тех же документов в публичный ИИ.
128 GB VRAM уверенно тянут Llama 3.3 70B в полной точности, а модели поменьше, такие как Qwen или Mistral, работают с большим запасом. В управляемом плане мы обновляем модели раз в квартал, поэтому новые релизы появляются у вас без усилий.
Да. Стандартный chat-completions API доступен в вашей LAN или VPN, поэтому инструменты и библиотеки под OpenAI работают после замены базового URL и ключа.
Да. Опциональный RAG индексирует источники вроде SharePoint в Qdrant или pgvector, а ночная переиндексация держит ответы актуальными.
Либо у вас в офисе в локальной сети, либо в нашем рижском дата-центре с VPN-доступом. В обоих случаях устройство и все данные на нём принадлежат вам.
Нет. Уже само внедрение передаёт вам работающий защищённый сервис. Управляемый план от 500 EUR в месяц нужен командам, которым важны мониторинг, патчи и обновление моделей без собственных усилий.
Оборудование покупается один раз, актуальные цены указаны на этой странице без 21% НДС. Внедрение стоит 5000 EUR разово, управляемый план начинается от 500 EUR в месяц. Платы за токены нет, поэтому расходы не растут вместе с использованием.
Одно устройство GB10 со 128 GB VRAM обслуживает 10-20 одновременных пользователей на Llama 3.3 70B в полной точности. Если команда вырастет, NVIDIA GB10 поддерживает кластер: вы добавляете узлы вместо замены железа.
В обоих устройствах один и тот же чип GB10 Blackwell со 128 GB VRAM, поэтому скорость нейросети одинакова. У версии NVIDIA 4 TB NVMe и поддержка кластера, у ASUS Ascent GX10 1 TB NVMe и только одиночный узел. Доставка по Риге включена для обоих.
Запустите за минуты или обсудите с инженером, что подходит вашему проекту.