Сервер штучного інтелекту | 128 ГБ GDDR7 | EPYC 512 ГБ

687 519,83 крон
687 519,83 чеських крон без ПДВ

Ідеально підходить для студій штучного інтелекту , рекламних агентств та розробників генеративного штучного інтелекту, яким потрібно створювати фотореалістичні відео та зображення локально — без витрат на хмарні ресурси, обмежень API та витоків даних. Один сервер замінює десятки Mac mini або інших робочих станцій зі штучним інтелектом за значно меншу вартість.

Остання одиниця на складі

Гарантія кращої ціни!
ПЕРЕДЗАМОВИТИ
Сервер штучного інтелекту | 128 ГБ GDDR7 | EPYC 512 ГБ
Сервер штучного інтелекту | 128 ГБ GDDR7 | EPYC 512 ГБ
687 519,83 крон
687 519,83 чеських крон без ПДВ

✅ Ціна без ПДВ при використанні нашого хостинг
🎓 Безкоштовне навчання для початківців і просунутих
🛡️ Гарантія 24 місяців на всіх пристроях
⚡ Експрес-сервіс – швидкий ремонт у нас центр

Безпечна оплата карткою

 

Ціна з ПДВ (21%)
Крон831 899
Без ПДВ: 687 520 CZK  · рахунок-фактура з номером ПДВ / номером платника ПДВ · доставка протягом 7 днів
4× RTX 5090 Blackwell — 128 ГБ відеопам'яті GDDR7 загалом
Час запуску 12 хвилин, всі відеокарти 575 Вт — 0 помилок
Попередньо встановлений стек штучного інтелекту (vLLM, llama.cpp, PyTorch, CUDA)
Віддалене керування BMC IPMI 2.0 — без фізичного доступу
Готовий до роботи — просто підключіться та увійдіть
✓ Запуск програми PASS Блеквелл sm_120 CUDA 12.8 Замовлення № KE21013 AMD EPYC 7643 512 ГБ ECC RAM
128 GB
Загальна відеопам'ять графічного процесора
~ 880 T
FP16 TFLOPS
1 631 т/с
Пакет LLM
0
Помилки вигорання
Генерація контенту зі штучним інтелектом

Сервер для створення відео та зображень, невідрізних від реальності

128 ГБ відеопам'яті GDDR7 на чотирьох графічних процесорах Blackwell дозволяє запускати найбільші моделі дифузії та відео з відкритим кодом з повною точністю — без розвантаження, квантування чи очікування. Без хмари, без плати за API, без даних, що залишають вашу мережу.

Попередньо встановлено та протестовано
🎬

Генерація відео — HunyuanVideo, Wan2.1, CogVideoX

128 ГБ відеопам'яті дозволяє створювати довгі послідовності з високою роздільною здатністю без обмежень щодо мозаїчного зображення або розділення кадрів. Повна підтримка CUDA 12.8 для всіх сучасних відеомоделей.

128 ГБ відеопам'яті
🖼️

Генерація зображень

FLUX.1, SD3.5, Стабільний каскад — повна точність FP16, пакетна робота, ControlNet, IP-адаптер.

🧠

Висновок LLM для команд

vLLM тензорно-паралельний × 4 GPU — 1631 потоків/с для 64 одночасних користувачів. Qwen, Llama, Mistral, DeepSeek.

Обладнання

Повні технічні характеристики

Графічний процесор (× 4 штуки)
МодельNVIDIA GeForce RTX 5090
АрхітектураБлеквелл, sm_120
Відеопам'ять на графічному процесорі32 GB GDDR7
Загальна кількість відеопам'яті128 GB
Багатопроцесна потокова передача.170 см/картка
Пропускна здатність пам'яті~1530 ГБ/с / графічний процесор
TDP575 Вт/графічний процесор (4x = 2300 Вт)
PCIeGen4 × 16 на слот
Процесор і системна пам'ять
центральний процесорAMD EPYC 7643
Серцевини/Волокон48C / 96T
Макс. частота3,64 ГГц
кеш L3256 МіБ
Системна оперативна пам'ять512 GB DDR4-2666
ECCТак (RDIMM)
Модулі DIMM8× 64 ГБ Samsung
Канали пам'яті8 (повністю обладнаних)
Материнська плата та сховище
Материнська платаASRockRack ROMED8-2T/BCM
BIOSP4.30 (20.05.2026)
NVMe SSDCrucial P310 2 ТБ
Послідовне читання7 МБ / с
Послідовне написання6 МБ / с
Випадкові 4K IOPS467 K / 477 K чорний/білий
Зшити2× 10GbE + IPMI/BMC
Дистанційне керуванняСтійка ASRock BMC 3.08
Програмне забезпечення (попередньо встановлено)
OSUbuntu LTS 24.04.4
Драйвер NVIDIA595.71.05 (відкрито)
Драйвер/інструментарій CUDA13.2 / 12.8
cuDNN9.10.02
PyTorch2.9.1+куб.см.128
vLLM0.14.0
call.cppЗбірка CUDA, sm_120
Python venv/головна/логіка/llm-env
Виміряна потужність

Реальні показники саме цієї машини

Виміряно 10.07.2026 на хості dm2, замовлення № KE21013. Цифри виміряні, а не надані виробником.

Продуктивність FP16 на графічному процесорі (8192² matmul)

Графічний процесор 0
219,1 T
Графічний процесор 1
221,3 T
Графічний процесор 2
219,4 T
Графічний процесор 3
218,3 T

Всього ~880 TFLOPS FP16 · +33% на карту порівняно з RTX 4090

Швидкість передачі даних відеопам'яті (GDDR7)

Графічний процесор 0
1533 ГБ/с
Графічний процесор 1
1533 ГБ/с
Графічний процесор 2
1533 ГБ/с
Графічний процесор 3
1533 ГБ/с

PCIe хост↔GPU: 27,6 / 28,3 ГБ/с (H2D / D2H)

vLLM · Qwen2.5-32B-Instruct AWQ · тензорно-паралельний × 4 · 64 одночасних користувачів

Пакетна агрегована пропускна здатність64 одночасних користувачів
1 631 потік/с
МодельQwen2.5-32B AWQ (ядро marlin)
32B
Підключення графічного процесораТензорно-паралельні × 4 графічних процесори
✓ усі 4

llama.cpp · Qwen2.5-14B Q4_K_M · 1 відеокарта · llama-bench

Генерація токенівбенчмарк tg128
147 потік/с
Оперативна обробкабенчмарк pp512
8 234 потік/с
КвантуванняQ4_K_M, 8,37 ГіБ
14,8B
7 074 МБ / с
Читання, сек.
6 341 МБ / с
Розділ. запис
467 K
4K IOPS для читання
477 K
4K IOPS для запису
Надійність

12 хвилин роботи при повному навантаженні — 0 помилок

Час роботи графічного процесора — 720 с безперервної роботи FP16 matmul (8192×8192), всі 4 графічні процесори споживають 575 Вт ✓ ПРОЙДЕНО
Графічний процесор 0
84 °C
575 Вт 2,4 ГГц
0 помилок
Графічний процесор 1
88 °C
575 Вт 2,35 ГГц
0 помилок
Графічний процесор 2
83 °C
575 Вт 2,5 ГГц
0 помилок
Графічний процесор 3
80 °C
575 Вт 2,5 ГГц
0 помилок
Поріг дроселювання RTX 5090 ≈ 90 °C · максимально виміряна температура 88 °C (GPU 1) · без дроселювання продуктивності · Тактова частота SM 2,3–2,5 ГГц постійно · комбінований тест GPU + 96 потоків CPU також пройдено без помилок · журнал ядра: немає помилок Xid / NVRM / PCIe AER
Порівняння з конкурентами

Чому саме наш сервер, а не Mac Studio M3 Ultra 512 ГБ?

Mac Studio M3 Ultra у конфігурації 512 ГБ / 8 ТБ — це найпотужніший одноблочний комп’ютер Apple для штучного інтелекту. Однак він коштує ~1 000 000 чеських крон — за цю ціну ви можете придбати більше одного нашого сервера.

Mac Studio M3 Ultra 512 ГБ / 8 ТБ Apple BTO · 32-ядерний процесор · 80-ядерний графічний процесор · лише macOS · без CUDA · пропускна здатність ~819 ГБ/с
Mac Studio M3 Ultra
~1 000 000 чеських крон
Конфігурація BTO 512 ГБ / 8 ТБ
→
Наш сервер (включно з ПДВ)
831 899 CZK
У 4 рази вища продуктивність CUDA, нижча ціна
ПараметрMac Studio M3 Ultra 512 ГБ4× Сервер RTX 5090 (KENTINO)
Ціна з ПДВ~1 000 000 чеських крон дорожчий831 899 CZK переможець
Прискорювач графічного процесора80-ядерні графічні процесори M3 Ultra · ~40–60 TFLOPS FP16 · Тільки метал4× RTX 5090 Blackwell · ~880 TFLOPS FP16 × 15+ · CUDA 12.8
VRAM / пам'ять зі штучним інтелектом512 ГБ об'єднаної пам'яті (спільне використання процесора та графічного процесора) 819 ГБ/с128 ГБ GDDR7 · ~1530 ГБ/с на графічний процесор У 5 разів швидше + 512 ГБ оперативної пам'яті з корекцією помилок (ECC)
Швидкість LLM 32B~35–40 потоків/с · 1 користувач1631 поток/с партія × 40+ · 64 користувачі
Генерація відеоМетал нестабільний для CUDA-моделейCUDA · HunyuanVideo · Wan2.1 · вбудована підтримка
Одночасні користувачі1–3 практично64+ (у тензорному паралелізму LLM)
Екосистема штучного інтелектуmacOS / Metal / MLX · без CUDALinux / CUDA · PyTorch · тонке налаштування · все
Дистанційне керуванняSSH · без IPMI · фізичний доступ для перезавантаженняIPMI 2.0 · BMC · консоль iKVM · віддалений BIOS
Тонка настройкаMPS нестабільний · не рекомендуєтьсяПовний CUDA LoRA QLoRA FSDP

За ціною Mac Studio M3 Ultra ви отримуєте сервер з RTX 5090 та екосистемою CUDA.

Mac Studio 512 ГБ чудово підходить для однокористувацьких робочих навантажень з величезними моделями в об'єднаній пам'яті. Але він дорожчий, працює на macOS без CUDA, може обробляти максимум 1-3 користувачів і не підтримує точне налаштування. Наш сервер швидший для пакетного виведення даних, має повну сумісність з CUDA та може обробляти всю команду одночасно.

~15x більше TFLOPS FP16 64+ одночасних користувачів Повна екосистема CUDA Точне налаштування, LoRA, навчання Дистанційне керування BMC цілодобово
Попередньо встановлене програмне забезпечення

Без встановлення — просто підключіть та увійдіть

Драйвер NVIDIA + CUDA
595.71.05 · CUDA 13.2 / інструментарій 12.8 · cuDNN 9.10
PyTorch 2.9.1
+cu128 · sm_120 Blackwell · NCCL багатопроцесорний
vLLM 0.14.0
tensor-parallel · AWQ marlin · OpenAI API сумісний
llama.cpp (збірка CUDA)
sm_120 · коміт c4ae9a8
Стек HuggingFace
трансформатори · прискорювачі · дифузори · маточина
Python venv
/home/logic/llm-env · моделі в /home/logic/models

⚡ Доставка та перший запуск

  • Доставка протягом 7 робочих днів після підтвердження замовлення
  • Рахунок-фактура з номером ПДВ — ПДВ може бути відрахований для компаній
  • Негайно змініть системний пароль та пароль BMC
  • Встановіть для BMC статичну IP-адресу у вашій мережі
  • Налаштуйте брандмауер перед запуском виведення API
  • Користувач SSH: logic (sudo) · Користувач BMC: admin
  • Споживання енергії графічним процесором можна регулювати: nvidia-smi -pl [ватти]
  • Технічна підтримка KENTINO sro — електронна пошта + телефон
Технічні примітки Усі графічні процесори працюють на PCIe Gen4 × 16 — платформа AMD EPYC 7003 / ROMED8-2T — це Gen4 (без впливу на продуктивність виведення LLM). RTX 5090 не має NVLink — зв'язок між кількома графічними процесорами через PCIe P2P ~24,3 ГБ/с (стандарт для цього класу). Пам'ять графічного процесора ECC недоступна на споживчій RTX 5090 (очікувано, ECC знаходиться в системній оперативній пам'яті). Бенчмарки виміряні 10.07.2026, номер деталі KE21013, хост dm2. Усі цифри виміряні, виробник не повідомляє.

Продюсер

Pcpraha

Ігрові комп'ютери марки Pc Praha. Найкраще рішення в Чехії та ЄС. Професійні ігрові комп’ютери та установки для майнінгу та Asici.

Питання та відповіді Q & A

Задайте питання
Питань поки немає