Ціна з ПДВ (21%)
Крон831 899
Без ПДВ: 687 520 CZK · рахунок-фактура з номером ПДВ / номером платника ПДВ · доставка протягом 7 днів
4× RTX 5090 Blackwell — 128 ГБ відеопам'яті GDDR7 загалом
Час запуску 12 хвилин, всі відеокарти 575 Вт — 0 помилок
Попередньо встановлений стек штучного інтелекту (vLLM, llama.cpp, PyTorch, CUDA)
Віддалене керування BMC IPMI 2.0 — без фізичного доступу
Готовий до роботи — просто підключіться та увійдіть
✓ Запуск програми PASS
Блеквелл sm_120
CUDA 12.8
Замовлення № KE21013
AMD EPYC 7643
512 ГБ ECC RAM
128 GB
Загальна відеопам'ять графічного процесора
Генерація контенту зі штучним інтелектом
Сервер для створення відео та зображень, невідрізних від реальності
128 ГБ відеопам'яті GDDR7 на чотирьох графічних процесорах Blackwell дозволяє запускати найбільші моделі дифузії та відео з відкритим кодом з повною точністю — без розвантаження, квантування чи очікування. Без хмари, без плати за API, без даних, що залишають вашу мережу.
Попередньо встановлено та протестовано🎬
Генерація відео — HunyuanVideo, Wan2.1, CogVideoX
128 ГБ відеопам'яті дозволяє створювати довгі послідовності з високою роздільною здатністю без обмежень щодо мозаїчного зображення або розділення кадрів. Повна підтримка CUDA 12.8 для всіх сучасних відеомоделей.
128 ГБ відеопам'яті
🖼️
Генерація зображень
FLUX.1, SD3.5, Стабільний каскад — повна точність FP16, пакетна робота, ControlNet, IP-адаптер.
🧠
Висновок LLM для команд
vLLM тензорно-паралельний × 4 GPU — 1631 потоків/с для 64 одночасних користувачів. Qwen, Llama, Mistral, DeepSeek.
Обладнання
Повні технічні характеристики
Графічний процесор (× 4 штуки)
МодельNVIDIA GeForce RTX 5090
АрхітектураБлеквелл, sm_120
Відеопам'ять на графічному процесорі32 GB GDDR7
Загальна кількість відеопам'яті128 GB
Багатопроцесна потокова передача.170 см/картка
Пропускна здатність пам'яті~1530 ГБ/с / графічний процесор
TDP575 Вт/графічний процесор (4x = 2300 Вт)
PCIeGen4 × 16 на слот
Процесор і системна пам'ять
центральний процесорAMD EPYC 7643
Серцевини/Волокон48C / 96T
Макс. частота3,64 ГГц
кеш L3256 МіБ
Системна оперативна пам'ять512 GB DDR4-2666
ECCТак (RDIMM)
Модулі DIMM8× 64 ГБ Samsung
Канали пам'яті8 (повністю обладнаних)
Материнська плата та сховище
Материнська платаASRockRack ROMED8-2T/BCM
BIOSP4.30 (20.05.2026)
NVMe SSDCrucial P310 2 ТБ
Послідовне читання7 МБ / с
Послідовне написання6 МБ / с
Випадкові 4K IOPS467 K / 477 K чорний/білий
Зшити2× 10GbE + IPMI/BMC
Дистанційне керуванняСтійка ASRock BMC 3.08
Програмне забезпечення (попередньо встановлено)
OSUbuntu LTS 24.04.4
Драйвер NVIDIA595.71.05 (відкрито)
Драйвер/інструментарій CUDA13.2 / 12.8
cuDNN9.10.02
PyTorch2.9.1+куб.см.128
vLLM0.14.0
call.cppЗбірка CUDA, sm_120
Python venv/головна/логіка/llm-env
Виміряна потужність
Реальні показники саме цієї машини
Виміряно 10.07.2026 на хості dm2, замовлення № KE21013. Цифри виміряні, а не надані виробником.
Продуктивність FP16 на графічному процесорі (8192² matmul)
Графічний процесор 0219,1 T Графічний процесор 1221,3 T Графічний процесор 2219,4 T Графічний процесор 3218,3 T Всього ~880 TFLOPS FP16 · +33% на карту порівняно з RTX 4090
Швидкість передачі даних відеопам'яті (GDDR7)
Графічний процесор 01533 ГБ/с Графічний процесор 11533 ГБ/с Графічний процесор 21533 ГБ/с Графічний процесор 31533 ГБ/с PCIe хост↔GPU: 27,6 / 28,3 ГБ/с (H2D / D2H)
vLLM · Qwen2.5-32B-Instruct AWQ · тензорно-паралельний × 4 · 64 одночасних користувачів
Пакетна агрегована пропускна здатність64 одночасних користувачів
1 631 потік/с
МодельQwen2.5-32B AWQ (ядро marlin)
32B
Підключення графічного процесораТензорно-паралельні × 4 графічних процесори
✓ усі 4
llama.cpp · Qwen2.5-14B Q4_K_M · 1 відеокарта · llama-bench
Генерація токенівбенчмарк tg128
147 потік/с
Оперативна обробкабенчмарк pp512
8 234 потік/с
КвантуванняQ4_K_M, 8,37 ГіБ
14,8B
7 074 МБ / с
Читання, сек.
6 341 МБ / с
Розділ. запис
Надійність
12 хвилин роботи при повному навантаженні — 0 помилок
Час роботи графічного процесора — 720 с безперервної роботи FP16 matmul (8192×8192), всі 4 графічні процесори споживають 575 Вт
✓ ПРОЙДЕНО
Графічний процесор 0
84 °C
575 Вт 2,4 ГГц
0 помилок
Графічний процесор 1
88 °C
575 Вт 2,35 ГГц
0 помилок
Графічний процесор 2
83 °C
575 Вт 2,5 ГГц
0 помилок
Графічний процесор 3
80 °C
575 Вт 2,5 ГГц
0 помилок
Поріг дроселювання RTX 5090 ≈ 90 °C · максимально виміряна температура 88 °C (GPU 1) · без дроселювання продуктивності · Тактова частота SM 2,3–2,5 ГГц постійно · комбінований тест GPU + 96 потоків CPU також пройдено без помилок · журнал ядра: немає помилок Xid / NVRM / PCIe AER
Порівняння з конкурентами
Чому саме наш сервер, а не Mac Studio M3 Ultra 512 ГБ?
Mac Studio M3 Ultra у конфігурації 512 ГБ / 8 ТБ — це найпотужніший одноблочний комп’ютер Apple для штучного інтелекту. Однак він коштує ~1 000 000 чеських крон — за цю ціну ви можете придбати більше одного нашого сервера.
Mac Studio M3 Ultra 512 ГБ / 8 ТБ
Apple BTO · 32-ядерний процесор · 80-ядерний графічний процесор · лише macOS · без CUDA · пропускна здатність ~819 ГБ/с
Mac Studio M3 Ultra
~1 000 000 чеських крон
Конфігурація BTO 512 ГБ / 8 ТБ
→
Наш сервер (включно з ПДВ)
831 899 CZK
У 4 рази вища продуктивність CUDA, нижча ціна
| Параметр | Mac Studio M3 Ultra 512 ГБ | 4× Сервер RTX 5090 (KENTINO) |
|---|
| Ціна з ПДВ | ~1 000 000 чеських крон дорожчий | 831 899 CZK переможець |
| Прискорювач графічного процесора | 80-ядерні графічні процесори M3 Ultra · ~40–60 TFLOPS FP16 · Тільки метал | 4× RTX 5090 Blackwell · ~880 TFLOPS FP16 × 15+ · CUDA 12.8 |
| VRAM / пам'ять зі штучним інтелектом | 512 ГБ об'єднаної пам'яті (спільне використання процесора та графічного процесора) 819 ГБ/с | 128 ГБ GDDR7 · ~1530 ГБ/с на графічний процесор У 5 разів швидше + 512 ГБ оперативної пам'яті з корекцією помилок (ECC) |
| Швидкість LLM 32B | ~35–40 потоків/с · 1 користувач | 1631 поток/с партія × 40+ · 64 користувачі |
| Генерація відео | Метал нестабільний для CUDA-моделей | CUDA · HunyuanVideo · Wan2.1 · вбудована підтримка |
| Одночасні користувачі | 1–3 практично | 64+ (у тензорному паралелізму LLM) |
| Екосистема штучного інтелекту | macOS / Metal / MLX · без CUDA | Linux / CUDA · PyTorch · тонке налаштування · все |
| Дистанційне керування | SSH · без IPMI · фізичний доступ для перезавантаження | IPMI 2.0 · BMC · консоль iKVM · віддалений BIOS |
| Тонка настройка | MPS нестабільний · не рекомендується | Повний CUDA LoRA QLoRA FSDP |
За ціною Mac Studio M3 Ultra ви отримуєте сервер з RTX 5090 та екосистемою CUDA.
Mac Studio 512 ГБ чудово підходить для однокористувацьких робочих навантажень з величезними моделями в об'єднаній пам'яті. Але він дорожчий, працює на macOS без CUDA, може обробляти максимум 1-3 користувачів і не підтримує точне налаштування. Наш сервер швидший для пакетного виведення даних, має повну сумісність з CUDA та може обробляти всю команду одночасно.
~15x більше TFLOPS FP16
64+ одночасних користувачів
Повна екосистема CUDA
Точне налаштування, LoRA, навчання
Дистанційне керування BMC цілодобово
Попередньо встановлене програмне забезпечення
Без встановлення — просто підключіть та увійдіть
Драйвер NVIDIA + CUDA
595.71.05 · CUDA 13.2 / інструментарій 12.8 · cuDNN 9.10
PyTorch 2.9.1
+cu128 · sm_120 Blackwell · NCCL багатопроцесорний
vLLM 0.14.0
tensor-parallel · AWQ marlin · OpenAI API сумісний
llama.cpp (збірка CUDA)
sm_120 · коміт c4ae9a8
Стек HuggingFace
трансформатори · прискорювачі · дифузори · маточина
Python venv
/home/logic/llm-env · моделі в /home/logic/models
⚡ Доставка та перший запуск
- Доставка протягом 7 робочих днів після підтвердження замовлення
- Рахунок-фактура з номером ПДВ — ПДВ може бути відрахований для компаній
- Негайно змініть системний пароль та пароль BMC
- Встановіть для BMC статичну IP-адресу у вашій мережі
- Налаштуйте брандмауер перед запуском виведення API
- Користувач SSH: logic (sudo) · Користувач BMC: admin
- Споживання енергії графічним процесором можна регулювати: nvidia-smi -pl [ватти]
- Технічна підтримка KENTINO sro — електронна пошта + телефон
Технічні примітки
Усі графічні процесори працюють на PCIe Gen4 × 16 — платформа AMD EPYC 7003 / ROMED8-2T — це Gen4 (без впливу на продуктивність виведення LLM). RTX 5090 не має NVLink — зв'язок між кількома графічними процесорами через PCIe P2P ~24,3 ГБ/с (стандарт для цього класу). Пам'ять графічного процесора ECC недоступна на споживчій RTX 5090 (очікувано, ECC знаходиться в системній оперативній пам'яті). Бенчмарки виміряні 10.07.2026, номер деталі KE21013, хост dm2. Усі цифри виміряні, виробник не повідомляє.