Сървър за изчисления с изкуствен интелект | 128 GB GDDR7 | EPYC 512GB

687 519,83 CZK
687 519,83 чешки крони без ДДС

Идеален за AI студия , рекламни агенции и разработчици на генеративен AI, които трябва да генерират фотореалистични видеоклипове и изображения локално — без разходи за облак, без ограничения на API и без изтичане на данни. Един сървър замества десетки Mac mini или други AI работни станции на част от общата цена.

Последна бройка на склад

Гаранция за най-добра цена!
Добави в кошницата
Сървър за изчисления с изкуствен интелект | 128 GB GDDR7 | EPYC 512GB
Сървър за изчисления с изкуствен интелект | 128 GB GDDR7 | EPYC 512GB
687 519,83 CZK
687 519,83 чешки крони без ДДС

✅ Цена без ДДС когато използвате нашия хостинг
🎓 Безплатно обучение за начинаещи и напреднали
️ 24 месеца гаранция на всички устройства
⚡ Експресна услуга – бърз ремонт в нашата център

Сигурно плащане с карта

 

Цена с ДДС (21%)
CZK831 899
Без ДДС: 687 лв.  · фактура с ДДС номер / ДДС номер · доставка до 7 дни
4× RTX 5090 Blackwell — общо 128GB GDDR7 VRAM
Време за работа 12 минути, всички графични процесори 575W — 0 грешки
Предварително инсталиран AI стек (vLLM, llama.cpp, PyTorch, CUDA)
Дистанционно управление на BMC IPMI 2.0 — без физически достъп
Готови за работа — просто се свържете и влезте
✓ Изпълнението е успешно Блекуел sm_120 CUDA 12.8 Поръчка № KE21013 AMD EPYC 7643 512 GB ECC RAM
128 GB
Обща видеопамять на графичния процесор (GPU)
~ 880 T
FP16 TFLOPS
1 631 т/с
Партида за магистърска степен по право
0
Грешки при изгаряне
Генериране на съдържание с изкуствен интелект

Сървър за генериране на видео и изображения, неразличими от реалността

128GB GDDR7 VRAM, разположени в четири графични процесора Blackwell, ви позволяват да стартирате най-големите модели за дифузия и видео с отворен код с пълна точност — без разтоварване, квантуване или чакане. Без облак, без такси за API, без данни, напускащи мрежата ви.

Предварително инсталиран и тестван
🎬

Генериране на видео — HunyuanVideo, Wan2.1, CogVideoX

128 GB VRAM позволява генериране на дълги поредици с висока резолюция без ограничения за разделяне на кадри или мозайка. Пълна поддръжка на CUDA 12.8 за всички съвременни видео модели.

128 GB видеопамять
️

Генериране на изображения

FLUX.1, SD3.5, Стабилна каскада — пълна прецизност FP16, пакетна обработка, ControlNet, IP-адаптер.

🧠

LLM Inference за екипи

vLLM тензорно-паралелен × 4 GPU — 1631 нишки/сек за 64 едновременни потребители. Qwen, Llama, Mistral, DeepSeek.

железария

Пълни технически спецификации

Графичен процесор (× 4 броя)
МоделNVIDIA GeForce RTX 5090
архитектураБлекуел, sm_120
VRAM на графичния процесор32 GB GDDR7
Общо видеопамять128 GB
Многопроцесорно стрийминг.170 см/карта
Пропускателна способност на паметта~1530 GB/s / графичен процесор
TDP575W/графичен процесор (4x = 2300W)
PCIeGen4 × 16 на слот
процесор и системна памет
процесорAMD EPYC 7643
Ядра/Влакна48C / 96T
Максимална честота3,64 GHz
L3 кеш256 MiB
Системна RAM памет512 GB DDR4-2666
ECCДа (RDIMM)
DIMM модули8× 64GB Samsung
Канали на паметта8 (напълно оборудвани)
Дънна платка и място за съхранение
Дънна платкаASRockRack ROMED8-2T/BCM
BIOSP4.30 (20.05.2026)
NVMe SSDCrucial P310 2TB
Последователно четене7 MB / s
Последователно писане6 MB / s
Случайни 4K IOPS467 K / 477 K черно/бяло
Зашийте2× 10GbE + IPMI/BMC
Дистанционно управлениеASRock Rack BMC 3.08
Софтуер (предварително инсталиран)
OSUbuntu LTS 24.04.4
NVIDIA драйвер595.71.05 (отворен)
CUDA драйвер/инструментариум13.2 / 12.8
cuDNN9.10.02
PyTorch2.9.1+cu128
vLLM0.14.0
call.cppCUDA компилация, sm_120
Python venv/начало/логика/llm-env
Измерена мощност

Реални показатели от тази конкретна машина

Измерено на 10.07.2026 г. на хост dm2, номер на поръчка KE21013. Числата са измерени, не са дадени от производителя.

Производителност на FP16 на графичен процесор (8192² matmul)

графичен процесор 0
219,1 T
графичен процесор 1
221,3 T
графичен процесор 2
219,4 T
графичен процесор 3
218,3 T

Общо ~880 TFLOPS FP16 · +33% на карта спрямо RTX 4090

Скорост на трансфер на VRAM (GDDR7)

графичен процесор 0
1533 ГБ/сек
графичен процесор 1
1533 ГБ/сек
графичен процесор 2
1533 ГБ/сек
графичен процесор 3
1533 ГБ/сек

PCIe хост↔GPU: 27,6 / 28,3 GB/s (H2D / D2H)

vLLM · Qwen2.5-32B-Instruct AWQ · тензорно-паралелен × 4 · 64 едновременни потребители

Агрегирана пропускателна способност на партиди64 едновременни потребители
1 631 поток/и
МоделQwen2.5-32B AWQ (ядро marlin)
32B
Връзка с графичния процесорТензорно-паралелни × 4 графични процесора
✓ всичките 4

llama.cpp · Qwen2.5-14B Q4_K_M · 1 графичен процесор · llama-bench

Генериране на токенибенчмарк tg128
147 поток/и
Бърза обработкаpp512 бенчмарк
8 234 поток/и
КвантиранеQ4_K_M, 8,37 GiB
14,8B
7 074 MB / сек
Четене, сек.
6 341 MB / сек
Запис в раздел
467 K
4K IOPS за четене
477 K
4K IOPS за запис
Надеждност

12-минутно изгаряне при пълно натоварване — 0 грешки

Изтощаване на графичния процесор — 720 секунди устойчиво FP16 matmul (8192×8192), всички 4 графични процесора по 575 W ✓ ПРОПУСНАТО
графичен процесор 0
84 ° C
575W 2,4GHz
0 грешки
графичен процесор 1
88 ° C
575W 2,35GHz
0 грешки
графичен процесор 2
83 ° C
575W 2,5GHz
0 грешки
графичен процесор 3
80 ° C
575W 2,5GHz
0 грешки
Праг на дроселиране RTX 5090 ≈ 90 °C · максимално измерено 88 °C (GPU 1) · без дроселиране на производителността · SM тактова честота 2,3–2,5 GHz през цялото време · комбинираният тест на GPU + 96 CPU нишки също е преминал без грешки · лог на ядрото: няма грешки в Xid / NVRM / PCIe AER
Сравнение с конкуренцията

Защо нашият сървър, а не Mac Studio M3 Ultra 512 GB?

Mac Studio M3 Ultra в конфигурация 512 GB / 8 TB е най-мощната еднокомпонентна машина на Apple за изкуствен интелект. Въпреки това, тя струва ~1 000 000 чешки крони — за тази цена можете да закупите повече от един от нашите сървъри.

Mac Studio M3 Ultra 512 GB / 8 TB Apple BTO · 32-ядрен процесор · 80-ядрен графичен процесор · само macOS · без CUDA · ~819 GB/s честотна лента
Mac Studio M3 Ultra
~1 000 000 чешки крони
BTO конфигурация 512GB / 8TB
→
Нашият сървър (с включен ДДС)
831 лв.
4 пъти по-висока CUDA производителност, по-ниска цена
ПараметърMac Studio M3 Ultra 512GB4× RTX 5090 сървър (KENTINO)
Цена с ДДС~1 000 000 чешки крони по-скъпо831 лв. победител
GPU ускорител80-ядрени M3 Ultra графични процесори · ~40–60 TFLOPS FP16 · Само метал4× RTX 5090 Blackwell · ~880 TFLOPS FP16 × 15+ · CUDA 12.8
VRAM / AI памет512 GB унифицирана (споделени процесор + графичен процесор) 819 GB/s128 GB GDDR7 · ~1530 GB/s на графичен процесор 5 пъти по-бърз + 512GB ECC RAM
LLM скорост 32B~35–40 потока/сек · 1 потребител1631 потока/сек. партида × 40+ · 64 потребители
Генериране на видеоМеталът е нестабилен за CUDA моделиCUDA · HunyuanVideo · Wan2.1 · вградена поддръжка
Едновременни потребители1–3 практически64+ (в LLM тензорен паралел)
Екосистема с изкуствен интелектmacOS / Metal / MLX · без CUDALinux / CUDA · PyTorch · фина настройка · всичко
Дистанционно управлениеSSH · без IPMI · физически достъп за рестартиранеIPMI 2.0 · BMC · iKVM конзола · отдалечен BIOS
Фина настройкаMPS нестабилен · не се препоръчваПълен CUDA LoRA QLoRA FSDP

За цената на Mac Studio M3 Ultra получавате RTX 5090 сървър с екосистемата CUDA

Mac Studio 512 GB е чудесен за еднопотребителски задачи с огромни модели в унифицирана памет. Но е по-скъп, работи на macOS без CUDA, може да обработва максимум 1-3 потребители и не поддържа фина настройка. Нашият сървър е по-бърз за пакетно извеждане, има пълна CUDA съвместимост и може да обработва целия екип едновременно.

~15 пъти повече TFLOPS FP16 64+ едновременни потребители Пълна CUDA екосистема Фина настройка, LoRA, обучение BMC дистанционно управление 24/7
Предварително инсталиран софтуер

Без инсталация — просто включете и влезте

NVIDIA драйвер + CUDA
595.71.05 · CUDA 13.2 / инструментариум 12.8 · cuDNN 9.10
PyTorch 2.9.1
+cu128 · sm_120 Blackwell · NCCL многопроцесорна графична карта
vLLM 0.14.0
tensor-parallel · AWQ marlin · OpenAI API съвместим
llama.cpp (CUDA компилация)
sm_120 · commit c4ae9a8
Стек HuggingFace
трансформатори · ускоряване · дифузори · хъб
Python venv
/home/logic/llm-env · модели в /home/logic/models

⚡ Доставка и първо пускане на пазара

  • Доставка до 7 работни дни след потвърждаване на поръчката
  • Фактура с ДДС номер — приспадаем ДДС за фирми
  • Променете системната парола и паролата за BMC незабавно
  • Задайте BMC на статичен IP адрес във вашата мрежа
  • Конфигурирайте защитната стена, преди да стартирате API inference
  • SSH потребител: logic (sudo) · BMC потребител: admin
  • Консумацията на енергия на графичния процесор може да се регулира: nvidia-smi -pl [ватове]
  • Техническа поддръжка KENTINO sro — имейл + телефон
Технически бележки Всички графични процесори работят на PCIe Gen4 × 16 — платформата AMD EPYC 7003 / ROMED8-2T е Gen4 (няма влияние върху производителността на LLM inference). RTX 5090 няма NVLink — комуникация между няколко графични процесора през PCIe P2P ~24,3 GB/s (стандартно за този клас). ECC GPU паметта не е налична на потребителската RTX 5090 (очаква се, ECC е в системната RAM памет). Бенчмаркове, измерени на 10.07.2026 г., номер на част KE21013, dm2 хост. Всички числа са измерени, а не са докладвани от производителя.

производител

Pcpraha

Компютри за игри на марката Pc Praha. Най-доброто решение в Чехия и ЕС. Професионални компютри за игри и съоръжения за копаене и Asici.

Въпроси и отговори Q & A

Задай въпрос
Все още няма въпроси