AI-computerserver | 128 GB GDDR7 | EPYC 512 GB

CZK 687
687 CZK exclusief BTW

Ideaal voor AI-studio's , reclamebureaus en ontwikkelaars van generatieve AI die lokaal fotorealistische video's en afbeeldingen willen genereren – zonder cloudkosten, API-beperkingen of datalekken. Eén server vervangt tientallen Mac mini's of andere AI-werkstations tegen een fractie van de totale kosten.

Laatste exemplaar op voorraad

Beste prijsgarantie!
Winkelmand
AI-computerserver | 128 GB GDDR7 | EPYC 512 GB
AI-computerserver | 128 GB GDDR7 | EPYC 512 GB
CZK 687
687 CZK exclusief BTW

✅ Prijs exclusief BTW bij gebruik van onze hosten
🎓 Gratis training voor beginners en gevorderden
🛡️ 24 maanden garantie op alle apparaten
⚡ Express-service – snelle reparatie in onze centrum

Veilige kaartbetaling

 

Prijs inclusief btw (21%)
CZK831
Exclusief btw: 687 520 CZK  • Factuur met btw-nummer / BTW-nummer • Levering binnen 7 dagen
4 x RTX 5090 Blackwell — 128 GB GDDR7 VRAM in totaal
Inbrandtest van 12 minuten, alle GPU's 575W — 0 fouten
AI-stack vooraf geïnstalleerd (vLLM, llama.cpp, PyTorch, CUDA)
BMC beheer op afstand via IPMI 2.0 — geen fysieke toegang nodig
Klaar voor gebruik — maak verbinding en log in.
✓ Burn-in PASS Blackwell sm_120 CUDA 12.8 Bestelnummer #KE21013 AMD EPYC 7643 512 GB ECC-RAM
128 GB
Totaal GPU VRAM
~ 880 T
FP16 TFLOPS
1 631 t/s
LLM-lichting
0
Inbrandfouten
AI-contentgeneratie

Server voor het genereren van video's en afbeeldingen die niet van de werkelijkheid te onderscheiden zijn.

Met 128 GB GDDR7 VRAM verdeeld over vier Blackwell GPU's kunt u de grootste open-source diffusie- en videomodellen met volledige nauwkeurigheid uitvoeren, zonder offloading, kwantisering of wachttijden. Geen cloud, geen API-kosten, geen data die uw netwerk verlaat.

Vooraf geïnstalleerd en getest
🎬

Videogeneratie — HunyuanVideo, Wan2.1, CogVideoX

128 GB VRAM maakt het mogelijk om lange sequenties in hoge resolutie te genereren zonder beperkingen door tiling of frame-splitting. Volledige CUDA 12.8-ondersteuning voor alle moderne videomodellen.

128 GB VRAM
🖼️

Beeldgeneratie

FLUX.1, SD3.5, Stable Cascade — volledige precisie FP16, batch, ControlNet, IP-adapter.

????

LLM-inferentie voor teams

vLLM tensor-parallel × 4 GPU — 1.631 threads/s voor 64 gelijktijdige gebruikers. Qwen, Llama, Mistral, DeepSeek.

Hardware

Volledige technische specificaties

GPU (× 4 stuks)
ModelNVIDIA GeForce RTX 5090
architectuurBlackwell, sm_120
VRAM op GPU32 GB GDDR7
Totaal VRAM128 GB
Streaming via meerdere processen.170 SM/kaart
Geheugenbandbreedte~1.530 GB/s / GPU
TDP575W/GPU (4x = 2300W)
PCIeGen4 × 16 per slot
CPU en systeemgeheugen
CPUAMD EPYC 7643
Kernen/vezels48C / 96T
Maximale frequentie3,64 GHz
L3 cache256 MiB
Systeem-RAM512 GB DDR4-2666
ECCJa (RDIMM)
DIMM's8 x 64 GB Samsung
Geheugenkanalen8 (volledig uitgerust)
Moederbord en opslag
Zakelijk bureauASRockRack ROMED8-2T/BCM
BIOSP4.30 (20. 5. 2026)
NVMe SSDCruciaal P310 2 TB
Sequentiële lezing7 MB / s
Opeenvolgend schrijven6 MB / s
Willekeurige 4K IOPS467 K / 477 K zwart-wit
Naaien2× 10GbE + IPMI/BMC
Beheer op afstandASRock Rack BMC 3.08
Software (vooraf geïnstalleerd)
OSUbuntu LTS 24.04.4
NVIDIA-stuurprogramma595.71.05 (geopend)
CUDA-stuurprogramma/toolkit13.2 / 12.8
cuDNN9.10.02
PyTorch2.9.1+cu128
vLLM0.14.0
lama.cppCUDA-build, sm_120
Python venv/home/logic/llm-env
Gemeten vermogen

Echte benchmarks van deze specifieke machine

Gemeten op 10-7-2026 op host dm2, ordernummer KE21013. De waarden zijn gemeten en niet door de fabrikant opgegeven.

FP16-prestaties op GPU (8192² matmul)

GPU-0
219,1 tanden
GPU-1
221,3 tanden
GPU-2
219,4 tanden
GPU-3
218,3 tanden

Totaal ~880 TFLOPS FP16 · +33% per kaart ten opzichte van de RTX 4090

VRAM-overdrachtssnelheid (GDDR7)

GPU-0
1.533 GB/s
GPU-1
1.533 GB/s
GPU-2
1.533 GB/s
GPU-3
1.533 GB/s

PCIe host↔GPU: 27,6 / 28,3 GB/s (H2D / D2H)

vLLM · Qwen2.5-32B-Instruct AWQ · tensor-parallel × 4 · 64 gelijktijdige gebruikers

Batch geaggregeerde doorvoer64 gelijktijdige gebruikers
1 631 tok/s
ModelQwen2.5-32B AWQ (marlijnkorrel)
32B
GPU-aansluitingTensor-parallel × 4 GPU's
✓ alle 4

llama.cpp · Qwen2.5-14B Q4_K_M · 1 GPU · llama-bench

Tokens genererentg128 benchmark
147 tok/s
Snelle verwerkingpp512 benchmark
8 234 tok/s
KwantisatieQ4_K_M, 8,37 GiB
14,8B
7 074 MB / s
Leesgedeelte.
6 341 MB / s
Sectie-ingang
467 K
4K lees-IOPS
477 K
4K schrijf-IOPS
Betrouwbaarheid

12 minuten inbranden onder volledige belasting — 0 fouten

GPU-belasting — 720 seconden aanhoudende FP16-matrixvermenigvuldiging (8192×8192), alle 4 GPU's op 575 W ✓ PASS
GPU-0
84 ° C
575W 2,4GHz
0 fouten
GPU-1
88 ° C
575W 2,35GHz
0 fouten
GPU-2
83 ° C
575W 2,5GHz
0 fouten
GPU-3
80 ° C
575W 2,5GHz
0 fouten
Throttlingdrempel RTX 5090 ≈ 90 °C · maximaal gemeten 88 °C (GPU 1) · geen prestatiebeperking · SM-klokfrequentie constant 2,3–2,5 GHz · gecombineerde GPU + 96 CPU-threads test ook zonder fouten geslaagd · kernellog: geen Xid / NVRM / PCIe AER-fouten
Vergelijking met de concurrentie

Waarom onze server in plaats van de Mac Studio M3 Ultra 512 GB?

De Mac Studio M3 Ultra in de configuratie met 512 GB / 8 TB is de krachtigste Apple-machine in één behuizing voor AI. Hij kost echter zo'n 1.000.000 Tsjechische kronen – voor dat bedrag kunt u meer dan één van onze servers kopen.

Mac Studio M3 Ultra 512 GB / 8 TB Apple BTO · 32-core CPU · 80-core GPU · alleen macOS · geen CUDA · ~819 GB/s bandbreedte
Mac Studio M3 Ultra
~1.000.000 CZK
BTO-configuratie 512 GB / 8 TB
→
Onze server (inclusief btw)
831 899 CZK
4x meer CUDA-prestaties, lagere prijs
parameterMac Studio M3 Ultra 512GB4× RTX 5090 Server (KENTINO)
Prijs inclusief btw~1.000.000 CZK duurder831 899 CZK winnaar
GPU-versneller80-core M3 Ultra GPU's · ~40–60 TFLOPS FP16 · Alleen Metal4× RTX 5090 Blackwell · ~880 TFLOPS FP16 × 15+ · CUDA 12.8
VRAM / AI-geheugen512 GB gecombineerd (CPU+GPU gedeeld) 819 GB/s128 GB GDDR7 · ~1530 GB/s per GPU 5x sneller + 512 GB ECC RAM
LLM snelheid 32B~35–40 debieten/s · 1 gebruiker1.631 stromen/s batch × 40+ · 64 gebruikers
VideogeneratieMetaal is instabiel voor CUDA-modellen.CUDA · HunyuanVideo · Wan2.1 · native ondersteuning
Gelijktijdige gebruikers1–3 praktisch64+ (in LLM tensor parallel)
AI-ecosysteemmacOS / Metal / MLX · zonder CUDALinux / CUDA · PyTorch · finetuning · alles
Beheer op afstandSSH · geen IPMI · fysieke toegang voor herstartIPMI 2.0 · BMC · iKVM-console · BIOS op afstand
ScherpstellenMPS instabiel · niet aanbevolenVolledige CUDA LoRA QLoRA FSDP

Voor de prijs van een Mac Studio M3 Ultra krijg je een RTX 5090-server met het CUDA-ecosysteem.

De Mac Studio 512 GB is geweldig voor workloads van één gebruiker met enorme modellen in een uniform geheugen. Maar hij is duurder, draait op macOS zonder CUDA, kan maximaal 1-3 gebruikers aan en biedt geen ondersteuning voor fine-tuning. Onze server is sneller voor batch-inferentie, is volledig CUDA-compatibel en kan het hele team tegelijk aan.

~15x meer TFLOPS FP16 64+ gelijktijdige gebruikers Volledig CUDA-ecosysteem Fijn afstellen, LoRA, training BMC beheer op afstand, 24/7
Vooraf geïnstalleerde software

Geen installatie nodig — gewoon aansluiten en inloggen.

NVIDIA-stuurprogramma + CUDA
595.71.05 · CUDA 13.2 / toolkit 12.8 · cuDNN 9.10
Py Torch 2.9.1
+cu128 · sm_120 Blackwell · NCCL multi-GPU
vLLM 0.14.0
tensor-parallel · AWQ-marlijn · OpenAI API-compatibel
llama.cpp (CUDA-build)
sm_120 · commit c4ae9a8
HuggingFace stapel
transformatoren · versnellen · diffusers · naaf
Python venv
/home/logic/llm-env · modellen in /home/logic/models

⚡ Levering en eerste lancering

  • Levering binnen 7 werkdagen na orderbevestiging.
  • Factuur met btw-nummer — btw aftrekbaar voor bedrijven
  • Wijzig onmiddellijk het systeemwachtwoord en het BMC-wachtwoord.
  • Stel het BMC-adres in op een statisch IP-adres in uw netwerk.
  • Configureer de firewall voordat u API-inferentie uitvoert.
  • SSH-gebruiker: logic (sudo) · BMC-gebruiker: admin
  • Het stroomverbruik van de GPU kan worden geregeld: nvidia-smi -pl [watt]
  • Technische ondersteuning KENTINO sro — e-mail + telefoon
Technische opmerkingen Alle GPU's draaien op PCIe Gen4 × 16 — het AMD EPYC 7003 / ROMED8-2T platform is Gen4 (geen invloed op de LLM-inferentieprestaties). De RTX 5090 heeft geen NVLink — multi-GPU-communicatie via PCIe P2P ~24,3 GB/s (standaard voor deze klasse). ECC GPU-geheugen is niet beschikbaar op de consumentenversie van de RTX 5090 (verwacht, ECC zit in het systeem-RAM). Benchmarks gemeten op 7/10/2026, onderdeelnummer KE21013, dm2 host. Alle cijfers zijn gemeten en niet door de fabrikant gerapporteerd.

Producent

Pcpraha

Spelcomputers van het merk Pc Praha. De beste oplossing in Tsjechië en de EU. Pro-spelcomputers en mijnbouwplatforms en Asici.

Vragen en antwoorden Vraag en antwoord

Een vraag stellen
Er zijn nog geen vragen