Server til generering af video og billeder, der ikke kan skelnes fra virkeligheden
128 GB GDDR7 VRAM på tværs af fire Blackwell GPU'er giver dig mulighed for at køre de største open source-diffusions- og videomodeller med fuld nøjagtighed – uden offloading, kvantisering eller ventetid. Ingen cloud, ingen API-gebyrer, ingen data, der forlader dit netværk.
Videogenerering — HunyuanVideo, Wan2.1, CogVideoX
128 GB VRAM muliggør generering af lange sekvenser i høj opløsning uden begrænsninger i form af tiling eller frame-splitting. Fuld CUDA 12.8-understøttelse af alle moderne videomodeller.
Billedgenerering
FLUX.1, SD3.5, Stabil Kaskade — fuld præcision FP16, batch, ControlNet, IP-adapter.
LLM-inferens for teams
vLLM tensor-parallel × 4 GPU — 1.631 tråde/s for 64 samtidige brugere. Qwen, Llama, Mistral, DeepSeek.
Komplette tekniske specifikationer
Ægte benchmarks fra netop denne maskine
Målt d. 10/7/2026 på vært dm2, ordrenummer KE21013. Tallene er målte, ikke angivet af producenten.
FP16-ydeevne på GPU (8192² matmul)
I alt ~880 TFLOPS FP16 · +33% pr. kort vs. RTX 4090
VRAM-overførselshastighed (GDDR7)
PCIe-vært↔GPU: 27,6 / 28,3 GB/s (H2D / D2H)
vLLM · Qwen2.5-32B-Instruct AWQ · tensor-parallel × 4 · 64 samtidige brugere
llama.cpp · Qwen2.5-14B Q4_K_M · 1 GPU · llama-bænk
12 minutters indbrænding ved fuld belastning — 0 fejl
Hvorfor vores server i stedet for Mac Studio M3 Ultra 512 GB?
Mac Studio M3 Ultra i 512 GB / 8 TB-konfigurationen er den kraftigste Apple-maskine til AI i én boks. Den koster dog ~1.000.000 CZK — for denne pris kan du købe mere end én af vores servere.
| Parameter | Mac Studio M3 Ultra 512GB | 4× RTX 5090-server (KENTINO) |
|---|---|---|
| Pris med moms | ~1.000.000 CZK dyrere | 831 899 CZK vinder |
| GPU-accelerator | 80-kernede M3 Ultra GPU'er · ~40-60 TFLOPS FP16 · Kun metal | 4× RTX 5090 Blackwell · ~880 TFLOPS FP16 × 15+ · CUDA 12.8 |
| VRAM / AI-hukommelse | 512 GB samlet (CPU+GPU delt) 819 GB/s | 128 GB GDDR7 · ~1530 GB/s pr. GPU 5 gange hurtigere + 512 GB ECC RAM |
| LLM-hastighed 32B | ~35–40 flow/s · 1 bruger | 1.631 flow/s batch × 40+ · 64 brugere |
| Videogenerering | Metal ustabilt for CUDA-modeller | CUDA · HunyuanVideo · Wan2.1 · native support |
| Samtidige brugere | 1–3 praktisk talt | 64+ (i LLM-tensorparallel) |
| AI-økosystem | macOS / Metal / MLX · uden CUDA | Linux / CUDA · PyTorch · finjustering · alle |
| Fjernadministration | SSH · ingen IPMI · fysisk adgang til genstart | IPMI 2.0 · BMC · iKVM-konsol · fjern-BIOS |
| Finjustering | MPS ustabil · anbefales ikke | Fuld CUDA LoRA QLoRA FSDP |
For prisen for en Mac Studio M3 Ultra får du en RTX 5090-server med CUDA-økosystemet.
Mac Studio 512 GB er fantastisk til enkeltbrugeropgaver med store modeller i samlet hukommelse. Men den er dyrere, kører på macOS uden CUDA, kan håndtere maks. 1-3 brugere og understøtter ikke finjustering. Vores server er hurtigere til batchinferens, har fuld CUDA-kompatibilitet og kan håndtere hele teamet på én gang.
Ingen installation – bare tilslut og log ind
⚡ Levering og første lancering
- Levering inden for 7 hverdage efter ordrebekræftelse
- Faktura med momsnummer — momsfradragsberettiget for virksomheder
- Skift systemadgangskoden og BMC-adgangskoden med det samme
- Indstil BMC'en til en statisk IP på dit netværk
- Konfigurer firewallen, før du kører API-inferens
- SSH-bruger: logik (sudo) · BMC-bruger: admin
- GPU-strømforbrug kan reguleres: nvidia-smi -pl [watt]
- Teknisk support KENTINO sro — e-mail + telefon









