K-AI 96 ROMA 4090
Kraftig konfigurasjon for AI-inferens, LLM og dyp læring med 2644 TOPS-ytelse.
Vi introduserer en 4U rackmontert server designet for de mest krevende AI-arbeidsbelastningene. Optimalisert for å kjøre store språkmodeller, bildegenerering og kompleks dataanalyse.
Konfigurer og kjøp
2644 TOPS
Ekstrem datakraft for umiddelbar respons fra moderne AI-modeller.
96 GB VRAM
4× NVIDIA RTX 4090 for problemfri drift av Llama 3.3-, Qwen- og DeepSeek-modeller.
32 KJERNER
AMD EPYC 7542 (Roma) med 64 tråder for håndtering av massive datastrømmer.
256 GB RAM
Server ECC-minne som sikrer systemstabilitet under belastning døgnet rundt.
Hvorfor velge K-AI 96 ROMA?
Denne maskinen tilbyr et uslåelig forhold mellom pris og ytelse takket være bruken av fire NVIDIA GeForce RTX 4090-grafikkort. Den er et ideelt valg for:
- Inferanseportal for bedrifter: Drift av interne chatboter (70B-modeller) for 50–200 ansatte.
- Generativ AI: Generering av flash-medier ved bruk av FLUX.1, SDXL eller Wan 2.2.
- Finjustering: Effektiv finjustering av modeller (LoRA/QLoRA) med størrelser på 7–34B parametere.
- RAG (gjenfinningsutvidet generering): Intelligent arbeid med bedriftsdokumentasjon i sanntid.

Komplette tekniske spesifikasjoner
| Komponent | Spesifikasjon |
|---|---|
| Grafikkort | 4× NVIDIA GeForce RTX 4090 (hver med 24 GB GDDR6X, PCIe 4.0 x16) |
| prosessor | AMD EPYC 7542 (32 kjerner / 64 tråder, TDP 225 W) |
| Hovedkort | ASRock Rack ROMED8-2T med IPMI-støtte for fjernadministrasjon |
| Driftsminne | 256 GB DDR4-2666 ECC RDIMM (kan utvides opptil 512 GB) |
| Oppbevaring | 2 TB NVMe M.2 (PCIe 4.0 x4) for lynrask systemoppstart |
| Strømforsyning | Dobbel synkronisert 2 kW ATX strømforsyning (totalt 4000 W) |
| Avkjøling | Industrielle 120 mm vifter med optimalisert strømning foran og bak |
| Operační system | Forhåndsinstallert Ubuntu + CUDA + Docker + AI-rammeverk (vLLM, ComfyUI) |
Målt ytelse i praksis:
Våre laboratorietester bekrefter topp effektivitet:
- Llama 3.3 70B (AWQ INT4): Rekker opp til 179 tok/s ved batch-32.
- GPU-minnegjennomstrømning: 920 GB/s per kort.
- Utplasseringstid: Serveren er klar til bruk innen 16–20 måneder (ved utleie/leasing) eller for umiddelbar levering.
Trenger du en individuell konfigurasjon?
Vi kan justere RAM-størrelsen, NVMe-diskkapasiteten eller legge til flere nettverkselementer etter dine behov.
Be om et individuelt tilbud







