Domáci AI server — Punkstation Pro – 88 GB VRAM – EPYC
Platforma podnikovej triedy, zostavená a testovaná v EÚ.
Punkstation na serverovej platforme : spotrebiteľská grafická karta RTX 4090 spárovaná s grafickou kartou NVIDIA CMP 170HX (64 GB HBM2e) s odomknutými ovládačmi a 88 GB agregovanej pamäte VRAM na jednozásuvnej doske AMD EPYC s pamäťou ECC, vzdialenou správou IPMI a štyrmi slotmi PCIe 4.0 ×16, o ktoré je možné rozšíriť systém. Nie je to lacný desktop – je to robustný, rozšíriteľný stroj, skonštruovaný a nakonfigurovaný pre maximálny výkon . K dispozícii ako tichá veža alebo rackový server.
Na čo to slúži
Rovnaké silné stránky agregovanej VRAM ako Punkstation, na hardvéri, ktorý vydrží a škáluje sa. VRAM je agregovaná, nie združená – obe karty sú nezávislé pamäte, takže je najlepšia pri generovaní videa a obrázkov, veľkých modeloch so zmiešanými expertmi, ktoré sa zmestia na jednu kartu, a pri spracovaní zmiešaných agentov/viacmodelových kanálov. RTX 4090 riadi desktopovú a rýchlu generáciu obrázkov; 64 GB RAM u 170HX je zárukou veľkého modelu. Platforma EPYC pridáva pamäť ECC, mimopásmovú správu IPMI, viac liniek PCIe a NVMe a jasnú cestu k upgradu na zostavu 4× 170HX.
Generovanie obrazu, Zmes agentov, Generovanie videa, Úvaha MoE
- Overené: Qwen3 35B-A3B (zmes expertov, W8A8, skompilovaný) beží výlučne na 64 GB pamäti 170HX bez nutnosti odľahčenia pri ~140 tokenov/s jeden stream (a ~3 270 tok/s v dávke so 48 požiadavkami) – rýchlejšie ako model s hustotou 7B a zároveň koherentne uvažuje.
- Video / obrázok: Generačné modely nie je možné rozdeliť medzi karty – každá z nich sa zmestí na jeden GPU. 64 GB pamäte karty 170HX umožňuje ukladať rozsiahle difúzne a video modely vo vysokom rozlíšení a dávkovo; karta 4090 poskytuje rýchle generovanie obrázkov triedy SDXL/Flux. Pre súbežné úlohy môžete spúšťať obe paralelne.
špecifikácia
| Zložka | detail |
|---|---|
| Akcelerátor 1 | NVIDIA GeForce RTX 4090 · 24 GB GDDR6X · displej + rýchla prevádzka s jednou grafickou kartou |
| Akcelerátor 2 | NVIDIA CMP 170HX · 64 GB HBM2e (upravená, bez ovládačov, iba výpočtová) |
| Celková VRAM | 88 GB agregovane (24 + 64), obe plne prístupné |
| CPU | AMD EPYC (Rím / Miláno, SP3) – model konfigurovaný na objednávku |
| Mainboard | Jednosocketová serverová doska EPYC · 8-kanálová pamäť DDR4 ECC · 4× PCIe 4.0 ×16 · integrovaná grafika + vzdialená správa IPMI/BMC |
| Memory Masážne stoly | DDR4 ECC, osemkanálová – konfigurovateľná (typicky 128 GB) |
| Uskladnenie | M.2 NVMe (až 3× PCIe 4.0 ×4) |
| networking | Duálny 2.5 GbE + vyhradený port IPMI pre vzdialenú správu |
| Výkon | Vylepšený zdroj dimenzovaný pre zostavu |
| Podvozok | Tichý stolný počítač – veža – alebo server do racku (vyberte vyššie) |
| Operačný systém | Ubuntu, ovládače NVIDIA + predkonfigurovaný CUDA, skompilovaný/vyladený pre beh cudagraphu |
| Montáž | Zostavené, zapálené a overené na maximálny výkon pred odoslaním |
Pred objednaním si, prosím, prečítajte
- 170HX je iba výpočtový (bez displeja) – konzolu poháňa grafická karta RTX 4090 (alebo integrovaná grafická karta BMC).
- Odkazy 170HX na PCIe 2.0 (×4 štandard, ×16 mod dostupný) – obmedzuje prenos hostiteľa↔zariadenia, nie inferenciu rezidentného modelu.
Radenie
Cena sa pripravuje – vyžiadajte si cenovú ponuku. Vyberte si vyššie vežu alebo server (rack) . Dodacia lehota 10–28 dní . Ceny sú v EUR bez DPH . CPU / pamäť / úložisko na mieru konfigurované na objednávku.
Otázky, ktoré nám kupujúci kladú najčastejšie pred objednaním servera.
Ako dlho to trvá?
Stroje vyrobené z komponentov, ktoré máme pripravené, expedujeme rýchlo; čokoľvek, čo vyžaduje konkrétnu generáciu GPU, závisí od dodávok. Pred zaplatením vám oznámime dátum a ak sa dodávka zmení, oznámime vám to, namiesto toho, aby ste sa o tom dozvedeli.
Dá sa konfigurácia zmeniť pred zostavením?
Takmer vždy. Grafické karty, pamäť, úložisko a chladenie sa vyberajú pre každú objednávku a uvedená konfigurácia je skôr východiskovým bodom ako fixným balíkom. Ak potrebujete viac VRAM, rýchlejšie úložisko alebo iný prístup k chladeniu, oznámte to pred objednaním a my vám poskytneme cenovú ponuku.
Môžem si server vyzdvihnúť osobne?
Môžete. Náš sklad sa nachádza v Prahe a osobný odber je vítaný – väčšina ľudí, ktorí prídu, využije návštevu na to, aby si s naším technikom prezreli stroj a položili otázky, ktoré sú cez e-mail nepríjemné. V prípade objednávok v rámci Českej republiky sa tiež snažíme doručiť osobne a sprevádzať vás nastavením na mieste.
Môžem sa porozprávať s niekým, kto skutočne rozumie pracovnej záťaži?
Áno. Máme inžiniera, ktorý pracuje konkrétne na systémoch umelej inteligencie, nie na všeobecnom predajnom oddelení. Ak sa vaša otázka týka veľkosti dávok, kvantizácie, prepojení alebo toho, kde bude vaše úzke miesto, opýtajte sa – takýto rozhovor zvyčajne zmení konfiguráciu k lepšiemu.
Ktorý model môžem spustiť na tejto konfigurácii?
Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.
Ako otestujete server pred odoslaním?
Porovnávame ho so skutočnými záťažami umelej inteligencie, a nie so syntetickými skóre: inferenčná priepustnosť, trvalé správanie pri záťaži a teploty pri nepretržitej prevádzke. Výsledky benchmarkov získate so strojom, takže výkon, ktorý vám bol sľúbený, je výkon, ktorý si môžete overiť hneď v prvý deň.
Je server pripravený na spustenie, keď dorazí?
Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.
Odosielame z nášho skladu v EÚ. Ťažké položky môžu vyžadovať prepravu – kontaktujte nás pre cenovú ponuku na prepravu a dodaciu lehotu. 2-ročná obmedzená záruka s rozšírenou podporou RMA; k dispozícii je predĺžená záruka.
Nie je to presne to, čo potrebujete?
Povedzte nám o vašej pracovnej záťaži a my túto platformu prispôsobíme jej špecifikáciám – grafické karty, pamäť, úložisko a chladenie zodpovedajú tomu, čo skutočne používate.