NVIDIA GeForce RTX 4090 24 GB GDDR6X (repasovaná)
Platforma podnikovej triedy, zostavená a testovaná v EÚ.
NVIDIA GeForce RTX 4090 — 24 GB pre lokálnu umelú inteligenciu
Profesionálne repasovaná RTX 4090: 24 GB pamäte GDDR6X a výpočtový výkon Ada Lovelace, testovaná a overená stabilita pri trvalom zaťažení. Ťažká karta pre inferenciu LLM pre viacero GPU a umelú inteligenciu pracovných staníc za zlomok ceny GPU pre dátové centrum.
24 GB pracant pre inferenciu umelej inteligencie
RTX 4090 kombinuje 24 GB pamäte GDDR6X so 16 384 jadrami CUDA Ada Lovelace a jadrami Tensor 4. generácie – čo je dostatok VRAM na pohodlné obsluhovanie kvantizovaných modelov 7B–13B alebo na spustenie modelu triedy 70B na dvoch až štyroch kartách. Je to chrbtica ceny a výkonu pre viacnásobné grafické karty s umelou inteligenciou od spoločnosti Kentino. Každá repasovaná jednotka je pred odoslaním vyčistená, skontrolovaná a podrobená záťažovému testu.
Technické údaje
| GPU | NVIDIA AD102 — Ada Lovelace |
| Memory Masážne stoly | 24 GB GDDR6X, 384-bitová |
| Šírka pásma pamäte | ~ 1,008 GB / s |
| CUDA jadrá | 16,384 |
| Tenzorové jadrá | 512 (4. generácia) · až ~330 TFLOPS FP16 |
| RT jadrá | 128 (3. generácia) |
| Rozhranie | PCIe 4.0 ×16 |
| Napájanie dosky | 450 W (16-kolíkový 12VHPWR) |
| Podmienka | Repasované – testované na skúšobnej stanici, overená stabilita |
Kam sa to hodí
- Inferencia LLM v lokálnej sieti – 24 GB hostitelia kvantizovali modely 7B–13B; škálovateľné na 70B naprieč viacerými kartami.
- Pracovné stanice s umelou inteligenciou a jemné doladenie malých až stredných modelov.
- Pracovné zaťaženie renderovania, simulácie a tvorby obsahu.
- Cenovo výhodné servery s viacerými grafickými procesormi, kde sú grafické procesory v dátových centrách zbytočné.
Často kladené otázky
Čo tu znamená „zrekonštruované“?
Karta bola pred odoslaním profesionálne vyčistená, vizuálne skontrolovaná a podrobená záťažovým testom na stabilitu a plnú funkčnosť VRAM. Nejde o nový maloobchodný kus.
Môže spustiť model 70B?
Nie na jednej karte – 70B model so 4-bitovou procesorovou pamäťou potrebuje približne 40 GB VRAM. Dve až štyri RTX 4090 (spolu 48 – 96 GB) to zvládajú pomocou tenzorovo-paralelnej inferencie.
Pasuje to na štandardný server?
RTX 4090 je veľká trojslotová karta. Je vhodná pre vežové aj 4U rackové zostavy; overte si priestor pre slot a dostupnosť 16-pinového napájania vo vašej šasi.
Otázky, ktoré nám kupujúci kladú najčastejšie pred objednaním servera.
Ako dlho to trvá?
Stroje vyrobené z komponentov, ktoré máme pripravené, expedujeme rýchlo; čokoľvek, čo vyžaduje konkrétnu generáciu GPU, závisí od dodávok. Pred zaplatením vám oznámime dátum a ak sa dodávka zmení, oznámime vám to, namiesto toho, aby ste sa o tom dozvedeli.
Dá sa konfigurácia zmeniť pred zostavením?
Takmer vždy. Grafické karty, pamäť, úložisko a chladenie sa vyberajú pre každú objednávku a uvedená konfigurácia je skôr východiskovým bodom ako fixným balíkom. Ak potrebujete viac VRAM, rýchlejšie úložisko alebo iný prístup k chladeniu, oznámte to pred objednaním a my vám poskytneme cenovú ponuku.
Môžem si server vyzdvihnúť osobne?
Môžete. Náš sklad sa nachádza v Prahe a osobný odber je vítaný – väčšina ľudí, ktorí prídu, využije návštevu na to, aby si s naším technikom prezreli stroj a položili otázky, ktoré sú cez e-mail nepríjemné. V prípade objednávok v rámci Českej republiky sa tiež snažíme doručiť osobne a sprevádzať vás nastavením na mieste.
Môžem sa porozprávať s niekým, kto skutočne rozumie pracovnej záťaži?
Áno. Máme inžiniera, ktorý pracuje konkrétne na systémoch umelej inteligencie, nie na všeobecnom predajnom oddelení. Ak sa vaša otázka týka veľkosti dávok, kvantizácie, prepojení alebo toho, kde bude vaše úzke miesto, opýtajte sa – takýto rozhovor zvyčajne zmení konfiguráciu k lepšiemu.
Ktorý model môžem spustiť na tejto konfigurácii?
Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.
Ako otestujete server pred odoslaním?
Porovnávame ho so skutočnými záťažami umelej inteligencie, a nie so syntetickými skóre: inferenčná priepustnosť, trvalé správanie pri záťaži a teploty pri nepretržitej prevádzke. Výsledky benchmarkov získate so strojom, takže výkon, ktorý vám bol sľúbený, je výkon, ktorý si môžete overiť hneď v prvý deň.
Je server pripravený na spustenie, keď dorazí?
Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.
Odosielame z nášho skladu v EÚ. Ťažké položky môžu vyžadovať prepravu – kontaktujte nás pre cenovú ponuku na prepravu a dodaciu lehotu. 2-ročná obmedzená záruka s rozšírenou podporou RMA; k dispozícii je predĺžená záruka.
Nie je to presne to, čo potrebujete?
Povedzte nám o vašej pracovnej záťaži a my túto platformu prispôsobíme jej špecifikáciám – grafické karty, pamäť, úložisko a chladenie zodpovedajú tomu, čo skutočne používate.