Kentino · Vlastný server s umelou inteligenciou

NVIDIA GeForce RTX 4090 24 GB GDDR6X (repasovaná)

Platforma podnikovej triedy, zostavená a testovaná v EÚ.

€1.830,00 bez DPH · poštovné sa vypočíta pri platbe
Skladom — odosiela sa zo skladu v EÚ
ISO 9001 · overený hardvérSklad a záruka v EÚ7+ rokov skúseností v oblasti podnikovej umelej inteligenciePred odoslaním testované zapálením
Prehľad
Často kladené otázky
Doprava a záruka
Repasované · Testované na skúšobnej stanici

NVIDIA GeForce RTX 4090 — 24 GB pre lokálnu umelú inteligenciu

Profesionálne repasovaná RTX 4090: 24 GB pamäte GDDR6X a výpočtový výkon Ada Lovelace, testovaná a overená stabilita pri trvalom zaťažení. Ťažká karta pre inferenciu LLM pre viacero GPU a umelú inteligenciu pracovných staníc za zlomok ceny GPU pre dátové centrum.

24 GB
Grafická pamäť GDDR6X
16,384
CUDA jadrá
~ 1,008 GB / s
Šírka pásma pamäte
450 W
Napájanie dosky
Prehľad

24 GB pracant pre inferenciu umelej inteligencie

RTX 4090 kombinuje 24 GB pamäte GDDR6X so 16 384 jadrami CUDA Ada Lovelace a jadrami Tensor 4. generácie – čo je dostatok VRAM na pohodlné obsluhovanie kvantizovaných modelov 7B–13B alebo na spustenie modelu triedy 70B na dvoch až štyroch kartách. Je to chrbtica ceny a výkonu pre viacnásobné grafické karty s umelou inteligenciou od spoločnosti Kentino. Každá repasovaná jednotka je pred odoslaním vyčistená, skontrolovaná a podrobená záťažovému testu.

technické údaje

Technické údaje

GPU NVIDIA AD102 — Ada Lovelace
Memory Masážne stoly 24 GB GDDR6X, 384-bitová
Šírka pásma pamäte ~ 1,008 GB / s
CUDA jadrá 16,384
Tenzorové jadrá 512 (4. generácia) · až ~330 TFLOPS FP16
RT jadrá 128 (3. generácia)
Rozhranie PCIe 4.0 ×16
Napájanie dosky 450 W (16-kolíkový 12VHPWR)
Podmienka Repasované – testované na skúšobnej stanici, overená stabilita
Najlepšie pre

Kam sa to hodí

  • Inferencia LLM v lokálnej sieti – 24 GB hostitelia kvantizovali modely 7B–13B; škálovateľné na 70B naprieč viacerými kartami.
  • Pracovné stanice s umelou inteligenciou a jemné doladenie malých až stredných modelov.
  • Pracovné zaťaženie renderovania, simulácie a tvorby obsahu.
  • Cenovo výhodné servery s viacerými grafickými procesormi, kde sú grafické procesory v dátových centrách zbytočné.
Staviate multi-GPU server okolo týchto? Kentino zostavuje, testuje a uvádza do prevádzky kompletné RTX 4090 AI servery – požiadajte nás o nakonfigurovanú zostavu.
otázky

Často kladené otázky

Čo tu znamená „zrekonštruované“?

Karta bola pred odoslaním profesionálne vyčistená, vizuálne skontrolovaná a podrobená záťažovým testom na stabilitu a plnú funkčnosť VRAM. Nejde o nový maloobchodný kus.

Môže spustiť model 70B?

Nie na jednej karte – 70B model so 4-bitovou procesorovou pamäťou potrebuje približne 40 GB VRAM. Dve až štyri RTX 4090 (spolu 48 – 96 GB) to zvládajú pomocou tenzorovo-paralelnej inferencie.

Pasuje to na štandardný server?

RTX 4090 je veľká trojslotová karta. Je vhodná pre vežové aj 4U rackové zostavy; overte si priestor pre slot a dostupnosť 16-pinového napájania vo vašej šasi.

Otázky, ktoré nám kupujúci kladú najčastejšie pred objednaním servera.

Ako dlho to trvá?

Stroje vyrobené z komponentov, ktoré máme pripravené, expedujeme rýchlo; čokoľvek, čo vyžaduje konkrétnu generáciu GPU, závisí od dodávok. Pred zaplatením vám oznámime dátum a ak sa dodávka zmení, oznámime vám to, namiesto toho, aby ste sa o tom dozvedeli.

Dá sa konfigurácia zmeniť pred zostavením?

Takmer vždy. Grafické karty, pamäť, úložisko a chladenie sa vyberajú pre každú objednávku a uvedená konfigurácia je skôr východiskovým bodom ako fixným balíkom. Ak potrebujete viac VRAM, rýchlejšie úložisko alebo iný prístup k chladeniu, oznámte to pred objednaním a my vám poskytneme cenovú ponuku.

Môžem si server vyzdvihnúť osobne?

Môžete. Náš sklad sa nachádza v Prahe a osobný odber je vítaný – väčšina ľudí, ktorí prídu, využije návštevu na to, aby si s naším technikom prezreli stroj a položili otázky, ktoré sú cez e-mail nepríjemné. V prípade objednávok v rámci Českej republiky sa tiež snažíme doručiť osobne a sprevádzať vás nastavením na mieste.

Môžem sa porozprávať s niekým, kto skutočne rozumie pracovnej záťaži?

Áno. Máme inžiniera, ktorý pracuje konkrétne na systémoch umelej inteligencie, nie na všeobecnom predajnom oddelení. Ak sa vaša otázka týka veľkosti dávok, kvantizácie, prepojení alebo toho, kde bude vaše úzke miesto, opýtajte sa – takýto rozhovor zvyčajne zmení konfiguráciu k lepšiemu.

Ktorý model môžem spustiť na tejto konfigurácii?

Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.

Ako otestujete server pred odoslaním?

Porovnávame ho so skutočnými záťažami umelej inteligencie, a nie so syntetickými skóre: inferenčná priepustnosť, trvalé správanie pri záťaži a teploty pri nepretržitej prevádzke. Výsledky benchmarkov získate so strojom, takže výkon, ktorý vám bol sľúbený, je výkon, ktorý si môžete overiť hneď v prvý deň.

Je server pripravený na spustenie, keď dorazí?

Áno. Každý stroj je pred odoslaním zostavený, otestovaný v praxi a porovnaný s reálnymi záťažami umelej inteligencie. Po odoslaní máme nainštalovaný a spustený LLM. Zapojíte ho, pripojíte k sieti a začnete pracovať – zostáva už len rozhodnutie, ktorý projekt spustíte ako prvý.

Odosielame z nášho skladu v EÚ. Ťažké položky môžu vyžadovať prepravu – kontaktujte nás pre cenovú ponuku na prepravu a dodaciu lehotu. 2-ročná obmedzená záruka s rozšírenou podporou RMA; k dispozícii je predĺžená záruka.

Nie je to presne to, čo potrebujete?

Povedzte nám o vašej pracovnej záťaži a my túto platformu prispôsobíme jej špecifikáciám – grafické karty, pamäť, úložisko a chladenie zodpovedajú tomu, čo skutočne používate.