Domácí AI server — Punkstation Pro - 88 GB VRAM - EPYC
Platforma podnikové úrovně, sestavená a testovaná v EU.
Punkstation na platformě serverové úrovně : spotřebitelská RTX 4090 spárovaná s grafickou kartou NVIDIA CMP 170HX (64 GB HBM2e) s odemčenými ovladači — 88 GB agregované paměti VRAM — na jednopaticové základní desce AMD EPYC s pamětí ECC, vzdálenou správou IPMI a čtyřmi sloty PCIe 4.0 ×16 pro rozšíření. Nejde o levný desktop — jde o robustní, rozšiřitelný stroj, konstruovaný a konfigurovaný pro maximální výkon . K dispozici jako tichá věž nebo rackový server.
K čemu to je
Stejné silné stránky agregované VRAM jako u Punkstation, na hardwaru, který vydrží a je škálovatelný. VRAM je agregovaná, nikoli sdružená – obě karty jsou nezávislé paměti, takže je nejlepší pro generování videa a obrázků, velké modely kombinující experty, které se vejdou na jednu kartu, a pro pipeline kombinující agenty / více modelů. RTX 4090 řídí desktop a rychlé generování obrázků; 64 GB u 170HX nese velký model. Platforma EPYC přidává paměť ECC, správu IPMI mimo pásmo, více linek PCIe a NVMe a jasnou možnost upgradu na sestavu 4× 170HX.
Generování obrazu, Směs agentů, Generování videa, Úvaha MoE
- Ověřeno: Qwen3 35B-A3B (směs expertů, W8A8, kompilováno) běží kompletně na 64 GB paměti 170HX bez nutnosti odlehčení paměti na ~140 tokenů/s jeden stream (a ~3 270 tok/s v dávce 48 požadavků) – rychlejší než model s hustotou 7B a zároveň koherentně uvažující.
- Video / obrázek: Generační modely nelze rozdělit mezi karty – každá z nich pojme jednu grafickou kartu. 64 GB paměti 170HX umožňuje ukládat velké difuzní a video modely ve vysokém rozlišení a dávkově; 4090 umožňuje rychlé generování obrazu třídy SDXL/Flux. Pro souběžné úlohy spusťte oba paralelně.
Specifikace
| Složka | Detail |
|---|---|
| Akcelerátor 1 | NVIDIA GeForce RTX 4090 · 24 GB GDDR6X · displej + rychlý provoz s jednou kartou |
| Akcelerátor 2 | NVIDIA CMP 170HX · 64 GB HBM2e (upravená, bez ovladačů, pouze pro výpočetní účely) |
| Celková VRAM | 88 GB celkem (24 + 64), obě plně přístupné |
| Procesor (CPU) | AMD EPYC (Řím / Milán, SP3) — model konfigurovaný na objednávku |
| Základní desky | Jednopaticová serverová základní deska EPYC · 8kanálová paměť DDR4 ECC · 4× PCIe 4.0 ×16 · integrovaná grafika + vzdálená správa IPMI/BMC |
| Memory | DDR4 ECC, osmikanálová – konfigurovatelná (typicky 128 GB) |
| Skladování | M.2 NVMe (až 3× PCIe 4.0 ×4) |
| networking | Duální 2.5 GbE + dedikovaný port IPMI pro vzdálenou správu |
| Výkon | Vylepšený zdroj dimenzovaný dle sestavy |
| Podvozek | Tichý stolní počítač ve věži – nebo server do racku (zvolte výše) |
| Operační systém | Ubuntu, ovladače NVIDIA + předkonfigurovaný CUDA, kompilovaný/vyladěný pro běhové prostředí CUDAgraph |
| Montáž | Sestaveno, zapáleno a ověřeno na maximální výkon před odesláním |
Před objednáním si prosím přečtěte
- 170HX je pouze pro výpočetní techniku (bez displeje) — konzoli pohání grafická karta RTX 4090 (nebo integrovaná grafika BMC).
- Odkazy 170HX na PCIe 2.0 (×4 standardně, ×16 mod k dispozici) – omezuje přenos mezi hostitelem a zařízením, nikoli inferenci rezidentního modelu.
Řazení
Cena se připravuje – vyžádejte si cenovou nabídku. Vyberte si výše věž nebo server (rack) . Dodací lhůta 10–28 dní . Ceny jsou v EUR bez DPH . CPU / paměť / úložiště konfigurované na míru dle objednávky.
Otázky, které nám kupující nejčastěji kladou před objednáním serveru.
Jak dlouho to trvá?
Stroje vyrobené z komponentů, které držíme v zásobě, expedujeme rychle; cokoli vyžadující specifickou generaci GPU závisí na dodávce. Před platbou vám sdělíme datum a pokud se pohne, raději vám to oznamujeme, než abyste se o tom dozvěděli.
Lze konfiguraci změnit před sestavením?
Téměř vždy. Grafické karty, paměť, úložiště a chlazení se volí pro každou objednávku a uvedená konfigurace je spíše výchozím bodem než pevně stanoveným balíčkem. Pokud potřebujete více VRAM, rychlejší úložiště nebo jiný přístup k chlazení, sdělte nám to před objednáním a my vám sdělíme cenovou nabídku.
Můžu si server vyzvednout osobně?
Můžete. Náš sklad je v Praze a osobní vyzvednutí je vítáno – většina lidí, kteří přijdou, využije návštěvy k prohlídce stroje s naším technikem a k položení otázek, které jsou přes e-mail nepříjemné. U objednávek v rámci České republiky se také snažíme doručit osobně a provést vás nastavením na místě.
Můžu si promluvit s někým, kdo skutečně rozumí pracovní zátěži?
Ano. Máme inženýra, který se zabývá konkrétně systémy umělé inteligence, ne běžným prodejním oddělením. Pokud se vaše otázka týká velikostí dávek, kvantizace, propojení nebo toho, kde bude vaše úzké místo, zeptejte se – tato konverzace obvykle změní konfiguraci k lepšímu.
Který model mohu v této konfiguraci provozovat?
Ano. Každý stroj je před odesláním sestaven, otestován a porovnán s reálnými úlohami umělé inteligence. Po odeslání máme již nainstalovaný a spuštěný LLM. Zapojíte ho, připojíte k síti a začnete pracovat – zbývá už jen rozhodnutí, který projekt spustí jako první.
Jak otestujete server před odesláním?
Porovnáváme to se skutečnými zátěžemi umělé inteligence, nikoli se syntetickými skóre: propustnost inference, trvalé chování při zátěži a teploty za nepřetržitého provozu. S tímto strojem získáte výsledky benchmarků, takže výkon, který vám byl slíben, je výkon, který si můžete ověřit hned první den.
Je server připraven ke spuštění, když dorazí?
Ano. Každý stroj je před odesláním sestaven, otestován a porovnán s reálnými úlohami umělé inteligence. Po odeslání máme již nainstalovaný a spuštěný LLM. Zapojíte ho, připojíte k síti a začnete pracovat – zbývá už jen rozhodnutí, který projekt spustí jako první.
Odesíláme z našeho skladu v EU. Těžké zboží může vyžadovat přepravu – kontaktujte nás pro cenovou nabídku a dodací lhůtu. Dvouletá omezená záruka s pokročilou podporou RMA; k dispozici je prodloužená záruka.
Není to přesně to, co potřebujete?
Sdělte nám svou pracovní zátěž a my tuto platformu specifikujeme podle ní – grafické karty, paměť, úložiště a chlazení budou odpovídat tomu, co skutečně používáte.