NVIDIA RTX PRO 6000 Blackwell Server Edition 96 GB GDDR7 ECC
Platforma podnikové úrovně, sestavená a testovaná v EU.
NVIDIA RTX PRO 6000 Blackwell Server Edition — 96 GB
Varianta pro datová centra: 96 GB unifikované paměti ECC GDDR7, pasivně chlazené pro proudění vzduchu z předozadního racku, s konfigurovatelným výkonem 400–600 W. Navrženo pro nepřetržitý provoz v serverové šasi, nikoli na stole.
Navrženo pro nepřetržitý provoz v racku
Serverová edice obsahuje stejný čip Blackwell a stejný 96GB paměťový fond ECC jako karty pro pracovní stanice, ale je navržena pro jiné prostředí. Nemá ventilátor ani výstupy pro zobrazení: chlazení je veden ze šasi, a to zepředu dozadu, což v první řadě umožňuje hustou sestavu racků s více grafickými kartami. Napájecí výkon je konfigurovatelný mezi 400 W a 600 W, takže hustotu a tepelný rozpočet lze vyvážit s propustností karty. Toto je karta, která stojí za rackovými servery Kentino s více grafickými kartami a umělou inteligencí od společnosti Kentino.
Technické údaje
| GPU | NVIDIA GB202 — Blackwell |
| Memory | 96 GB GDDR7 ECC, 512bitová |
| Šířka pásma paměti | ~1.8 TB/s |
| CUDA jádra | 24,064 |
| Tenzorová jádra | 752 (5. generace) · ~2 000 TOPS INT8 |
| RT jádra | 188 (4. generace) |
| Rozhraní | PCIe 5.0 × 16 |
| Napájení desky | Konfigurovatelné 400–600 W |
| Chlazení | Pasivní – vyžaduje proudění vzduchu zepředu dozadu na šasi |
| Výstupy displeje | Nevyplněno |
| Formální faktor | Dvouslotový, plná výška |
| Záruka | Záruka výrobce 3 |
Kam se to hodí
- Husté rackové servery s více grafickými kartami – 2, 4, 6 nebo 8 karet v jednom šasi.
- Nepřetržitá inference obsluhovaná 24 hodin denně, 7 dní v týdnu v datovém centru nebo serverovně.
- Sdílená nebo vícenájemnická infrastruktura umělé inteligence, kde jsou požadavky na ECC a stabilitu.
- Nasazení, kde musí být výkon na kartu omezen tak, aby odpovídal tepelnému rozpočtu racku.
- Velký model obsluhovaný několika kartami s 96 GB unifikované VRAM na každé z nich.
Nejčastější dotazy
Můžu to použít ve stolním počítači?
Ne. Nemá ventilátor a spoléhá výhradně na proudění vzduchu ze šasi určené pro pasivní grafické karty. V běžné věžové skříni se bude brzdit a poté přehřívat. Pro věžové a stolní sestavy použijte edici Workstation nebo Max-Q.
Jak si vede v porovnání s kartami pro pracovní stanice?
Identická grafická karta a identických 96 GB paměti ECC. Rozdíly jsou fyzické: pasivní chlazení, žádné grafické výstupy a konfigurovatelný výkon 400–600 W pro hustotu racku. Zvolte ji pouze v případě, že máte serverovou šasi, do které ji můžete umístit.
Proč omezit výkon na 400 W?
V husté sestavě je limitem obvykle celkový výkon a chlazení v racku – nikoliv jednotlivé karty. Omezením výkonu každé karty můžete do stejného tepelného rozpočtu vejít více grafických karet, což obvykle vede k vyšší celkové propustnosti než menší počet karet běžících na plný výkon.
Dodáváte s nimi kompletní servery?
Ano. Řada racků Kentino AI je postavena na základě této karty v konfiguracích s 1, 2, 4, 6 a 8 GPU, je sestavena, otestována a uvedena do provozu před dodáním.
Otázky, které nám kupující nejčastěji kladou před objednáním serveru.
Jak dlouho to trvá?
Stroje vyrobené z komponentů, které držíme v zásobě, expedujeme rychle; cokoli vyžadující specifickou generaci GPU závisí na dodávce. Před platbou vám sdělíme datum a pokud se pohne, raději vám to oznamujeme, než abyste se o tom dozvěděli.
Lze konfiguraci změnit před sestavením?
Téměř vždy. Grafické karty, paměť, úložiště a chlazení se volí pro každou objednávku a uvedená konfigurace je spíše výchozím bodem než pevně stanoveným balíčkem. Pokud potřebujete více VRAM, rychlejší úložiště nebo jiný přístup k chlazení, sdělte nám to před objednáním a my vám sdělíme cenovou nabídku.
Můžu si server vyzvednout osobně?
Můžete. Náš sklad je v Praze a osobní vyzvednutí je vítáno – většina lidí, kteří přijdou, využije návštěvy k prohlídce stroje s naším technikem a k položení otázek, které jsou přes e-mail nepříjemné. U objednávek v rámci České republiky se také snažíme doručit osobně a provést vás nastavením na místě.
Můžu si promluvit s někým, kdo skutečně rozumí pracovní zátěži?
Ano. Máme inženýra, který se zabývá konkrétně systémy umělé inteligence, ne běžným prodejním oddělením. Pokud se vaše otázka týká velikostí dávek, kvantizace, propojení nebo toho, kde bude vaše úzké místo, zeptejte se – tato konverzace obvykle změní konfiguraci k lepšímu.
Který model mohu v této konfiguraci provozovat?
Ano. Každý stroj je před odesláním sestaven, otestován a porovnán s reálnými úlohami umělé inteligence. Po odeslání máme již nainstalovaný a spuštěný LLM. Zapojíte ho, připojíte k síti a začnete pracovat – zbývá už jen rozhodnutí, který projekt spustí jako první.
Jak otestujete server před odesláním?
Porovnáváme to se skutečnými zátěžemi umělé inteligence, nikoli se syntetickými skóre: propustnost inference, trvalé chování při zátěži a teploty za nepřetržitého provozu. S tímto strojem získáte výsledky benchmarků, takže výkon, který vám byl slíben, je výkon, který si můžete ověřit hned první den.
Je server připraven ke spuštění, když dorazí?
Ano. Každý stroj je před odesláním sestaven, otestován a porovnán s reálnými úlohami umělé inteligence. Po odeslání máme již nainstalovaný a spuštěný LLM. Zapojíte ho, připojíte k síti a začnete pracovat – zbývá už jen rozhodnutí, který projekt spustí jako první.
Odesíláme z našeho skladu v EU. Těžké zboží může vyžadovat přepravu – kontaktujte nás pro cenovou nabídku a dodací lhůtu. Dvouletá omezená záruka s pokročilou podporou RMA; k dispozici je prodloužená záruka.
Není to přesně to, co potřebujete?
Sdělte nám svou pracovní zátěž a my tuto platformu specifikujeme podle ní – grafické karty, paměť, úložiště a chlazení budou odpovídat tomu, co skutečně používáte.