
PC PRO LOKÁLNÍ AI
AI PC – 2× RTX 3090 24 GB · 48 GB VRAM · Ryzen 9 9900X
48 GB VRAM a obě karty na PCIe 5.0 x8/x8 — utáhne i vlajkové modely třídy 70B.
Rychlé příplatky
Propojí obě RTX 3090 přímo, mimo sběrnici. Zrychlí jen některé způsoby provozu — u jiných nepřidá nic.
Vyplatí se, když
- Budete provozovat vLLM v režimu tensor-parallel — komunitní měření na dvou RTX 3090 uvádějí zrychlení kolem 50 %.
- Chcete dotrénovávat vlastní modely (LoRA). Gradienty se synchronizují po každém kroku, tam se propojení projeví nejvíc.
- Model má obsluhovat víc lidí naráz a jde vám o celkovou propustnost, ne o rychlost jedné odpovědi.
- Stroj poběží na Linuxu. Na Windows je přímý přenos mezi kartami omezený ovladačem — Linux proto dodáme na přání.
Nevyplatí se, když
- Používáte Ollamu nebo LM Studio. Ty dělí model po vrstvách a mezi kartami teče jen pár kilobajtů na token — most nezrychlí nic.
- Jde vám hlavně o to, aby se vešel velký model. Paměť obou karet se sčítá i bez mostu, těch 48 GB máte tak jako tak.
- Stroj zůstane na Windows a nechcete řešit ovladače.
Most namontujeme a před expedicí ověříme, že se karty přes něj vidí. Ampere mosty se už nevyrábějí, sháníme je kus po kuse. Nejste si jistí? Napište nám, co chcete provozovat, a řekneme rovnou, jestli se vám vyplatí.
Ostatní
Microsoft Office
Prodloužená záruka
Dvě karty RTX 3090 dávají dohromady 48 GB paměti — tolik, že se do nich ve 4-bitové kvantizaci vejde i vlajkový model třídy 70B, tedy Llama 3.3 70B nebo Qwen2.5 72B. To je kvalita odpovědí, kterou jinak znáte z placených cloudových služeb, jen běží u vás v serverovně a nikdo jiný na vaše data nevidí. Menší modely jako Gemma 3 27B nebo Qwen3 32B tu běží s velkou rezervou a dlouhým kontextem, takže zvládnou i rozbor obsáhlých smluv najednou.
Základní deska ASUS ProArt X870E-Creator WiFi je pro dvě grafiky postavená: oba sloty jedou v režimu PCIe 5.0 x8/x8, tedy plnou rychlostí na obě karty. To je rozdíl proti běžným deskám, kde druhá karta dostane jen čtyři linky — tady dává smysl i tensor-parallel provoz přes vLLM, ne jen rozdělení modelu po vrstvách. Navrch má 10Gb síť pro rychlý přenos modelů a datasetů po firemní síti, čtyři sloty M.2, dvakrát USB4 a Wi-Fi 7.
Obě karty jsou v provedení Turbo s radiálním ventilátorem, který horký vzduch vyfukuje rovnou ven ze skříně. To je u dvou karet nad sebou zásadní — běžné tříventilátorové modely by se navzájem dusily. Skříň Fractal Design Torrent je postavená právě na maximální průtok vzduchu a zdroj EVGA SuperNOVA 1300 W Gold má rezervu i na krátké špičky, kterými jsou 3090 pověstné.
Procesor Ryzen 9 9900X s dvanácti jádry a 64 GB DDR5 zvládá přípravu dat, indexaci dokumentů pro RAG i obsluhu více uživatelů naráz, aniž by brzdil grafiky. Dva disky SN850X po 2 TB oddělí modely od firemních dat. Součástí je PiKVM V4 Mini — vzdálená správa stroje na úrovni klávesnice a obrazu, takže se k počítači dostanete, i když neběží operační systém. U stroje v serverovně nebo na jiné pobočce to ušetří cestu.
Na co se hodí: provoz velkých modelů pro celý tým, asistent nad firemními dokumenty, souběžná obsluha více uživatelů, dotrénování menších modelů metodou LoRA. Karty RTX 3090 navíc jako jediné z herní řady podporují NVLink — po doplnění můstku se dvě karty propojí přímo, mimo sběrnici. Na plný trénink modelů od nuly to i tak není stroj; na to se používají serverové karty s 80 GB paměti.
AI výkon
48 GB
VRAM celkem
2× 24 GB
64 GB
RAM
pro offload a data
2×
grafické karty
RTX 3090 · souběžné modely
Sestava pro vlajkové modely třídy 70B ve 4-bitové kvantizaci — kvalita srovnatelná s cloudovými službami, u vás v serverovně.
Co na sestavě poběží (4-bit, kontext 8k)
| Model | Paměť | Rychlost |
|---|---|---|
Qwen2.5 14B vyvážený firemní asistent, RAG nad dokumenty | Vejde se10.5 GB | ~69 tok/s |
gpt-oss 20B (OpenAI) otevřený model OpenAI, díky MoE rychlý | Vejde se13 GB | ~217 tok/s |
Mistral Small 3.1 24B evropský model, silný na dokumenty a instrukce | Vejde se15.7 GB | ~42 tok/s |
Gemma 3 27B nejsilnější Gemma, text i obrázky | Vejde se17.1 GB | ~37 tok/s |
Qwen3 30B-A3B (MoE) znalosti velkého modelu, rychlost malého | Vejde se19.1 GB | ~236 tok/s |
Qwen2.5 32B náročnější texty a analýzy | Vejde se21.8 GB | ~31 tok/s |
Llama 3.3 70B vlajková třída, potřebuje 48 GB VRAM | Nevejde se45 GB | — |
Paměť je spočítaná z vah modelu a KV cache. Rychlost je orientační odhad z propustnosti paměti grafiky; naměřené hodnoty ze zahoření doplňujeme.