Slevu 100 Kč a další slevové kódy na váš nákup najdete zde

AI počítače pro lokální LLM

Sestavy LYNX · NVIDIA RTX

Umělá inteligence, která běží u vás.

Vyberte si počítač, na kterém spustíte jazykové modely lokálně – bez placení za dotazy, offline a s daty, která nikdy neopustí váš stůl.

Příklad

Model musí do paměti grafiky (VRAM). Barevný proužek u každé sestavy níže ukazuje, kolik z ní model zabere:

16 GB VRAMQwen3 14B ≈ 9 GB
 
zbývá místo na delší kontext i běžnou práci
Spuštění jedním příkazem: ollama run qwen3:14b
 Proč lokálně

Cloud si účtuje každý dotaz. Tvůj počítač ne.

Náklady
Nula za tokeny
Zaplatíte jednou za hardware. Pak generujete, kolik chcete – bez měsíčních poplatků a limitů.
Provoz
Offline a rychle
Funguje bez internetu, s nízkou odezvou. Model odpovídá z grafiky přímo u vás.
Soukromí
Data zůstávají doma
Citlivé podklady – objednávky, zákazníci, interní dokumenty – neposíláte do cizí služby.
Kontrola
Máte to pod kontrolou
Vybíráte model, verzi i chování. Žádné cenzury API ani změny podmínek přes noc.
 Sestavy podle výkonu

Čím víc paměti grafiky, tím větší model spustíte.

Klíčový parametr pro lokální AI je VRAM – paměť grafické karty. Model se do ní musí vejít, aby běžel rychle. Barevný proužek u každé sestavy ukazuje, kolik z paměti grafiky doporučený model zabere – a kolik místa zbyde.

8 GB VRAM · RTX 5060
Start
První AI počítač, chat, zkoušení
29 490 Kč
orientační cena
8 GBLlama 3.1 8B ≈ 5,5 GB
 
cílový model: llama3.1:8b · qwen3:8b – do ~9 mld. parametrů
Chytrý pomocník běží u vás – zadarmo a offline.
8B modely zvládnou chat, shrnutí, nápady i pomoc s kódem rychlostí přes 40 slov za sekundu. Ideální start, když chcete AI vyzkoušet naostro, aniž platíte za každý dotaz.
Cena a dostupnost ›
LYNX Challenger Ultra 5 225F · 16 GB RAM · 1 TB SSD · Windows 11
12 GB VRAM · RTX 5070
Doma
Každodenní práce, psaní, kód
Doporučujeme
42 490 Kč
orientační cena
12 GBQwen3 14B ≈ 9 GB
 
cílový model: qwen3:14b · phi4 · gemma3:12b
Ideální stroj pro reálnou práci – 14B modely plnou rychlostí.
14B modely jsou znát: lepší uvažování, kód i delší souvislé texty než u 8B. Dvanáct gigabajtů je nejlepší poměr ceny a schopnosti pro běžnou denní práci.
Cena a dostupnost ›
LYNX Challenger Ryzen 7 5700X · 32 GB RAM · 1 TB SSD · Windows 11
16 GB VRAM · RTX 5070 Ti / 5080
Studio
Náročná tvorba, obrázky, malá firma
89 990 Kč
orientační cena
16 GBGemma 3 27B ≈ 16 GB
 
cílový model: gemma3:27b · qwen3:32b · mistral-small
30B modely i generování obrázků – na hraně jedné karty.
Sem se vejdou 27–32B modely – kvalita blízko cloudu – a pohodlně i tvorba obrázků.
Cena a dostupnost ›
LYNX Challenger Ryzen 7 7800X3D · 32 GB RAM · 2 TB SSD · Windows 11
32 GB VRAM · RTX 5090
Max
Profíci, vývojáři, kreativa
214 990 Kč
orientační cena
32 GBQwen3 32B (Q6) ≈ 24 GB
 
cílový model: qwen3:32b · llama4:scout
Nejvýkonnější grafika pro lokální AI – modely do 32B nejvyšší rychlostí.
Na modelech do 32B má zdaleka nejvyšší rychlost a nejnižší odezvu ze všech sestav – ideální pro interaktivní práci a MoE modely jako Llama 4 Scout. Pro modely nad 32B (70B a víc) je vhodnější Workstation níže.
Cena a dostupnost ›
LYNX ULTIMATE Ryzen 9 9900X3D · 64 GB RAM · 4 TB SSD · Windows 11
128 GB unified · NVIDIA GB10
Workstation
Vývoj AI, fine-tuning, výzkum
174 480 Kč
orientační cena
128 GBLlama 3.3 70B ≈ 42 GB
 
cílový model: llama3.3:70b · qwen2.5:72b – až ~200 mld.
AI superpočítač na stůl – modely 70B–200B, co se do běžné grafiky nevejdou.
Čip NVIDIA GB10 Grace Blackwell, 128 GB sdílené paměti, DGX OS. Nativně pojme modely 70B–200B (405 mld. při spojení dvou kusů), na které žádná běžná grafika nestačí. Vyměňuje rychlost za kapacitu – na token je pomalejší než RTX 5090, zato zvládne největší modely a fine-tuning.
Cena a dostupnost ›
GIGABYTE AI TOP ATOM · 128 GB unified · 4 TB SSD · NVIDIA DGX OS / Ubuntu
 Průvodce výběrem

Nevíte, kolik VRAM potřebujete? Začněte od toho, co chcete dělat.

Nevybírejte podle značky grafiky, ale podle toho, jak velký a chytrý model chcete spustit. Podle úlohy si najdete úroveň – a v tabulce níž ověříte, co se do dané paměti vejde.

Chci AI vyzkoušet – chat, psaní, pomoc s kódemobčasné použití, jeden uživatel
Start / Doma8–12 GB
Denní práce, delší dokumenty, lepší kvalita, obrázkychci se na to spolehnout
Studio16 GB
Nejchytřejší modely, 70B, rychlost, kreativa, vývojvýkon je priorita
Max32 GB
Fine-tuning, největší modely, firemní AI nad datypráce s velkými modely a citlivými daty
Workstation128 GB
VRAM
Velikost modelu
Příklady modelů
Zážitek
8 GB
do ~9 mld.
llama3.1:8b, qwen3:8b, deepseek-r1:8b
rychlé, 40+ slov/s
12 GB
do ~14 mld.
qwen3:14b, phi4, gemma3:12b
svižné, denní práce
16 GB
do ~32 mld.
gemma3:27b, qwen3:32b, mistral-small
kvalita blízko cloudu
32 GB
32B+ · 70B*
qwen3:32b, llama4:scout
*70B s offloadem
128 GB
70–200 mld.
llama3.3:70b, qwen2.5:72b
AI workstation
Co když se model úplně nevejde?
Přebytek se „odloží" do systémové RAM a počítá ho procesor – model poběží, jen pomaleji. Proto u vyšších sestav dáváme 32–64 GB RAM: 16 GB grafika + 64 GB RAM zvládne i 70B model, který by se do grafiky sám nevešel.
Má AI pracovat s mým ceníkem nebo databází?
Nenahrává se celá databáze do modelu. Model se jí ptá (dotazem nebo vyhledáním) a odpovídá jen z vytažených dat – přesně, bez vymýšlení. Zvládne to i vstupní sestava Start.
 Jak to funguje

Lokální AI srozumitelně

Co je lokální LLM?
Velký jazykový model (jako ty za chatboty) běžící přímo na vašem počítači místo v cloudu. Ptáte se ho normálně česky, on odpovídá – jen zdarma, offline a bez odesílání dat ven.
Co je VRAM a proč rozhoduje?
VRAM je rychlá paměť přímo na grafické kartě, kde model počítá. Aby běžel svižně, musí se do ní vejít. Víc VRAM = větší a chytřejší model. Proto je to první číslo, které u AI počítače řešíme.
Co znamená kvantizace (Q4)?
Chytré zmenšení modelu zhruba na čtvrtinu při zachování velmi dobré kvality. Díky tomu se model, který by v plné velikosti potřeboval 16 GB, vejde do ~5–6 GB. Q4_K_M je běžný standard pro domácí běh.
Co je offload na CPU?
Když se model nevejde celý do grafiky, jeho zbytek se uloží do běžné RAM a počítá ho procesor. Model poběží, ale pomaleji. Proto radíme dost systémové RAM – je „kam ten přetok odložit".
Zvládne to pracovat s mým ceníkem nebo objednávkami?
Ano – ne nahráním celé databáze, ale tak, že se jí model ptá (přes SQL nebo vyhledávání) a odpovídá jen z vytažených řádků. U citlivých dat (zákazníci, objednávky) je lokální běh navíc bezpečnější – nic neopouští váš počítač.
Jak model spustím?
Nejjednodušeji přes Ollama (jeden příkaz, např. ollama run qwen3:14b) nebo LM Studio (klikací aplikace). Modely stáhne samo. S prvním rozjezdem rádi poradíme při předání.
NVIDIA, nebo AMD?
NVIDIA (řada RTX 50) je pro lokální AI nejhladší a nejlépe podporovaná – doporučená volba pro „bez starostí". AMD (RX 9070 XT) funguje taky a nabízí levnějších 16 GB, jen s o něco méně bezúdržbovým nastavením.
Autorizovaný partner
Člen partnerské sítě
Nastavení cookies