Velín: jak řídit celý svůj AI svět z jednoho místa
Pět účtů, tři předplatné, každý model v jiné záložce a soubory pořád na disku. Tenhle díl je mapa celého seriálu: co je velín, z jakých čtyř vrstev se skládá a v jakém pořadí ho stavět.
Kde co běží a kdo to smí spustit
Otázka už není „ChatGPT ano, nebo ne“. Otázka je kde co běží a kdo to smí spustit. Lokální a firemní AI roste vedle cloudu: Mac mini zvládne inference, open weights dotahují uzavřené modely a agenti jsou produkt roku i riziko roku. Tenhle seriál vás provede od prvního lokálního modelu po velín, ze kterého celý ten svět řídíte jedním chatem — a po pravidla, bez kterých se to celé rozsype.
25 dílů · šest linek · průběžně přibývá
Seriál se dá číst popořadě jako kurz, nebo skákat po štítcích. Když nevíte, začněte prvním dílem každé linky — jsou psané pro člověka, který zatím nic nenainstaloval.
01 · 4×
Co je model, co harness a co agent — a proč se ta otázka posunula z „AI ano/ne“ na „kde co běží“.
02 · 5×
První model na vlastním stroji: Mac mini, Windows s Nvidií, kolik paměti to sní a kdy lokál stačí.
03 · 4×
Jedna brána před všechny modely, API klíče na jednom místě a směrování úloh podle toho, co která umí.
04 · 4×
Velín v kapse: Telegram jako ovládací panel, bezpečná cesta domů a fronta úloh, kterou schvalujete vy.
05 · 4×
Soubory z disku do chatu: jak to doopravdy funguje, co je RAG, co umí MCP a co do cloudu nepatří.
06 · 4×
Agenti jsou produkt roku i riziko roku. Pravidla na jednu stránku a případovky, které stály miliardy.
Štítky
Co je model, co harness a co agent — a proč se ta otázka posunula z „AI ano/ne“ na „kde co běží“.
Pět účtů, tři předplatné, každý model v jiné záložce a soubory pořád na disku. Tenhle díl je mapa celého seriálu: co je velín, z jakých čtyř vrstev se skládá a v jakém pořadí ho stavět.
Model je motor, harness je auto, agent je řidič s úkolem. Když tyhle tři vrstvy nerozlišujete, nedá se rozumět ani jediné zprávě o AI — ani rozhodnout, co si pustíte doma a co necháte v cloudu.
Za jediný srpen 2026 vyšly Grok Bot, Cursor Origin, Slack Code i Claudeforce. Všechny řeší stejnou věc: pustit AI z chatu do vaší práce. A všechny naráží na stejnou otázku, kterou nikdo neumí odpovědět elegantně — kdo za to ručí.
„Používáme AI?“ je otázka roku 2023. Dneska už na ni odpovídá každý stejně a nic to neříká. Užitečná otázka má dvě poloviny — kde ta konkrétní úloha běží a kdo ji smí spustit — a odpověď se dá napsat na jednu stránku.
První model na vlastním stroji: Mac mini, Windows s Nvidií, kolik paměti to sní a kdy lokál stačí.
Bez účtu, bez karty, bez odesílání dat komukoli. Instalace jedné aplikace, jeden příkaz, jeden stažený model — a za hodinu máte na svém stroji AI, která funguje i v letadle.
Tichá krabice u routeru, která běží pořád a odpovídá vám na dotazy z mobilu i z notebooku. Jak z Macu mini udělat inferenční server, kolik paměti si pořídit a co udělat, aby se nevypínal.
Herní PC je na lokální AI často lepší stroj než Mac — dokud se model vejde do paměti grafické karty. Jak zjistit, co vaše sestava utáhne, co nastavit ve Windows a proč je VRAM jediné číslo, na kterém záleží.
Proč má stejný model v knihovně pět různých velikostí, co znamená Q4 v názvu souboru a jak spočítat, jestli se vám do stroje vejde. Jedna tabulka, jeden vzorec, žádná matematika.
Otevřené modely už nejsou chudá varianta. U poloviny běžné práce rozdíl nepoznáte — a u druhé poloviny ho poznáte hodně. Jak rozhodnout úlohu po úloze, místo abyste si vybírali tábor.
Jedna brána před všechny modely, API klíče na jednom místě a směrování úloh podle toho, co která umí.
Pět modelů, pět aplikací, pět klíčů a nikdo neví, kolik to stojí. Brána je jeden endpoint, za kterým se schová všechno — lokální model doma i ten nejdražší v cloudu. A vyměnit se dá za jeden řádek.
Klíč je heslo, které nikdo nezmění, protože si na něj nikdo nevzpomene. Kam ho uložit na Macu, na Windows a na serveru, proč nepatří do chatu ani do souboru v projektu a jak poznat, že vám utekl.
Posílat všechno tomu nejchytřejšímu modelu je jako jezdit do trafiky náklaďákem. Jak rozdělit práci do tří tříd, nastavit záložní trasu a přestat platit za práci, kterou zvládne krabice v obýváku.
Lokální model není zadarmo a cloud není drahý — dokud nezačnete počítat objem. Jak si spočítat vlastní bod zlomu, kde se skrývají náklady, které vám nikdo neřekne, a proč hlavní důvod pro lokál stejně nejsou peníze.
Velín v kapse: Telegram jako ovládací panel, bezpečná cesta domů a fronta úloh, kterou schvalujete vy.
Napíšete zprávu z mobilu, doma to spočítá váš model a odpověď přijde zpátky do chatu. Kompletní návod: založení bota, kam patří token, jak povolit jen sebe a padesát řádků kódu, které to celé spojí.
Přesměrovat port na routeru je nejrychlejší způsob, jak dát svůj model celému internetu. Privátní síť ho zpřístupní jen vašim zařízením a nastaví se za deset minut — bez veřejné IP, bez certifikátů, bez děr ve firewallu.
Tři zařízení, tři různé role a jedna společná paměť. Jak si rozdělit, co se dělá kde, aby vám rozdělaná práce nezůstávala na stroji, který je zrovna zavřený v batohu.
Rozdíl mezi užitečným a nebezpečným agentem není v modelu, ale v jedné čáře: kde končí příprava a začíná akce. Jak tu čáru postavit tak, aby držela — složkou, frontou a jedním tlačítkem v mobilu.
Soubory z disku do chatu: jak to doopravdy funguje, co je RAG, co umí MCP a co do cloudu nepatří.
„AI vidí moje soubory“ znamená pět různých věcí s velmi různými dopady na soukromí. Rozdíl mezi přiložením, indexem, konektorem a přímým přístupem — a proč byste ho měli znát dřív, než někam nahrajete smlouvu.
Nahrát modelu tisíc dokumentů a čekat, že je bude znát, nefunguje. Jak vyhledávání nad vlastními materiály doopravdy pracuje, proč nejčastěji selhává na špatných datech a co udělat, aby odpovídalo správně.
Konektory nejsou jen pro cloudové služby. Lokální MCP server umí modelu zpřístupnit složku, databázi nebo příkazovou řádku — a rozdíl mezi užitečným a nebezpečným zapojením je jediný parametr: co všechno mu vymezíte.
Krátký seznam věcí, které nemají opustit váš stroj, a tři technická opatření, díky kterým to nezáleží na vaší paměti. Protože pravidlo, které si musíte pamatovat, dřív nebo později selže.
Agenti jsou produkt roku i riziko roku. Pravidla na jednu stránku a případovky, které stály miliardy.
Není to chyba v kódu, kterou někdo opraví. Je to vlastnost způsobu, jakým modely fungují — a jediná obrana je odebrat agentovi jednu ze tří schopností. Které tři to jsou a jak si to zkontrolovat u vlastního nastavení.
Dvacetistránková směrnice, kterou nikdo nečte, chrání méně než jedna stránka, kterou má každý na nástěnce. Kompletní vzor s osmi body, který zabere pět minut čtení a dá se přijmout ještě tento týden.
V březnu 2026 se do balíčku populární AI brány dostala na čtyřicet minut upravená verze se sběračem přihlašovacích údajů. Čtyřicet minut stačilo. Co se stalo, proč to je varování pro každého, kdo si staví vlastní velín, a co s tím.
Plán z ledna: ať rutinní práci převezmou agenti a týmy zeštíhlí až o 60 %. Realita ze srpna: kódu o 220 % víc, hotových funkcí o 36 % víc, incidentů o 40 % víc. Případovka, ze které se dá naučit víc než z deseti návodů.
Nový díl vám dojde
Nové díly a to podstatné ze světa agentů posílám v týdenním newsletteru.
E-book Top 30 tipů zdarma — pošlu vám ho hned.
Pak 1 tip týdně · žádný spam · odhlášení jedním klikem