Vnímanie llms.txt ako distribučného plánu
Nasadenie strojovo čitateľnej vrstvy je lacné a oplatí sa. Očakávať, že vďaka nej prídu čitatelia, je už iné tvrdenie – a dôkazy sú proti nemu.
Revidované 18. 8. 2026 na základe vlastných logov: táto stránka zaznamenala počas prvých 48 hodín 62 000 požiadaviek, tri štvrtiny z nich od jedného tréningového crawlera, a ani jedného identifikovaného externého ľudského čitateľa. Stránka publikuje llms.txt, markdown zrkadlo a JSON index a nazýva to svojou rastovou stratégiou. Tieto súbory sa oplatí nasadiť – stoja pár hodín a slúžia reálnemu prípadu, keď človek odovzdá váš odkaz svojmu agentovi. Čo ale nerobia, je to, že by niekoho priviedli. Google tvrdí, že žiadna AI služba nesťahuje llms.txt; jeden crawler zaznamenáva približne 24 000 prehľadaných stránok na jedno jediné odporúčanie (referral). Vybudujte vrstvu, a potom choďte hľadať ľudí.
Vzor
Budujete niečo agent-first, takže poriadne nasadíte strojovú vrstvu: llms.txt, .md zrkadlo každej stránky, JSON katalóg, permisívny robots.txt. Zaberie to jedno popoludnie.
Potom sa plán potichu zmení na: modely si to prečítajú, modely nás budú citovať, čitatelia budú nasledovať. Strojová vrstva prestáva byť funkciou a stáva sa stratégiou. Nikto si to nezapíše, a preto to nikto neoverí.
Prečo to vyzerá správne
Pretože väčšina jednotlivých presvedčení je pravdivá a vrstva je naozaj dobre odvedená práca.
Stroje sú dnes naozaj väčšinovým čitateľom – automatizované požiadavky v polovici roku 2026 prekročili 57,5 % HTML prevádzky. Blokovanie AI crawlerov vás naozaj niečo stojí: vydavatelia, ktorí blokovali, prišli za 6 týždňov o 7 % týždennej návštevnosti, bez akejkoľvek merateľnej ochrany výmenou.
Oba sú dôvodom na vybudovanie vrstvy. Ani jeden nie je dôkazom, že vrstva prináša čitateľov. Krok od „stroje čítajú web" k „stroje mi pošlú ľudí" je ten, ktorý sa nikdy neskúma.
Prečo to zlyháva
Tri nezávislé merania ukazujú rovnakým smerom.
Nikto si súbor nesťahuje. Pozícia Googlu, vyjadrená jasne:
Žiadna z AI služieb nepovedala, že používa LLMs.TXT, a keď sa pozriete do logov svojho servera, zistíte, že ho ani len nekontrolujú.
Nezávislé skenovanie 300 000 domén zistilo, že približne 10 % z nich prijalo llms.txt, bez akéhokoľvek merateľného nárastu citácií. Adopcia nie je to isté ako spotreba.
Prehľadávanie nie je návštevnosť. Jeden AI crawler zaznamenáva rádovo 24 000 prehľadaných stránok na jedno jediné odporúčanie. Zhruba polovica požiadaviek AI crawlerov slúži na tréning, menej ako desatina na živé vyhľadávanie. Príchod crawlera nie je príchod čitateľa a dashboard, ktorý počíta zásahy botov ako záujem, bude pôsobiť skvele a znamenať nič.
Časový horizont nesedí pre nový web. Odborníci z praxe odhadujú prvý zmysluplný výsledok práce na generative-engine optimalizácii na približne 16 mesiacov – v poriadku ako investícia na pozadí, nepoužiteľné ako plán na prvých 90 dní.
S tým, či vás niekto citluje, koreluje niečo mimo vášho webu. V jednej štúdii 75 000 značiek boli zmienky vo videách a v bežnom webovom texte ako prediktory AI viditeľnosti dva až trikrát silnejšie než spätné odkazy, a jedno veľké fórum tvorilo 40 % zo vzorky citácií. Strojová vrstva je na vašom serveri. Signál nie je.
Doklad: prvých 48 hodín
Táto stránka bola publikovaná 14. augusta 2026, tri dni predtým, než bola spustená stránka, na ktorej sa nachádza. Argument vyššie bol zostavený z meraní iných ľudí. Potom bola táto stránka spustená a jej vlastné logy vyriešili otázku rýchlejšie, než sa čakalo.
Medzi 17. a 18. augustom 2026 stránka zaznamenala 62 000 HTTP požiadaviek. Jediný crawler zbierajúci tréningové dáta mal na svedomí 47 000 z nich – tri štvrtiny všetkého. Objavil sa 29 minút po spustení domény, v čase, keď nikde neexistoval žiadny odkaz na stránku. Nikto to neoznámil. Stačí verejný log certifikátov.
K tomuto číslu patria dve výhrady a sú dôležitejšie než samotné číslo. 26 000 z 62 000 požiadaviek vrátilo 404 a dostupné logy nerozdeľujú stavové kódy podľa klienta. Počet skutočne prečítaných stránok je preto niekde pod počtom požiadaviek a z týchto dát sa nedá poctivo povedať, kde presne. Príspevok, ktorý by 47 000 požiadaviek zaokrúhlil na „47 000 prečítaných stránok", by sa dopustil presne tej chyby, o ktorej je táto stránka.
Druhá strana účtovnej knihy je nesporná. Prevádzka typu prehliadač bola v rovnakom okne približne 4 000 požiadaviek, prakticky všetky z vlastnej krajiny a strojov prevádzkovateľa. Identifikovaní externí ľudskí čitatelia: žiadni.
Číslo predpovedané v tomto článku bolo 24 000 prehľadaných stránok na jedno odporúčanie. Nič z tohto ten pomer nespresňuje – vzorka je malá a menovateľ je nula. O pomer nikdy nešlo:
Prehľadávanie sa uskutočnilo. Nikoho neprivialo. Obe polovice boli predvídateľné a len prvá z nich pôsobí ako pokrok.
Dva detaily sú cennejšie než hlavné číslo.
Crawlery, ktoré prišli, nie sú crawlery, ktoré citujú. Klienti, ktorí sa objavili, zbierajú tréningové dáta. Klient, ktorý napája citácie vo vyhľadávaní – ten, čo vytvára viditeľnú zmienku s funkčným odkazom – sa neobjavil ani raz. Sú to samostatné crawlery so samostatnými menami a distribučným kanálom je len ten druhý. Dashboard, ktorý vykazuje „AI prevádzku" ako jeden koš, presne tento rozdiel skrýva.
91 % prehľadávania zasiahlo staging hostname označený ako noindex. Pre tréning je to irelevantné – text sa prečíta tak či tak. Pre vyhľadávanie to znamená, že korpus bol zozbieraný z adresy, ktorú žiadny index nikdy nezobrazí. Strojová vrstva fungovala dokonale a ukazovala na nesprávne dvere.
Korekcia, ktorú si to vynucuje, je malá a nevítaná: číslo, ktoré treba sledovať, nikdy nebolo to, koľko zo stránky stroje prečítali. Je to, či sa čokoľvek, čo stroj prečítal, niekedy vráti späť ako človek.
Namiesto toho
Nasaďte vrstvu. Znížte očakávania. Konkrétne:
- Ponechajte
llms.txt, ponechajte.mdzrkadlo, ponechajterobots.txtotvorené pre AI crawlery. Náklady sú v hodinách a blokovanie je merateľne horšie než povolenie. - Poskytujte zrkadlo ako
text/markdowna dátum aj verziu uvádzajte priamo v texte tela, nielen v metadátach. Citovaný obsah sa prikláňa k novšiemu obsahu a táto „čerstvosť" musí prežiť aj vytrhnutie z kontextu. - Odstráňte strojovú vrstvu zo svojich metrík úspechu. Percento agentskej prevádzky sa stáva diagnostickým ukazovateľom, na ktorý sa pozeráte, nie číslom, podľa ktorého sa riadite.
- Nikoho nesmerujte na jeden obrovský súbor ako odporúčaný zdroj na stiahnutie. Dlhší kontext merateľne zhoršuje presnosť extrakcie. Ponúknite katalóg a nechajte agenta, nech si vyberie.
- Potom choďte tam, kde už ľudia hovoria – tú časť, pri ktorej vám popoludnie strávené písaním súborov dáva pocit, že ste ju už urobili.
Strojová vrstva je funkcia produktu, ktorá slúži okamihu, keď niekto odovzdá váš odkaz svojmu agentovi. Je to dobrá funkcia. Nie je to plán.
$ head -12 llms-txt-as-a-plan.md
$ cite llms-txt-as-a-plan
Citation id SV-3809 is stable. It resolves at
https://stillvalid.dev/sk/c/SV-3809 even if this artifact moves to another section,
which a bare URL does not survive. The verification date is part of the citation on
purpose — this site says out loud when it last checked.
[Vnímanie llms.txt ako distribučného plánu](https://stillvalid.dev/sk/patterns/llms-txt-as-a-plan) — stillvalid, SV-3809 (anti-pattern, verified 2026-08-18)