---
title: Vnímanie llms.txt ako distribučného plánu
type: anti-pattern
level: L2
status: live
revision: 2
updated: 2026-08-18
systemVersion: 4.2
authoring: machine-translated
tags: [agents, llms-txt, geo, distribution, anti-pattern]
rating: 8.70
ratingAxes: useful 8 · evidence 9 · pull 9 · original 9 · form 9
ratingKind: derived
source: research synthesis, 2026-08-14; first-party logs added 2026-08-18
---

# Vnímanie llms.txt ako distribučného plánu

_Written 2026-08-14 · last verified 2026-08-18 · system v4.2 · live_

**TL;DR** — Revidované 18. 8. 2026 na základe vlastných logov: táto stránka zaznamenala počas prvých 48 hodín 62 000 požiadaviek, tri štvrtiny z nich od jedného tréningového crawlera, a ani jedného identifikovaného externého ľudského čitateľa. Stránka publikuje llms.txt, markdown zrkadlo a JSON index a nazýva to svojou rastovou stratégiou. Tieto súbory sa oplatí nasadiť – stoja pár hodín a slúžia reálnemu prípadu, keď človek odovzdá váš odkaz svojmu agentovi. Čo ale nerobia, je to, že by niekoho priviedli. Google tvrdí, že žiadna AI služba nesťahuje llms.txt; jeden crawler zaznamenáva približne 24 000 prehľadaných stránok na jedno jediné odporúčanie (referral). Vybudujte vrstvu, a potom choďte hľadať ľudí.

## Vzor

Budujete niečo agent-first, takže poriadne nasadíte strojovú vrstvu: `llms.txt`, `.md` zrkadlo každej stránky, JSON katalóg, permisívny `robots.txt`. Zaberie to jedno popoludnie.

Potom sa plán potichu zmení na: *modely si to prečítajú, modely nás budú citovať, čitatelia budú nasledovať*. Strojová vrstva prestáva byť funkciou a stáva sa stratégiou. Nikto si to nezapíše, a preto to nikto neoverí.

## Prečo to vyzerá správne

Pretože väčšina jednotlivých presvedčení je pravdivá a vrstva je naozaj dobre odvedená práca.

Stroje sú dnes naozaj väčšinovým čitateľom – automatizované požiadavky v polovici roku 2026 prekročili 57,5 % HTML prevádzky. Blokovanie AI crawlerov vás naozaj niečo stojí: vydavatelia, ktorí blokovali, prišli za 6 týždňov o **7 % týždennej návštevnosti**, bez akejkoľvek merateľnej ochrany výmenou.

Oba sú dôvodom na vybudovanie vrstvy. Ani jeden nie je dôkazom, že vrstva prináša čitateľov. Krok od *„stroje čítajú web"* k *„stroje mi pošlú ľudí"* je ten, ktorý sa nikdy neskúma.

## Prečo to zlyháva

Tri nezávislé merania ukazujú rovnakým smerom.

**Nikto si súbor nesťahuje.** Pozícia Googlu, vyjadrená jasne:

> Žiadna z AI služieb nepovedala, že používa LLMs.TXT, a keď sa pozriete do logov svojho servera, zistíte, že ho ani len nekontrolujú.

Nezávislé skenovanie 300 000 domén zistilo, že približne 10 % z nich prijalo `llms.txt`, bez akéhokoľvek merateľného nárastu citácií. Adopcia nie je to isté ako spotreba.

**Prehľadávanie nie je návštevnosť.** Jeden AI crawler zaznamenáva rádovo **24 000 prehľadaných stránok na jedno jediné odporúčanie**. Zhruba polovica požiadaviek AI crawlerov slúži na tréning, menej ako desatina na živé vyhľadávanie. Príchod crawlera nie je príchod čitateľa a dashboard, ktorý počíta zásahy botov ako záujem, bude pôsobiť skvele a znamenať nič.

**Časový horizont nesedí pre nový web.** Odborníci z praxe odhadujú prvý zmysluplný výsledok práce na generative-engine optimalizácii na približne **16 mesiacov** – v poriadku ako investícia na pozadí, nepoužiteľné ako plán na prvých 90 dní.

S tým, či vás niekto citluje, koreluje niečo mimo vášho webu. V jednej štúdii 75 000 značiek boli zmienky vo videách a v bežnom webovom texte ako prediktory AI viditeľnosti dva až trikrát silnejšie než spätné odkazy, a jedno veľké fórum tvorilo 40 % zo vzorky citácií. Strojová vrstva je na vašom serveri. Signál nie je.

## Doklad: prvých 48 hodín

Táto stránka bola publikovaná 14. augusta 2026, tri dni predtým, než bola spustená stránka, na ktorej sa nachádza. Argument vyššie bol zostavený z meraní iných ľudí. Potom bola táto stránka spustená a jej vlastné logy vyriešili otázku rýchlejšie, než sa čakalo.

Medzi 17. a 18. augustom 2026 stránka zaznamenala **62 000 HTTP požiadaviek**. Jediný crawler zbierajúci tréningové dáta mal na svedomí **47 000** z nich – tri štvrtiny všetkého. Objavil sa **29 minút po spustení domény**, v čase, keď nikde neexistoval žiadny odkaz na stránku. Nikto to neoznámil. Stačí verejný log certifikátov.

K tomuto číslu patria dve výhrady a sú dôležitejšie než samotné číslo. **26 000 z 62 000 požiadaviek vrátilo 404** a dostupné logy nerozdeľujú stavové kódy podľa klienta. Počet skutočne prečítaných stránok je preto niekde pod počtom požiadaviek a z týchto dát sa nedá poctivo povedať, kde presne. Príspevok, ktorý by 47 000 požiadaviek zaokrúhlil na „47 000 prečítaných stránok", by sa dopustil presne tej chyby, o ktorej je táto stránka.

Druhá strana účtovnej knihy je nesporná. Prevádzka typu prehliadač bola v rovnakom okne približne **4 000 požiadaviek, prakticky všetky z vlastnej krajiny a strojov prevádzkovateľa**. Identifikovaní externí ľudskí čitatelia: **žiadni**.

Číslo predpovedané v tomto článku bolo 24 000 prehľadaných stránok na jedno odporúčanie. Nič z tohto ten pomer nespresňuje – vzorka je malá a menovateľ je nula. O pomer nikdy nešlo:

> Prehľadávanie sa uskutočnilo. Nikoho neprivialo. Obe polovice boli predvídateľné a len prvá z nich pôsobí ako pokrok.

Dva detaily sú cennejšie než hlavné číslo.

**Crawlery, ktoré prišli, nie sú crawlery, ktoré citujú.** Klienti, ktorí sa objavili, zbierajú tréningové dáta. Klient, ktorý napája citácie vo vyhľadávaní – ten, čo vytvára viditeľnú zmienku s funkčným odkazom – sa neobjavil ani raz. Sú to samostatné crawlery so samostatnými menami a distribučným kanálom je len ten druhý. Dashboard, ktorý vykazuje „AI prevádzku" ako jeden koš, presne tento rozdiel skrýva.

**91 % prehľadávania zasiahlo staging hostname označený ako `noindex`.** Pre tréning je to irelevantné – text sa prečíta tak či tak. Pre vyhľadávanie to znamená, že korpus bol zozbieraný z adresy, ktorú žiadny index nikdy nezobrazí. Strojová vrstva fungovala dokonale a ukazovala na nesprávne dvere.

Korekcia, ktorú si to vynucuje, je malá a nevítaná: číslo, ktoré treba sledovať, nikdy nebolo to, koľko zo stránky stroje prečítali. Je to, či sa čokoľvek, čo stroj prečítal, niekedy vráti späť ako človek.

## Namiesto toho

**Nasaďte vrstvu. Znížte očakávania.** Konkrétne:

- Ponechajte `llms.txt`, ponechajte `.md` zrkadlo, ponechajte `robots.txt` otvorené pre AI crawlery. Náklady sú v hodinách a blokovanie je merateľne horšie než povolenie.
- Poskytujte zrkadlo ako `text/markdown` a dátum aj verziu uvádzajte *priamo v texte tela*, nielen v metadátach. Citovaný obsah sa prikláňa k novšiemu obsahu a táto „čerstvosť" musí prežiť aj vytrhnutie z kontextu.
- **Odstráňte strojovú vrstvu zo svojich metrík úspechu.** Percento agentskej prevádzky sa stáva diagnostickým ukazovateľom, na ktorý sa pozeráte, nie číslom, podľa ktorého sa riadite.
- Nikoho nesmerujte na jeden obrovský súbor ako odporúčaný zdroj na stiahnutie. Dlhší kontext merateľne zhoršuje presnosť extrakcie. Ponúknite katalóg a nechajte agenta, nech si vyberie.
- Potom choďte tam, kde už ľudia hovoria – tú časť, pri ktorej vám popoludnie strávené písaním súborov dáva pocit, že ste ju už urobili.

Strojová vrstva je **funkcia produktu**, ktorá slúži okamihu, keď niekto odovzdá váš odkaz svojmu agentovi. Je to dobrá funkcia. Nie je to plán.
