llms.txt je textový soubor v rootu webu (na adrese vasdomena.cz/llms.txt), který nabízí AI vyhledávačům strukturovaný popis stránky v markdown formátu — kdo jste, co děláte, jak vás kontaktovat a kam máte odkazovat. Standard navržený v roce 2024 funguje jako robots.txt pro AI, jen místo „kam smíš" říká „co o nás máš vědět".
Proč llms.txt vůbec existuje?
Klasické HTML je pro AI crawlery šum. Stránka může mít 50 kB designu, navigace, reklamních prvků a tří odstavců reálné informace. AI model to musí přečíst, dekódovat, vyhodnotit důležitost. To je pomalé, drahé a chybové.
llms.txt řeší tři konkrétní problémy:
- Sumarizace. AI dostane kondenzovaný popis stránky bez nutnosti procházet sto podstránek.
- Autoritativní fakta. Kontaktní údaje, ceny, otevírací doba — věci, které AI jinak musí scrape-ovat z různých míst webu, jsou na jednom místě.
- Linking strategie. Řeknete AI, které stránky jsou pro vás důležité (knowledge, services, portfolio) a které ignorovat.
Standard je popsaný na llmstxt.org a začínají ho podporovat Anthropic, OpenAI i smaller engines. V květnu 2026 ho má v ČR zhruba 0,3 % webů, které sleduju — což znamená, že nasazení dnes je rozdíl o dva roky proti většině konkurence.
Jak vypadá struktura llms.txt?
Specifikace je krátká a strict markdown. Tři pravidla:
- První řádek je
# Title(název webu). - Druhý řádek je
> Description(jedna věta o stránce). - Zbytek jsou markdown sekce
## SekceNames odrážkami nebo seznamy odkazů.
Doporučené sekce, které sám používám:
# fana.design
> Webdesigner z Brna. Tvořím weby, které najdou ChatGPT, Perplexity a Google AI Overviews.
> Poslední aktualizace: 18. května 2026
## O webu
- **Web**: https://fana.design/
- **Kontakt**: info@fana.design · +420 778 039 169
- **Lokace**: Brno · remote ČR/SK
- **Adresa**: Veletržní 674/5, 603 00 Brno
- **IČO**: 19221011
## Služby
- **Nový web** — AI-first struktura, structured data, hotový web za 1 až 3 týdny.
- **Redesign webu** — modernizace + AI viditelnost + měřitelný posun v konverzích.
- **AI automatizace** — chatboty, automatizace e-mailů, n8n / Make flows.
## Knowledge / blog
- [Co je GEO](https://fana.design/blog/co-je-geo) — definice GEO a jak začít.
- [llms.txt](https://fana.design/blog/llms-txt-standard) — tento článek.
- [Měřit AI citace](https://fana.design/blog/merit-ai-citace) — manuál.
Sekce, které byste neměli vynechat: O webu (kdo jste), Služby nebo Produkty (co prodáváte), Kontakt (jak vás najít), Knowledge nebo Blog (kde máte autoritativní obsah).
Příklad: llms.txt na fana.design
Skutečný llms.txt mého webu má 80 řádků a obsahuje: title, description s datem poslední aktualizace, sekce O webu, Služby, Stack, Specializace, Portfolio (11 projektů), FAQ (6 zkrácených otázek), Knowledge / blog (4 články), Kontakt a Právní. Soubor je celý v češtině — AI engines češtinu zvládají bez problémů a u CZ webu to dává smysl.
Vedle llms.txt mám i llms-full.txt — rozšířená verze (~1 367 slov), kde jsou plné odstavce místo odrážek. Některé AI engines (zejména Claude a Perplexity v deep-research módu) llms-full.txt načítají jako sekundární zdroj a dávají z něj věrnější citace.
Jak ho najdou? Z robots.txt, kde mám:
Sitemap: https://fana.design/sitemap.xml
# AI crawlers — llms.txt entrypoint:
# https://fana.design/llms.txt
# https://fana.design/llms-full.txt
To je jediný oficiální způsob signalizace. Některé crawlery (GPTBot, ClaudeBot) prostě zkusí /llms.txt jako defaultní URL — funguje to i bez tohoto komentáře, ale s ním je to čistší.
Čím se liší llms.txt od llms-full.txt?
Specifikace zná dvě úrovně:
- llms.txt — krátká verze (typicky 1–4 kB). Optimalizovaná pro rychlou sumarizaci. AI engines ji čtou na začátku konverzace.
- llms-full.txt — rozšířená verze (5–15 kB). Plný kontext s odstavci. AI engines ji čtou, když uživatel požaduje hluboké informace o vás.
V praxi: dělejte oba, pokud máte kapacitu. Pokud ne, dělejte minimálně llms.txt. Bez něj AI engines pracují s tím, co najdou na webu jako HTML, a to je vždycky horší.
Jaké jsou časté chyby?
Z toho, co jsem viděl u klientů a v auditech, ty nejčastější:
- Soubor v podadresáři. llms.txt musí být v rootu, ne v
/files/llms.txt. Crawlery hledají jen na top-level. - Špatný Content-Type. Server musí vracet
text/plainnebotext/markdown. Některé Apache configy ho identifikují jakoapplication/octet-streama crawlery ho přeskočí. Fix v.htaccess:AddType text/plain .txt. - HTML místo markdown. llms.txt musí být plain markdown. Žádné
<br>, žádné<a href>. AI parser čeká syntaxi[link](url). - Mismatch s realitou webu. Když llms.txt řekne „IČO 19478023", ale JSON-LD na webu má „19221011", AI vás vidí jako dva subjekty. Trust signál je rozbitý. Pozor na konzistenci.
- Žádné datum aktualizace. Bez
> Poslední aktualizace: …AI engines pokládají soubor za nedávno změněný, ale neumí přesvědčit jiné, že máte čerstvý kontext. Datum dáváte ručně nebo z CI/CD pipeline.
Pro koho llms.txt nedává smysl?
Tři případy, kdy bych to nepoužil:
- Web bez identity. Pokud máte čistě transakční stránku (jeden produkt, žádný brand, žádný blog), llms.txt přidává overhead bez benefitu. AI nemá co citovat.
- Web v aktivní migraci. Pokud měníte celý stack, nesynchronizovaný llms.txt vám škodí. Vypněte ho přes
robots.txtdokud nebude konzistentní. - Web, kde vás AI traffic nezajímá. Interní portály, klientské aplikace za login. llms.txt v rootu = veřejný, takže pro neveřejné weby zbytečné.
Co dál číst
llms.txt je část širší disciplíny GEO. Doporučuji: