Jak optimalizovat web pro LLM
Základ je text vykreslený na serveru, strukturovaná data (JSON-LD) a popisy služeb běžnou češtinou, bez marketingových obratů. Vzniká k tomu konvence llms.txt — soubor, který modelům ukazuje důležité stránky. Její podporu ale zatím žádný velký dodavatel AI nezaručuje, takže ji berte jako levný doplněk, ne jako jádro řešení.
Optimalizace pro jazykové modely zní jako nová disciplína, ale většina práce jsou věci, které se dělaly vždycky — jen se přestaly kontrolovat.
Text musí být v HTML
Model si vaši stránku neotevře v prohlížeči a nepočká, až doběhne JavaScript. Co není v odpovědi serveru, pro něj neexistuje. Server-side rendering nebo statické generování je proto první a nejdůležitější krok — všechno ostatní na něm stojí.
Strukturovaná data
JSON-LD popíše firmu, služby, články a časté dotazy způsobem, který stroj nemusí odhadovat. Je to nejlevnější zlepšení srozumitelnosti, jaké se dá udělat, protože nevyžaduje zásah do textu ani do designu.
Pište konkrétně a česky
Obraty typu „komplexní řešení na míru“ nenesou informaci. Napište obor, službu, region a pro koho to je. Platí jednoduché pravidlo: pokud by z věty neuhodl váš obor člověk mimo firmu, neuhodne ho ani model.
Odpovědi hned pod nadpisem
Nadpis formulujte jako otázku a hned pod něj dejte odstavec, který ji zodpoví. Detaily, výjimky a příklady patří až za něj. Tenhle jediný zvyk zvedne šanci na citaci víc než většina technických úprav.
llms.txt: levný doplněk, ne řešení
llms.txt je vznikající konvence — textový soubor v kořeni webu, který modelům ukazuje důležité stránky. Zatím jeho podporu žádný velký dodavatel AI negarantuje, takže se na něj nedá spoléhat. Nasazení stojí pár minut, takže dává smysl jako doplněk, ne jako jádro řešení.
Co nedělat
- Neschovávejte text pro roboty mimo viditelnou stránku.
- Nepřidávejte strukturovaná data, která neodpovídají obsahu stránky.
- Negenerujte desítky téměř stejných stránek na variace jedné otázky.
Tyhle zkratky fungovaly krátce ve vyhledávání a v AI vyhledávání nefungují vůbec — model porovnává obsah, ne značky v kódu.