Az llms.txt egy egyszerű Markdown-fájl a domain gyökerében (/llms.txt), amely felsorolja egy nyelvi modell számára az oldal legfontosabb tartalmait, mindegyikhez egy rövid leírással. Az llms-full.txt ugyanennek a kibontott változata: nem csak hivatkozik az oldalakra, hanem a teljes szövegüket is beleteszi egyetlen fájlba.
Hogyan épül fel
A javasolt szerkezet kötött, de nagyon rövid. Egy # H1 a projekt vagy cég nevével, utána egy > blokk egymondatos összefoglalóval. Ezt követik a ## szekciók, alattuk - [Cím](URL): egy mondat leírás formátumú linkek.
A fájl szándékosan Markdown, nem XML. Az indok egyszerű: egy modell a Markdownt tokenizálva is jól olvassa, HTML-sallang nélkül. Ez nem indexelési utasítás, és nem ad és nem von meg hozzáférést sem. Azt, hogy egy bot egyáltalán beléphet-e, továbbra is a robots.txt dönti el.
Ki olvassa ma és ki nem
Itt érdemes őszintének lenni. A nagy AI-crawlerek jelenleg gyakorlatilag nem kérik le: egy Ahrefs-mérés szerint a létező llms.txt-fájlok 97 százalékáért soha senki nem nyúlt le. A GPTBot, ClaudeBot és társaik ugyanúgy a HTML-t és a XML sitemap-et használják, mint eddig.
Akik viszont olvassák: az IDE-be épített fejlesztői AI-eszközök és kódoló agentek, illetve az agent-szemléletű auditeszközök. A Lighthouse Agentic Browsing például külön tételként nézi a meglétét. A műfaj rokona a WebMCP, ami már nem listát, hanem hívható műveleteket ad az AI-ügynököknek.
Mikor számít igazán
Dokumentációs oldalon, API-nál és SaaS-terméknél van valódi haszna, mert a fejlesztő agentje pont ilyenkor keresi a belépési pontot. Egy tíz aloldalas bemutatkozó oldalon a hozadék ma közel nulla. A magyar KKV-oldalak többségén ez a fájl hiányzik, és ez önmagában nem hiba.
Röviden: az llms.txt olcsó, jövőbe mutató kísérlet, nem rangsorolási tényező.
Miért fontos
Amit ma ad
A fájl elkészítése fél óra, a kockázata nulla. Cserébe a fejlesztői agentek és a kódoló asszisztensek gyorsabban megtalálják a dokumentációdat. Ha API-t vagy szoftverterméket árulsz, ez mérhető különbség lehet abban, hogy egy modell helyesen idézi-e a végpontjaidat.
Amit ma nem ad
Nem javítja a rangsorolást. Nem növeli az esélyt, hogy bekerülj egy AI-válaszba. Nem helyettesíti a rendes HTML-struktúrát, a strukturált adatokat vagy a XML sitemap-et. Aki azt ígéri, hogy az llms.txt önmagában GEO-eredményt hoz, az félreérti a jelenlegi helyzetet.
A hosszú táv
A security.txt (RFC 9116) is évekig obskúrus kísérlet volt, mire RFC lett belőle. Az llms.txt hasonló pályán lehet. A korai bevezetésnek annyi a tétje, hogy ha holnap mégis elkezdik olvasni, neked már ott van.
Mit néz ebből a riport
A riport kísérleti, tájékoztató tételként vizsgálja a /llms.txt meglétét. Nem hiba, ha nincs, és nem rontja a pontszámot. Ha van, a minőséget is nézi: legyen benne H1, legalább 200 karakter tartalom, és működő linkek. Az ajánlás ugyanez: készíts /llms.txt fájlt a legfontosabb oldalak listájával, mert a fejlesztői AI-eszközök használják, a nagy crawlerek egyelőre nem.
Technikai példa
Egy minimális, de szabályos llms.txt:
# Példa Kft.
> Webshop-fejlesztés és technikai SEO magyar KKV-knak.
A cég 2012 óta működik, Budapesten. Fő profil: WooCommerce- es Shopify-fejlesztes, teljesitmenyoptimalizalas.
## Szolgáltatások
- [Webshop-fejlesztés](https://pelda.hu/webshop-fejlesztes): WooCommerce és Shopify boltok építése, költségkeret és határidő a lap alján.
- [Technikai SEO](https://pelda.hu/technikai-seo): auditok, sebességjavítás, indexelési hibák javítása.
## Tudástár
- [Core Web Vitals útmutató](https://pelda.hu/tudastar/core-web-vitals): LCP, INP, CLS küszöbértékek és mérés.
## Kapcsolat
- [Kapcsolat és impresszum](https://pelda.hu/kapcsolat): cégadatok, adószám, e-mail cím.
A H1 és a > blokk adja a kontextust. Minden link után kettősponttal jön az egymondatos leírás, ez a rész a legértékesebb.
Gyors ellenőrzés parancssorból:
# Státusz és tartalomtípus
curl -sI https://pelda.hu/llms.txt | head -n 5
# A fájlban szereplő linkek státuszkódja
grep -o 'https://[^)]*' llms.txt | while read u; do
echo "$(curl -o /dev/null -s -w '%{http_code}' "$u") $u"
done
A második parancs minden hivatkozott URL elé kiírja a státuszkódot. Ami nem 200, azt javítsd vagy vedd ki.
Gyakori kérdések
Kötelező az llms.txt?
Nem, és nem is szabvány. Közösségi javaslat, amit senki nem ír elő. A hiánya nem hiba, és nem befolyásolja a Google-indexelést sem.
Ha elkészítem, több AI-válaszban fogok megjelenni?
Ma nem. A nagy AI-crawlerek a HTML-t olvassák, a llms.txt-fájlok túlnyomó részét soha nem kérik le. A megjelenéshez a tartalom minősége, a struktúra és a márkaemlítések számítanak.
Mi a különbség az llms.txt és az llms-full.txt között?
Az llms.txt egy válogatott linklista rövid leírásokkal. Az llms-full.txt a hivatkozott oldalak teljes szövegét is tartalmazza egyetlen fájlban. Az utóbbi gyorsan óriásira nő, ezért csak indokolt esetben érdemes.
Blokkolja vagy engedélyezi az llms.txt az AI-botokat?
Egyiket sem. Nem hozzáférés-szabályozó fájl. A botok kizárását vagy beengedését a robots.txt és a szerveroldali szabályok intézik.
Érdemes most megcsinálni, vagy várjak?
Ha dokumentációs vagy fejlesztői terméked van, csináld meg, fél óra munka. Ha egy kis bemutatkozó oldalad van, nyugodtan várhatsz. Addig a HTML-struktúrába és a strukturált adatokba fektetett idő többet hoz.