AI-értelmezhetőség Szakszó

llms.txt és llms-full.txt

Szerző: · 8 perc olvasás · Frissítve:
llms.txt és llms-full.txt - AI-értelmezhetőség (szakszó) a tudástárban
llms.txt és llms-full.txt - AI-értelmezhetőség | eClick GEO-audit tudástár

Az llms.txt egy egyszerű Markdown-fájl a domain gyökerében (/llms.txt), amely felsorolja egy nyelvi modell számára az oldal legfontosabb tartalmait, mindegyikhez egy rövid leírással. Az llms-full.txt ugyanennek a kibontott változata: nem csak hivatkozik az oldalakra, hanem a teljes szövegüket is beleteszi egyetlen fájlba.

Hogyan épül fel

A javasolt szerkezet kötött, de nagyon rövid. Egy # H1 a projekt vagy cég nevével, utána egy > blokk egymondatos összefoglalóval. Ezt követik a ## szekciók, alattuk - [Cím](URL): egy mondat leírás formátumú linkek.

A fájl szándékosan Markdown, nem XML. Az indok egyszerű: egy modell a Markdownt tokenizálva is jól olvassa, HTML-sallang nélkül. Ez nem indexelési utasítás, és nem ad és nem von meg hozzáférést sem. Azt, hogy egy bot egyáltalán beléphet-e, továbbra is a robots.txt dönti el.

Ki olvassa ma és ki nem

Itt érdemes őszintének lenni. A nagy AI-crawlerek jelenleg gyakorlatilag nem kérik le: egy Ahrefs-mérés szerint a létező llms.txt-fájlok 97 százalékáért soha senki nem nyúlt le. A GPTBot, ClaudeBot és társaik ugyanúgy a HTML-t és a XML sitemap-et használják, mint eddig.

Akik viszont olvassák: az IDE-be épített fejlesztői AI-eszközök és kódoló agentek, illetve az agent-szemléletű auditeszközök. A Lighthouse Agentic Browsing például külön tételként nézi a meglétét. A műfaj rokona a WebMCP, ami már nem listát, hanem hívható műveleteket ad az AI-ügynököknek.

Mikor számít igazán

Dokumentációs oldalon, API-nál és SaaS-terméknél van valódi haszna, mert a fejlesztő agentje pont ilyenkor keresi a belépési pontot. Egy tíz aloldalas bemutatkozó oldalon a hozadék ma közel nulla. A magyar KKV-oldalak többségén ez a fájl hiányzik, és ez önmagában nem hiba.

Röviden: az llms.txt olcsó, jövőbe mutató kísérlet, nem rangsorolási tényező.

Miért fontos

Amit ma ad

A fájl elkészítése fél óra, a kockázata nulla. Cserébe a fejlesztői agentek és a kódoló asszisztensek gyorsabban megtalálják a dokumentációdat. Ha API-t vagy szoftverterméket árulsz, ez mérhető különbség lehet abban, hogy egy modell helyesen idézi-e a végpontjaidat.

Amit ma nem ad

Nem javítja a rangsorolást. Nem növeli az esélyt, hogy bekerülj egy AI-válaszba. Nem helyettesíti a rendes HTML-struktúrát, a strukturált adatokat vagy a XML sitemap-et. Aki azt ígéri, hogy az llms.txt önmagában GEO-eredményt hoz, az félreérti a jelenlegi helyzetet.

A hosszú táv

A security.txt (RFC 9116) is évekig obskúrus kísérlet volt, mire RFC lett belőle. Az llms.txt hasonló pályán lehet. A korai bevezetésnek annyi a tétje, hogy ha holnap mégis elkezdik olvasni, neked már ott van.

Mit néz ebből a riport

A riport kísérleti, tájékoztató tételként vizsgálja a /llms.txt meglétét. Nem hiba, ha nincs, és nem rontja a pontszámot. Ha van, a minőséget is nézi: legyen benne H1, legalább 200 karakter tartalom, és működő linkek. Az ajánlás ugyanez: készíts /llms.txt fájlt a legfontosabb oldalak listájával, mert a fejlesztői AI-eszközök használják, a nagy crawlerek egyelőre nem.

Kikre vonatkozik

Markdown-felsorolásban, hogy kinek éri meg:

  • Dokumentációs és fejlesztői oldalak: itt a legerősebb az érv, a kódoló agentek tényleg lekérik.
  • SaaS és API-szolgáltatók: a végpontok és a feltételek pontos idézése múlhat rajta.
  • Tartalmas tudástárak, blogok: közepes haszon, viszont könnyen generálható.
  • Webshopok: gyenge illeszkedés, a termékadatot a Product séma adja át jobban.
  • Kis bemutatkozó oldalak: ma alig van hozadéka, nyugodtan elhagyható.

Ahol biztosan ne csináld:

  • Staging és teszt környezet: ott az egész site-ot zárni kell, nem tartalomlistát publikálni.
  • Zárt, bejelentkezés mögötti tartalom: a fájl nyilvános, ne szivárogtass ki vele belső URL-eket.

Hogyan ellenőrzöd

  1. Nyisd meg böngészőben a https://domain.hu/llms.txt címet. Ha 404-et kapsz, nincs fájl.
  2. Parancssorból ellenőrizd a státuszt és a fejlécet: curl -I https://domain.hu/llms.txt.
  3. Nézd meg a tartalomtípust. A text/plain vagy text/markdown a jó, a text/html azt jelenti, hogy egy hibaoldalt vagy sablont kapsz vissza.
  4. Olvasd végig a fájlt. Van benne H1? Legalább 200 karakter érdemi tartalom?
  5. Kattintsd végig a benne szereplő linkeket, vagy futtasd rájuk a curl -o /dev/null -s -w "%{http_code}\n" URL parancsot.
  6. Ha van llms-full.txt, nézd meg a méretét. Több megabájtos fájl kezelhetetlen, a kontextus-ablak nem végtelen.

Jó jelek:

  • 200-as státusz, sima szöveges tartalomtípus.
  • H1, rövid összefoglaló, tematikus ## szekciók.
  • Minden link 200-zal válaszol, és abszolút URL.
  • A leírások konkrétak, nem marketingmondatok.

Rossz jelek:

  • 404, vagy a 404-oldal HTML-je jelenik meg 200-as kóddal (soft 404).
  • Üres vagy pársoros fájl, tényleges tartalom nélkül.
  • Törött, régi vagy átirányított linkek a listában.
  • Relatív útvonalak, amiket egy külső kliens nem tud feloldani.
  • Bejelentkezés mögötti vagy noindexelt oldalak szerepelnek benne.

Hogyan javítod

WordPress

  1. Telepíts erre a célra készült bővítményt, vagy készítsd el kézzel a fájlt.
  2. Kézi út: hozd létre az llms.txt fájlt, és töltsd fel a WordPress gyökérkönyvtárába, a wp-config.php mellé.
  3. Ellenőrizd, hogy a permalink-szabályok nem nyelik-e el. Ha igen, vegyél fel kivételt a .htaccess fájlban.
  4. Gyorsítótárazó bővítmény esetén üríts cache-t, majd nézd meg böngészőben.

Shopify

  1. A gyökérbe közvetlenül nem tudsz fájlt tenni, ezért hozz létre egy új sablont: templates/page.llms.liquid.
  2. A sablon csak sima szöveget adjon vissza, layout nélkül.
  3. Készíts hozzá egy oldalt llms kézirattal, majd a témában vagy a Shopify oldalán állíts be átirányítást a /llms.txt címről erre.
  4. Ha ez túl körülményes, tedd a fájlt CDN mögé, és irányítsd rá a gyökér URL-t.

Unas

  1. Az adminban keresd a saját fájlok feltöltésére szolgáló felületet.
  2. Töltsd fel az llms.txt fájlt a gyökérbe, ugyanoda, ahová a hitelesítő fájlok kerülnek.
  3. Ha a rendszer nem engedi, kérd a támogatástól a gyökér szintű statikus fájl elhelyezését.

Shoprenter

  1. Az adminban a fájlkezelőn vagy a támogatáson keresztül helyezhető el gyökér szintű fájl.
  2. Feltöltés után ellenőrizd a curl -I kimenetét, mert a platform sok gyökér URL-t a boltmotorra irányít.

Egyedi fejlesztés

  1. Tedd az llms.txt fájlt a statikus gyökérbe (public/, web/, static/).
  2. Nginx esetén rögzítsd a típust:
    location = /llms.txt { default_type text/plain; }
    
  3. Generáltasd a fájlt build-időben a sitemap vagy a tartalomfa alapján, hogy ne avuljon el.
  4. Ha nagy a dokumentációd, az llms-full.txt generálásánál vágd ki a navigációt és a lábléceket.
  5. Vedd fel a deploy utáni ellenőrzésbe a linkek státuszkódját.

Gyakori hibák

  • Egyszer megírt, soha nem frissített lista: fél év múlva törött linkekre mutat, és rosszabb, mintha nem lenne.
  • Marketingszöveg leírás helyett: a „piacvezető megoldás" semmit nem mond a modellnek, a funkció neve viszont igen.
  • Relatív URL-ek használata: a fájlt letöltő kliens nem tudja, mihez képest relatív.
  • Az egész sitemap bemásolása: a lényeg a válogatás, nem a teljesség, erre ott a XML sitemap.
  • Túlméretezett llms-full.txt: több megabájtos fájlt egyetlen modell sem fog egyben feldolgozni.
  • Zárt vagy tiltott oldalak felsorolása: ha a robots.txt tiltja, ne hirdesd nyilvános listában.
  • Hamis elvárás: attól, hogy kikerült a fájl, nem kerülsz be több AI-válaszba.

Technikai példa

Egy minimális, de szabályos llms.txt:

# Példa Kft.

> Webshop-fejlesztés és technikai SEO magyar KKV-knak.

A cég 2012 óta működik, Budapesten. Fő profil: WooCommerce- es Shopify-fejlesztes, teljesitmenyoptimalizalas.

## Szolgáltatások

- [Webshop-fejlesztés](https://pelda.hu/webshop-fejlesztes): WooCommerce és Shopify boltok építése, költségkeret és határidő a lap alján.
- [Technikai SEO](https://pelda.hu/technikai-seo): auditok, sebességjavítás, indexelési hibák javítása.

## Tudástár

- [Core Web Vitals útmutató](https://pelda.hu/tudastar/core-web-vitals): LCP, INP, CLS küszöbértékek és mérés.

## Kapcsolat

- [Kapcsolat és impresszum](https://pelda.hu/kapcsolat): cégadatok, adószám, e-mail cím.

A H1 és a > blokk adja a kontextust. Minden link után kettősponttal jön az egymondatos leírás, ez a rész a legértékesebb.

Gyors ellenőrzés parancssorból:

# Státusz és tartalomtípus
curl -sI https://pelda.hu/llms.txt | head -n 5

# A fájlban szereplő linkek státuszkódja
grep -o 'https://[^)]*' llms.txt | while read u; do
  echo "$(curl -o /dev/null -s -w '%{http_code}' "$u") $u"
done

A második parancs minden hivatkozott URL elé kiírja a státuszkódot. Ami nem 200, azt javítsd vagy vedd ki.

Gyakori kérdések

Kötelező az llms.txt?
Nem, és nem is szabvány. Közösségi javaslat, amit senki nem ír elő. A hiánya nem hiba, és nem befolyásolja a Google-indexelést sem.
Ha elkészítem, több AI-válaszban fogok megjelenni?
Ma nem. A nagy AI-crawlerek a HTML-t olvassák, a llms.txt-fájlok túlnyomó részét soha nem kérik le. A megjelenéshez a tartalom minősége, a struktúra és a márkaemlítések számítanak.
Mi a különbség az llms.txt és az llms-full.txt között?
Az llms.txt egy válogatott linklista rövid leírásokkal. Az llms-full.txt a hivatkozott oldalak teljes szövegét is tartalmazza egyetlen fájlban. Az utóbbi gyorsan óriásira nő, ezért csak indokolt esetben érdemes.
Blokkolja vagy engedélyezi az llms.txt az AI-botokat?
Egyiket sem. Nem hozzáférés-szabályozó fájl. A botok kizárását vagy beengedését a robots.txt és a szerveroldali szabályok intézik.
Érdemes most megcsinálni, vagy várjak?
Ha dokumentációs vagy fejlesztői terméked van, csináld meg, fél óra munka. Ha egy kis bemutatkozó oldalad van, nyugodtan várhatsz. Addig a HTML-struktúrába és a strukturált adatokba fektetett idő többet hoz.

Források

Kapcsolódó fogalmak

A te oldaladon hogy áll a(z) „llms.txt és llms-full.txt”?

Futtass egy GEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes GEO-audit indítása