AI-értelmezhetőség Útmutató

AI-értelmezhetőség: mit ért egy nyelvi modell az oldaladból

Szerző: · 10 perc olvasás · Frissítve:
AI-értelmezhetőség: mit ért egy nyelvi modell az oldaladból - AI-értelmezhetőség (útmutató) a tudástárban
AI-értelmezhetőség: mit ért egy nyelvi modell az oldaladból - AI-értelmezhetőség | eClick GEO-audit tudástár

Az AI-értelmezhetőség azt mutatja meg, hogy egy nyelvi modell a nyers oldalból mennyire pontosan tudja megállapítani, ki vagy, mit csinálsz és kinek. Nem rangsor-mutató, hanem megértés-mutató: a kérdés az, hogy a szövegedből gépi olvasás után is összeáll-e néhány ellenőrizhető állítás.

Hogyan olvas egy nyelvi modell egy oldalt

A modell nem látja a dizájnt. Egy letöltött HTML-t kap, vagy annak szöveggé alakított változatát. A menü, a lábléc, a süti-sáv és a bannerek ugyanúgy szövegként érkeznek, mint a fő tartalom.

Ebből próbál entitásokat és tényeket kinyerni. A tipikus kérdések ezek:

  • Melyik szervezet üzemelteti az oldalt?
  • Mi az egyetlen fő tevékenység?
  • Milyen konkrét szolgáltatásokat vagy termékeket kínál?
  • Kinek szól: cégeknek, magánszemélyeknek, egy szűkebb szakmának?
  • Hol működik: város, megye, ország, online?

Minden megállapításhoz tartozik egy bizonyíték-idézet az oldalról és egy bizonyossági szint. Ha nincs idézhető mondat, a megállapítás sem születik meg. Ezért lesz a szép, de üres főoldalból rossz olvasat.

Miért más ez, mint a klasszikus SEO

A klasszikus SEO kulcsszavakban és linkekben gondolkodik. A generatív rendszerek állításokban. Egy modell nem azt jegyzi meg, hogy hányszor írtad le a „költöztetés” szót, hanem azt, hogy „a cég Budapesten és Pest megyében végez lakossági és irodaköltöztetést”.

Ez a GEO lényege. A modell akkor tud rólad beszélni egy válaszban, ha van mit idéznie. Az idézhető, önálló mondat a citálhatóság alapegysége.

Mi rontja el a legtöbb oldalon

A magyar KKV-oldalak többségén nem a tartalom hiányzik, hanem a konkrétum. A szolgáltatásoldal három bekezdésben beszél „egyedi megoldásokról”, de sehol nincs leírva, mit csinálsz. Az szervezet felismerése már a cégnévnél elbukik, mert az csak a logóban szerepel.

A másik tipikus ok technikai. Ha a szöveg csak JavaScript után jelenik meg, vagy az AI-crawlereket tiltod, a modell üres oldalt lát. Ilyenkor hiába jó a szöveg, nem jut el hozzá.

A harmadik ok a mennyiség rossz helyen. Ha a HTML-ben több a navigáció, a lábléc és a banner, mint a valódi mondat, romlik a jel-zaj arány. Erről szól a tartalmi zaj.

Mikor számít igazán

Akkor, amikor a vásárlód nem a Google találati listáját nézi, hanem kérdez. „Ki csinál Miskolcon ipari villanyszerelést?” Erre a rendszer néhány oldalból épít választ. Aki nem értelmezhető, az nem is kerül bele.

Mit néz ebből a riport

Az audit „AI-értelmezhetőség” területe az oldal nyers tartalmából próbál olvasatot készíteni, és minden megállapításhoz idézetet és bizonyossági szintet rendel. Emellett nézi az AI-crawlerek hozzáférését, az llms.txt meglétét, a WebMCP-támogatást, a Knowledge Graph-jelenlétet, a zaj-arányt és az idézhetőséget. A riport „Ezt érti az AI az oldaladból” kártyája ezekből áll össze.

Röviden: az AI-értelmezhetőség nem attól javul, hogy többet írsz, hanem attól, hogy konkrétabbat írsz, és a gép hozzá is fér.

Miért fontos

A keresés egy része átköltözött a válaszokba. A felhasználó nem tíz linket kap, hanem egy bekezdést, benne néhány forrással. Ebbe a bekezdésbe csak az kerül be, amit a rendszer biztosan ért.

A gyakorlati következmények:

  • Kimaradsz a válaszokból. Ha nem derül ki, mit csinálsz, nem is ajánlanak. Nincs róla jelentés, nincs hibaüzenet, egyszerűen nem szerepelsz.
  • Rossz kategóriába kerülsz. Ha a főoldal fele blogajánló, a modell tartalomgyártónak nézhet egy szolgáltató céget.
  • Rossz területet társít hozzád. Ha sehol nincs leírva a működési terület, a modell találgat, vagy kihagyja.
  • Nő a hallucináció esélye. Bizonytalan forrásból pontatlan állítás lesz, és az a te nevedben hangzik el.
  • A klasszikus SEO-t is húzza. Ugyanaz a konkrétság, ami a modellnek segít, a keresőnek és az olvasónak is segít.

A riportokban ezt látjuk: a legtöbb oldalon a szervezet neve felismerhető, de a célcsoport és a működési terület már nem. Pont az a két adat hiányzik, ami a helyi keresésben eldönti a dolgot.

Kikre vonatkozik

Vonatkozik rá:

  • Minden nyilvános, indexelhető oldal: bemutatkozó site, szolgáltatásoldalak, webshop, SaaS-oldal, tudástár.
  • Kifejezetten a helyi és szakmai szolgáltatókra, ahol a keresés kérdés formájú.
  • Webshopokra, ahol a kategória, a márka és a szállítási terület számít.
  • Több nyelvű oldalakra, ahol nyelvenként külön kell értelmezhetőnek lenni.

Nem vagy csak részben vonatkozik rá:

  • Staging és fejlesztői környezet, ami eleve noindex vagy jelszóval védett. Ott a zárt állapot a helyes.
  • Belső rendszerek, adminfelületek, ügyfélportálok bejelentkezés mögött.
  • Kampány-landing oldalak, ahol csak fizetett forgalmat vársz. Ott is hasznos, de nem kritikus.

A lényeg egyszerű: ha egy oldal célja, hogy idegenek megtaláljanak, akkor az AI-értelmezhetőség rá is vonatkozik.

Hogyan ellenőrzöd

Lépések

  1. Nézd meg a nyers HTML-t. Böngészőben Ctrl+U, vagy terminálban curl -sL https://pelda.hu | wc -c. Ha a fő szöveg nincs benne, a modell sem látja.
  2. Kapcsold ki a JavaScriptet. Chrome DevTools, Command Palette, „Disable JavaScript”, majd frissítés. Ami eltűnik, az sok robot számára nem létezik.
  3. Olvasd el csak a szöveget. Mentsd ki a fő tartalmat sima szövegként. Ha te sem tudod megmondani belőle, mit csinál a cég, a modell sem fogja.
  4. Tedd fel az öt alapkérdést. Másold be a szöveget egy chat-modellbe, és kérdezd meg: ki a szervezet, mi a fő szolgáltatás, milyen szolgáltatások vannak, kinek szól, hol működik. Kérj minden válaszhoz szó szerinti idézetet az oldalról.
  5. Nézd meg a hozzáférést. Töltsd le a https://pelda.hu/robots.txt fájlt, és keress GPTBot, ClaudeBot, PerplexityBot és hasonló sorokat. A szerver- vagy WAF-szintű tiltás ezen felül is blokkolhat.
  6. Ellenőrizd a strukturált adatokat. Rich Results teszt vagy a schema.org validátor. Legalább Organization és WebSite séma legyen az oldalon.
  7. Nézd a zaj-arányt. Becsüld meg, hogy a látható szöveg hány százaléka fő tartalom. Ha a menü és a lábléc dominál, ott a probléma.

Jó jel

  • Az első képernyőn egy mondatban ott van, mit csinálsz és kinek.
  • A cégnév szövegként szerepel, nemcsak a logó képfájljában.
  • A szolgáltatások külön oldalon, névvel és leírással állnak.
  • A működési terület konkrét: város, megye, ország.
  • Van JSON-LD Organization séma valós adatokkal.
  • A modell szó szerinti idézetet tud adni minden megállapításhoz.

Rossz jel

  • A főoldal szövege általánosság: „megoldások”, „partnered vagyunk”, „minőség”.
  • A fő tartalom csak JS-renderelés után jelenik meg.
  • A robots.txt tiltja az AI-botokat, miközben te forgalmat vársz tőlük.
  • A modell „nem derül ki” választ ad a célcsoportra vagy a területre.
  • Minden szolgáltatás egyetlen, felsorolás nélküli bekezdésben van.

Hogyan javítod

Minden rendszerben ugyanaz az első lépés

  1. Írj egy egymondatos meghatározást: mit csinálsz, kinek, hol. Tedd a főoldal tetejére, h1 vagy közvetlenül alatta lévő bekezdésként.
  2. Bontsd a szolgáltatásokat külön oldalakra, mindegyiket saját címmel és 300-600 szóval.
  3. Írd ki a működési területet szövegben, ne csak a térkép-beágyazásban.
  4. Tedd fel az Organization és WebSite sémát JSON-LD-ben.
  5. Ellenőrizd, hogy a fontos szöveg szerveroldalon is a HTML-ben van.

WordPress

  1. A témában nézd meg, hogy a h1 a valódi oldalcím-e, ne a logó legyen h1.
  2. Ha page builder generálja a tartalmat, ellenőrizd a forráskódot: sok builder JS-ből tölt be szekciókat.
  3. SEO-bővítménnyel add meg a szervezeti adatokat, és kapcsold be a schema kimenetet.
  4. A robots.txt-t a bővítmény felületén nézd meg, ne csak a fájlt. Sok plugin dinamikusan írja felül.
  5. Kapcsold ki a felesleges „kapcsolódó bejegyzések” és widget-blokkokat a szolgáltatásoldalakon.

Shopify

  1. A téma theme.liquid fájljában ellenőrizd a JSON-LD blokkot. Alapból sok téma csak Product sémát ad.
  2. Az „Rólunk” és a kategóriaoldalak szövegét bővítsd: mit árulsz, kinek, honnan szállítasz.
  3. A kategórialeírásokat tedd a listázás fölé, hogy a HTML-ben előrébb legyen.
  4. A szállítási területet írd ki szövegesen is, ne csak a pénztár beállításaiban.
  5. Alkalmazás-blokkokat rendszeresen takaríts: minden felesleges widget növeli a zajt.

Unas

  1. Az adminban a Design, Saját tartalom résznél tedd a főoldal tetejére a meghatározó mondatot.
  2. A kategóriákhoz írj saját leírást, ne hagyd üresen.
  3. A cégadatokat töltsd ki teljesen, és ellenőrizd, hogy a lábléc szövegként jeleníti meg őket.
  4. A saját HTML-mezőbe beteheted a JSON-LD blokkot, ha a sablon nem generál sémát.
  5. Nézd meg a sablon által generált forrást, mennyi benne a sablon-elem a valódi szöveghez képest.

Shoprenter

  1. A Tartalom, Oldalak résznél készíts valódi szolgáltatás- vagy információs oldalakat.
  2. A kategóriaoldalak leírását kapcsold be, és a listázás elé helyezd.
  3. A sablonszerkesztőben a fejlécbe illeszd be az Organization JSON-LD-t.
  4. A fizetési és szállítási feltételeket írd ki konkrétan, azok is idézhető tények.
  5. Ellenőrizd a robots.txt tartalmát az admin felületén.

Egyedi fejlesztés

  1. Használj szerveroldali renderelést vagy statikus generálást a fő tartalomra.
  2. A sémát adatbázisból generáld, ne kézzel másold. Így nem avul el.
  3. Vezess be egy egyszerű ellenőrzést a build-folyamatban: a kirenderelt HTML tartalmazza-e a h1-et és a fő bekezdést.
  4. A robots.txt-t verziókövesd, és döntsd el tudatosan, mely botokat engeded be.
  5. Ha van API-d vagy kereshető adatod, fontold meg az llms.txt és a WebMCP bevezetését.

Gyakori hibák

  • Szlogen a meghatározás helyett. A „Gondolkodj nagyot” nem mondja meg, mit csinálsz, így a modell sem tudja meg.
  • Cégnév csak a logóban. Ha a név képfájlban van, a szöveges olvasatból kimarad, és a szervezet azonosítása elbukik.
  • JS-ből töltött fő tartalom. Ami csak kliensoldalon jelenik meg, azt a legtöbb robot üresnek látja.
  • Minden szolgáltatás egy oldalon. A modell nem tud külön entitásokat képezni, összemosódik a kínálat.
  • Az AI-botok globális tiltása indoklás nélkül. Sokan bemásolnak egy blokkoló robots.txt-t, aztán csodálkoznak, hogy nem jelennek meg a válaszokban.
  • Túlsúlyos sablon. Ha a lábléc és a menü hosszabb, mint a cikk, romlik a jel-zaj arány és vele az olvasat.
  • Elavult vagy kitalált séma. A valódi tartalomtól eltérő strukturált adat rontja a bizalmat, nem javítja.

Technikai példa

Az alábbi részlet mindent megad, amit egy modellnek tudnia kell. Szöveges meghatározás a h1 alatt, és ugyanaz gépi formában JSON-LD-ben. A két forrásnak egyeznie kell.

<main>
  <h1>Ipari villanyszerelés Miskolcon</h1>
  <p>
    A Pelda Kft. ipari villanyszerelést és karbantartast vegez
    gyartocegeknek Miskolcon es Borsod-Abauj-Zemplen megyeben.
    Fo teruletek: kapcsoloszekreny-epites, gepbekotes, erintesvedelmi felulvizsgalat.
  </p>
</main>

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Organization",
  "name": "Pelda Kft.",
  "url": "https://pelda.hu/",
  "description": "Ipari villanyszereles es karbantartas gyartocegeknek Miskolcon.",
  "areaServed": {
    "@type": "AdministrativeArea",
    "name": "Borsod-Abauj-Zemplen megye"
  },
  "sameAs": [
    "https://www.linkedin.com/company/pelda"
  ]
}
</script>

Ezzel ellenőrzöd, hogy mit lát egy egyszerű, JavaScript nélküli letöltés. Ha a grep nem találja a meghatározó mondatot, a modell sem fogja.

curl -sL -A "Mozilla/5.0 (compatible; GPTBot/1.0)" https://pelda.hu/ \
  | grep -io "ipari villanyszerel[a-zá-ű]*" | head

curl -sI -A "GPTBot" https://pelda.hu/ | head -n 1

Az első parancs a tartalmat ellenőrzi, a második a hozzáférést. Ha a második 403-at ad vissza, a bot szerver- vagy tűzfal-szinten van tiltva.

Gyakori kérdések

Ha jól rangsorolok a Google-ben, akkor az AI is ért engem?
Nem feltétlenül. A rangsoroláshoz elég a relevancia és a tekintély, az olvasathoz konkrét, idézhető állítások kellenek. Sok jól rangsoroló főoldalból nem derül ki a célcsoport és a működési terület. A két dolog összefügg, de nem ugyanaz.
Be kell engednem az AI-crawlereket?
Üzleti döntés, nem technikai kényszer. Ha forgalmat és említést vársz a generatív keresőktől, akkor a kereső célú botokat engedd be. A tréning célú botokat külön kezelheted. A részletekért nézd meg az AI-crawlerek cikket.
Elég, ha felteszek strukturált adatot?
Nem. A séma megerősíti azt, ami a szövegben már ott van, de nem pótolja. Ha a látható tartalom üres általánosság, a JSON-LD sem menti meg. Először a szöveget írd meg konkrétan, utána jelöld.
Mennyi idő alatt látszik a javítás?
A nyers olvasat azonnal javul, mert az a letöltött HTML-ből készül. A generatív válaszokban való megjelenés lassabb, mert ott az újrafeltérképezés és az indexelés is számít. Néhány héttel érdemes számolni.
Kell llms.txt fájl?
Nem kötelező, és ma még nem minden rendszer olvassa. Nagyobb, dokumentáció-jellegű oldalaknál viszont olcsó kiegészítés. Előbb a látható tartalmat és a hozzáférést rendezd, utána jöhet az llms.txt.

Források

Kapcsolódó fogalmak

Nézd meg, hogy áll ebben a te weboldalad

Futtass egy GEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes GEO-audit indítása