AI-értelmezhetőség Szakszó

LLM (nagy nyelvi modell)

Szerző: · 7 perc olvasás · Frissítve:
LLM (nagy nyelvi modell) - AI-értelmezhetőség (szakszó) a tudástárban
LLM (nagy nyelvi modell) - AI-értelmezhetőség | eClick GEO-audit tudástár

Az LLM (large language model, nagy nyelvi modell) olyan neurális hálón alapuló program, amely hatalmas szövegmennyiségen tanulta meg, hogy egy szövegrészlet után mi a legvalószínűbb folytatás. Nem adatbázis és nem kereső: nem tételeket keres ki, hanem valószínűség alapján generál választ.

Hogyan működik

A modell a szöveget nem szavakban, hanem tokenekben látja. A bemenetet, vagyis a promptot, tokenekre bontja, majd tokenenként jósolja meg a választ. Ezért érzékeny a fogalmazásra: más szórend más folytatást hoz.

Egyszerre véges mennyiségű szöveget lát. Ez a kontextus-ablak, és minden bele akart tartalom ebbe fér csak be:

  • a rendszerutasítás,
  • a felhasználó kérdése,
  • a beolvasott weboldalak szövege,
  • a saját, már legenerált válasza.

Honnan tudja, mi van az oldaladon

Két forrásból. Az egyik a tréning-adat, ami egy adott időpontig tartalmaz webes szöveget, és elavulhat. A másik az élő lekérés: a modell futás közben tölt be oldalakat, ez a RAG elve, és erre épül a generatív kereső is.

A gyakorlatban ez azt jelenti, hogy a lekért oldalból általában a kinyert szöveg számít. A vizuális elrendezés, a színek és a képi kontextus nagy része elvész. Ami csak designban van benne, az a modellnek nem létezik.

Miért téved

Az LLM akkor is generál választ, ha nincs elég adata. Ilyenkor a legvalószínűbb, de nem feltétlenül igaz mondatot írja le, ez a hallucináció. A riportokban tipikus eset, hogy a modell kitalál egy telefonszámot vagy egy szolgáltatást, mert az oldalon nem találta meg egyértelműen.

Röviden: az LLM azt mondja el rólad, amit a szövegedből tokenként kiolvas, nem azt, amit te a fejedben tudsz a cégedről.

Miért fontos

Ez dönti el, mit mondanak rólad

Egyre több vásárlási döntés indul chatben, nem találati oldalon. A modell válasza lesz az első benyomás a cégedről. Ha az oldaladból nem derül ki tisztán, mit csinálsz és kinek, a modell vagy kihagy, vagy rosszul idéz.

Konkrét következmények

  • Kimaradsz a válaszból. A modell inkább azt a versenytársat említi, akinek a szövege egyértelmű.
  • Rossz adat terjed rólad. Elavult ár, régi cím vagy megszűnt szolgáltatás kerül a válaszba.
  • Nincs kattintás. Ha a válaszban nincs forrásmegjelölés, a forgalom nálad nem jelenik meg.
  • Nehezen mérhető. A chat-forgalom jó része hivatkozó nélkül érkezik, ezért az analitikában alulbecsülöd.

A magyar KKV-oldalak többségén ugyanaz a minta: a főoldal tele van hangulatos szlogenekkel, de egyetlen mondat sem mondja ki, milyen szolgáltatást nyújtanak, melyik városban.

Kikre vonatkozik

Kire vonatkozik

  • Minden nyilvános, indexelhető weboldalra, mérettől függetlenül.
  • Kiemelten a szolgáltató KKV-kra, ahol a döntés előtt sok a kérdés.
  • Webshopokra, ahol a termékadat és a szállítási feltétel gyakran csak scriptből töltődik be.
  • Helyi vállalkozásokra, ahol a cím, a nyitvatartás és a vonzáskörzet a válasz lényege.

Kire nem

  • Zárt, bejelentkezés mögötti felületekre.
  • Staging és fejlesztői környezetekre, amelyek amúgy sem publikusak.
  • Tisztán belső eszközökre, intranetre.

Figyelj arra, hogy a bejelentkezés mögötti tudásbázis marketingértéke nulla a modellek felé. Ha szeretnéd, hogy idézzenek belőle, ki kell tenni nyilvánosra.

Hogyan ellenőrzöd

Lépések

  1. Nyisd meg az oldalt a böngészőben, és nyomj Ctrl+U-t. A forráskódban keresd meg a fő állításaidat szövegként.
  2. Futtass egy curl -s https://pelda.hu | head -100 parancsot. Ha itt szinte üres a body, a tartalmad csak JavaScriptből jön.
  3. Kapcsold ki a JavaScriptet a devtools beállításaiban, majd töltsd újra az oldalt. Ami eltűnik, azt sok bot sem látja.
  4. Másold be a nyers szöveget egy chatbe, és kérdezd meg: mivel foglalkozik ez a cég, kinek szól, hol dolgozik.
  5. Hasonlítsd össze a választ azzal, amit te mondanál ugyanerre.

Jó jel

  • Az első képernyőn kimondod, mit csinálsz és kinek.
  • A kapcsolati adatok sima szövegként is szerepelnek, nem csak képen.
  • A szolgáltatások listaként, nevesítve jelennek meg.
  • A modell a saját szavaiddal, kitalálás nélkül foglalja össze az oldalt.

Rossz jel

  • A válasz általános: "modern megoldásokat kínál ügyfeleinek".
  • A modell rossz iparágat vagy rossz várost mond.
  • A JavaScript kikapcsolása után üres marad a tartalom.
  • Az oldal szövege néhány szlogen, a többi kép és animáció.

Mit néz ebből a riport

Az audit betölti az oldalt, kinyeri belőle a szöveget, és egy nyelvi modellel értelmezteti. A riportban azt látod vissza, mit értett meg ebből a szervezetről, a fő szolgáltatásról, a célcsoportról és a működési területről. Ha ott hiányt vagy tévedést látsz, az nem a modell hibája, hanem a szövegé.

Hogyan javítod

WordPress

  1. A főoldal első bekezdésébe írj egy egymondatos, konkrét definíciót a cégről.
  2. Minden szolgáltatásnak legyen saját aloldala, valódi szöveggel, ne csak ikonnal.
  3. Kapcsolj be egy sémabővítményt (Yoast, Rank Math), és töltsd ki a szervezeti adatokat.
  4. Ha page builder generálja a szöveget, ellenőrizd a forráskódban, hogy valóban ott van-e.

Shopify

  1. A termékleírást a product.description mezőbe írd, ne csak appból injektált blokkba.
  2. A szállítási és elállási feltételeket tedd önálló, indexelhető oldalra.
  3. A sémát a theme theme.liquid vagy a termék-sablon szintjén ellenőrizd.

Unas

  1. A Tartalom menüben hozz létre valódi szöveges oldalakat a fő kategóriákhoz.
  2. A termékadatlapon töltsd ki a hosszú leírást, ne hagyd üresen.
  3. A céginformációkat a lábléc mellett külön oldalon is tüntesd fel.

Shoprenter

  1. A kategórialeírás mezőt töltsd ki minden fontos kategóriánál.
  2. A statikus oldalak közül az impresszum és az ÁSZF legyen teljes és pontos.
  3. Ellenőrizd a sablonban, hogy a leírás a HTML-ben renderelődik.

Egyedi fejlesztés

  1. Használj szerveroldali renderelést vagy prerendert a fő tartalomhoz.
  2. Tedd a lényeget a HTML első néhány kilobájtjába.
  3. Adj ki JSON-LD-t a szervezetről és a szolgáltatásokról.
  4. Ellenőrizd a robots.txt-ben, hogy az AI-crawlerek nincsenek-e véletlenül tiltva.

Gyakori hibák

  • Marketing-szöveg konkrétum nélkül. A modellnek nincs mit kiolvasnia, ezért általánosságot vagy semmit mond rólad.
  • Fontos adat csak képen. A telefonszám vagy az árlista képként nem kerül be a szövegbe.
  • Kliensoldali renderelés mindenre. Sok bot a nyers HTML-t dolgozza fel, és üres oldalt lát.
  • Ellentmondó adatok az oldalon. Két különböző telefonszám esetén a modell találgat, és téveszt.
  • Elavult, de fent hagyott tartalom. A modell nem tudja, melyik az érvényes, és a régit idézi.
  • Túl hosszú, szétfolyó oldalak. A lényeg nem fér bele a kontextusba, a felesleg viszi el a helyet.
  • Hit abban, hogy a modell "utánanéz". Élő lekérés nélkül csak a tréning-adatból dolgozik, ami régi lehet.

Technikai példa

Nézd meg, mit lát a modell a nyers HTML-ből, JavaScript futtatása nélkül:

curl -sL -A "Mozilla/5.0 (compatible; GPTBot/1.1; +https://openai.com/gptbot)" \
  https://pelda.hu | sed -e 's/<[^>]*>//g' | tr -s '[:space:]' ' ' | head -c 1200

Ha a kimenet menüfeliratokon kívül alig tartalmaz mondatot, a tartalmad nem jut el a modellig.

Egy tömör JSON-LD blokk kevés tokenben ad át sok tényt:

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "name": "Példa Kft.",
  "url": "https://pelda.hu",
  "description": "Ipari hűtéstechnikai karbantartás élelmiszeripari üzemeknek.",
  "areaServed": "Magyarország",
  "telephone": "+36-1-234-5678",
  "email": "info@pelda.hu"
}

Ez a néhány sor egyértelműsíti azt, amit a látogató a designból amúgy értene.

Gyakori kérdések

Az LLM ugyanaz, mint a Google keresője?
Nem. A kereső indexből ad vissza találatokat rangsorolva, az LLM viszont szöveget generál. A kettő ma keveredik: a generatív keresők lekérik az oldalakat, majd egy modellel foglalják össze őket. A rangsor és az idézés így külön logika mentén dől el.
Kell külön szöveget írnom az AI-nak?
Nem kell külön verzió. Ugyanaz a tiszta, konkrét szöveg működik az embernek és a modellnek is. Annyi a különbség, hogy a modell nem érti a képi utalásokat és a designban rejlő jelentést. Amit fontosnak tartasz, azt mondd ki szövegben.
Miért mond rólam rosszat vagy elavultat a chat?
Többnyire azért, mert a tréning-adata régi, vagy az oldalról nem tudja kiolvasni az aktuális információt. Frissítsd a nyilvános oldalaidat, és szüntesd meg az ellentmondásokat. Ha ugyanaz az adat több helyen máshogy szerepel, a modell találgat.
Hány token fér bele egy modellbe?
Modellenként eltér, és folyamatosan nő. A lényeg nem a pontos szám: a lekért oldalakból sokszor csak egy részlet kerül be a kontextusba. Ezért érdemes a fontos állításokat előre, a szöveg elejére tenni.
Blokkoljam az AI-crawlereket?
Ez üzleti döntés. Ha azt szeretnéd, hogy idézzenek és ajánljanak, a lekérő botokat engedd be. A tréning célú botokat ettől függetlenül tilthatod a robots.txt-ben. Sok oldalon ezt véletlenül, egy plugin miatt állították be rosszul.

Források

Kapcsolódó fogalmak

A te oldaladon hogy áll a(z) „LLM (nagy nyelvi modell)”?

Futtass egy GEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes GEO-audit indítása