AI-értelmezhetőség Szakszó

ChatGPT-User

Szerző: · 7 perc olvasás · Frissítve:
ChatGPT-User - AI-értelmezhetőség (szakszó) a tudástárban
ChatGPT-User - AI-értelmezhetőség | eClick GEO-audit tudástár

A ChatGPT-User az OpenAI azon lekérője, amely akkor nyitja meg az oldaladat, amikor egy felhasználó vagy egy ChatGPT-ben futó művelet konkrétan erre kéri. Nem tömeges feltérképezés: egy kérdéshez jellemzően egy-két oldalletöltés tartozik, valós időben.

Hogyan működik

A felhasználó beilleszt egy linket a ChatGPT-be, vagy a modell dönt úgy, hogy megnézi a forrást. Ekkor indul egy hagyományos HTTP-kérés a szervered felé. A kérés User-Agent fejlécében ott a ChatGPT-User token és az +https://openai.com/bot hivatkozás. A forgalom az OpenAI által publikált IP-tartományokból érkezik, ezek JSON-ban letölthetők és ellenőrizhetők.

Miben más, mint a többi OpenAI-bot

Az OpenAI három külön néven jár az oldaladon, és mindháromnak más a célja:

  • GPTBot: modelltanításhoz gyűjt tartalmat, ütemezetten, nagy mennyiségben.
  • OAI-SearchBot: a ChatGPT keresési indexét építi és frissíti.
  • ChatGPT-User: egyetlen felhasználói kérésre reagál, itt és most.

Ezért külön is engedélyezhető vagy tiltható mindhárom. A logika mögötte a tréning-bot vs kereső-bot különbsége, és ugyanez igaz a többi szolgáltató lekérőire is az AI-crawlerek (GPTBot, ClaudeBot, PerplexityBot és társaik) között.

Mikor számít igazán

Akkor, amikor egy ügyfél a te linkeddel megy a ChatGPT-hez. Ha a szervered visszautasítja a kérést, a modell annyit válaszol, hogy nem tudta megnyitni az oldalt. Ugyanezen a néven érkeznek az AI-ügynökök is, amikor egy űrlapot vagy egy termékoldalt akarnak végigjárni. A riportokban ezt látjuk a leggyakrabban: a tiltás nem szándékos, hanem egy WAF-szabály mellékhatása.

Mit néz ebből a riport

Az audit a saját lekéréseivel és a robots.txt kiértékelésével nézi meg, hogy a ChatGPT-User token engedélyezett-e. Külön jelzi, ha a robots.txt engedné, de a szerver vagy a védelmi réteg mégis hibakóddal válaszol. Ez a két eset más javítást igényel.

Röviden: a ChatGPT-User akkor jön, amikor valaki épp rólad kérdez, ezért a blokkolása közvetlen üzleti veszteség.

Miért fontos

Az elvesztett látogató itt már döntés előtt áll

Aki a ChatGPT-be beilleszti a linkedet, az nem böngészik. Összehasonlít, árat keres, feltételeket ellenőriz. Ha a lekérés 403-mal elhasal, a modell inkább a versenytársad elérhető oldalát idézi.

A tréning-tiltás nem ugyanaz, mint az elérés-tiltás

Sok oldal a GPTBot tiltása közben véletlenül a ChatGPT-Usert is kizárja. A tartalmad így sem a tanításba nem kerül be, sem a válaszokba. Ez a legrosszabb kombináció, mert csak a hátrányt hozza.

Üzleti hatás

  • Kevesebb márkaemlítés és hivatkozás a generatív válaszokban.
  • Az ügynöki vásárlási folyamatok félbeszakadnak a kosár előtt.
  • A hallucináció esélye nő: friss adat híján a modell régi vagy idegen forrásból dolgozik.

A GEO szempontjából ez alapfeltétel. Hiába jó a szöveged, ha a lekérő be sem jut.

Kikre vonatkozik

Vonatkozik rá minden nyilvános oldal, amelyet ügyfél, partner vagy újságíró beilleszthet egy AI-chatbe. Különösen fontos a webshopoknál, a szolgáltatásoldalaknál és az ár- vagy feltétel-jellegű aloldalaknál.

Kiemelten érinti:

  • azokat az oldalakat, amelyek előtt Cloudflare, WAF vagy bot-védelem van;
  • a webshopokat, ahol egy AI-ügynök (agent) végigmenne a kosáron;
  • a B2B-oldalakat, ahol az ajánlatkérés előtt ellenőriznek.

Nem releváns a staging és fejlesztői környezeteknél, a belépés mögötti felületeknél, valamint az adminfelületeknél. Ezeket továbbra is zárva kell tartani, és a noindex, meta robots és X-Robots-Tag vagy a jelszavas védelem a helyes eszköz rájuk.

Hogyan ellenőrzöd

  1. Nyisd meg a https://oldalad.hu/robots.txt címet a böngészőben. Keress rá a ChatGPT-User és a User-agent: * blokkokra.
  2. Futtass egy lekérést a bot fejlécével curl-lel, és nézd meg a státuszkódot.
  3. Ismételd meg a fontos aloldalakkal is: főoldal, egy szolgáltatásoldal, egy termékoldal, a kapcsolat.
  4. Nézd meg a szerver hozzáférési logját, és szűrj a ChatGPT-User szövegre. Így látod a valódi forgalmat és a rájuk adott válaszkódokat.
  5. Ha van bot-védelmed, ellenőrizd a szabálylistát. A Cloudflare esetében az AI-botokra vonatkozó kapcsoló és a Bot Fight Mode a két tipikus tettes.
  6. Teszteld élesben: kérd meg a ChatGPT-t, hogy foglalja össze egy konkrét aloldaladat.

Jó jel

  • A curl-lekérés HTTP/2 200 választ ad, és a HTML tartalmazza a fő szöveget.
  • A robots.txt nem tiltja a ChatGPT-User tokent.
  • A logban szerepelnek 200-as ChatGPT-User kérések az OpenAI IP-tartományaiból.

Rossz jel

  • 403, 429 vagy 503 státusz, esetleg egy JavaScript-alapú ellenőrző oldal HTML-je.
  • A böngészőben látott tartalom eltér a bot által kapottól. Ez már cloaking kockázat.
  • Disallow: / a ChatGPT-User blokkban vagy a * blokkban.
  • A ChatGPT azt válaszolja, hogy nem tudta megnyitni a linket.

Hogyan javítod

WordPress

  1. Ha statikus robots.txt fájl van a gyökérben, szerkeszd azt. Ha nincs, a Yoast vagy a Rank Math robots.txt-szerkesztőjét használd.
  2. Vedd ki a ChatGPT-User tokent a tiltások közül, vagy tedd egyértelművé az Allow: / sorral.
  3. Nézd át a biztonsági bővítmény (Wordfence, iThemes, All In One WP Security) bot- és rate limit szabályait.
  4. Ellenőrizd a .htaccess fájlt: a régi user agent alapú tiltások gyakran itt maradnak.

Shopify

  1. A témában hozd létre vagy szerkeszd a robots.txt.liquid sablont a Edit code menüben.
  2. A generált szabályokhoz adj hozzá saját blokkot, majd ellenőrizd a publikált robots.txt-t.
  3. A bot-védelmi és tűzfal-kiegészítőknél nézd meg, van-e AI-bot szűrés.

Unas

  1. Az adminban a keresőoptimalizálási beállításoknál keresd a robots.txt tartalmát.
  2. Ha nincs szerkeszthető mező, kérd az ügyfélszolgálattól a szabály módosítását.
  3. Teszteld a végeredményt a publikus /robots.txt címen.

Shoprenter

  1. Az adminban a SEO-beállítások között szerkeszd a robots.txt tartalmát.
  2. Ügyelj rá, hogy a kosár és a fiók tiltása maradjon meg, csak a bot-tiltást oldd fel.
  3. Mentés után frissítsd a gyorsítótárat, és ellenőrizd a publikus fájlt.

Egyedi fejlesztés

  1. A webszerver konfigjában keresd az if ($http_user_agent ...) vagy BrowserMatch szabályokat.
  2. A Cloudflare WAF-ban a menedzselt AI-bot szabályt állítsd Allow értékre a ChatGPT-User esetén.
  3. Ha rate limitet használsz, adj a lekérőnek reális keretet. Egy felhasználói kérés általában kevés letöltéssel jár.
  4. A robots.txt fájlt a gyökérben, text/plain típussal, 200-as kóddal szolgáld ki.
  5. Frissítés után futtasd újra a curl-tesztet minden érintett sablontípuson.

Gyakori hibák

  • Mindent egy kalap alá venni: a GPTBot tiltása mellé odakerül a ChatGPT-User is, így a saját ügyfeled sem éri el a linket a chatben.
  • Néma WAF-blokk: a robots.txt engedi, a tűzfal mégis 403-at ad, és erről sehol nincs visszajelzés.
  • JavaScript-függő tartalom: a lekérő a nyers HTML-t kapja, a fő szöveg viszont csak kliensoldalon jelenik meg.
  • Agresszív rate limit: néhány kérés után 429 jön, pedig a bot nem terhel komolyan.
  • Eltérő tartalom botnak és embernek: ez cloaking, és a keresőknél is büntethető.
  • Elfelejtett örökölt szabály: egy régi .htaccess user agent tiltás évekig a helyén marad, senki nem nézi.
  • Robots.txt rossz válaszkóddal: a fájl 404-et vagy HTML hibaoldalt ad vissza, így a szabályok kiértékelése is bizonytalan.

Technikai példa

Különválasztott engedélyezés a robots.txt fájlban. A tréninghez nem adsz tartalmat, a kereséshez és a felhasználói lekéréshez igen:

User-agent: GPTBot
Disallow: /

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /
Disallow: /kosar/
Disallow: /fiok/

User-agent: *
Disallow: /wp-admin/

Sitemap: https://pelda.hu/sitemap.xml

Ellenőrzés a bot fejlécével. A válasz első sorában 200-at akarsz látni, nem 403-at vagy 429-et:

curl -sI -A "Mozilla/5.0 (compatible; ChatGPT-User/1.0; +https://openai.com/bot)" \
  https://pelda.hu/szolgaltatasok

# és a tényleges HTML-tartalom első sorai:
curl -s -A "Mozilla/5.0 (compatible; ChatGPT-User/1.0; +https://openai.com/bot)" \
  https://pelda.hu/szolgaltatasok | head -n 40

Ha a head kimenetében csak egy ellenőrző oldal vagy üres váz látszik, a lekérő sem lát többet.

Gyakori kérdések

Ha tiltom a ChatGPT-Usert, azzal védem a tartalmamat a tanítástól?
Nem. A modelltanításhoz a GPTBot gyűjt, a ChatGPT-User pedig egy konkrét felhasználói kérésre tölti le az oldalt. A kettőt külön tokennel kezelheted a robots.txt-ben. A ChatGPT-User tiltása csak annyit ér el, hogy az érdeklődő nem kap rólad információt.
Honnan tudom, hogy valóban az OpenAI lekérője járt nálam?
A user agent önmagában hamisítható. Az OpenAI publikálja a botjai IP-tartományait JSON formátumban, ezeket összevetheted a logban szereplő címekkel. Ha az IP nem szerepel a listán, akkor egy másik fél használja a nevet.
Megterheli a szerveremet ez a forgalom?
Általában nem. Egy felhasználói kérdéshez jellemzően néhány oldalletöltés tartozik, nem folyamatos feltérképezés. Ha mégis sok kérést látsz, az inkább az ügynöki használatra utal, és egy ésszerű rate limit elég a kezelésére.
Lefuttatja a JavaScriptet az oldalamon?
Erre nem érdemes építeni. Biztonságosabb feltételezés, hogy a lényegi tartalom a szerver által küldött HTML-ben van. Szerveroldali renderelés vagy statikus tartalom esetén nincs kockázat, kliensoldali betöltésnél viszont könnyen üres oldalt lát a lekérő.
Mi a helyes beállítás egy webshopnál?
Engedd a kategória- és termékoldalakat, a blogot és a tájékoztató oldalakat. A kosarat, a pénztárat és a fiókfelületet nyugodtan tiltsd, ezeket a kosár- és pénztároldalak kezelése miatt amúgy sem akarod látni a válaszokban.

Források

Kapcsolódó fogalmak

A te oldaladon hogy áll a(z) „ChatGPT-User”?

Futtass egy GEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes GEO-audit indítása