Alapok Szakszó

Indexelés

Szerző: · 7 perc olvasás · Frissítve:
Indexelés - Alapok (szakszó) a tudástárban
Indexelés - Alapok | eClick GEO-audit tudástár

Az indexelés az a folyamat, amikor a kereső a már letöltött oldalt feldolgozza, és felveszi a saját adatbázisába, az indexbe. Ami nincs az indexben, az nem jelenhet meg találatként, és jellemzően a generatív válaszokban sem.

Hogyan működik

Az út három lépésből áll, és mindegyiken el lehet bukni:

  1. Feltérképezés: a robot letölti az URL-t. Erről bővebben a crawl (feltérképezés) szól.
  2. Renderelés: a kereső lefuttatja a JavaScriptet, és megnézi, mi lesz a látható tartalom.
  3. Indexelés: a kereső eldönti, hogy eltárolja-e az oldalt, és milyen URL alatt.

A harmadik lépés nem automatikus. A Google akkor is dönthet a kihagyás mellett, ha az oldal technikailag hibátlan. Vékony, duplikált vagy értéktelen tartalmat egyszerűen nem tárol el.

Indexelve nem egyenlő rangsorolva

Ez a leggyakoribb félreértés. Az index egy raktár, a rangsorolás pedig a sorrend, amit a kereső a raktárból összeállít. Az indexelés csak a belépő. Sok oldal indexelve van, mégsem hoz forgalmat, mert semmilyen kérdésre nem ő a legjobb válasz.

A másik irány rosszabb: ha az oldal kimarad az indexből, a legjobb tartalom is láthatatlan. A riportokban ezt látjuk a legtöbb hirtelen forgalomesés mögött.

Mit jelent ez a generatív keresőknek

Az AI-válaszok jelentős része él keresőindexre épülő visszakeresésből. Ha egy oldal nincs az indexben, akkor nincs miből idézni. A modellek ettől még ismerhetik a márkádat a tréningadatból, de forrásként nem hivatkoznak rád. Ez a különbség a felbukkanás és a linkelt említés között.

Röviden: az indexelés a minimum, nem a cél. Nélküle nincs találat, de önmagában nem hoz forgalmat.

Miért fontos

SEO

Az index a keresés alapja. Ha a fontos oldalaid kimaradnak, a hirdetésen kívül nincs más csatornád a keresőben. A legdrágább hiba az, amikor egy noindex, meta robots és X-Robots-Tag felkerül egy éles kategóriaoldalra, és hetekig ott marad.

AI-értelmezhetőség

A generatív keresők nagy része létező keresőindexből dolgozik, amikor forrást keres egy válaszhoz. Index nélkül nem leszel idézhető forrás. A márkád szerepelhet a válaszban, de link és kattintás nélkül.

Üzleti következmények

  • Egy nem indexelt termékkategória bevételkiesés, nem technikai apróság.
  • Az indexelési hibák halmozódnak: ami ma 5 URL, az egy rossz sablon miatt holnap 5000.
  • A visszaállás lassú. Az újraindexelés napokig, nagyobb oldalon hetekig tart.

A magyar KKV-oldalak többségén nem a tartalom a szűk keresztmetszet, hanem az, hogy a jó tartalom rossz URL alatt vagy sehogy sem kerül be az indexbe.

Kikre vonatkozik

Kikre vonatkozik

  • Minden nyilvános weboldalra, ahol a keresőből érkező forgalom számít.
  • Webshopokra fokozottan: ott több ezer URL sorsa dől el sablonszinten.
  • Blogokra, tudástárakra, szolgáltatásoldalakra, ahol a tartalom a termék.
  • Többnyelvű oldalakra, ahol a nyelvi változatok külön URL-ek.

Kikre nem

  • Staging és fejlesztői környezetre: ott a cél épp a kizárás, jelszóval vagy noindex, meta robots és X-Robots-Tag fejléccel.
  • Belső rendszerekre, admin felületekre, ügyfélportálokra.
  • Kosár-, pénztár- és köszönőoldalakra, szűrt listanézetekre.
  • Egyedi tokenes oldalakra, például letöltési vagy jelszóvisszaállító linkekre.

Ha egy oldal nem tud önálló válasz lenni egy keresésre, nem is kell az indexbe.

Hogyan ellenőrzöd

Lépések

  1. Nyisd meg a Google Search Console fiókot, és keresd az Oldalak (Page indexing) riportot. Itt látod az indexelt és a kihagyott URL-ek számát, okok szerint bontva.
  2. Használd az URL-ellenőrzés eszközt egy konkrét címre. A válasz vagy „Az URL szerepel a Google-ban”, vagy egy kizárási ok.
  3. Kattints az „Indexelt oldal tesztelése” gombra. Itt látod a renderelt HTML-t, tehát azt, amit a Google valóban feldolgozott.
  4. Nézd meg a nyers választ: curl -sI https://pelda.hu/oldal megmutatja a státuszkódot és az X-Robots-Tag fejlécet.
  5. Ellenőrizd a forrásban a <meta name="robots"> sort és a canonical címkét.
  6. Vesd össze a sitemapban szereplő URL-számot az indexelt oldalak számával.

Jó jel

  • Az indexelt oldalak száma nagyságrendileg megegyezik a valódi tartalomoldalak számával.
  • A kizárt URL-ek nagy része szándékos: szűrők, kosár, paraméteres címek.
  • Az új tartalom néhány napon belül megjelenik az indexben.
  • Az URL-ellenőrzés ugyanazt az URL-t jelöli kanonikusnak, amit te is annak szánsz.

Rossz jel

  • „Kizárva a „noindex” címke miatt” fontos oldalakon.
  • „Feltérképezve, jelenleg nincs indexelve” nagy tömegben: a Google látta, de nem tartotta érdemesnek.
  • „Alternatív oldal megfelelő kanonikus címkével” ott, ahol önálló oldalt vártál. Ilyenkor a Canonical URL beállítás téved.
  • Az indexelt oldalak száma hetek alatt jelentősen csökken.

Hogyan javítod

WordPress

  1. Beállítások > Olvasás: a „Keresőmotorok láthatósága” pipa legyen kikapcsolva. Ez a pipa az éles oldal leggyakoribb néma gyilkosa.
  2. SEO-bővítményben (Yoast, Rank Math, SEOPress) nézd át a tartalomtípusok alapbeállítását. Gyakran a címke- és szerzőarchívumok indexelhetők feleslegesen.
  3. Oldalanként ellenőrizd a „Megjelenjen a találatokban?” kapcsolót.
  4. Küldd be az XML sitemapot a Search Console-ba, és kérj újraindexelést a javított URL-ekre.

Shopify

  1. A theme.liquid fájlban keress rá a noindex szóra. A sablonok gyakran tartalmaznak feltételes kizárást kollekciókra vagy szűrt nézetekre.
  2. A jelszóvédelmet kapcsold ki, amíg aktív, a bolt nem indexelhető.
  3. A /collections/all és a szűrt URL-ek kezelését hagyd az alapértelmezett canonical logikán, ne írd felül kézzel.

Unas

  1. Admin > Beállítások > Keresőoptimalizálás: ellenőrizd a robots és a sitemap beállításokat.
  2. Nézd át, hogy a kifutó termékek státusza mit vált ki. A törölt termék 404 legyen, ne üres 200-as oldal.
  3. A szűrt listaoldalak indexelését kapcsold ki, ha nincs egyedi tartalmuk.

Shoprenter

  1. Admin > SEO beállítások: a paraméteres és lapozott URL-ek kezelését nézd át.
  2. Ellenőrizd a sablonban a robots meta tag kimenetét egy termék- és egy kategóriaoldalon.
  3. A sitemap generálást futtasd újra a nagyobb termékfeltöltések után.

Egyedi fejlesztés

  1. Tedd a robots szabályt egy központi helyre, ne szórd szét sablonokba.
  2. A staging környezetet HTTP-alapú jelszóval és X-Robots-Tag: noindex fejléccel védd. Élesítéskor mindkettőt kapcsold ki.
  3. Írj integrációs tesztet, ami az éles buildben megbukik, ha bármelyik kulcsoldal noindex fejlécet ad.
  4. Ha a tartalom JavaScriptből érkezik, ellenőrizd szerveroldali rendereléssel vagy előrenderelt HTML-lel, hogy a robot is lássa.

Mit néz ebből a riport

Az audit megnézi, hogy az oldal nem zárja-e ki magát az indexelésből robots meta taggel vagy X-Robots-Tag fejléccel. Vizsgálja a canonical cím következetességét és a sitemap meglétét is. A riport a nyilvánosan látható jeleket olvassa, a tényleges indexeltséget a Search Console mutatja meg pontosan.

Gyakori hibák

  • Az éles oldalon marad a fejlesztői noindex: a legdrágább egysoros hiba, teljes forgalomvesztéssel.
  • A robots.txt-ben tiltott URL-re tesznek noindexet: a robot nem tudja letölteni az oldalt, így a noindexet sem látja soha.
  • Az indexelést összekeverik a rangsorolással: az „indexelve van, mégsem hoz forgalmat” panasz mögött szinte mindig tartalmi ok áll.
  • Rossz canonical mutat máshova: a jó oldal eltűnik, és egy gyengébb változat marad az indexben.
  • Szűrt és paraméteres URL-ek ezrei kerülnek be: felhígítják az indexet, és elszívják a feltérképezési kapacitást.
  • A sitemapban nem létező vagy átirányított URL-ek szerepelnek: a kereső bizalma csökken a fájl iránt.
  • Csak JavaScriptből érkezik a fő tartalom: a renderelés késik vagy elmarad, az index üres vázat tárol.

Technikai példa

Indexelés tiltása HTML-ben, canonical címmel együtt:

<head>
  <meta name="robots" content="noindex, follow">
  <link rel="canonical" href="https://pelda.hu/szolgaltatasok/">
</head>

A noindex, follow azt jelenti: az oldal ne kerüljön az indexbe, de a linkjeit a robot kövesse. Nem HTML fájloknál (PDF, kép) fejlécből kell tiltani:

HTTP/1.1 200 OK
Content-Type: application/pdf
X-Robots-Tag: noindex

Gyors ellenőrzés parancssorból:

curl -sI https://pelda.hu/szolgaltatasok/ | grep -i -E 'HTTP/|x-robots-tag|location'

A válaszban HTTP/2 200 szerepeljen, és ne legyen x-robots-tag: noindex sor. Ha location fejlécet látsz, az oldal átirányít, és az indexbe a célcím kerül.

Gyakori kérdések

Mennyi idő alatt kerül be egy új oldal az indexbe?
Aktív, rendszeresen frissülő oldalon jellemzően néhány nap. Új domainen vagy ritkán frissülő oldalon ez hetekre nyúlhat. A Search Console URL-ellenőrzésében kért indexelés gyorsíthat, de nem garantál semmit. Tömeges beküldésre ne használd, arra a sitemap való.
Miért nem indexeli a Google az oldalamat, ha nincs rajta noindex?
A leggyakoribb ok a tartalom minősége. A „Feltérképezve, jelenleg nincs indexelve” üzenet azt jelenti, hogy a Google látta, de nem tartotta elég értékesnek. Ilyenkor egyedi, önálló tartalomra van szükség, nem technikai javításra. Másik gyakori ok, hogy egy canonical címke máshova mutat.
Ha indexelve van, miért nincs forgalmam?
Mert az indexelés csak a belépő. A sorrendet a rangsorolás dönti el, ami több száz jeltől függ. Nézd meg a Search Console teljesítmény riportjában, milyen kifejezésekre jelensz meg, és hányadik helyen.
Hogyan veszek ki egy oldalt az indexből gyorsan?
Tedd rá a noindex meta taget vagy az X-Robots-Tag fejlécet, és hagyd feltérképezhetőnek. Sürgős esetben a Search Console Eltávolítások eszközével kérhetsz ideiglenes, körülbelül 6 hónapos elrejtést. Az ideiglenes eltávolítás nem pótolja a noindexet, csak időt vesz.
Az AI-válaszokhoz is kell az indexelés?
A keresőre épülő generatív válaszokhoz igen, mert azok visszakeresett forrásokból dolgoznak. Index nélkül nem leszel idézhető forrás linkkel együtt. A modellek tréningadatából ettől még felbukkanhat a márkád, de az nem hoz kattintást.

Források

Kapcsolódó fogalmak

A te oldaladon hogy áll a(z) „Indexelés”?

Futtass egy GEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes GEO-audit indítása