Az indexelés az a folyamat, amikor a kereső a már letöltött oldalt feldolgozza, és felveszi a saját adatbázisába, az indexbe. Ami nincs az indexben, az nem jelenhet meg találatként, és jellemzően a generatív válaszokban sem.
Hogyan működik
Az út három lépésből áll, és mindegyiken el lehet bukni:
- Feltérképezés: a robot letölti az URL-t. Erről bővebben a crawl (feltérképezés) szól.
- Renderelés: a kereső lefuttatja a JavaScriptet, és megnézi, mi lesz a látható tartalom.
- Indexelés: a kereső eldönti, hogy eltárolja-e az oldalt, és milyen URL alatt.
A harmadik lépés nem automatikus. A Google akkor is dönthet a kihagyás mellett, ha az oldal technikailag hibátlan. Vékony, duplikált vagy értéktelen tartalmat egyszerűen nem tárol el.
Indexelve nem egyenlő rangsorolva
Ez a leggyakoribb félreértés. Az index egy raktár, a rangsorolás pedig a sorrend, amit a kereső a raktárból összeállít. Az indexelés csak a belépő. Sok oldal indexelve van, mégsem hoz forgalmat, mert semmilyen kérdésre nem ő a legjobb válasz.
A másik irány rosszabb: ha az oldal kimarad az indexből, a legjobb tartalom is láthatatlan. A riportokban ezt látjuk a legtöbb hirtelen forgalomesés mögött.
Mit jelent ez a generatív keresőknek
Az AI-válaszok jelentős része él keresőindexre épülő visszakeresésből. Ha egy oldal nincs az indexben, akkor nincs miből idézni. A modellek ettől még ismerhetik a márkádat a tréningadatból, de forrásként nem hivatkoznak rád. Ez a különbség a felbukkanás és a linkelt említés között.
Röviden: az indexelés a minimum, nem a cél. Nélküle nincs találat, de önmagában nem hoz forgalmat.
Technikai példa
Indexelés tiltása HTML-ben, canonical címmel együtt:
<head>
<meta name="robots" content="noindex, follow">
<link rel="canonical" href="https://pelda.hu/szolgaltatasok/">
</head>
A noindex, follow azt jelenti: az oldal ne kerüljön az indexbe, de a linkjeit a robot kövesse. Nem HTML fájloknál (PDF, kép) fejlécből kell tiltani:
HTTP/1.1 200 OK
Content-Type: application/pdf
X-Robots-Tag: noindex
Gyors ellenőrzés parancssorból:
curl -sI https://pelda.hu/szolgaltatasok/ | grep -i -E 'HTTP/|x-robots-tag|location'
A válaszban HTTP/2 200 szerepeljen, és ne legyen x-robots-tag: noindex sor. Ha location fejlécet látsz, az oldal átirányít, és az indexbe a célcím kerül.
Gyakori kérdések
Mennyi idő alatt kerül be egy új oldal az indexbe?
Aktív, rendszeresen frissülő oldalon jellemzően néhány nap. Új domainen vagy ritkán frissülő oldalon ez hetekre nyúlhat. A Search Console URL-ellenőrzésében kért indexelés gyorsíthat, de nem garantál semmit. Tömeges beküldésre ne használd, arra a sitemap való.
Miért nem indexeli a Google az oldalamat, ha nincs rajta noindex?
A leggyakoribb ok a tartalom minősége. A „Feltérképezve, jelenleg nincs indexelve” üzenet azt jelenti, hogy a Google látta, de nem tartotta elég értékesnek. Ilyenkor egyedi, önálló tartalomra van szükség, nem technikai javításra. Másik gyakori ok, hogy egy canonical címke máshova mutat.
Ha indexelve van, miért nincs forgalmam?
Mert az indexelés csak a belépő. A sorrendet a rangsorolás dönti el, ami több száz jeltől függ. Nézd meg a Search Console teljesítmény riportjában, milyen kifejezésekre jelensz meg, és hányadik helyen.
Hogyan veszek ki egy oldalt az indexből gyorsan?
Tedd rá a noindex meta taget vagy az X-Robots-Tag fejlécet, és hagyd feltérképezhetőnek. Sürgős esetben a Search Console Eltávolítások eszközével kérhetsz ideiglenes, körülbelül 6 hónapos elrejtést. Az ideiglenes eltávolítás nem pótolja a noindexet, csak időt vesz.
Az AI-válaszokhoz is kell az indexelés?
A keresőre épülő generatív válaszokhoz igen, mert azok visszakeresett forrásokból dolgoznak. Index nélkül nem leszel idézhető forrás linkkel együtt. A modellek tréningadatából ettől még felbukkanhat a márkád, de az nem hoz kattintást.