A noindex egy indexelési utasítás, amely megtiltja a keresőknek, hogy az adott oldalt felvegyék a találati listájukba. Kétféleképpen adhatod meg: HTML-ben a <meta name="robots" content="noindex"> tagben, vagy HTTP-válaszban az X-Robots-Tag: noindex fejlécben.
Hogyan működik
A robot letölti az oldalt, és elolvassa az utasítást. Ha noindexet talál, kiveszi az oldalt az indexből, vagy be sem teszi. A linkeket közben követheti, hacsak nem írsz mellé nofollow értéket.
Három helyen érdemes keresni:
<meta name="robots">: minden keresőrobotnak szól<meta name="googlebot">: csak a Google-nek szól, felülírja az általánosatX-Robots-TagHTTP-fejléc: HTML-en kívüli fájlokra is működik, például PDF-re vagy képre
Fontos csapda: a noindex csak akkor érvényesül, ha a robot be tudja tölteni az oldalt. Ha a robots.txt letiltja a feltérképezést, a robot el sem jut a meta tagig. Ilyenkor az URL bent maradhat az indexben, leírás nélkül. Az indexelés és a feltérképezés két külön lépés.
Miért más a generatív keresőknek
A noindex nem tünteti el a tartalmat a szerverről. Csak azt tiltja, hogy találati listában megjelenjen. A generatív keresők és az asszisztensek nagyrészt keresőindexre támaszkodnak, amikor forrást keresnek egy válaszhoz. Ha az oldalad nincs indexben, gyakorlatilag nem létezik forrásként.
Mit néz ebből a riport
Az audit a HTML-ben a meta robots és a meta googlebot tagot is beolvassa, a válaszfejlécekben pedig az X-Robots-Tag értéket. Ha bármelyikben noindex szerepel, figyelmeztetést kapsz. Ez nem bukó szabály, mert stagingen a noindex szándékos és helyes. Éles oldalon viszont ez az első dolog, amit meg kell nézned.
Röviden: a noindex azt mondja a keresőnek, hogy ne listázza az oldalt, és éles oldalon ez szinte mindig hiba.