Technikai alapok Útmutató

Technikai alapok: amit egy weboldalnak tudnia kell

Szerző: · 8 perc olvasás · Frissítve:
Technikai alapok: amit egy weboldalnak tudnia kell - Technikai alapok (útmutató) a tudástárban
Technikai alapok: amit egy weboldalnak tudnia kell - Technikai alapok | eClick GEO-audit tudástár

A technikai alapok azok a szerver- és HTML-szintű feltételek, amelyek nélkül egy weboldalt sem a keresőrobotok, sem a nyelvi modellek nem tudnak megbízhatóan beolvasni. Ez a réteg a tartalom alatt helyezkedik el: még azelőtt eldől, hogy bárki elolvasná az első mondatot.

A legtöbb ilyen szabály egyszerű igen-nem kérdés. Vagy 200-as a válasz, vagy nem. Vagy van canonical, vagy nincs. Épp ezért gyorsan ellenőrizhető és gyorsan javítható terület.

Mi tartozik ide

  • Elérés és biztonság: HTTPS érvényes tanúsítvánnyal, a kezdőoldal 200-as státuszkódja, stabil válaszidő, egyetlen végleges domain-változat.
  • Feltérképezés és indexelés: robots.txt, XML sitemap, Canonical URL címek, noindex, meta robots és X-Robots-Tag jelölések, soft-404 kezelés.
  • Dokumentum-váz: doctype, charset, viewport, nyelvi jelölés, favicon, belső linkek, alt szövegek.
  • Kódhigiénia: elavult HTML-tagek, inline CSS, nyílt szöveges e-mail cím, W3C-validáció, használaton kívüli shop-plugin, böngészős jó gyakorlatok.

Hogyan működik a gépi olvasás

A robot mindig ugyanabban a sorrendben halad. Először feloldja a domaint, majd HTTP-kérést küld. Utána megnézi a robots.txt tartalmát, és csak ezután tölti le a HTML-t.

Minden lépés kapu. Ha a tanúsítvány lejárt, nincs második esély a tartalomra. Ha a robots.txt tilt, a legszebb szöveg sem jut el sehová. A riportokban ezt látjuk a leggyakrabban: nem a tartalommal van baj, hanem azzal, hogy oda sem ér a robot.

Fontossági sorrend

  1. Kapu-szabályok: elérhetőség, HTTPS, a kezdőoldal státusza, robots.txt, noindex, domain-átirányítás. Ezek bármelyike nullázza a többit.
  2. Értelmezés: canonical, sitemap, doctype, charset és viewport, lang attribútum, soft-404.
  3. Tartalmi kapcsolódás: belső linkek, alt szövegek, favicon.
  4. Higiénia: elavult tagek, inline CSS, W3C-hibák, nyílt e-mail cím, felesleges shop-plugin.

Előbb mindig felfelé haladj a listán. Alt szövegeket javítani lejárt tanúsítvány mellett értelmetlen munka.

Miért más ez a generatív keresőknek

A klasszikus keresőrobot türelmes. Visszajön holnap, rendereli a JavaScriptet, kijavítja magában a rossz HTML-t. Az AI-crawlerek jóval szigorúbbak.

Sok nyelvi modell nyers HTML-t dolgoz fel, futtatott JavaScript nélkül. Ilyenkor a szerkezet maga a jelentés. A hiányzó lang attribútum, a szétesett címhierarchia vagy a canonical nélküli duplikátum közvetlenül rontja a kinyert információ pontosságát.

Mit néz ebből a riport

Az audit Technikai alapok területe húsz szabályt futtat le a kezdőoldalon és a kiszolgáló válaszán. A riport kapu-szabályként kezeli a HTTPS-t, a státuszkódot, a robots.txt-t és a noindex jelölést: ezek bukása lehúzza a teljes eredményt. A többi szabály pontlevonással jelenik meg, hatás szerint besorolva.

Röviden: a technikai alapok nem rangsoroló tényezők, hanem belépőjegy. Amíg ez nincs rendben, minden más befektetés kisebb hozamot hoz.

Miért fontos

SEO-hatás

Egy rosszul beállított noindex vagy egy tiltó robots.txt napok alatt kiviszi az oldalt az indexből. A visszaszerzés hetekig tart. A lejárt tanúsítvány pedig azonnali figyelmeztetést kap a böngészőben, és a látogatók nagy része visszalép.

AI-értelmezhetőség

A nyelvi modellek a struktúrából olvassák ki, miről szól az oldal. Hiányzó lang attribútum mellett a modell találgatja a nyelvet. Canonical nélküli duplikátumoknál nem tudja, melyik a hiteles cím.

Üzleti következmény

A technikai hibák költsége nem lineáris. Egy hiba a kapu-szabályok között a teljes organikus forgalmat elviheti. Ugyanakkor a javítás általában olcsó: legtöbbször néhány óra fejlesztői munka vagy egy plugin-beállítás.

Idő

A technikai alapok karbantartás nélkül romlanak. A tanúsítvány lejár, a plugin elavul, a migráció után bent marad a staging noindex. Érdemes negyedévente újranézni.

Kikre vonatkozik

Mindenkire vonatkozik

  • Bemutatkozó oldalak, blogok, szolgáltatásoldalak.
  • Webshopok, ahol a duplikált szűrő-URL-ek miatt a canonical különösen kritikus.
  • Több nyelven futó oldalak, ahol a nyelvi jelölés és a hreflang együtt dolgozik.
  • Landing oldalak, ha organikus forgalmat is kapnak.

Ahol más a mérce

  • Staging és fejlesztői környezet: ott a noindex és a robots.txt tiltás a helyes állapot. A baj az, ha ez élesben is bennmarad.
  • Zárt, belépéshez kötött rendszerek: ügyfélportál, admin felület. Ezeket nem kell indexelni, de a HTTPS és a biztonsági beállítások itt is kötelezőek.
  • Kampány-mikrosite: ha szándékosan kimarad a keresőből, akkor a szándékot dokumentáld, különben a következő audit hibának veszi.

A magyar KKV-oldalak többségén a technikai alapok fele rendben van, a másik fele pedig sosem volt beállítva. Nem romlásról van szó, hanem hiányról.

Hogyan ellenőrzöd

Lépések

  1. Nyisd meg a kezdőoldalt inkognitó ablakban. Nézd meg a lakat ikont és a tanúsítvány lejáratát.
  2. Futtasd le: curl -sSI https://pelda.hu/. A státuszkód és a fejlécek azonnal látszanak.
  3. Hívd le a https://pelda.hu/robots.txt címet. Keress Disallow: / sort.
  4. Hívd le a sitemap URL-t a robots.txt-ből. Ellenőrizd, hogy XML-t ad vissza, nem 404-et.
  5. A böngésző devtools Elements fülén nézd meg a <head> elejét: doctype, charset, viewport, lang, title, canonical.
  6. Keress rá a forráskódban a noindex szóra. Ellenőrizd az x-robots-tag fejlécet is.
  7. Kérj le egy biztosan nem létező URL-t, például /nincs-ilyen-oldal-123. A válasz 404 legyen, ne 200.
  8. Nézd meg a Search Console Oldalak jelentését. Az indexelésből kizárt okok listája megmutatja a rendszerszintű hibákat.
  9. Futtass egy Lighthouse mérést. A Best Practices és az SEO kategória a kódhigiéniát mutatja.

Jó jel

  • HTTP/2 vagy HTTP/3, 200 státusz a kezdőoldalon.
  • A négy domain-változat egyetlen címre mutat 301-gyel.
  • Önhivatkozó canonical minden indexelendő oldalon.
  • <html lang="hu"> a forrás elején.
  • Nem létező URL-en valódi 404-es kód.

Rossz jel

  • Vegyes tartalom figyelmeztetés a konzolon.
  • Disallow: / élesben, vagy teljesen hiányzó robots.txt.
  • Sitemap, amiben http-s vagy átirányított URL-ek szerepelnek.
  • Minden oldalon ugyanaz a canonical cím.
  • 200-as válasz a hibaoldalon, vagyis soft-404.

Hogyan javítod

WordPress

  1. Beállítások / Olvasás alatt vedd ki a „Keresőmotorok tiltása” pipát.
  2. Beállítások / Általános: a WordPress-cím és a webhelycím is https-sel kezdődjön.
  3. SEO-pluginban kapcsold be az önhivatkozó canonicalt, és add meg a sitemap indexet.
  4. Nézd át a plugin listát. A kikapcsolt, de telepített webshop-bővítményt töröld, ne csak deaktiváld.
  5. Frissíts PHP-t és sablont. Az elavult tagek nagy része régi sablonból jön.

Shopify

  1. A HTTPS és a canonical alapból megoldott, ezt nem kell építeni.
  2. Online Store / Preferences: itt tiltsd le vagy engedélyezd a keresőmotorok indexelését.
  3. A theme.liquid fájlban ellenőrizd a <html lang> értékét és a viewport metát.
  4. A robots.txt a robots.txt.liquid sablonnal szabható. Csak indokolt esetben nyúlj hozzá.
  5. Töröld a nem használt alkalmazásokat, mert a maradék scriptjeik bennmaradnak a forrásban.

Unas

  1. A vezérlőpultban ellenőrizd a saját domain beállítását és az SSL állapotát.
  2. Kapcsold be a sitemap generálást, majd ellenőrizd a kimenetet böngészőben.
  3. A kategória- és szűrőoldalak indexelési szabályait állítsd be, hogy ne keletkezzen duplikátum.
  4. A sablonszerkesztőben nézd meg a fejléc metatagjeit és a nyelvi beállítást.

Shoprenter

  1. Beállítások alatt ellenőrizd az SSL-t és a fő domain átirányítását.
  2. A sitemap modult kapcsold be, majd add meg a címét a Search Console-ban.
  3. A szűrt listaoldalakra állíts canonicalt a kategória alapcímére.
  4. A sablon fejlécében pótold a hiányzó viewport és charset sorokat.

Egyedi fejlesztés

  1. A webszerveren kényszerítsd a HTTPS-t 301-es átirányítással, majd kapcsold be a HSTS fejlécet.
  2. A négy domain-változatból válassz egy kanonikusat, a többi egy lépésben oda irányítson.
  3. A hibakezelőben adj vissza valódi 404-es és 410-es kódot, ne 200-as oldalt.
  4. A canonical címet a routerből generáld, ne kézzel írd be a sablonba.
  5. Építsd be a sitemap generálást a deploy folyamatba, lastmod értékkel.
  6. Tedd be a Lighthouse futtatást a CI-be, és bukjon a build, ha a Best Practices érték a küszöb alá esik.

Gyakori hibák

  • Bennmaradt staging noindex: élesítés után hetekig senki nem veszi észre, közben eltűnik az oldal az indexből.
  • Mindenhol ugyanaz a canonical: a kezdőoldalra mutató globális canonical az összes aloldalt kiüti a találatokból.
  • Soft-404 hibaoldal: a nem létező cím 200-as kóddal válaszol, így a kereső valós tartalomnak hiszi az üres oldalt.
  • Több lépcsős átirányítás: a http és a www külön ugrásban oldódik fel, ami feleslegesen fogyasztja a crawl keretet.
  • Sitemap régi URL-ekkel: átirányított vagy törölt címek maradnak benne, ami rontja a fájl hitelességét.
  • Hiányzó lang attribútum: a gép nem tudja biztosan, milyen nyelvű a szöveg, és rosszul illeszti a kérdésekhez.
  • Nyílt szöveges e-mail cím a forrásban: a spamrobotok pillanatok alatt begyűjtik, utána a postafiók használhatatlan lesz.

Technikai példa

A szerver válasza a leggyorsabb diagnózis. Ez a parancs megmutatja a státuszkódot és a fontos fejléceket:

curl -sSI https://pelda.hu/

Egy egészséges válasz így néz ki:

HTTP/2 200
content-type: text/html; charset=utf-8
strict-transport-security: max-age=31536000; includeSubDomains
x-content-type-options: nosniff

Ha itt x-robots-tag: noindex sort látsz, az oldal fejléc szinten van kizárva az indexből. Ez a hiba a HTML-ben nem látszik.

A dokumentum-váz minimuma egy indexelhető kezdőoldalon:

<!DOCTYPE html>
<html lang="hu">
<head>
  <meta charset="utf-8">
  <meta name="viewport" content="width=device-width, initial-scale=1">
  <title>Egyedi konyhabútor Szegeden | Példa Kft.</title>
  <link rel="canonical" href="https://pelda.hu/">
  <link rel="icon" href="/favicon.ico" sizes="any">
  <meta name="robots" content="index, follow">
</head>

A charset és a viewport az első 1024 bájtba kerüljön. A canonical abszolút, https-sel kezdődő cím legyen.

Gyakori kérdések

Mennyi idő alatt javítható a technikai alapok nagy része?
A kapu-szabályok általában egy nap alatt rendezhetők. A HTTPS, az átirányítás és a noindex javítása beállítás kérdése, nem fejlesztésé. A kódhigiénia, például az inline CSS kiszervezése vagy a validációs hibák javítása, sablonmunkát igényel. Ez jellemzően néhány nap.
Számít-e még a W3C-validáció, ha a böngészők a hibás HTML-t is megjelenítik?
A böngészők valóban javítanak a hibákon, de nem minden feldolgozó teszi ezt. A nyelvi modellek és az egyszerűbb feldolgozók gyakran nyers HTML-t olvasnak. Egy lezáratlan elem ott összecsúsztathatja a tartalmat. A validáció ezért higiéniai szabály, nem rangsoroló tényező.
Rontja-e a helyezést, ha hiányzik a favicon?
Közvetlenül nem. A favicon a találati listában és a böngésző fülén jelenik meg, tehát márkafelismerést segít. Hiánya apró bizalmi jel, ezért alacsony hatású tételként kezeljük. Javítása viszont perces munka.
Miért kritikus a soft-404, ha a látogató úgyis látja, hogy nincs tartalom?
A látogató és a robot mást lát. Ha a szerver 200-as kóddal válaszol, a kereső valós oldalnak veszi az üres tartalmat. Így üres oldalak kerülnek az indexbe, ami hígítja a domain megítélését. A helyes válasz a 404-es vagy a 410-es kód.
Elég-e egyszer beállítani ezeket?
Nem. A tanúsítvány lejár, a plugin elavul, a migráció után bennmaradnak a régi beállítások. Érdemes negyedévente újrafuttatni az ellenőrzést, és minden nagyobb változtatás után is. A folyamat nagy része automatizálható.

Források

Kapcsolódó fogalmak

Nézd meg, hogy áll ebben a te weboldalad

Futtass egy SEO-auditot: pontszám, fejlesztői ítélet, a leggyorsabb javítások, és minden tételhez bizonyíték.

Ingyenes SEO-audit indítása