A canonical URL az a cím, amelyet a keresők és az AI-rendszerek az adott tartalom hivatalos, elsődleges változatának tekintenek. Ha ugyanaz a tartalom több URL-en is elérhető, a <link rel="canonical"> jelöli meg, melyik verzió számít.
Hogyan működik
A canonical egy sor a HTML <head> szekciójában. Abszolút URL-t tartalmaz, protokollal és domainnel együtt. A kereső ezt nem parancsként, hanem erős jelzésként kezeli. Ha a jelzés ellentmond más jeleknek, felülbírálhatja.
A canonical több jelből álló rendszer része. Az átirányítások, a sitemap-bejegyzések, a belső linkek és a canonical együtt döntik el, mi kerül az indexbe. Az indexelés során a Google ezeket összeveti, és kiválaszt egy URL-t. Ha a jelek egymásnak feszülnek, a döntés kiszámíthatatlan lesz.
Miért más ez a generatív keresőknek
Egy nyelvi modell nem rangsorol, hanem forrást választ és idéz. Ha ugyanaz a szöveg négy URL-en fut, a hivatkozás szétszóródik. A márkaemlítés mellett a megjelenő link is fontos: rossz canonical mellett paraméteres, csúnya cím kerül a válaszba. A RAG-rendszerek indexében a duplikált változatok redundáns találatokat adnak.
Mikor számít igazán
Webshopoknál a legerősebb a hatás. Szűrők, rendezés, oldalszámozás, kampányparaméterek: mind új URL-t gyártanak. Blogoknál a kategória- és címke-archívumok okozzák ugyanezt. Statikus, néhány oldalas bemutatkozó oldalon a kockázat kicsi, de a canonical ott sem árt.
Röviden: a canonical mondja meg, melyik URL az igazi, ha ugyanaz a tartalom több címen is elérhető.
Miért fontos
SEO-hatás
A duplikált tartalom nem büntetés, hanem pazarlás. A kereső feleslegesen tölt le ugyanabból a szövegből öt változatot. A feltérképezési keret elfogy, a friss oldalak később kerülnek indexbe.
A linkerő is megoszlik. Ha az egyik változatra mutat három külső link, a másikra kettő, egyik sem lesz elég erős. A canonical összevonja ezeket a jelzéseket egy címre.
AI-értelmezhetőség
A generatív rendszerek forrásmegjelölésnél URL-t írnak ki. Paraméteres vagy duplikált cím esetén a hivatkozás hosszú és bizalmatlanságot kelt. Ami rosszabb: ha az AI a régi, nem karbantartott változatot választja, elavult árat vagy szöveget idéz.
Üzleti következmény
A riportokban ezt látjuk a leggyakrabban: egy termék négy URL-en fut, mindegyik más pozícióban. Az analitika szétesik, a kampánymérés pontatlan lesz. A Search Console „Alternatív oldal megfelelő canonical elemmel” sora hirtelen több ezer URL-t mutat, és senki nem tudja, miért.
Technikai példa
A legegyszerűbb, önhivatkozó canonical. Minden oldal saját, tiszta címére mutat:
<head>
<meta charset="utf-8">
<link rel="canonical" href="https://pelda.hu/termekek/futocipo-42">
</head>
Ez a szűrt változat ugyanarra a canonicalra mutat, így a paraméteres URL nem kerül külön az indexbe:
<!-- https://pelda.hu/termekek/futocipo-42?szin=fekete&utm_source=hirlevel -->
<link rel="canonical" href="https://pelda.hu/termekek/futocipo-42">
Nem HTML-fájloknál, például PDF-nél HTTP-fejléccel adod meg:
HTTP/1.1 200 OK
Content-Type: application/pdf
Link: <https://pelda.hu/dokumentumok/arlista.pdf>; rel="canonical"
Gyors ellenőrzés parancssorból, fejléc és HTML egyszerre:
curl -sIL https://pelda.hu/termekek/futocipo-42 | grep -i "^link:"
curl -s https://pelda.hu/termekek/futocipo-42 | grep -i "rel=.canonical"