Az oldalméret (HTML-méret) az a bájtban mért adatmennyiség, amit a szerver egyetlen dokumentum kérésére válaszul küld vissza. A képek és a külső fájlok nem tartoznak bele: azok önálló kérések, saját mérettel.
Hogyan működik
A böngésző lekéri az URL-t, a szerver visszaküldi a HTML-forrást. Ebből épül fel a DOM, és minden további kérés innen indul. Két számot érdemes megkülönböztetni:
- nyers méret: a dokumentum tényleges bájtszáma tömörítés nélkül,
- átvitt méret: amit a gzip vagy brotli tömörítés után tényleg letölt a kliens.
Szöveges tartalomnál a tömörítés gyakran 70-85 százalékot visz le. Ettől még a nyers méret számít, mert a böngészőnek ki kell tömörítenie és elemeznie az egészet.
Mennyi a sok
Átlagos tartalmi oldalon a nyers HTML 30-80 kilobájt körül mozog. 100 kilobájt alatt nincs teendő. 300 kilobájt fölött szinte mindig beágyazott stílus, beágyazott szkript vagy base64-be kódolt kép van a forrásban. Az indexelés ezen ritkán bukik el: a Googlebot egy HTML-fájlból az első 15 megabájtot tölti le. A valódi kár a feldolgozásnál jelentkezik, nem a letöltésnél.
Miért más ez a generatív keresőknek
A nyelvi modellek betápláló pipeline-jai a nyers HTML-ből nyerik ki a szöveget. Ha egy 400 kilobájtos forrásban 5 kilobájt az értékes mondat, akkor a szöveg/HTML arány rossz. A kinyert tartalom hígul, a tartalmi zaj nő. A riportokban ezt látjuk a legtöbb page builderrel épített oldalon.
Röviden: a HTML-méret önmagában ritkán kritikus, de megbízható jelzés arról, mennyi felesleg maradt a dokumentumban.