A szöveg / HTML arány azt mutatja meg, hogy a letöltött HTML-forráskód hány százaléka valódi, olvasható szöveg, és hány százaléka kód. Egyszerű osztás: a tagek nélküli szöveg mérete osztva a teljes HTML méretével.
Hogyan számolják
A mérőeszközök nagyjából ugyanazt csinálják. Letöltik a nyers HTML-t, kiveszik belőle a <script> és <style> blokkokat, majd eltávolítják a tageket. Ami marad, az a szöveg. A maradék bájtokat elosztják a teljes fájl méretével.
Fontos, hogy ez a nyers forráskódra vonatkozik, nem a megjelenített oldalra. Ha a tartalom JavaScriptből érkezik, az arány nagyon alacsony lesz, pedig a látogató sok szöveget olvas.
Mit jelent ez a keresőknek és a modelleknek
Önmagában nem rangsoroló tényező, és egyetlen kereső sem ígért jobb pozíciót magasabb arányért. Tünet, nem betegség. Az alacsony érték általában két dolog egyikét jelzi: felesleges kódot cipel az oldal, vagy tényleg kevés rajta a tartalom.
A nyelvi modelleknél ez élesebben jelentkezik. Egy AI-crawler véges mennyiségű HTML-t dolgoz fel egy oldalról. Ha az első több száz kilobájt inline stílus és beágyazott script, a lényeg hátrébb csúszik vagy kimarad.
Mikor számít igazán
A 3 százalék alatti arány szinte mindig kódfelesleget takar. Ilyenkor érdemes az HTML-méretet és az inline CSS mennyiségét is megnézni. A riportokban a magyar KKV-oldalak többsége 4 és 15 százalék között mozog, ami rendben van.
Akkor gond, ha az alacsony arány mellé rövid, semmitmondó szöveg társul. Az már vékony tartalom (thin content), és azt a keresők is, a modellek is büntetik.
Mit néz ebből a riport
Az audit letölti a nyers HTML-t, és kiszámolja a szöveg arányát. Alacsony hatású, kód hatókörű szabály. Az ajánlás mindig ugyanaz: növeld a valódi szöveges tartalom arányát a kódhoz képest.
Röviden: az alacsony szöveg / HTML arány nem hiba, hanem jelzés, hogy vagy túl sok a kód, vagy túl kevés a mondanivaló.