URL paraméterek: teljes útmutató
Az URL paraméterek a webcím kérdőjel utáni részében álló kulcs-érték párok, amelyek szűrést, rendezést, lapozást, keresést vagy követést jeleznek. SEO szempontból minden eltérő paraméteres cím külön URL, ezért a paraméterek könnyen duplikált tartalmat és felesleges feltérképezést okoznak. A megoldás a paraméterek tudatos szétválogatása, egységes kezelése és rendszeres mérése.
Alapfogalmak
Egy URL paraméteres része a kérdőjellel kezdődik, és egy vagy több kulcs-érték párból áll, amelyeket az és-jel választ el. A kulcs a paraméter neve, az érték a hozzá tartozó adat, például egy szín neve, egy oldalszám vagy egy kampány azonosítója. A szerver ezek alapján dönti el, milyen tartalmat adjon vissza, vagy a böngészőben futó kód használja fel őket, például analitikai célra.
A kereső szempontjából a legfontosabb tény: két URL, amelyek csak a paraméterekben különböznek, két különböző cím. Ha a paraméter sorrendje más, ha egy paraméter üres értékkel szerepel, vagy ha a kis- és nagybetűk eltérnek, az is külön URL. A kereső nem tudja előre, hogy ezek ugyanazt a tartalmat mutatják-e, ezért le kell töltenie őket, és utána dönti el, melyiket tekinti kanonikusnak.
A paraméterek típusai
| Típus | Mire való | Változtatja-e a tartalmat | Tipikus kezelés |
|---|---|---|---|
| Követés | Kampány, forrás, hirdetés azonosítása | Nem | Canonical a paraméter nélküli URL-re, belső linkben ne szerepeljen |
| Munkamenet | Látogató azonosítása | Nem | Sütiben tárolni, ne az URL-ben |
| Rendezés | A lista sorrendje | Csak a sorrendet | Canonical az alap lapra, ne legyen követhető link |
| Szűrés | A lista szűkítése | Igen | Kiemelt kombinációk indexelhetők, a többi lezárva |
| Lapozás | A lista következő szelete | Igen | Indexelhető, önhivatkozó canonical |
| Belső keresés | Keresési kifejezés | Igen | Általában ne kerüljön indexbe, ne legyen linkelve |
| Nyelv vagy régió | Nyelvi változat | Igen | Inkább külön útvonal vagy aldomain |
Aktív és passzív paraméterek
Hasznos megkülönböztetés, hogy a paraméter megváltoztatja-e a lap tartalmát. Az aktív paraméter, mint a szűrés, a lapozás vagy a keresés, más tartalmat eredményez. A passzív paraméter, mint a követés vagy a munkamenet, ugyanazt a tartalmat adja vissza, csak más címen. A passzív paramétereknél a cél mindig az, hogy a kereső a paraméter nélküli változatot tekintse kanonikusnak. Az aktív paramétereknél a döntés attól függ, hogy a kapott tartalomnak van-e önálló keresési értéke.
Mi nem URL paraméter
A kettőskereszt utáni rész, a fragment, nem paraméter. Ezt a böngésző nem küldi el a szervernek, és a Google általában nem kezeli külön URL-ként. Az útvonal részei sem paraméterek, akkor sem, ha szűrést kódolnak. A különbség azért számít, mert a robots.txt szabályok, a canonical döntések és az analitikai szűrők is másként bánnak velük.
Honnan kerülnek paraméterek az URL-ekbe?
A paraméterek három fő forrásból érkeznek. Az első a webhely saját sablonja: szűrők, rendezés, lapozás, belső keresés. A második a külső rendszerek: hírlevélküldők, hirdetési platformok, közösségi megosztások, amelyek automatikusan követési paramétert fűznek a linkekhez. A harmadik a bővítmények és a régi rendszermaradványok, amelyek a webhely tulajdonosának tudta nélkül is létrehozhatnak paramétert. A kezelés mindhárom forrásnál más: a sablont át lehet írni, a külső forrásokat csak canonicallal lehet ellensúlyozni.
Hogyan működik?
A robot a lapokon talált linkekből gyűjti az URL-eket. Minden egyedi karaktersorozat új címnek számít, amelyet sorba állít. A paraméterek ezért két módon hatnak: sokszorozzák a feltérképezendő URL-ek számát, és szétaprózzák ugyanannak a tartalomnak a jeleit több cím között.
A sokszorozódás
Vegyünk egy kategórialapot. Ha a rendezésnek néhány változata van, a nézetnek kettő, a lapozásnak sok oldala, és ehhez szűrők is jönnek, akkor a lehetséges URL-ek száma ezek szorzata. Ha a paraméterek sorrendje nincs rögzítve, minden kombináció több sorrendben is létezik. Ehhez jönnek a követési paraméterek, amelyek külső linkekből és hirdetésekből érkeznek. Egy kategóriából így könnyen sokszor több URL lesz, mint ahány valódi tartalmi változat. Ha ez korlátlanná válik, crawl trap keletkezik.
A jelek szétaprózódása
Ha ugyanaz a tartalom több címen érhető el, a külső és belső linkek, a megosztások és a felhasználói jelek is megoszlanak közöttük. A kereső a duplikátumok közül kiválaszt egyet kanonikusnak, és a jeleket arra próbálja összevonni. Ez a választás nem mindig az, amelyet a webhely szeretne. A canonical jelzés, a belső linkek és a sitemap együtt segítik, hogy a kereső a helyes változatot válassza.
A Search Console régi paraméter eszköze
Korábban a Google Search Console-ban volt egy eszköz, ahol meg lehetett adni, melyik paraméter mit csinál, és hogyan kezelje a robot. Ezt az eszközt a Google megszüntette, azzal az indoklással, hogy a rendszer már maga is jól felismeri a paraméterek szerepét. Ez azt jelenti, hogy ma a paraméterek kezelése teljesen a webhelyen múlik: a linkek, a canonical, a robots.txt és a válaszkódok együttesén.
Példa: egy termék, sok cím
Egy termékoldal elérhető a tiszta URL-en, egy hírlevélből érkező követési paraméterrel, egy közösségi megosztásból érkező másik követési paraméterrel, egy kategórialapról átvett szín paraméterrel, és egy régi rendszerből megmaradt munkamenet-azonosítóval. Ez öt cím ugyanarra a termékre. Ha mindegyik önhivatkozó canonicalt ad, a kereső öt külön lapot lát, és a jelek öt felé oszlanak. Ha mindegyik a tiszta URL-re mutat canonicallal, és belső link csak a tiszta URL-re vezet, a jelek egy helyre futnak össze.
Fő módszerek
A paraméterek kezelése leltárral kezdődik: milyen paraméterek léteznek a webhelyen, mire valók, és honnan kerülnek a linkekbe. Enélkül minden szabály vakon születik. A leltár után minden paraméterhez egy kezelési mód tartozik.
1. Paraméterleltár
Gyűjtsd össze a paraméterneveket a szervernaplóból, egy saját crawler eredményéből és a Search Console indexelési jelentéséből. Mindegyikről jegyezd fel: aktív vagy passzív, milyen értékei vannak, melyik sablon vagy rendszer hozza létre, és kap-e belső linket. Ez a táblázat a későbbi döntések alapja, és érdemes karbantartani, mert új funkciókkal új paraméterek jelennek meg.
2. Egységes URL-képzés
- Rögzített sorrend: a rendszer mindig azonos sorrendben írja a paramétereket.
- Üres értékek elhagyása: a kiválasztás nélküli paraméter ne szerepeljen az URL-ben.
- Kisbetűs értékek: az értékek formátuma legyen következetes.
- Alapértelmezés elhagyása: ha a rendezés alapértelmezett értéke van kiválasztva, a paraméter ne jelenjen meg.
3. Belső linkek tisztán
A belső linkek mindig a kanonikus URL-re mutassanak. Követési paraméter soha ne szerepeljen belső linkben: a webhelyen belüli navigációt nem kampányként kell mérni, és ezek a linkek feleslegesen sokszorozzák a címeket. A rendezés és nézet váltását érdemes űrlapelemmel vagy gombbal megoldani, amelyből nem keletkezik követhető link.
4. Canonical, noindex, robots.txt
A passzív paraméteres URL-ek canonicalja a paraméter nélküli változatra mutasson. Azokra az aktív paraméteres URL-ekre, amelyek nem érdemesek a találatokra, de a robot már ismeri őket, a meta robots noindex jó eszköz. Azokra a mintákra, amelyekre a keresőnek soha nincs szüksége, a robots.txt Disallow szabálya csökkenti a feltérképezést. A Google és a Bing támogatja a csillag helyettesítő karaktert, így paraméterre is írható szabály. A robots.txt nem akadályozza meg, hogy egy sokat linkelt tiltott URL tartalom nélkül bekerüljön az indexbe, és a tiltott lapon a robot a noindexet sem látja.
5. Kiemelt paraméteres lapok
Ha egy szűrt kombinációnak saját keresési kereslete van, érdemes stabil, lehetőleg paraméter nélküli útvonalat adni neki, önhivatkozó canonicallal, egyedi címmel és belső linkkel. A szűrők kezelésének részleteit a faceted navigation útmutató tartalmazza, a lapozásét a pagination útmutató.
Döntési szabály
| Kérdés | Ha igen |
|---|---|
| A paraméter nem változtat a tartalmon? | Canonical a tiszta URL-re, belső linkből eltávolítani |
| Csak a sorrendet vagy a nézetet változtatja? | Canonical az alap lapra, nem követhető vezérlő |
| Más tartalmat ad, de nincs keresési értéke? | Nem követhető link, szükség esetén noindex, majd tiltás |
| Más tartalmat ad, és van keresési értéke? | Kiemelt lap, stabil URL, indexelhető |
| A lista következő oldalát adja? | Indexelhető, önhivatkozó canonical |
Gyakori hibák
A paraméterekkel kapcsolatos hibák nagy része nem egy rossz döntésből, hanem döntések hiányából fakad. Új funkció, új kampányeszköz vagy új bővítmény hoz egy új paramétert, és senki nem nézi meg, hogyan viselkedik a keresőnél.
Tévhit: a Google úgyis kitalálja
Igaz, hogy a kereső sok paramétert felismer, és a duplikátumok közül választ kanonikus változatot. De ehhez előbb le kell töltenie a változatokat, és a választás nem mindig egyezik a webhely szándékával. A tiszta belső linkek és a következetes canonical nem feleslegesek attól, hogy a kereső okos: éppen ezek adják a legerősebb jelet.
Ellenpélda: követési paraméter a belső linkekben
Egy webáruház a kezdőlap kiemelt ajánlataira követési paramétert tett, hogy mérje, melyik doboz hoz több kattintást. A paraméteres URL-ek így belső linkeket kaptak a webhely legerősebb lapjáról. A kereső ezeket a változatokat is feltérképezte, és egyes termékeknél a paraméteres címet mutatta a találatokban. Emellett az analitikában a belső kattintások kampányforgalomként jelentek meg, ami torzította a forrásadatokat. A javítás: a belső kattintások mérése eseménykövetéssel, a linkek pedig a tiszta URL-re mutattak.
További tipikus hibák
- Paraméteres URL-ek a sitemapban. Az XML sitemap csak kanonikus, indexelendő címeket tartalmazzon.
- Önhivatkozó canonical a passzív változatokon. A rendszer a canonicalt az aktuális URL-ből építi, a paraméterekkel együtt.
- Munkamenet-azonosító az URL-ben. Minden látogatás új címet hoz létre.
- Túl széles robots.txt szabály. Egy általános paramétertiltás kizárhatja a lapozást vagy a kiemelt lapokat is.
- Átirányítás paraméterrel, amely újabb paramétert fűz. Ez redirect chain vagy hurok forrása lehet.
Tévhit: a robots.txt tiltás kiveszi az URL-t az indexből
Gyakori reakció, hogy ha paraméteres URL-ek jelennek meg a találatokban, valaki gyorsan tiltást ír rájuk a robots.txt-ben. A tiltás azonban csak a letöltést akadályozza meg. A már indexelt URL-ek ettől nem tűnnek el, sőt, mivel a robot nem tölti le őket, a rajtuk lévő canonicalt és noindexet sem látja. A találatokban ilyenkor gyakran leírás nélküli bejegyzés marad. Ha a cél az indexből való kikerülés, előbb a noindex vagy a canonical dolgozzon, és a tiltás csak utána jöjjön, ha a feltérképezést is csökkenteni kell.
Ellenpélda: kis- és nagybetűs változatok
Egy katalógusoldalon a szűrők értékei hol kisbetűvel, hol nagybetűvel kerültek az URL-be, attól függően, melyik sablon generálta a linket. A szerver mindkét változatra ugyanazt a tartalmat adta vissza, de a kereső két külön címet látott. A crawler több száz ilyen párt talált. A javítás egy egységesítő szabály volt: a rendszer minden értéket kisbetűvel ír, és a nagybetűs változatok 301 átirányítással a kisbetűsre mutatnak.
Mérés
A paraméterek mérése két kérdésre ad választ: mennyi robotfigyelmet visznek el a paraméteres URL-ek, és melyik változatot választja a kereső kanonikusnak. Mindkettőhöz paraméternév szerint bontott adatok kellenek.
Szervernapló
A keresőrobotok kéréseit bontsd paraméternév szerint. Nézd meg, melyik paraméter viszi a legtöbb kérést, és hány egyedi értéke fordul elő. Ha egy passzív paraméter, például egy követési azonosító, sok robotkérést kap, akkor valahol linkelve van, és meg kell találni, honnan. Ha egy aktív paraméter egyedi értékeinek száma folyamatosan nő, az csapdára utalhat.
Search Console
Az indexelési jelentés "Duplikált, a felhasználó nem jelölt ki canonical oldalt" és "Duplikált, a Google más canonical oldalt választott, mint a felhasználó" csoportjai mutatják, hol nem egyezik a kereső döntése a webhely szándékával. Az URL-vizsgálat eszközzel egy-egy paraméteres URL-ről megnézheted, melyik változatot választotta a Google kanonikusnak. A teljesítményjelentésben URL-szűrővel ellenőrizhető, megjelennek-e paraméteres címek a találatokban.
Saját crawler
A crawler megmutatja, hol keletkeznek paraméteres belső linkek, milyen canonicalt adnak ezek a lapok, és van-e köztük olyan, amely noindexet és robots.txt tiltást egyszerre kap. Érdemes a crawlert úgy is lefuttatni, hogy a paraméteres URL-eket nem követi, és összevetni a két eredményt: a különbség mutatja, mennyi URL-t termelnek a paraméterek.
Kidolgozott példa
Egy utazási webhely naplóelemzése szerint a robotkérések jelentős része paraméteres URL-ekre ment. A paraméterleltár hét paraméternevet talált: kettő követési volt, egy munkamenet, kettő rendezés, egy szűrés és egy lapozás. A munkamenet-azonosító sütibe került, a követési paraméterek eltűntek a belső linkekből, a rendezésre és a követésre canonical került a tiszta URL-re, a szűrés két keresett kombinációja pedig saját útvonalat kapott. A következő hetekben a mérés a paraméteres kérések arányát és a Search Console duplikált csoportjait követte. A tanulság a sorrend: leltár, forrás megszüntetése, jelek tisztázása, csak végül tiltás.
Ellenőrzőlista
- Van-e naprakész paraméterleltár, típussal és kezelési móddal?
- A paraméterek sorrendje rögzített, az üres értékek elmaradnak?
- A belső linkek a kanonikus URL-re mutatnak, követési paraméter nélkül?
- A passzív paraméteres változatok canonicalja a tiszta URL?
- A sitemapban csak kanonikus URL-ek vannak?
- Nincs olyan URL, amelyen noindex és robots.txt tiltás egyszerre van?
- A naplóban csökken a paraméteres robotkérések aránya?
Kapcsolódó részletes útmutatók
Csináltassuk meg helyetted
Ha ez sok, mi elvégezzük. Egy munkanapon belül konkrét ajánlatot kapsz.