Navigare cu filtre

Cunoscut și ca: navigare fațetată, filtrare fațetată, navigare prin filtre, filtre ecommerce, faceted navigation, faceted search, Faceted Navigation
Ce este navigarea cu filtre?
Pe scurt
Navigarea cu filtre, numită și navigare fațetată, permite vizitatorilor să schimbe lista de produse, articole sau evenimente prin selectarea unor atribute. Implementarea bazată pe parametri URL poate genera foarte multe combinații și URL-uri. Fără reguli clare, acestea pot consuma resurse de crawling și pot încetini descoperirea paginilor utile.
Cum funcționează
Navigarea cu filtre permite restrângerea sau reorganizarea unei liste pe baza atributelor disponibile. Într-un magazin online, utilizatorul poate filtra produsele după culoare, mărime sau tip. O implementare obișnuită adaugă selecțiile în URL sub forma unor parametri:
/produse?culoare=verde&marime=mare
Fiecare schimbare a parametrilor poate afișa un alt set de produse. Deoarece filtrele pot fi combinate, site-ul poate genera un spațiu foarte mare de URL-uri. Crawlerele nu pot stabili utilitatea unui URL înainte de a-l accesa. Astfel, ele pot solicita numeroase pagini filtrate fără valoare distinctă și pot descoperi mai lent paginile noi sau actualizate.
Controlul URL-urilor filtrate
Dacă paginile filtrate nu trebuie să apară în Google Search, crawlingul lor poate fi blocat prin reguli robots.txt. O altă opțiune este folosirea fragmentelor URL pentru filtre. Google Search nu folosește, în general, fragmentele pentru crawling și indexare, iar conținutul diferențiat numai prin fragmente nu este tratat ca pagini distincte.
Elementul rel="canonical" poate indica versiunea preferată a unei pagini similare sau duplicate. Totuși, pentru reducerea crawlingului URL-urilor fațetate, Google precizează că această metodă este, în general, mai puțin eficientă pe termen lung decât metodele recomandate pentru prevenirea crawlingului.
Dacă paginile filtrate trebuie să poată fi accesate și indexate, URL-urile trebuie construite consecvent. Parametrii ar trebui să folosească formatul ?cheie=valoare și separatorul &. Ordinea filtrelor codificate în calea URL trebuie să rămână stabilă. Filtrele duplicate trebuie evitate.
O combinație fără rezultate, duplicată sau lipsită de sens trebuie să returneze starea HTTP 404 la URL-ul solicitat, fără redirecționare către o pagină comună de eroare.
De ce contează în SEO?
Impactul asupra SEO clasic
Navigarea cu filtre influențează modul în care crawlerele găsesc și solicită paginile unui magazin online. O structură necontrolată poate crea multe URL-uri alternative pentru același conținut sau pentru liste foarte asemănătoare. Googlebot poate accesa aceste versiuni înainte de a determina că nu sunt utile, ceea ce adaugă încărcare pe server și poate încetini descoperirea URL-urilor importante.
Controlul trebuie stabilit în funcție de rolul fiecărei pagini filtrate. URL-urile fără valoare pentru căutare pot fi excluse de la crawling. Paginile care trebuie indexate au nevoie de URL-uri persistente, legături interne consecvente și elemente canonice coerente. URL-ul folosit în linkurile interne, sitemap și rel="canonical" trebuie să fie consecvent. Paginile indexabile ar trebui să aibă un element canonical autoreferențial.
Impactul asupra vizibilității în motoarele AI
Extrasele furnizate nu stabilesc un efect al navigării cu filtre asupra vizibilității în sisteme bazate pe inteligență artificială. Nu se pot formula concluzii sau garanții despre această vizibilitate pe baza surselor disponibile.
Ca principiu tehnic, alegerea filtrelor care pot fi accesate și indexate trebuie făcută în funcție de utilitatea reală a paginilor și de gestionarea eficientă a crawlingului, fără multiplicarea inutilă a URL-urilor.
Exemplu
Un magazin românesc de îmbrăcăminte are categoria:
https://www.exemplu.ro/tricouri
Utilizatorii pot selecta culoarea și mărimea:
https://www.exemplu.ro/tricouri?culoare=verde&marime=mare
Dacă magazinul nu dorește indexarea combinațiilor filtrate, poate limita crawlingul parametrilor prin robots.txt:
user-agent: Googlebot
disallow: /*?*culoare=
disallow: /*?*marime=
Pagina de categorie și paginile individuale ale produselor rămân accesibile. Dacă o combinație precum culoare=verde&marime=inexistenta nu produce rezultate, URL-ul respectiv returnează starea HTTP 404, fără redirecționare către categoria generală.
Dacă o anumită pagină filtrată trebuie păstrată ca pagină indexabilă, aceasta folosește un URL persistent. Același URL este utilizat în linkurile interne, sitemap și elementul rel="canonical".
Cum verifici?
- Selectează fiecare filtru și notează URL-ul generat. Verifică dacă folosește formatul
?cheie=valoareși separatorul&. - Aplică aceleași filtre în ordine diferită. Confirmă că site-ul nu creează URL-uri alternative pentru aceeași selecție.
- Verifică dacă parametrii duplicați sau combinațiile fără rezultate returnează starea HTTP
404. - Inspectează sursa HTML și compară elementul
rel="canonical"cu URL-ul stabilit ca versiune preferată. - Compară URL-urile din linkurile interne, sitemap și elementele canonice. Acestea trebuie folosite consecvent.
- Verifică fișierul
robots.txtși confirmă că regulile blochează numai parametrii care nu trebuie accesați de Googlebot. - Rulează un crawl tehnic al site-ului pentru a verifica URL-urile filtrate, elementele canonice, duplicatele și răspunsurile HTTP.
Ce trebuie să faci?
- Inventariază filtrele și combinațiile de URL-uri pe care le pot genera.
- Decide ce pagini filtrate au conținut util și trebuie să poată fi indexate.
- Blochează prin
robots.txtcrawlingul URL-urilor fațetate care nu trebuie să apară în Google Search. - Folosește parametri în formatul
?cheie=valoareși separă-i cu&. - Păstrează o ordine logică stabilă dacă filtrele sunt incluse în calea URL.
- Elimină parametrii temporari și filtrele duplicate din legăturile interne.
- Folosește consecvent URL-ul preferat în linkuri interne, sitemap și
rel="canonical". - Returnează starea HTTP
404pentru combinațiile fără rezultate sau lipsite de sens.
Greșeli frecvente
- Permiterea crawlingului tuturor combinațiilor de filtre, deși majoritatea nu trebuie indexate.
- Folosirea `robots.txt` ca metodă de canonicalizare, deși acesta controlează crawlingul, nu alegerea URL-ului canonical.
- Generarea mai multor URL-uri pentru aceeași combinație prin schimbarea ordinii filtrelor.
- Redirecționarea combinațiilor fără rezultate către o pagină generală în locul unui răspuns HTTP `404`.
- Declararea unui URL canonical, dar folosirea altor versiuni în linkurile interne sau în sitemap.
Perspectiva SEO 365
Recomandăm separarea filtrelor utile pentru căutare de combinațiile create doar pentru interacțiunea utilizatorului. Stabilim mai întâi ce URL-uri trebuie să rămână accesibile și indexabile, apoi configurăm crawlingul și canonicalizarea. Evităm folosirea elementului canonical ca unic mecanism pentru controlul unui spațiu foarte mare de URL-uri.