Faceted navigation in online stores: filters that don’t hurt SEO

  • Home
  • Faceted navigation in online stores: filters that don’t hurt SEO
Faceted navigation in online stores: filters that don’t hurt SEO

Tysiące adresów z parametrami filtrów w Search Console? Zwykle to znak, że roboty Google marnują czas na przeglądanie kolejnych kombinacji filtrów. Kary za to nie ma. Da się to uporządkować kilkoma decyzjami technicznymi. Nawigacja fasetowa ułatwia klientom zakupy, ale puszczona samopas produkuje prawie nieskończoną liczbę podstron. Niżej odpowiadam na trzy pytania: które filtry zablokować, które zostawić i jakich narzędzi Google do tego użyć.

Czym jest nawigacja fasetowa i skąd biorą się tysiące adresów z parametrami?

Nawigacja fasetowa to zestaw filtrów, które zmieniają widok listy produktów, na przykład według kategorii, koloru albo rozmiaru. Najczęściej działa przez parametry doklejane do adresu, typu ?color=czarny&size=m. I tu zaczyna się kłopot. Każdy wybrany filtr, a także każda kombinacja filtrów, to osobny URL. Wystarczy kilka cech po kilkanaście wartości, a liczba możliwych adresów rośnie lawinowo. Google nazywa to nieskończoną przestrzenią adresów. Większość tych stron pokazuje w sumie te same produkty, więc sklep sam sobie robi duplikację treści.

Czy adresy filtrów w Search Console to problem dla SEO sklepu?

Kary nie będzie, ale budżet na crawlowanie idzie w błoto. Tłumaczą to wytyczne Google dotyczące nawigacji fasetowej: robot nie wie, czy nowy adres się do czegoś przyda, dopóki go nie odwiedzi. Przegląda więc masę wariantów, zanim uzna je za bezużyteczne. W branży mówi się na to overcrawling, czyli nadmierne crawlowanie. Co z tego wynika w praktyce?

  • nowe produkty i kategorie są wykrywane wolniej, bo robot siedzi w filtrach,
  • serwer renderuje tysiące wersji tej samej listy i zużywa na to moc obliczeniową,
  • raporty puchną od adresów, które nic nie dają widoczności sklepu.

Indeksowanie filtrów produktów: kiedy blokować, a kiedy zostawić?

Jeśli strony z filtrami nie muszą być w wynikach wyszukiwania, zablokuj ich crawlowanie. A jeśli mają tam trafiać? Wtedy muszą spełniać dobre praktyki Google. Zanim zdecydujesz, odpowiedz sobie uczciwie na trzy pytania:

  • Czy ktoś faktycznie wyszukuje taką kombinację, na przykład konkretny kolor w danej kategorii?
  • Czy strona z filtrem ma unikalną wartość, czy tylko przestawia te same produkty?
  • Czy tę samą listę można już zobaczyć pod adresem bez filtrów?

Dokumentacja Google zaleca, żeby dla robota otwarte zostały strony pojedynczych produktów i jedna lista wszystkich produktów bez filtrów. Tyle. Każdy dodatkowy wariant, który zostawisz, to kolejne obciążenie serwera. Moim zdaniem lepiej zacząć od minimum i dokładać tylko to, co naprawdę ma sens.

Jak zablokować filtry w robots.txt i kiedy wystarczą fragmenty URL?

Google wskazuje dwie metody, które w długim okresie sprawdzają się najlepiej: reguły disallow w robots.txt dla parametrów filtrów albo filtry oparte na fragmentach URL (to część adresu po znaku #). Blokowanie w robots.txt to cztery kroki:

  1. Spisz parametry filtrów, które pojawiają się w raportach Search Console.
  2. Dodaj reguły disallow dla każdego z nich.
  3. Zostaw regułę allow dla listy wszystkich produktów.
  4. Upewnij się, że strony produktów i kategorii nadal są dostępne dla robota.

Przykład na bazie dokumentacji:

user-agent: Googlebot
disallow: /*?*products=
disallow: /*?*color=
disallow: /*?*size=
allow: /*?products=all$

Fragmenty URL, takie jak #products=fish&color=green, na crawlowanie nie wpływają w ogóle. Ani na plus, ani na minus. Jeśli projektujesz nowe filtry albo przebudowujesz stare, to dobry moment, żeby o nich pomyśleć.

Canonical w sklepie internetowym i nofollow: sygnały pomocnicze

Atrybuty rel=”canonical” i rel=”nofollow” podpowiadają Google, które adresy są preferowane. Ale według dokumentacji w długim okresie działają słabiej niż robots.txt i fragmenty URL. Canonical na wersji z filtrem, wskazujący listę bez filtrów, może z czasem ograniczyć crawlowanie adresów niekanonicznych. Z czasem. Nie od razu. No i robot i tak musi wejść na stronę, żeby canonical w ogóle odczytać. Nofollow na linkach do filtrów? Spoko jako dodatkowy sygnał, który wspiera resztę, tylko nie rób z niego jedynego zabezpieczenia, gdy parametrów jest dużo.

Od czego zacząć porządki z filtrami w swoim sklepie?

Najpierw spis parametrów i decyzja, które filtry mają być indeksowane. Dopiero potem ruszasz robots.txt i canonicale. Samo wdrożenie zależy od platformy, bo każdy silnik buduje adresy filtrów po swojemu. Inaczej konfiguruje się sklepy oparte na WooCommerce, a inaczej wdrożenia sklepów na PrestaShop. Dopiero planujesz sklep? To pomyśl o filtrach już przy wyborze silnika (później jest drożej). Przyda się poradnik o tym, jak przebiega wybór platformy sklepu internetowego. A gdy adresów są dziesiątki tysięcy albo nie masz pewności, co da się bezpiecznie zablokować, zleć techniczny audyt SEO sklepu.

Dobrze ustawiona nawigacja fasetowa robi dwie rzeczy naraz: kupujący szybko znajdują produkt, a roboty nie grzęzną w filtrach.

Najczęstsze pytania

Czy filtry w sklepie szkodzą pozycjom w Google?

Same filtry nie. Kłopotem jest ogromna liczba adresów, która zjada czas robota i obciąża serwer. Przez to nowe produkty mogą być wykrywane później.

Czy wystarczy ustawić canonical na stronach filtrów?

Canonical pomaga, ale według Google w długim okresie działa słabiej niż robots.txt. Przy dużej liczbie adresów z parametrami lepiej zablokować parametry, a canonical traktować jako sygnał dodatkowy.

Czy mogę zablokować wszystkie filtry w robots.txt?

Tak, jeśli strony z filtrami nie są Ci potrzebne w wynikach wyszukiwania. Jeden warunek: strony produktów i lista wszystkich produktów bez filtrów muszą zostać dostępne dla robota. Po zmianie zajrzyj do Search Console i sprawdź, czy nie zablokowałeś czegoś ważnego.

Book a free consultation

Provide your phone number or schedule a meeting