Facettierte Navigation im Shop: Filter, die SEO nicht schaden

  • Startseite
  • Facettierte Navigation im Shop: Filter, die SEO nicht schaden
Facettierte Navigation im Shop: Filter, die SEO nicht schaden

Tausende URLs mit Filterparametern in der Search Console? Meist heißt das: Die Google-Crawler verschwenden Zeit mit immer neuen Filterkombinationen. Eine Abstrafung gibt es dafür nicht. Mit ein paar technischen Entscheidungen lässt sich das in den Griff bekommen. Facettierte Navigation erleichtert Kunden den Einkauf, erzeugt aber ohne Kontrolle eine fast unendliche Zahl von Unterseiten. Im Folgenden beantworte ich drei Fragen: Welche Filter sollten Sie blockieren, welche behalten, und welche Google-Werkzeuge helfen dabei?

Was ist facettierte Navigation und woher kommen Tausende URLs mit Parametern?

Facettierte Navigation ist eine Reihe von Filtern, die die Ansicht einer Produktliste verändern, zum Beispiel nach Kategorie, Farbe oder Größe. Meist funktioniert sie über Parameter, die an die URL angehängt werden, etwa ?color=schwarz&size=m. Und genau hier beginnt das Problem. Jeder gewählte Filter und jede Filterkombination ist eine eigene URL. Schon wenige Merkmale mit jeweils einem Dutzend Werten reichen, und die Zahl möglicher Adressen wächst lawinenartig. Google nennt das einen unendlichen URL-Raum. Die meisten dieser Seiten zeigen im Grunde dieselben Produkte, und so erzeugt der Shop selbst doppelte Inhalte im Shop.

Sind Filter-URLs in der Search Console ein SEO-Problem für den Shop?

Eine Abstrafung droht nicht, aber das Crawl-Budget wird verschwendet. Das erklären die Google-Richtlinien zur facettierten Navigation: Der Crawler weiß erst, ob eine neue URL nützlich ist, wenn er sie besucht hat. Also durchsucht er jede Menge Varianten, bevor er sie als nutzlos einstuft. In der Branche nennt man das Overcrawling, also übermäßiges Crawlen. Was bedeutet das in der Praxis?

  • neue Produkte und Kategorien werden langsamer entdeckt, weil der Crawler in den Filtern hängt,
  • der Server rendert Tausende Versionen derselben Liste und verbraucht dafür Rechenleistung,
  • Berichte blähen sich mit URLs auf, die der Sichtbarkeit des Shops nichts bringen.

Indexierung von Produktfiltern: wann blockieren, wann behalten?

Wenn Filterseiten nicht in den Suchergebnissen erscheinen müssen, blockieren Sie das Crawlen. Und wenn sie dort landen sollen? Dann müssen sie die Best Practices von Google erfüllen. Bevor Sie entscheiden, beantworten Sie sich ehrlich drei Fragen:

  • Sucht wirklich jemand nach dieser Kombination, zum Beispiel nach einer bestimmten Farbe in einer Kategorie?
  • Hat die Filterseite einen eigenen Mehrwert, oder ordnet sie nur dieselben Produkte neu an?
  • Ist dieselbe Liste bereits unter einer URL ohne Filter zu sehen?

Die Google-Dokumentation empfiehlt, für den Crawler die einzelnen Produktseiten und eine Liste aller Produkte ohne Filter offen zu lassen. Mehr nicht. Jede zusätzliche Variante, die Sie offen lassen, belastet den Server weiter. Meiner Meinung nach ist es besser, mit dem Minimum zu beginnen und nur das zu ergänzen, was wirklich Sinn ergibt.

Wie blockiert man Filter in der robots.txt und wann reichen URL-Fragmente?

Google nennt zwei Methoden, die sich langfristig am besten bewähren: disallow-Regeln in der robots.txt für Filterparameter oder Filter auf Basis von URL-Fragmenten (das ist der Teil der Adresse nach dem Zeichen #). Das Blockieren in der robots.txt erfolgt in vier Schritten:

  1. Listen Sie die Filterparameter auf, die in den Berichten der Search Console auftauchen.
  2. Fügen Sie für jeden davon eine disallow-Regel hinzu.
  3. Lassen Sie eine allow-Regel für die Liste aller Produkte stehen.
  4. Prüfen Sie, ob Produkt- und Kategorieseiten für den Crawler weiterhin erreichbar sind.

Ein Beispiel auf Basis der Dokumentation:

user-agent: Googlebot
disallow: /*?*products=
disallow: /*?*color=
disallow: /*?*size=
allow: /*?products=all$

URL-Fragmente wie #products=fish&color=green haben überhaupt keinen Einfluss auf das Crawlen. Weder positiv noch negativ. Wenn Sie neue Filter planen oder alte umbauen, ist das ein guter Zeitpunkt, darüber nachzudenken.

Canonical im Onlineshop und nofollow: unterstützende Signale

Die Attribute rel=”canonical” und rel=”nofollow” zeigen Google, welche URLs bevorzugt werden. Laut Dokumentation wirken sie langfristig aber schwächer als robots.txt und URL-Fragmente. Ein Canonical auf der gefilterten Version, das auf die Liste ohne Filter verweist, kann das Crawlen nicht kanonischer URLs mit der Zeit einschränken. Mit der Zeit. Nicht sofort. Außerdem muss der Crawler die Seite trotzdem aufrufen, um das Canonical überhaupt zu lesen. Nofollow bei Links zu Filtern? Als zusätzliches Signal, das den Rest unterstützt, ist das in Ordnung. Machen Sie es nur nicht zum einzigen Schutz, wenn es viele Parameter gibt.

Womit fangen Sie beim Aufräumen der Filter in Ihrem Shop an?

Zuerst kommen die Liste der Parameter und die Entscheidung, welche Filter indexiert werden sollen. Erst danach ändern Sie robots.txt und Canonicals. Die Umsetzung selbst hängt von der Plattform ab, denn jedes System baut Filter-URLs auf seine eigene Weise. Shops auf Basis von WooCommerce konfiguriert man anders als Shop-Projekte mit PrestaShop. Sie planen Ihren Shop erst? Dann denken Sie schon bei der Wahl des Systems an die Filter (später wird es teurer). Hilfreich ist dabei der Ratgeber zur Wahl der richtigen Shop-Plattform. Und wenn es Zehntausende URLs sind oder Sie nicht sicher sind, was sich gefahrlos blockieren lässt, beauftragen Sie ein technisches SEO-Audit für den Shop.

Eine gut eingerichtete facettierte Navigation leistet zwei Dinge gleichzeitig: Käufer finden schnell ihr Produkt, und Crawler bleiben nicht in den Filtern stecken.

Häufige Fragen

Schaden Filter im Shop den Rankings bei Google?

u003cpu003eDie Filter selbst nicht. Das Problem ist die riesige Zahl an URLs, die Zeit des Crawlers frisst und den Server belastet. Dadurch werden neue Produkte unter Umständen später entdeckt.u003c/pu003e

Reicht es, auf Filterseiten ein Canonical zu setzen?

u003cpu003eCanonical hilft, wirkt laut Google langfristig aber schwächer als robots.txt. Bei vielen URLs mit Parametern ist es besser, die Parameter zu blockieren und Canonical als zusätzliches Signal zu behandeln.u003c/pu003e

Kann ich alle Filter in der robots.txt blockieren?

u003cpu003eJa, wenn Sie die Filterseiten nicht in den Suchergebnissen brauchen. Eine Bedingung gibt es: Die Produktseiten und die Liste aller Produkte ohne Filter müssen für den Crawler erreichbar bleiben. Schauen Sie nach der Änderung in die Search Console und prüfen Sie, ob Sie nichts Wichtiges blockiert haben.u003c/pu003e

Kostenlose Beratung buchen

Geben Sie Ihre Telefonnummer an oder vereinbaren Sie einen Termin