Dein Shop hat 500 Produkte, aber die Search Console zeigt 12.000 gecrawlte URLs, die Hälfte davon mit dem Hinweis „Duplikat, vom Nutzer nicht als kanonisch festgelegt“ oder „Gecrawlt, zurzeit nicht indexiert“. Das ist der Normalzustand bei Onlineshops, und der Grund ist immer derselbe: Das Shopsystem erzeugt für jede Variante, jeden Filter, jede Sortierung und jede Seite der Paginierung eine eigene URL, und auf den meisten steht fast dasselbe.
Dieser Artikel zeigt dir, wo Duplicate Content im Onlineshop entsteht, wie du ihn findest, welche Lösung zu welchem Fall passt und wie Shopify und WooCommerce mit dem Thema umgehen. Dazu der Sonderfall kopierter Herstellertexte, der in Nischen wie Vape und CBD besonders verbreitet ist, weil viele Shops dieselben Marken führen.
Was Duplicate Content ist und warum Google ihn nicht mag
Von Duplicate Content, auf Deutsch doppelte Inhalte, spricht man, wenn identischer oder sehr ähnlicher Inhalt unter mehreren URLs erreichbar ist. Das kann innerhalb deiner Domain passieren, etwa dasselbe Produkt unter zwei Pfaden, oder domainübergreifend, etwa derselbe Herstellertext in 200 Shops.
Google hat mehrfach gesagt, dass es keine Strafe für Duplicate Content gibt, solange keine Täuschungsabsicht vorliegt. Das Problem ist ein anderes: Google muss entscheiden, welche der Versionen es in den Index aufnimmt und rankt. Trifft Google diese Entscheidung selbst, fällt sie oft anders aus als gewünscht. Dann rankt die Variante in Größe XL statt der Hauptproduktseite, oder die gefilterte Kategorie statt der eigentlichen. Die drei konkreten Folgen:
- Crawl-Budget: Google besucht pro Tag eine begrenzte Zahl deiner URLs. Verbringt der Crawler seine Zeit mit 10.000 Filter-Kombinationen, kommt er seltener zu den Produktseiten, die tatsächlich neu oder geändert sind.
- Verteilte Signale: Links und Nutzersignale, die auf drei URL-Versionen derselben Seite treffen, stärken keine davon richtig.
- Falsche Auswahl: Google wählt eine Version als kanonisch, die keinen Kategorietext hat, eine unpassende Sortierung zeigt oder auf Seite 3 der Paginierung liegt.
Wo Duplicate Content im Onlineshop entsteht
| Quelle | Beispiel | Typisch bei | Lösung |
|---|---|---|---|
| Produktvarianten | /produkt/vaporizer?variant=123 für jede Farbe | Shopify, Shopware | Canonical auf Hauptprodukt |
| Mehrere Pfade zum Produkt | /collections/vaporizer/products/mighty und /products/mighty | Shopify | Canonical, im Theme nur einen Pfad verlinken |
| Filter | /liquids?nikotin=3mg&marke=xy | alle Systeme | Canonical auf Kategorie oder Noindex, wichtige Filter als eigene Seite |
| Sortierung | /liquids?sort=preis-aufsteigend | alle Systeme | Canonical auf Kategorie |
| Paginierung | /liquids?page=2, ?page=3 | alle Systeme | Selbstreferenzierender Canonical pro Seite, kein Canonical auf Seite 1 |
| Tags und Schlagwörter | /produkt-tag/bio, /produkt-tag/vegan | WooCommerce | Noindex oder gezielt als Landingpage ausbauen |
| Tracking-Parameter | ?utm_source=newsletter, ?fbclid= | alle Systeme | Canonical ohne Parameter |
| www und ohne www, http und https, Slash am Ende | shop.at/produkt und shop.at/produkt/ | WooCommerce, Eigenentwicklungen | 301-Weiterleitung auf eine Version |
| Kopierte Herstellertexte | Dieselbe Produktbeschreibung in 200 Shops | alle Systeme | Eigene Texte für umsatzstarke Produkte |
| Ähnliche Produkte | Liquid in 10 ml und 50 ml als eigene Produkte mit gleichem Text | alle Systeme | Zusammenlegen als Varianten oder Texte differenzieren |
Duplicate Content finden: Die Prüfung in vier Schritten
Bevor du doppelte Inhalte vermeiden kannst, musst du wissen, wo sie auf deiner Webseite entstehen. Als Betreiber hast du dafür vier Wege, die keine Programmierkenntnisse brauchen.
- Search Console, Bericht Seitenindexierung: Die Kategorien „Duplikat, vom Nutzer nicht als kanonisch festgelegt“, „Duplikat, Google hat eine andere Seite als kanonisch ausgewählt“ und „Alternative Seite mit richtigem kanonischen Tag“ zeigen dir, welche URL-Muster betroffen sind. Klicke in jede Kategorie und schau dir die Beispiel-URLs an.
- site-Abfrage bei Google: Mit site:deinshop.at inurl:sort oder site:deinshop.at inurl:variant siehst du, welche Parameter-URLs im Index gelandet sind.
- Crawl mit Screaming Frog oder Sitebulb: Der Crawler listet alle erreichbaren URLs, ihre Canonical-Tags, doppelte Titel und doppelte Beschreibungen. Der Filter „Duplicate“ unter Content zeigt Seiten mit fast identischem Text.
- Stichprobe bei Herstellertexten: Kopiere einen Satz aus einer Produktbeschreibung in Anführungszeichen in die Google-Suche. Erscheinen 50 andere Shops mit demselben Satz, ist der Text kein Unterscheidungsmerkmal.
Der Canonical-Tag: Das wichtigste Werkzeug
Der Canonical-Tag ist eine Zeile im Head-Bereich einer Seite, die Google sagt: „Die Hauptversion dieser Seite liegt unter dieser URL.“ Die Suchmaschine folgt dem Hinweis in den meisten Fällen, fasst die Signale der Duplikate auf der kanonischen URL zusammen und zeigt nur diese in den Ergebnissen. Der Tag ist ein Hinweis, keine Anweisung, und Google ignoriert ihn, wenn die Seiten zu unterschiedlich sind oder der Hinweis widersprüchlich ist.
Die Regeln, die in der Praxis am häufigsten verletzt werden:
- Jede indexierbare Seite hat genau einen Canonical-Tag, der auf sich selbst zeigt, wenn sie die Hauptversion ist.
- Der Canonical zeigt auf eine erreichbare URL mit Status 200, nicht auf eine Weiterleitung oder eine Noindex-Seite.
- Filter- und Sortier-URLs zeigen auf die ungefilterte Kategorie.
- Varianten-URLs zeigen auf die Hauptproduktseite.
- Paginierte Seiten zeigen auf sich selbst, nicht auf Seite 1. Ein Canonical von Seite 2 auf Seite 1 sagt Google, Seite 2 sei eine Kopie, und die Produkte auf Seite 2 werden schlechter gefunden.
- Canonical und interne Verlinkung stimmen überein. Wenn du überall auf /collections/x/products/y verlinkst, der Canonical aber /products/y nennt, sendest du widersprüchliche Signale.
Wie du den Canonical-Tag in der Praxis setzt und welche Fehler bei Shopify typisch sind, zeigt das folgende Video.
Paginierung richtig lösen
Paginierung ist der Fall, bei dem am meisten falsch gemacht wird. Eine Kategorie mit 300 Liquids auf 15 Seiten hat 15 URLs mit demselben Kategorietext, aber unterschiedlichen Produkten. Diese Seiten sind kein Duplicate Content im engeren Sinn, denn die Produkte unterscheiden sich. Google muss sie crawlen können, um alle Produkte zu finden.
Die richtige Umsetzung 2026:
- Jede paginierte Seite bekommt einen selbstreferenzierenden Canonical, also Seite 2 auf Seite 2.
- Der Kategorietext steht nur auf Seite 1 oder ist auf den Folgeseiten gekürzt, damit die Seiten sich unterscheiden.
- Titel der Folgeseiten enthalten die Seitenzahl: „Liquids, Seite 2 von 15“.
- Die Links zu den Folgeseiten sind normale, crawlbare HTML-Links, kein reiner „Mehr laden“-Button per JavaScript.
- Die Attribute rel=“prev“ und rel=“next“ nutzt Google nicht mehr als Signal, sie schaden aber auch nicht.
- Folgeseiten nicht auf Noindex setzen, sonst verlieren die Produkte auf Seite 2 bis 15 ihre interne Verlinkung aus der Kategorie.
Ein Zwischenweg, der bei großen Kategorien gut funktioniert: mehr Produkte pro Seite, etwa 48 statt 24, und Unterkategorien, die die Zahl der Seiten pro Kategorie reduzieren. Eine Kategorie „Liquids“ mit 300 Produkten wird zu „Liquids mit Nikotin“, „Nikotinfreie Liquids“, „Nikotinsalz“ und „Shortfills“ mit je 50 bis 100 Produkten, jede mit eigenem Text und eigenem Keyword.
Das folgende Video erklärt den Zusammenhang zwischen Paginierung und Canonical-Tag noch einmal im Detail.
Filter und Sortierung: Was indexiert werden soll und was nicht
Filter erzeugen die meisten URLs. Eine Kategorie mit fünf Filtern zu je vier Werten ergibt theoretisch über tausend Kombinationen. Die Regel: Filter-URLs bekommen einen Canonical auf die ungefilterte Kategorie, es sei denn, der Filter entspricht einer echten Suchanfrage mit Volumen.
Beispiele aus der Praxis:
- „Liquids 3 mg Nikotin“ wird gesucht. Dieser Filter verdient eine eigene, indexierbare Seite mit eigenem Titel, eigenem Text und einem selbstreferenzierenden Canonical.
- „Liquids sortiert nach Preis aufsteigend“ wird nicht gesucht. Canonical auf die Kategorie.
- „CBD-Öl 10 Prozent“ wird gesucht. Eigene Seite oder Unterkategorie.
- „CBD-Öl Marke X 10 Prozent 30 ml“ wird kaum gesucht. Canonical auf die Kategorie oder auf die 10-Prozent-Seite.
Technisch gibt es zwei Wege, wichtige Filter indexierbar zu machen: als statische Unterkategorie mit eigener URL, was bei allen Systemen funktioniert, oder als Filter-Landingpage, bei der das System für bestimmte Kombinationen eine saubere URL und eigene Meta-Daten erzeugt. Bei Shopify sind das meist zusätzliche Kollektionen, bei WooCommerce Unterkategorien oder Attribut-Archive. Welche Filter das Volumen rechtfertigen, ergibt die Keyword-Recherche für Onlineshops.
Duplicate Content bei Shopify
Shopify setzt automatisch Canonical-Tags, und in vielen Fällen sind sie richtig. Drei Punkte solltest du trotzdem prüfen:
- Kollektions-Pfade zu Produkten: Shopify verlinkt Produkte aus Kollektionen standardmäßig unter /collections/kollektion/products/produkt und setzt den Canonical auf /products/produkt. Der Canonical ist richtig, aber die interne Verlinkung zeigt auf die nicht-kanonische Version. Im Theme lässt sich das ändern, indem Produktlinks auf product.url ohne Kollektionsbezug gesetzt werden. Dann stimmen Verlinkung und Canonical überein.
- Varianten-URLs: Der Parameter ?variant= erzeugt für jede Variante eine URL. Der Canonical zeigt auf das Produkt ohne Parameter, das ist korrekt. Problematisch wird es, wenn Themes oder Apps Varianten als eigene Produkte anlegen, um sie einzeln in Kollektionen zu zeigen.
- Paginierung von Kollektionen: Ältere Themes setzen den Canonical aller Seiten auf Seite 1. Das ist der Fehler, den das Video oben erklärt. Aktuelle Themes setzen den selbstreferenzierenden Canonical korrekt, prüfen solltest du es trotzdem im Quelltext von Seite 2 einer großen Kollektion.
Weitere Shopify-Besonderheiten, etwa Tag-Seiten von Kollektionen und die Suchseite, behandeln wir im Shopify SEO Guide.
Duplicate Content bei WooCommerce
WooCommerce und WordPress erzeugen andere Duplikat-Quellen, und die Lösung liegt meist in einem SEO-Plugin wie Yoast oder Rank Math plus Einstellungen im Shop.
- Produkt-Tags und Attribut-Archive: Jeder Produkt-Tag und jedes Attribut kann ein eigenes Archiv mit URL erzeugen. Bei 200 Tags sind das 200 dünne Seiten mit Produktlisten ohne Text. Entweder auf Noindex setzen oder die wenigen Tags mit Suchvolumen als Landingpage mit Text ausbauen.
- Filter-Plugins: Plugins für Ajax-Filter erzeugen Parameter-URLs oder sprechende Pfade. Prüfe, ob der Canonical auf die Kategorie zeigt und die Filter-URLs nicht in der Sitemap landen.
- Sortier-Parameter: ?orderby=price und ähnliche Parameter brauchen einen Canonical auf die Kategorie. Yoast erledigt das in der Regel automatisch.
- Kategorie in der Produkt-URL: Die Permalink-Einstellung entscheidet, ob Produkte unter /produkt/name oder /kategorie/name liegen. Ein Produkt in zwei Kategorien ist mit Kategorie-Pfad unter zwei URLs erreichbar. Der Canonical löst das, sauberer ist die Struktur ohne Kategorie im Pfad.
- Anhang-Seiten und Feeds: WordPress erzeugt für jedes hochgeladene Bild eine Anhang-Seite und für Kategorien einen RSS-Feed. Beides gehört umgeleitet oder deaktiviert. Interne Suchergebnisse und Warenkorb-URLs sperrst du zusätzlich in der robots.txt, damit der Crawler sie gar nicht erst aufruft.
Die vollständige Einrichtung beschreiben wir im Artikel WordPress SEO für WooCommerce-Shops.
Externer Duplicate Content: Herstellertexte und dünne Produktseiten
In Nischen wie Vape, CBD und Headshop führen hunderte Shops dieselben Marken, und die meisten übernehmen die Produktbeschreibung des Herstellers. Google sieht dann 200 Seiten mit identischem Text, von denen keine das Original ist, und muss entscheiden, welche davon rankt. Die Entscheidung fällt meist zugunsten des Shops mit der stärksten Domain oder des Herstellers selbst. Ein kleiner Shop mit Herstellertext hat auf dieser Produktseite fast keine Chance.
Der Ausweg ist nicht, alle 800 Produkte neu zu texten. Der Ablauf, der sich bewährt hat:
- Die 50 bis 100 Produkte mit dem höchsten Umsatz oder Suchvolumen bekommen eigene Beschreibungen mit Anwendungshinweisen, Vergleichen, Antworten auf Kundenfragen und eigenen Fotos.
- Die Kategorieseiten bekommen eigene Texte, weil sie in den meisten Nischen mehr Suchvolumen bündeln als einzelne Produkte.
- Für den Rest bleibt der Herstellertext, ergänzt um zwei bis drei eigene Sätze zu Lieferumfang, Zubehör oder Einsatz. Das macht die Seite nicht einzigartig, aber unterscheidbar.
Wie eigene Produkttexte aussehen, die ranken und verkaufen, steht im Artikel Produktbeschreibungen schreiben. Wer die Texte nicht selbst schreiben will, findet unser Angebot unter SEO-Texte.
Ähnliche Produkte zusammenlegen oder trennen
Ein Liquid in 10 ml und 50 ml, ein CBD-Öl in 5, 10 und 15 Prozent, ein Grinder in drei Farben: Oft sind das eigene Produkte mit identischem Text, weil sie aus der Warenwirtschaft so importiert wurden. Für Google sind das Duplikate. Die Entscheidung:
- Zusammenlegen als Varianten, wenn Kunden nach dem Produkt suchen und die Ausführung erst auf der Seite wählen. Farben, Größen, Mengen.
- Trennen mit eigenen Texten, wenn Kunden gezielt nach der Ausführung suchen. „CBD-Öl 10 Prozent“ und „CBD-Öl 20 Prozent“ sind eigene Suchanfragen mit unterschiedlicher Zielgruppe und rechtfertigen eigene Seiten mit eigenem Inhalt.
Beispiel: CBD-Shop mit 14.000 URLs im Index
Ein CBD-Shop auf WooCommerce mit rund 400 Produkten hatte laut Search Console über 14.000 bekannte URLs, davon nur 600 indexiert. Der Rest verteilte sich auf Produkt-Tags, Attribut-Archive, Filter-Kombinationen, Sortier-Parameter und Anhang-Seiten. Google crawlte täglich Tausende dieser URLs, während neue Produkte teils Wochen bis zur Indexierung brauchten.
Die Maßnahmen: Tags und Attribut-Archive auf Noindex, Filter-URLs mit Canonical auf die Kategorie, drei Filter mit Suchvolumen als eigene Unterkategorien mit Text ausgebaut, Anhang-Seiten umgeleitet, Sitemap bereinigt, Permalinks ohne Kategorie-Pfad mit Weiterleitungen umgestellt. Nach acht Wochen lag die Zahl bekannter URLs bei rund 1.800, neue Produkte waren innerhalb von Tagen indexiert, und die drei neuen Unterkategorien rankten innerhalb von drei Monaten auf Seite 1. Die Sichtbarkeit der Domain stieg, obwohl kein einziger neuer Backlink gesetzt wurde, weil die vorhandenen Signale auf weniger URLs gebündelt waren. Wie sich das bei unserem Referenzprojekt BioBloom insgesamt entwickelt hat, mit einem Sichtbarkeitsindex von 0,15 auf 0,52 seit 2024, beschreiben wir unter Cannabis SEO.
Duplicate Content und KI-Suche
ChatGPT, Perplexity und Gemini zitieren Seiten, die sie eindeutig einem Thema zuordnen können. Ein Produkt, das unter fünf URLs mit demselben Text erreichbar ist, wird von diesen Systemen genauso uneindeutig wahrgenommen wie von Google. Und ein Herstellertext, der in 200 Shops steht, gibt keinem dieser Shops einen Grund, zitiert zu werden. Eigene Inhalte mit klaren Aussagen zu Anwendung, Unterschieden und Eignung sind das, was KI-Systeme in Antworten übernehmen.
Diese Sichtbarkeit nennt sich Generative Engine Optimization, kurz GEO. Wir bieten dafür einen kostenlosen GEO-Check ohne Mindestgröße: Wir prüfen zehn Kaufabsichts-Prompts deiner Nische in ChatGPT, Perplexity, Gemini und Claude und schicken dir das Ergebnis innerhalb von 48 Stunden. Mehr dazu auf unserer Seite als GEO-Agentur.
Häufige Fragen zu Duplicate Content
Wird mein Shop wegen Duplicate Content abgestraft?
Nein, es gibt keine Strafe für technisch bedingten Duplicate Content. Die Folgen sind indirekt: verschwendetes Crawl-Budget, verteilte Signale und die Gefahr, dass Google die falsche Version rankt. Eine manuelle Maßnahme droht nur bei Täuschung, etwa beim Kopieren ganzer Websites.
Canonical oder Noindex: Was ist wann richtig?
Canonical, wenn die Duplikat-Seite Signale hat, die du auf die Hauptversion übertragen willst, etwa bei Filtern und Varianten. Noindex, wenn die Seite gar nicht in den Index soll und keine Signale trägt, etwa bei Tag-Archiven oder internen Suchergebnissen. Beides zusammen auf einer Seite ist widersprüchlich und sollte vermieden werden.
Muss ich paginierte Seiten auf Noindex setzen?
Nein. Paginierte Seiten bleiben indexierbar mit selbstreferenzierendem Canonical, damit Google die Produkte auf Seite 2 und folgende über die Kategorie findet. Ein Noindex kappt die interne Verlinkung zu diesen Produkten.
Sind Herstellertexte ein Problem, wenn alle sie nutzen?
Ja, gerade dann. Google muss aus 200 identischen Seiten eine wählen und nimmt die stärkste Domain. Für die umsatzstärksten Produkte lohnen sich eigene Texte, für den Rest reichen ergänzende eigene Sätze.
Wie erkenne ich, welche Version Google als kanonisch gewählt hat?
Über das URL-Prüftool in der Search Console. Es zeigt die vom Nutzer angegebene und die von Google gewählte kanonische URL. Weichen beide ab, hat Google deinen Canonical-Tag nicht übernommen, meist weil die Seiten zu unterschiedlich sind oder interne Links auf die andere Version zeigen.
Fazit: Weniger URLs, klarere Signale
Duplicate Content im Onlineshop ist kein Zeichen für schlechte Arbeit, sondern eine Eigenschaft von Shopsystemen. Entscheidend ist, dass du die Quellen kennst und für jede die passende Lösung setzt: Canonical für Varianten, Filter und Sortierung, selbstreferenzierender Canonical für Paginierung, Noindex für Tag-Archive, Weiterleitungen für Pfad-Varianten und eigene Texte für die Produkte, die Umsatz bringen. Das Ergebnis ist ein Shop, den Google effizient crawlt und bei dem die richtigen Seiten ranken.
Wenn du wissen willst, wie viele URLs dein Shop erzeugt, welche davon Google indexiert und wo die Signale verpuffen: Wir kommen nicht aus der Agenturwelt, sondern aus eigenen SEO-Projekten und prüfen in jedem Audit Indexierung, Canonicals und Paginierung im Detail. Alles zu unserem Angebot findest du unter SEO-Audit und E-Commerce SEO. Oder du sicherst dir direkt ein kostenloses Erstgespräch, in dem wir deinen Indexierungsbericht gemeinsam durchgehen.


