Was ist Duplicate Content? Definition
Duplicate Content bezeichnet identische oder weitgehend übereinstimmende Inhalte, die unter mehreren URLs erreichbar sind. Das kann innerhalb einer Website geschehen oder über verschiedene Domains hinweg.
Ein verbreitetes Missverständnis ist die Vorstellung einer Strafe. Google bestraft doppelte Inhalte in aller Regel nicht, sondern wählt eine Version aus und ignoriert die übrigen. Das Problem ist damit weniger eine Abstrafung als die Aufteilung von Signalen auf mehrere schwache Seiten.
Wie er in Shops entsteht
Typische Quellen sind Filter- und Sortierparameter, die für dieselbe Kategorie neue URLs erzeugen, Produkte in mehreren Kategorien mit unterschiedlichem Pfad, Produktvarianten auf getrennten Seiten, Paginierung mit wiederholtem Kategorietext sowie die parallele Erreichbarkeit mit und ohne www.
Ein Sonderfall sind Herstellerbeschreibungen: Wer die Texte des Lieferanten unverändert übernimmt, konkurriert mit allen anderen Händlern, die dasselbe tun.
Wie du das Problem löst
Das übliche Mittel ist der Canonical Tag, der auf die maßgebliche Version verweist. Bei dauerhaft entfernten Doppelungen ist eine 301-Weiterleitung sauberer. Parameter-URLs ohne eigenständigen Nutzen sollten gar nicht erst indexierbar sein.
Bei mehrsprachigen Shops regelt das hreflang-Attribut die Zuordnung. Eine deutsche und eine österreichische Version mit fast gleichem Text sind kein Duplicate-Problem, solange die Auszeichnung korrekt ist.
Was wirklich schadet
Kritisch wird es, wenn massenhaft dünne, fast identische Seiten entstehen, etwa automatisch erzeugte Kombinationen aus Ort und Produkt. Solche Muster können als Spam bewertet werden, was dann tatsächlich eine Maßnahme nach sich ziehen kann.
« Zurück zum Glossar-Index