Duplicate Content

Duplicate Content sind identische oder fast identische Inhalte, die unter mehreren Internetadressen erreichbar sind.

Was bedeutet dieser Begriff?

Duplicate Content — auf Deutsch doppelter Inhalt — liegt vor, wenn derselbe oder ein sehr ähnlicher Text unter mehreren Internetadressen abrufbar ist. Das kann innerhalb einer Website passieren oder über mehrere Websites hinweg. Für Suchmaschinen entsteht daraus ein Zuordnungsproblem: Welche der gleichlautenden Seiten soll in den Ergebnissen erscheinen? Im Zweifel entscheidet sich die Suchmaschine für eine und ignoriert die anderen — oder verteilt die Bewertung, sodass keine Version richtig stark wird. Wichtig zur Klarstellung: Es gibt keine direkte Strafe für versehentliche Dubletten, wie oft behauptet wird. Der Schaden entsteht indirekt, durch die Aufsplitterung von Bewertungskraft und die Unsicherheit der Suchmaschine.

Wo hat dieser Begriff seinen Ursprung?

Das Problem wuchs mit der Verbreitung dynamischer Websites und Onlineshops in den 2000er Jahren, die technisch bedingt oft dieselben Inhalte unter vielen Adressvarianten ausgaben. Suchmaschinen entwickelten daraufhin Mechanismen, um Dubletten zu erkennen und zusammenzufassen — und Werkzeuge wie den Canonical Tag, mit denen Website-Betreiber selbst die maßgebliche Version festlegen können.

Warum ist dieser Begriff wichtig?

Doppelte Inhalte verschenken Sichtbarkeit, ohne dass es auffällt. Statt einer starken Seite, die alle Bewertungskraft auf sich vereint, entstehen mehrere schwache, die sich gegenseitig Konkurrenz machen. Die Funktion des Wissens um Duplicate Content ist es, diese stille Selbstschwächung zu vermeiden — sei es die technisch entstandene Dublette im eigenen Shop oder der ungeprüft übernommene Herstellertext, den hunderte andere Händler ebenfalls nutzen.

Herausforderungen

Viele Dubletten entstehen ungewollt und technisch — durch Filter, Sortierungen, Adressvarianten mit und ohne bestimmte Anhängsel — und sind ohne Fachwissen schwer aufzuspüren. In großen Shops mit tausenden Seiten ist die Bereinigung komplex. Die häufigste Quelle, ungeprüft übernommene Hersteller- oder Standardtexte, lässt sich nur durch eigene Inhalte lösen, was Aufwand bedeutet — der sich bei wichtigen Seiten aber lohnt.

Beispiel

Ein Onlinehändler übernimmt die Produktbeschreibungen exakt so, wie der Hersteller sie liefert. Dieselben Texte stehen wortgleich auf hunderten anderen Händlerseiten. Keine davon hebt sich ab, alle konkurrieren mit identischem Inhalt. Nachdem der Händler eigene, ausführlichere Beschreibungen mit praktischen Anwendungshinweisen schreibt, beginnen seine Produktseiten sich von der Masse abzusetzen und besser zu ranken.