Unisono · II. Gefunden werden
Duplicate Content vermeiden: Ursachen und saubere Lösungen
Aktualisiert am 24. September 20262 Min. Lesezeit
Duplicate Content klingt nach abgeschriebenen Texten. In der Praxis entsteht er aber fast immer ungewollt – durch Technik, die denselben Inhalt unter mehreren Adressen ausliefert.
T. 1Was mit Duplicate Content gemeint ist
Als Duplicate Content bezeichnet man Inhalte, die unter mehr als einer Adresse identisch oder fast identisch erreichbar sind – innerhalb einer Website oder über mehrere Websites hinweg. Suchmaschinen müssen dann entscheiden, welche Fassung sie anzeigen. Meist wählen sie eine aus und blenden die anderen aus.
Eine häufige Sorge ist eine „Abstrafung“. Google hat mehrfach erklärt, dass es für gewöhnliche technische Dubletten keine Strafe gibt. Problematisch wird es erst, wenn Inhalte absichtlich massenhaft kopiert werden, um Suchmaschinen zu manipulieren. Trotzdem schaden Dubletten: Links verteilen sich auf mehrere Adressen, Crawler verschwenden Zeit, und in den Ergebnissen erscheint womöglich nicht die Fassung, die man sich wünscht.
T. 2Typische technische Ursachen
| Ursache | Beispiel | Lösung |
|---|---|---|
| www und ohne www | example.de/ und www.example.de/ | eine Variante wählen, die andere per 301 weiterleiten |
| http und https | http://… und https://… | alles per 301 auf https |
| Schrägstrich am Ende | /kontakt und /kontakt/ | eine Schreibweise, die andere weiterleiten |
| URL-Parameter | /schuhe?sort=preis | Canonical auf die Adresse ohne Parameter |
| Druck- oder Mobilversion | /artikel/print/ | Druck per CSS statt eigener Seite |
| Kategorien und Schlagwörter | derselbe Beitrag unter mehreren Pfaden | ein fester Pfad pro Beitrag |
T. 3Werkzeug 1: die 301-Weiterleitung
Wenn eine Adresse keinen eigenen Zweck hat, ist die dauerhafte Weiterleitung die sauberste Lösung. Der Besucher landet automatisch an der richtigen Stelle, Suchmaschinen übertragen die Signale. Wie sich Weiterleitungen auf einem Apache-Server einrichten lassen, zeigt die .htaccess-Referenz.
T. 4Werkzeug 2: das Canonical-Tag
Wenn beide Adressen für Besucher erreichbar bleiben sollen – etwa eine sortierte Produktliste –, hilft ein Hinweis im Seitenkopf, welche Fassung die maßgebliche ist:
<link rel="canonical" href="https://www.example.de/schuhe/">
Suchmaschinen behandeln das als starken Hinweis, nicht als Befehl. Es ist üblich und unschädlich, dass jede Seite ein Canonical auf sich selbst trägt.
T. 5Inhalte, die auf anderen Seiten stehen
Schwieriger sind Dubletten über Website-Grenzen hinweg: Herstellertexte in Onlineshops, Pressemitteilungen, die auf zwanzig Portalen erscheinen, Gastbeiträge, die zusätzlich im eigenen Blog stehen. Hier gibt es keine technische Weiterleitung. Wer selbst Urheber ist, kann den Partner bitten, ein Canonical auf das Original zu setzen. Wer Herstellertexte nutzt, sollte sie um eigene Informationen ergänzen – Erfahrungen, Maße, Hinweise zur Anwendung. Ein Text, der nur hundertfach vorhanden ist, bietet der Suchmaschine keinen Grund, gerade diese Seite zu zeigen.
T. 6Dubletten finden
- In der Google Search Console unter „Seiten“: Einträge wie „Duplikat – vom Nutzer nicht als kanonisch festgelegt“.
- Eine Suche nach einem wörtlichen Satz aus einer Seite in Anführungszeichen.
- Crawling-Programme, die alle Adressen einer Website abrufen und gleiche Titel oder Inhalte markieren.
Google erklärt das Thema selbst in der Search-Central-Dokumentation zu kanonischen URLs. Wie man eine Website überhaupt in die Search Console bringt, steht im Beitrag Website bei Google anmelden.