deine-geo-agentur.de

Technik

Duplicate Content

Von Felix Wilhelm · geprüft am 22. September 2026

Kurz gesagt: Duplicate Content sind identische oder weitgehend gleiche Inhalte, die unter mehreren URLs abrufbar sind — innerhalb einer Website oder über Domains hinweg.

Definition: Duplicate Content

Von Duplicate Content spricht man, wenn derselbe Hauptinhalt unter verschiedenen Adressen erreichbar ist. Google bildet daraus Cluster, wählt per Kanonisierung eine repräsentative URL und zeigt meist nur diese. Google stellt klar, dass etwas Duplicate Content auf einer Website normal ist und nicht gegen die Spam-Richtlinien verstößt. Anders liegt es bei kopierten Fremdinhalten ohne eigenen Mehrwert (Scraping) und bei massenhaft erzeugten, fast gleichen Seiten; das behandeln die Richtlinien zu Scaled Content Abuse und Doorway-Seiten.

Auch genannt:doppelter InhaltDCDuplikateduplizierte Inhalte

Was du dazu wissen solltest

Technische Duplikate entstehen fast immer ungewollt. Google nennt typische Ursachen: regionale Varianten in derselben Sprache, getrennte Mobil- und Desktopversionen, HTTP und HTTPS parallel, Sortier- und Filterfunktionen sowie versehentlich offene Test- oder Demo-Umgebungen. Die Folge ist keine Strafe, sondern ein Auswahl- und Effizienzproblem. Google crawlt Duplikate seltener, verteilt Signale auf mehrere Adressen und wählt womöglich nicht die Fassung, die du zeigen willst. Die Werkzeuge dagegen sind 301-Weiterleitungen, das Canonical Tag und eine konsistente interne Verlinkung.

Heikler ist der inhaltliche Fall. Hundert Standortseiten, die sich nur im Ortsnamen unterscheiden, sind technisch keine Duplikate, weil jede URL einen anderen Text hat. Für Google sind sie trotzdem nahezu gleich. Die Spam-Richtlinien nennen ausdrücklich Seiten, die auf einzelne Städte oder Regionen zielen und Nutzer auf eine Zielseite trichtern, als Beispiel für Doorway-Missbrauch. Formulierungen zu variieren hilft nicht. Hilfreich sind echte Unterschiede: lokale Ansprechpartner, Anfahrt, Preise, Referenzen, Öffnungszeiten.

Messbar wird Ähnlichkeit mit Shingle-Vergleichen. Man zerlegt Texte in überlappende Wortfolgen, etwa fünf Wörter lang, und berechnet für jedes Seitenpaar den Anteil gemeinsamer Folgen (Jaccard-Koeffizient). Das ist keine Google-Methode und kein offizieller Grenzwert, aber ein brauchbares internes Qualitätsgate. Wer viele ähnliche Seiten erzeugt, sollte eine Obergrenze je Seitenpaar festlegen und Ausreißer vor der Veröffentlichung überarbeiten. Im Zweifel ist eine starke Sammelseite besser als zwanzig schwache Varianten; das ist der Kern von Thin Content als Risiko.

Für die KI-Suche zählt vor allem Eindeutigkeit. Google beschreibt im Leitfaden zu generativen KI-Funktionen, dass Duplikate Crawling-Ressourcen verschwenden, und rät, sie zu reduzieren. Existiert ein Ratgebertext unter drei Adressen, kann jede davon als Quelle auftauchen, und Nennungen zersplittern. Übernimmt ein Partner deinen Text ohne Canonical oder Quellverweis, ist nicht garantiert, dass das Original als Quelle erkannt wird. Eigene Daten und eigene Beispiele sind deshalb auch ein Schutz: Sie machen den Unterschied zwischen Original und Kopie sichtbar, siehe Information Gain.

An einem Fall erklärt

Praxisbeispiel

Ein Anbieter von Treppenliften hat für 120 Städte eigene Seiten angelegt, die sich nur in Stadtname und Postleitzahl unterscheiden. Ein Shingle-Vergleich zeigt sehr hohe Überschneidungen zwischen allen Paaren. Das Team fasst die Seiten zu zwölf Regionalseiten zusammen, jede mit eigenem Techniker-Team, Einsatzgebiet, typischen Förderhinweisen des Bundeslands und echten Montagefotos. Die übrigen Stadt-URLs leiten per 301 auf die passende Region weiter.

In der Praxis setzen wir das so um: Technik für KI-Sichtbarkeit: Crawler, Schema, llms.txt →

Häufige Fragen zu Duplicate Content

Bestraft Google Duplicate Content?

Technische Duplikate nicht. Google schreibt, dass etwas Duplicate Content normal ist und keinen Verstoß darstellt; die Suchmaschine wählt dann eine Fassung aus. Kopierte Fremdinhalte ohne Mehrwert und massenhaft erzeugte Beinahe-Kopien fallen dagegen unter die Spam-Richtlinien und können abgewertet werden.

Wie finde ich Duplikate auf meiner Website?

Der Indexierungsbericht der Search Console listet Seiten mit den Status „Duplikat“ und zeigt, welche URL Google gewählt hat. Ein Crawl mit einem Desktop-Crawler findet zusätzlich gleiche Titel, gleiche Inhalte und Parameter-Varianten. Für inhaltliche Beinahe-Duplikate hilft ein paarweiser Textvergleich über Wortfolgen.

Ist es Duplicate Content, wenn ich meinen Artikel auf LinkedIn oder Medium veröffentliche?

Ja, domainübergreifend. Google wählt dann eine Fassung, und das muss nicht deine sein. Veröffentliche zuerst auf der eigenen Website, verweise in der Zweitveröffentlichung sichtbar auf das Original und nutze, wo die Plattform es erlaubt, ein Canonical auf deine URL.

Sind übersetzte Seiten Duplicate Content?

Nein, wenn der Hauptinhalt tatsächlich übersetzt ist. Google betrachtet Sprachversionen nur dann als Duplikate, wenn lediglich Navigation und Footer übersetzt sind und der eigentliche Text gleich bleibt. Regionale Varianten in derselben Sprache sollten mit hreflang und Canonical gekennzeichnet werden.

Begriffe im Umfeld

Quellen: Google Search Central: What is URL canonicalization (Stand September 2026) · Google Search Central: Spam policies for Google web search (Stand September 2026)

Definitionen im Glossar sind redaktionell geprüft, ersetzen aber keine Beratung für deinen Einzelfall. Zurück zum Glossar

Reden wir 30 Minuten darüber

Kostenlos, unverbindlich und mit einer ehrlichen Einschätzung, ob sich GEO bei dir gerade lohnt.

Erstgespräch vereinbaren+49 174 164 5727

Nach oben scrollen