
Den Canonical Tag im HTML prüfen: So finden Sie Fehler im Quelltext
Es reicht nicht aus, hochwertige Texte zu veröffentlichen, wenn Suchmaschinen nicht wissen, welche URL sie als Original werten sollen. Um technische Konflikte auszuschließen, müssen Sie regelmäßig den Canonical Tag im HTML prüfen. Falsche oder widersprüchliche Angaben im Quelltext führen schnell dazu, dass wichtige Unterseiten aus den Suchergebnissen verschwinden. In diesem Ratgeber erfahren Sie, wie Sie Ihre Webseiten auf korrekte Verweise kontrollieren und kritische Fehler bei der Auszeichnung im Code identifizieren.
Warum die technische Kontrolle im Quelltext unverzichtbar ist
Ein kanonischer Link ist ein HTML-Element, das Suchmaschinen die primäre Version einer Webseite mitteilt. Er kommt zum Einsatz, wenn ähnliche oder identische Inhalte unter verschiedenen URLs erreichbar sind. Ohne eine solche klare Anweisung entscheiden Suchmaschinen selbstständig, welche Variante sie für relevant halten. Das führt oft zu unerwünschten Ergebnissen in der Auflistung der Treffer.
Sie können sich bei der Auszeichnung nicht blind auf Ihr Content-Management-System verlassen. Oft generieren installierte Plugins oder aktive Filterfunktionen in Online-Shops dynamische Pfade, die unbeabsichtigt Duplikate erzeugen. Ein klassisches Beispiel sind Produktvarianten: Wenn Sie ein Produkt in verschiedenen Farben anbieten und jede Farbe eine eigene URL generiert, benötigen Sie klare technische Vorgaben, um die Linkstärke auf das Hauptprodukt zu lenken.

So können Sie die korrekte Canonical URL herausfinden
Um zu kontrollieren, welche Seite Ihr System als Original definiert, müssen Sie die aktive Canonical URL herausfinden. Rufen Sie dazu die zu prüfende Webseite in Ihrem Browser auf. Mit der Tastenkombination für die Quelltextansicht öffnen Sie den reinen Code der Seite. Nutzen Sie anschließend die Suchfunktion Ihres Browsers und suchen Sie nach dem Begriff "canonical".
Der entsprechende Eintrag muss sich zwingend im <head>-Bereich des HTML-Dokuments befinden. Ein korrekter Code-Schnipsel besteht aus einem Link-Element ohne End-Tag und sieht so aus: <link rel="canonical" href="https://ihredomain.de/original-seite/" />. Das Attribut rel definiert die Beziehung zum Dokument, während href das exakte Ziel angibt.
Finden Sie den Eintrag stattdessen weiter unten im <body>-Bereich, ignoriert Google diese Anweisung vollständig. Achten Sie bei der Prüfung auch darauf, dass die ausgewiesene Adresse tatsächlich erreichbar ist und keinen Fehlercode wie 404 zurückgibt. Fehlt der Eintrag gänzlich, gehen Suchmaschinen davon aus, dass die Seite ihr eigenes Original darstellt.
Wenn mehrere Canonical Tags auf einer Seite Fehler verursachen
Ein besonders schwerwiegendes Problem entsteht durch widersprüchliche Angaben im Kopfbereich des Dokuments. Dass mehrere Canonical Tags auf einer Seite Fehler verursachen, liegt daran, dass Suchmaschinen in diesem Fall keine eindeutige Vorgabe erkennen können. Dies passiert häufig, wenn sowohl das Kernsystem als auch ein zusätzlich installiertes SEO-Plugin gleichzeitig versuchen, die kanonischen Angaben zu steuern.
Sobald ein Webcrawler auf mehr als ein solches Link-Element in einem HTML-Dokument stößt, verwirft er sämtliche kanonischen Anweisungen für diese spezifische Unterseite. Die Folge ist, dass der technische Schutz vor Duplikaten komplett entfällt und die Crawler willkürlich entscheiden. Prüfen Sie daher bei jedem Check sorgfältig, ob das Element exakt einmal im Code vorkommt.

Weitere kritische Fallstricke bei der technischen Umsetzung
Neben doppelten Tags gibt es weitere strukturelle Details, die eine erfolgreiche Auszeichnung behindern. Kontrollieren Sie bei Ihrer Quelltext-Analyse immer auch die genaue Formatierung der hinterlegten URLs.
- Verwendung relativer Pfade: Ein kanonischer Link sollte immer als absolute URL angegeben werden, also inklusive Protokoll und Domain. Fehlt das
https://, wertet das System die Angabe als relativen Pfad. Das führt dazu, dass der Crawler eine falsche, verschachtelte URL konstruiert und den Hinweis ignoriert. - Unnötige Weiterleitungsketten: Stellen Sie sicher, dass Ihre kanonischen URLs nicht auf Seiten zeigen, die selbst wieder umleiten oder einen eigenen, abweichenden Tag nutzen. Solche Ketten irritieren die Crawler.
- Falscher Umgang mit Paginierung: Wenn Sie lange Inhalte auf mehrere Seiten aufteilen, darf nicht jede Unterseite stur auf die erste Seite verweisen, da es sich nicht um echte Duplikate handelt. In solchen Fällen gehen ansonsten die Inhalte der Folgeseiten für den Index verloren. Jeder paginierte Teil sollte entweder auf sich selbst zeigen oder auf eine Gesamtübersicht verweisen.
Besonderheiten bei PDF-Dateien und fremden Domains
Nicht jeder Inhalt liegt als HTML-Dokument vor. Wenn Sie beispielsweise eine Broschüre sowohl als Webseite als auch als PDF-Datei zum Download anbieten, müssen Sie kritisch prüfen, ab wann es Duplicate Content ist. Da PDFs keinen HTML-Kopfbereich besitzen, erfolgt die Auszeichnung zur Vermeidung solcher Duplikate über den HTTP-Header. Der Server muss so konfiguriert sein, dass er beim Aufruf der Datei die entsprechende Link-Information im Header mitgibt.
Ebenso können Sie die Auszeichnung nutzen, um auf externe Domains zu verweisen. Wenn Sie im Rahmen der Content-Syndication einen Artikel auf einer anderen Domain veröffentlichen oder fremden Content übernehmen, setzen Sie den Verweis auf die Ursprungsdomain. So bewahren Sie die externe Seite vor negativen Effekten und signalisieren den Suchmaschinen fair, wem der Inhalt gehört.
Der Unterschied zur klassischen 301-Weiterleitung
Viele Webmaster verwechseln den kanonischen Verweis mit einer direkten Weiterleitung. Bei einer 301-Weiterleitung wird der Nutzer automatisch auf die neue Adresse umgeleitet; die alte Seite ist für ihn nicht mehr sichtbar. Dies ist eine zuverlässige Methode, wenn Sie veraltete Duplikate komplett aus dem Netz nehmen.
Das Link-Element hingegen arbeitet rein im Hintergrund. Der Nutzer sieht weiterhin die aufgerufene URL, während nur die Suchmaschine den Hinweis zur Originalressource erhält. Nutzen Sie diese Methode immer dann, wenn verschiedene URLs aus technischen oder vertrieblichen Gründen parallel erreichbar bleiben müssen – etwa bei Tracking-Parametern oder Sortierfunktionen im Shop.
Effiziente Werkzeuge für die Code-Analyse
Bei großen und dynamisch wachsenden Web-Projekten ist die manuelle Prüfung jeder einzelnen Unterseite zeitaufwendig. Hier unterstützen Sie spezialisierte Analyse-Werkzeuge, die den Quelltext automatisiert auslesen. Die Google Search Console liefert verlässliche Daten darüber, ob das System Ihre Vorgaben akzeptiert oder eigenständig eine andere Version indexiert hat.
Externe SEO-Lösungen crawlen Ihre gesamte Struktur und listen sämtliche Fehler zentral auf. Sie erkennen sofort fehlende, falsch formatierte oder widersprüchliche Verweise und können die Probleme beheben, bevor sie sich negativ auswirken. So behalten Sie auch bei größeren Architektur-Anpassungen stets die Kontrolle über alle technischen Signale.
Abschließende Sicherung Ihrer Website-Architektur
Das Setzen technischer Verweise ist primär eine Empfehlung an die Suchmaschinen, keine zwingende Direktive, an die sich Webcrawler immer halten müssen. Dennoch ist ein sauber konfigurierter Quellcode die wichtigste Basis, um die Autorität Ihrer Seiten gezielt zu steuern. Eine Unterseite darf im Übrigen problemlos auf sich selbst verweisen – das ist für die Systeme ein eindeutiges Signal, dass genau dieser Inhalt sein eigenes Original darstellt.
Indem Sie die Architektur regelmäßig analysieren, verhindern Sie, dass verborgene Fehler im Code Ihre Rankings verwässern. Nur wenn die Signale im Hintergrund eindeutig sind, erfassen Suchmaschinen Ihre Inhalte so, wie Sie es vorgesehen haben.
Häufig gestellte Fragen zur kanonischen Auszeichnung
Wo genau muss das Element im HTML-Code platziert werden?
Der Code-Schnipsel muss zwingend im <head>-Bereich der Seite stehen. Wird er im <body> platziert, ignorieren Suchmaschinen die Anweisung komplett.
Ist es schlimm, wenn eine Seite auf sich selbst verweist?
Nein, das ist eine gängige und sichere Praxis. Ein selbstreferenzierender Verweis bestätigt den Suchmaschinen lediglich, dass die aufgerufene URL das Original ist.
Warum beachtet Google meine Vorgabe nicht?
Da es sich nur um eine Empfehlung handelt, kann Google die Angabe ignorieren. Häufige Gründe dafür sind Fehler im Quellcode, widersprüchliche Signale oder fehlende Erreichbarkeit der Ziel-URL.
Können auch Nicht-HTML-Dateien ausgezeichnet werden?
Ja, bei Dokumenten wie PDFs erfolgt die Definition der Originalressource über den HTTP-Header, da diese Dateien keinen eigenen HTML-Kopfbereich besitzen.
Was passiert, wenn die Auszeichnung komplett fehlt?
Fehlt der Verweis, geht der Webcrawler davon aus, dass die aktuelle Seite ihr eigenes Original ist. Bei identischen Inhalten unter verschiedenen URLs entscheiden die Suchmaschinen dann eigenmächtig, welche Version sie indexieren.