Sitemaps & kanonische URLs: der KI helfen, deine Seiten zu finden und ihnen zu vertrauen

KI kann nur eine Seite zitieren, die sie findet – und sie wird verwirrt, wenn derselbe Inhalt unter mehreren Adressen liegt. Zwei alte, unscheinbare Werkzeuge lösen beides: die Sitemap (eine Liste deiner Seiten) und das Canonical-Tag (die eine wahre URL einer Seite). Zusammen helfen sie der KI, deinen Inhalt zu entdecken und ihr Vertrauen nicht auf Duplikate zu verteilen.

Was eine Sitemap macht

Eine sitemap.xml ist eine schlichte Liste der URLs, die gefunden werden sollen, meist unter /sitemap.xml ausgeliefert. Crawler – Suche und KI gleichermaßen – lesen sie, um Seiten zu entdecken, die sie sonst verpassen könnten, besonders bei großen Seiten oder Seiten mit wenigen internen Links. Sie steigert nicht das Ranking; sie verbessert die Auffindbarkeit.

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url><loc>https://example.com/</loc></url>
  <url><loc>https://example.com/guide/</loc></url>
</urlset>

Verweise dann aus der robots.txt darauf, damit Crawler sie automatisch finden:

Sitemap: https://example.com/sitemap.xml

Was Canonical macht

Wenn dieselbe Seite über mehrere URLs erreichbar ist – Tracking-Links (?ref=...), http vs. https, mit oder ohne abschließenden Schrägstrich, Druckversionen –, können Maschinen jede als eigene Seite behandeln und den Wert aufteilen. Ein Canonical-Tag benennt die eine echte URL:

<link rel="canonical" href="https://example.com/guide/what-is-geo">

Setz es in den <head> jeder Seite und zeig auf die bevorzugte Adresse dieser Seite. Duplikate werden dann auf eine URL gebündelt, statt miteinander zu konkurrieren.

Der häufige Fehler

Zeig nicht das Canonical jeder Seite auf deine Startseite. Das ist ein häufiger Copy-Paste-Fehler, der Crawlern praktisch sagt „alle meine Seiten sind eigentlich die Startseite” und den Rest verbirgt. Das Canonical jeder Seite sollte auf sich selbst zeigen – auf die eigene bevorzugte URL.

Fazit

Sitemaps und Canonical-Tags sind unscheinbar, beseitigen aber zwei echte Hürden: Seiten, die KI nie findet, und Vertrauen, das auf doppelte URLs aufgeteilt wird. Füge eine sitemap.xml hinzu, verlinke sie aus der robots.txt und gib jeder Seite ein selbstbezügliches Canonical. Es ist die „auffindbar sein”-Schicht aus unserer GEO-Einführung.

← Alle Leitfäden