Sitemaps y URLs canónicas: ayudar a la IA a encontrar y confiar en tus páginas
La IA solo puede citar una página que encuentre, y se confunde cuando el mismo contenido vive en varias direcciones. Dos herramientas viejas y poco vistosas resuelven ambos problemas: el sitemap (una lista de tus páginas) y la etiqueta canonical (la única URL verdadera de una página). Juntas ayudan a la IA a descubrir tu contenido y a no repartir su confianza entre duplicados.
Qué hace un sitemap
Un sitemap.xml es una lista sencilla de las URLs que quieres que se encuentren, normalmente servida en /sitemap.xml. Los rastreadores —de búsqueda y de IA por igual— lo leen para descubrir páginas que de otro modo se les escaparían, sobre todo en sitios grandes o en páginas con pocos enlaces internos. No mejora el posicionamiento; mejora el descubrimiento.
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url><loc>https://example.com/</loc></url>
<url><loc>https://example.com/guide/</loc></url>
</urlset>
Luego apunta a él desde robots.txt para que los rastreadores lo encuentren automáticamente:
Sitemap: https://example.com/sitemap.xml
Qué hace canonical
Cuando la misma página es accesible en varias URLs —enlaces de seguimiento (?ref=...), http frente a https, con o sin barra final, versiones para imprimir—, las máquinas pueden tratar cada una como una página distinta y repartir el crédito. Una etiqueta canonical nombra la única URL real:
<link rel="canonical" href="https://example.com/guide/what-is-geo">
Ponla en el <head> de cada página, apuntando a la dirección preferida de esa página. Así los duplicados se consolidan en una sola URL en lugar de competir entre sí.
El error frecuente
No apuntes el canonical de todas las páginas a tu página de inicio. Es un error de copiar y pegar muy habitual que en la práctica les dice a los rastreadores «todas mis páginas son en realidad la página de inicio» y oculta el resto. El canonical de cada página debe apuntar a sí misma, a su propia URL preferida.
En resumen
Los sitemaps y las etiquetas canonical son poco vistosos, pero eliminan dos obstáculos reales: páginas que la IA nunca encuentra y confianza repartida entre URLs duplicadas. Añade un sitemap.xml, enlázalo desde robots.txt y dale a cada página un canonical que apunte a sí misma. Es la capa de «ser localizable» de nuestra introducción al GEO.