El sitemap es un archivo que lista las URL de un sitio web para facilitar su descubrimiento por los motores de búsqueda. Google, Bing y sus robots de exploración se basan en este archivo para recorrer un sitio de manera metódica. Sin embargo, el papel del sitemap ha evolucionado en los últimos años, y algunos de sus campos técnicos se han convertido en señales de confianza en lugar de simples indicaciones de estructura.
El campo lastmod del sitemap: una señal de fiabilidad que Google supervisa
La etiqueta lastmod en un sitemap XML indica la fecha de última modificación de una URL. Durante mucho tiempo percibida como un simple indicador de frescura, ahora funciona como un indicador de credibilidad para todo el sitio.
Cuando las fechas lastmod son sistemáticamente inexactas (todas idénticas, todas iguales al día de construcción del sitio), Google tiende a ignorar este campo para la totalidad del dominio. El sitio pierde así un recurso de priorización del recrawl en sus páginas realmente actualizadas.
Un sitemap cuyas fechas reflejan fielmente las modificaciones reales dirige a los robots hacia el contenido fresco, lo que acelera la consideración de las actualizaciones. En cambio, un sitemap “engañoso” equivale a enviar una señal confusa, y los motores terminan por ignorarlo.
Se puede observar este tipo de funcionamiento consultando la página sitemap de Le Comptoir de Violette, que ilustra la estructura de un archivo sitemap accesible directamente desde un sitio.
Etiquetas priority y changefreq del sitemap XML: ¿todavía útiles o obsoletas?

El protocolo sitemaps.org sigue documentando las etiquetas opcionales priority y changefreq. La primera asigna un valor de prioridad relativa entre las URL del sitio. La segunda indica la frecuencia estimada de modificación de una página.
En la práctica, los motores de búsqueda principales ignoran estos dos campos. Google lo ha confirmado en varias ocasiones: sus algoritmos determinan por sí mismos la frecuencia de rastreo y la prioridad de indexación, independientemente de lo que declare el archivo sitemap.
Conservar estas etiquetas no es penalizante, pero eliminarlas reduce el tamaño del archivo sitemap y simplifica su mantenimiento. Para los sitios voluminosos (varios miles de páginas), esta reducción de peso puede tener un efecto marginal en la velocidad de procesamiento por parte de los robots. Los comentarios en el terreno divergen sobre este punto, algunos webmasters no notando ninguna diferencia medible después de la eliminación.
Sitemap XML y búsqueda por IA: un papel emergente en la frescura del contenido
Los entornos de búsqueda asistidos por inteligencia artificial, como las respuestas generativas de Google, otorgan una importancia creciente a la frescura del contenido. El sitemap XML, cuando sus fechas lastmod son fiables, se convierte en una señal que estos sistemas pueden aprovechar para determinar qué páginas merecen ser citadas en prioridad.
Este fenómeno sigue siendo reciente y los datos disponibles no permiten concluir sobre su alcance exacto. Sin embargo, la lógica es coherente: un motor de IA que genera respuestas necesita fuentes actualizadas, y el sitemap sigue siendo uno de los pocos archivos estandarizados que declara explícitamente la fecha de modificación de una página.
Contenido de un sitemap XML: qué URL incluir y cuáles excluir
Un sitemap eficaz no lista todas las URL de un sitio. Solo contiene las páginas destinadas a aparecer en los resultados de búsqueda. Incluir URL no indexables, redirigidas o duplicadas confunde la señal enviada a los motores.
Los criterios de filtrado a aplicar antes de generar o actualizar un sitemap son:
- Excluir las URL bloqueadas por el archivo robots.txt o que tengan una etiqueta noindex, ya que su presencia en el sitemap crea una contradicción técnica
- Excluir las páginas de paginación, los archivos por fecha y las páginas de etiquetas si no aportan contenido único a los motores de búsqueda
- Excluir las URL redirigidas (301, 302): el sitemap debe apuntar a la dirección final, no a la antigua
- Incluir únicamente las páginas cuyo contenido justifique una indexación, como los artículos, las fichas de producto, las páginas de categorías principales
Un sitemap limpio contiene menos URL pero envía una señal más clara a los robots de exploración. En los sitios que superan varias cientos de páginas, esta poda hace una verdadera diferencia en la velocidad de indexación de los contenidos recientes.

Enviar y verificar su sitemap: Google Search Console y robots.txt
Dos métodos complementarios permiten declarar un sitemap a los motores de búsqueda. El primero pasa por Google Search Console, donde se envía directamente la URL del archivo sitemap. La herramienta devuelve luego un informe de estado que indica el número de URL descubiertas, indexadas o con errores.
El segundo método consiste en declarar la ubicación del sitemap en el archivo robots.txt, a través de una línea del tipo Sitemap: https://exemple.com/sitemap.xml. Esta declaración es leída por todos los motores compatibles con el protocolo, no solo Google.
Los dos enfoques no se excluyen mutuamente. Combinar la presentación a través de Search Console y la declaración en robots.txt garantiza una cobertura máxima. Bing Webmaster Tools ofrece un mecanismo similar al de Google, con el complemento del protocolo IndexNow que permite notificar a los motores en tiempo real cuando se publica o modifica una página.
- Search Console: presentación manual, informe de cobertura detallado, alertas en caso de error en el sitemap
- Robots.txt: declaración pasiva, leída automáticamente por todos los crawlers compatibles
- IndexNow: notificación proactiva compatible con Bing, que acelera la consideración de las actualizaciones sin esperar el próximo rastreo programado
El sitemap sigue siendo un archivo técnico cuya eficacia depende de la rigurosidad con la que se mantenga. Un sitemap actualizado, fiel y correctamente presentado no garantiza la indexación, pero proporciona a los motores las mejores condiciones para explorar un sitio de manera coherente. Ignorar su mantenimiento equivale a dejar que los robots naveguen sin un referente fiable, lo que penaliza especialmente a los sitios voluminosos o aquellos cuyo contenido cambia con frecuencia.



