|
Tiempo de lectura
11 min
Qué es un sitemap y para qué sirve
Qué es un sitemap y para qué sirve
Un sitemap es una lista de las URLs que quieres que se conozcan. El XML es para Google. El HTML es una página para las personas. En España «qué es un sitemap» tiene unas 170 búsquedas al mes y sube. No es un mapa de Google Maps ni un plano de la oficina. Esta página separa los dos archivos y dice cuál hay que enviar a Search Console, y deja claro que el archivo XML no indexa una URL por el mero hecho de listarla.
Un sitemap es una lista de las URLs que quieres que se conozcan. El XML es para Google. El HTML es una página para las personas. En España «qué es un sitemap» tiene unas 170 búsquedas al mes y sube. No es un mapa de Google Maps ni un plano de la oficina. Esta página separa los dos archivos y dice cuál hay que enviar a Search Console, y deja claro que el archivo XML no indexa una URL por el mero hecho de listarla.
Dos cosas que se llaman igual
Sitemap XML es un archivo. Sitemap HTML es una página. Quien busca «qué es un sitemap» en España se encuentra las dos definiciones en el resumen de IA, y a veces un resultado de mapas que no tiene nada que ver. Si tu duda es «dónde estoy en el plano», esta no es la página. Si tu duda es por qué Google no conoce una URL nueva, sí.
El XML es el que se envía a Search Console. El HTML es opcional. Una web de diez páginas bien enlazadas puede vivir sin un índice HTML. Casi ninguna debería vivir sin saber cuál es su XML y qué URLs contiene.
Qué hace el XML y qué no
Le entrega a Google una lista. El bot puede descubrir URLs por los enlaces, por el historial y por esta lista. En una web pequeña y bien enlazada, el sitemap no es la razón de que te indexen. En una web nueva, o después de publicar un bloque de páginas, acorta el tiempo hasta que Google se entera de que existen.
No hace estas cosas, aunque se vendan así:
No indexa. Una URL en el sitemap y en noindex sigue fuera. El noindex gana.
No posiciona. Estar en la lista no es estar en la primera página.
No limpia errores. Si la URL redirige o da 404, meterla en el sitemap le pide a Google que mire un problema.
No sustituye los enlaces internos. Una página que solo vive en el sitemap y nadie enlaza es una página huérfana con una mención en un archivo.
Qué debe incluir y qué debe quedar fuera
Las URLs canónicas que quieres en el índice: servicios, contacto, artículos vigentes, fichas que se venden.
Fuera, las que redirigen. La lista debe llevar el destino, no el origen de la redirección 301.
Fuera, las que llevan noindex: gracias, borradores, resultados internos de búsqueda.
Fuera, las variantes con parámetros que no son una página distinta.
Fuera, las de prueba y las de un dominio antiguo si ya migraste.
Si el archivo y el índice se contradicen, gana lo que Google encuentra al rastrear. El sitemap no deshace un canonical ni un bloqueo. Esa prioridad está en qué es el SEO técnico.
Dónde se mira
La mayoría de plataformas lo generan solas, en una ruta del tipo /sitemap.xml. Ábrela en el navegador. Tienes que ver URLs de tu dominio, no las de la plantilla de ejemplo. Si ves páginas que borraste hace meses, el generador no se ha actualizado o estás mirando un archivo estático viejo.
En Search Console, el informe de sitemaps dice si Google ha podido leerlo y cuántas URLs ha descubierto. «Descubiertas» no significa «indexadas». El informe de páginas es el que dice si se han guardado. Confundir los dos números es la lectura que más planes de contenido innecesarios provoca.
En el robots.txt se puede dejar la línea que apunta al archivo. Es una ayuda, no una obligación si ya lo enviaste en Search Console. No bloquees el sitemap con el propio robots.txt.
El HTML, para no mezclarlo
Un sitemap HTML es una página con enlaces, a menudo en el pie, del tipo «mapa del sitio». Sirve cuando la navegación es estrecha y una persona no llega a una sección. Google también puede seguir esos enlaces, como sigue cualquier otra página. No se sube como archivo. No lleva etiquetas XML. Y no se usa para esconder, en un listado enorme, lo que no quisiste enlazar en el menú: si no debe indexarse, no lo enlaces ahí tampoco.
Después de una migración o de un borrado
Regenera la lista. Quita las URLs que ya redirigen. Comprueba que las nuevas están. Vuelve a mirar Search Console por si el archivo que lee sigue siendo el antiguo. El contexto de ese cambio está en migrar sin perder posiciones.
Si la web tiene pocos enlaces y páginas que no descubres ni tú, el sitemap no es el proyecto. Lo es la arquitectura. El archivo, entonces, solo documenta un sitio que una persona tampoco puede recorrer. Cuando la lista esté limpia, el trabajo de que cada URL merezca estar en ella es el del SEO, no el de generar otro XML.
Un repaso antes de enviarlo
Abre el XML y lee diez URLs al azar, no solo la primera. Pregúntate si querrías que esa URL saliera en Google. Si la respuesta es no, quítala de la lista antes de enviarla. Comprueba que no hay dominios de prueba, ni http mezclado con https, ni la misma ficha con y sin barra final si una de las dos redirige.
Después de enviarlo, anota la fecha. A la semana, mira en Search Console cuántas de esas URLs están indexadas de verdad. Si el archivo tiene cuarenta y el índice tiene doce, no generes otro sitemap. Lee el motivo de exclusión de las que faltan. Casi siempre es un noindex, un canonical o una página que Google considera duplicada, no un archivo que «no se ha procesado».
Si la plataforma regenera el archivo sola, confirma que no vuelve a meter lo que acabas de quitar. Un generador que lista todo lo publicado, incluidos gracias y borradores, deshace el trabajo cada noche. En ese caso la solución es excluir esas plantillas en el generador, no borrar a mano una URL cada lunes.
Dos cosas que se llaman igual
Sitemap XML es un archivo. Sitemap HTML es una página. Quien busca «qué es un sitemap» en España se encuentra las dos definiciones en el resumen de IA, y a veces un resultado de mapas que no tiene nada que ver. Si tu duda es «dónde estoy en el plano», esta no es la página. Si tu duda es por qué Google no conoce una URL nueva, sí.
El XML es el que se envía a Search Console. El HTML es opcional. Una web de diez páginas bien enlazadas puede vivir sin un índice HTML. Casi ninguna debería vivir sin saber cuál es su XML y qué URLs contiene.
Qué hace el XML y qué no
Le entrega a Google una lista. El bot puede descubrir URLs por los enlaces, por el historial y por esta lista. En una web pequeña y bien enlazada, el sitemap no es la razón de que te indexen. En una web nueva, o después de publicar un bloque de páginas, acorta el tiempo hasta que Google se entera de que existen.
No hace estas cosas, aunque se vendan así:
No indexa. Una URL en el sitemap y en noindex sigue fuera. El noindex gana.
No posiciona. Estar en la lista no es estar en la primera página.
No limpia errores. Si la URL redirige o da 404, meterla en el sitemap le pide a Google que mire un problema.
No sustituye los enlaces internos. Una página que solo vive en el sitemap y nadie enlaza es una página huérfana con una mención en un archivo.
Qué debe incluir y qué debe quedar fuera
Las URLs canónicas que quieres en el índice: servicios, contacto, artículos vigentes, fichas que se venden.
Fuera, las que redirigen. La lista debe llevar el destino, no el origen de la redirección 301.
Fuera, las que llevan noindex: gracias, borradores, resultados internos de búsqueda.
Fuera, las variantes con parámetros que no son una página distinta.
Fuera, las de prueba y las de un dominio antiguo si ya migraste.
Si el archivo y el índice se contradicen, gana lo que Google encuentra al rastrear. El sitemap no deshace un canonical ni un bloqueo. Esa prioridad está en qué es el SEO técnico.
Dónde se mira
La mayoría de plataformas lo generan solas, en una ruta del tipo /sitemap.xml. Ábrela en el navegador. Tienes que ver URLs de tu dominio, no las de la plantilla de ejemplo. Si ves páginas que borraste hace meses, el generador no se ha actualizado o estás mirando un archivo estático viejo.
En Search Console, el informe de sitemaps dice si Google ha podido leerlo y cuántas URLs ha descubierto. «Descubiertas» no significa «indexadas». El informe de páginas es el que dice si se han guardado. Confundir los dos números es la lectura que más planes de contenido innecesarios provoca.
En el robots.txt se puede dejar la línea que apunta al archivo. Es una ayuda, no una obligación si ya lo enviaste en Search Console. No bloquees el sitemap con el propio robots.txt.
El HTML, para no mezclarlo
Un sitemap HTML es una página con enlaces, a menudo en el pie, del tipo «mapa del sitio». Sirve cuando la navegación es estrecha y una persona no llega a una sección. Google también puede seguir esos enlaces, como sigue cualquier otra página. No se sube como archivo. No lleva etiquetas XML. Y no se usa para esconder, en un listado enorme, lo que no quisiste enlazar en el menú: si no debe indexarse, no lo enlaces ahí tampoco.
Después de una migración o de un borrado
Regenera la lista. Quita las URLs que ya redirigen. Comprueba que las nuevas están. Vuelve a mirar Search Console por si el archivo que lee sigue siendo el antiguo. El contexto de ese cambio está en migrar sin perder posiciones.
Si la web tiene pocos enlaces y páginas que no descubres ni tú, el sitemap no es el proyecto. Lo es la arquitectura. El archivo, entonces, solo documenta un sitio que una persona tampoco puede recorrer. Cuando la lista esté limpia, el trabajo de que cada URL merezca estar en ella es el del SEO, no el de generar otro XML.
Un repaso antes de enviarlo
Abre el XML y lee diez URLs al azar, no solo la primera. Pregúntate si querrías que esa URL saliera en Google. Si la respuesta es no, quítala de la lista antes de enviarla. Comprueba que no hay dominios de prueba, ni http mezclado con https, ni la misma ficha con y sin barra final si una de las dos redirige.
Después de enviarlo, anota la fecha. A la semana, mira en Search Console cuántas de esas URLs están indexadas de verdad. Si el archivo tiene cuarenta y el índice tiene doce, no generes otro sitemap. Lee el motivo de exclusión de las que faltan. Casi siempre es un noindex, un canonical o una página que Google considera duplicada, no un archivo que «no se ha procesado».
Si la plataforma regenera el archivo sola, confirma que no vuelve a meter lo que acabas de quitar. Un generador que lista todo lo publicado, incluidos gracias y borradores, deshace el trabajo cada noche. En ese caso la solución es excluir esas plantillas en el generador, no borrar a mano una URL cada lunes.
Sitemap XML y sitemap HTML
Sitemap XML y sitemap HTML
El resumen de IA de esta consulta ya separa el archivo para el buscador y la página para las personas. La tabla dice para quién es cada uno y qué pasa si lo tratas del revés.
El resumen de IA de esta consulta ya separa el archivo para el buscador y la página para las personas. La tabla dice para quién es cada uno y qué pasa si lo tratas del revés.
Sitemap XML | Sitemap HTML | |
|---|---|---|
Para quién | Para Google y otros buscadores | Para una persona que no encuentra una página |
Dónde vive | Un archivo, a menudo /sitemap.xml | Una URL normal de la web, enlazada en el pie |
Qué consigue | Que el bot conozca URLs que quizá no ha enlazado | Que la persona navegue. No indexa nada por sí solo |
Qué no hace | No obliga a indexar ni quita un noindex | No sustituye al XML ni se envía a Search Console |
Dos cosas que se llaman igual
Sitemap XML es un archivo. Sitemap HTML es una página. Quien busca «qué es un sitemap» en España se encuentra las dos definiciones en el resumen de IA, y a veces un resultado de mapas que no tiene nada que ver. Si tu duda es «dónde estoy en el plano», esta no es la página. Si tu duda es por qué Google no conoce una URL nueva, sí.
El XML es el que se envía a Search Console. El HTML es opcional. Una web de diez páginas bien enlazadas puede vivir sin un índice HTML. Casi ninguna debería vivir sin saber cuál es su XML y qué URLs contiene.
Qué hace el XML y qué no
Le entrega a Google una lista. El bot puede descubrir URLs por los enlaces, por el historial y por esta lista. En una web pequeña y bien enlazada, el sitemap no es la razón de que te indexen. En una web nueva, o después de publicar un bloque de páginas, acorta el tiempo hasta que Google se entera de que existen.
No hace estas cosas, aunque se vendan así:
No indexa. Una URL en el sitemap y en noindex sigue fuera. El noindex gana.
No posiciona. Estar en la lista no es estar en la primera página.
No limpia errores. Si la URL redirige o da 404, meterla en el sitemap le pide a Google que mire un problema.
No sustituye los enlaces internos. Una página que solo vive en el sitemap y nadie enlaza es una página huérfana con una mención en un archivo.
Qué debe incluir y qué debe quedar fuera
Las URLs canónicas que quieres en el índice: servicios, contacto, artículos vigentes, fichas que se venden.
Fuera, las que redirigen. La lista debe llevar el destino, no el origen de la redirección 301.
Fuera, las que llevan noindex: gracias, borradores, resultados internos de búsqueda.
Fuera, las variantes con parámetros que no son una página distinta.
Fuera, las de prueba y las de un dominio antiguo si ya migraste.
Si el archivo y el índice se contradicen, gana lo que Google encuentra al rastrear. El sitemap no deshace un canonical ni un bloqueo. Esa prioridad está en qué es el SEO técnico.
Dónde se mira
La mayoría de plataformas lo generan solas, en una ruta del tipo /sitemap.xml. Ábrela en el navegador. Tienes que ver URLs de tu dominio, no las de la plantilla de ejemplo. Si ves páginas que borraste hace meses, el generador no se ha actualizado o estás mirando un archivo estático viejo.
En Search Console, el informe de sitemaps dice si Google ha podido leerlo y cuántas URLs ha descubierto. «Descubiertas» no significa «indexadas». El informe de páginas es el que dice si se han guardado. Confundir los dos números es la lectura que más planes de contenido innecesarios provoca.
En el robots.txt se puede dejar la línea que apunta al archivo. Es una ayuda, no una obligación si ya lo enviaste en Search Console. No bloquees el sitemap con el propio robots.txt.
El HTML, para no mezclarlo
Un sitemap HTML es una página con enlaces, a menudo en el pie, del tipo «mapa del sitio». Sirve cuando la navegación es estrecha y una persona no llega a una sección. Google también puede seguir esos enlaces, como sigue cualquier otra página. No se sube como archivo. No lleva etiquetas XML. Y no se usa para esconder, en un listado enorme, lo que no quisiste enlazar en el menú: si no debe indexarse, no lo enlaces ahí tampoco.
Después de una migración o de un borrado
Regenera la lista. Quita las URLs que ya redirigen. Comprueba que las nuevas están. Vuelve a mirar Search Console por si el archivo que lee sigue siendo el antiguo. El contexto de ese cambio está en migrar sin perder posiciones.
Si la web tiene pocos enlaces y páginas que no descubres ni tú, el sitemap no es el proyecto. Lo es la arquitectura. El archivo, entonces, solo documenta un sitio que una persona tampoco puede recorrer. Cuando la lista esté limpia, el trabajo de que cada URL merezca estar en ella es el del SEO, no el de generar otro XML.
Un repaso antes de enviarlo
Abre el XML y lee diez URLs al azar, no solo la primera. Pregúntate si querrías que esa URL saliera en Google. Si la respuesta es no, quítala de la lista antes de enviarla. Comprueba que no hay dominios de prueba, ni http mezclado con https, ni la misma ficha con y sin barra final si una de las dos redirige.
Después de enviarlo, anota la fecha. A la semana, mira en Search Console cuántas de esas URLs están indexadas de verdad. Si el archivo tiene cuarenta y el índice tiene doce, no generes otro sitemap. Lee el motivo de exclusión de las que faltan. Casi siempre es un noindex, un canonical o una página que Google considera duplicada, no un archivo que «no se ha procesado».
Si la plataforma regenera el archivo sola, confirma que no vuelve a meter lo que acabas de quitar. Un generador que lista todo lo publicado, incluidos gracias y borradores, deshace el trabajo cada noche. En ese caso la solución es excluir esas plantillas en el generador, no borrar a mano una URL cada lunes.
Conclusión
Conclusión
Publica un XML con solo las URLs que quieres en el índice, envíalo en Search Console y no lo uses como prueba de que ya estás indexado. El HTML, si hace falta, es otra página: un índice para personas, no un archivo para el bot.
Preguntas frecuentes sobre el sitemap
Preguntas frecuentes sobre el sitemap
¿Qué es un sitemap?
Es una lista de direcciones de tu web. En XML, esa lista se la pasas a Google para que descubra URLs. En HTML, es una página que ayuda a una persona a encontrar secciones. No es el mapa de una ciudad ni la ficha de Google Business Profile. Tampoco obliga a indexar lo que incluye.
¿Para qué sirve un sitemap XML?
Sirve para decirle al buscador qué URLs te importan, sobre todo si la web es nueva, si tiene pocas enlaces internos o si acabas de publicar muchas páginas. No indexa. Google puede ignorar una URL de la lista si está en noindex, si redirige o si no merece estar en el índice.
¿Hay que enviar el sitemap a Google?
Sí, una vez, en Search Console, en el informe de sitemaps. También se puede declarar en el robots.txt. Enviarlo no es un botón de indexación. Es la forma de que Google encuentre la lista. Después hay que mirar si esas URLs se indexan de verdad.
¿Un sitemap es un mapa de ubicación?
No. People Also Ask mezcla esta consulta con mapas de sitios físicos. Un sitemap web no enseña una calle ni un plano. Si lo que buscas es salir en Google Maps, el trabajo es la ficha del negocio, no el archivo XML. Son dos proyectos distintos.
¿Necesitas un equipo de Marketing?
Hablemos y hagamos crecer tu negocio

Contruyamos algo increible
Listo para tu proximo proyecto

Contruyamos algo increible
Listo para tu proximo proyecto

Contruyamos algo increible

