# Sitemap, robots.txt y canonical

El sitemap enumera URLs, robots.txt orienta el rastreo y canonical señala una versión preferida. Sitemap, robots y canonical suelen aparecer juntos en una propuesta técnica, pero no hacen el mismo trabajo. Una URL de campaña puede declarar como canonical la dirección limpia. Bloquear el rastreo no garantiza eliminar una URL de resultados.

## Asigne una función distinta a cada mecanismo

Sitemap, robots y canonical suelen aparecer juntos en una propuesta técnica, pero no hacen el mismo trabajo. El sitemap comunica direcciones y relaciones que considera importantes. Robots regula determinadas instrucciones de rastreo. Canonical señala una versión preferida de contenido. Utilizar uno no reemplaza los otros.

Un ejemplo sencillo es un sitio con páginas públicas, administración y versiones Markdown de artículos. Las páginas públicas canónicas pueden entrar en el sitemap. La administración necesita autenticación real y no debería formar parte del inventario de búsqueda. Las versiones alternativas deben relacionarse de forma coherente con sus páginas humanas.

No confunda rastreo e indexación. Impedir que un robot lea una página puede impedir también que vea una directiva de no indexación situada en ella. Las decisiones deben entenderse como un conjunto. Robots no es un mecanismo para proteger datos privados.

## Prepare un inventario antes de escribir reglas

Liste las páginas que desea hacer públicas y compruebe que responden correctamente. Un sitemap no debería incluir direcciones inexistentes, borradores o resultados de formularios. Tampoco hace falta añadir cada imagen auxiliar o copia técnica sin una razón específica.

Las URL canónicas deben corresponder a contenido real. Si una página se publica con distintas variantes, examine cómo se enlaza internamente y qué versión se presenta como principal. Señales contradictorias complican la interpretación y también la navegación humana.

Para varias lenguas, mantenga canónicas apropiadas para cada versión y relaciones de idioma separadas. Una traducción completa no debería apuntar indiscriminadamente al inglés como si fuera la única página válida. El modelo de rutas compartido puede evitar que cada archivo tenga una interpretación diferente.

El sitemap ayuda al descubrimiento, pero no asegura rastreo o indexación. Conviene mantener sus fechas vinculadas a modificaciones reales. [Guía oficial de sitemaps](https://developers.google.com/search/docs/crawling-indexing/sitemaps/overview).

## Compruebe la respuesta publicada

Después del despliegue, solicite los archivos y algunas páginas desde el dominio real. Un robots correcto en el repositorio puede no ser el único comportamiento aplicado si el proveedor añade reglas. Revise también restricciones configuradas en el panel.

Pruebe direcciones canónicas, redirecciones y URL inexistentes. Un error que devuelve la portada con estado correcto puede ocultar enlaces rotos. Compruebe igualmente que las páginas que necesitan mostrar una directiva puedan ser leídas según la política elegida.

Mantenga un mapa sencillo de decisiones: página pública indexable, página pública no indexable y área privada. No necesita presentar esa clasificación como un estándar universal; sirve para organizar el proyecto. La regla importante es que los mecanismos técnicos correspondan al objetivo de cada recurso. Así, sitemap, robots y canonical trabajan de forma complementaria sin convertir una señal de búsqueda en una falsa barrera de seguridad. Compruebe además una URL retirada y una traducción existente para confirmar que cada regla actúa sobre el recurso esperado.

## Lista práctica

- Usar URLs absolutas
- Revisar reglas
- Alinear canonicals

**Un ejemplo concreto:** Una URL de campaña puede declarar como canonical la dirección limpia.

**Un límite importante:** Bloquear el rastreo no garantiza eliminar una URL de resultados.

## Siguiente paso

[Cuéntele su proyecto a Orvunweb](/es/iniciar-proyecto/)

## Lecturas relacionadas

- [Lista de SEO técnico para una nueva web](/es/blog/lista-de-seo-tecnico-para-una-nueva-web/)
- [Cómo descubre Google una nueva web](/es/blog/como-descubre-google-una-nueva-web/)
- [Para qué sirve hreflang](/es/blog/para-que-sirve-hreflang/)
- [Sitio web empresarial](/es/servicios/sitio-empresarial/)
- [Comparar paquetes](/es/precios/)


## Servicios relacionados

- [Sitio empresarial](/es/servicios/sitio-empresarial/)

---

Locale: es
Canonical: https://orvunweb.com/es/blog/sitemap-robots-txt-y-canonical/
Updated: 2026-09-16


- [Google Search Central — Canonical URLs](https://developers.google.com/search/docs/crawling-indexing/consolidate-duplicate-urls)