Skip to content
Buscar

Canonical tag: consolida duplicados y clarifica páginas

Aprende a usar rel="canonical" correctamente: definición, mecánica entre crawling/indexación/ranking, verificación con herramientas y errores frecuentes.

Etiqueta canónica: consolidar duplicados y aclarar páginas

Qué es la canonical tag

La canonical tag (implementada mediante el elemento HTML <link rel="canonical" href="https://example.com/pagina-preferida" />) es una señal que indica a los motores de búsqueda qué URL debe considerarse la versión preferida cuando hay páginas con contenido idéntico o muy similar. No es una orden: actúa como una sugerencia para consolidar señales de SEO como link equity y relevancia interna.

Su uso más frecuente aparece cuando un mismo contenido es accesible desde varias URL por parámetros, filtros, versiones imprimibles o rutas del CMS. Bien aplicada, reduce ruido técnico y ayuda a que el índice muestre la URL que tú prefieres; mal aplicada, genera señales contradictorias que complican crawling e indexación.

Cómo funciona (mecánica técnica)

Crawl, indexación y ranking: qué controla la canonical tag

Es útil distinguir tres etapas: crawling (descubrimiento y fetch), indexación (qué se guarda en el índice) y ranking (cómo se ordenan resultados). La canonical tag influye sobre la indexación y la consolidación de señales entre páginas, pero no es un control directo del ranking. Además, es una pista que los motores pueden aceptar o ignorar si encuentran señales contradictorias.

Tipos de canonical y comportamiento práctico

Pautas clave:

  • Auto-referencial: cada página apunta a sí misma; reduce ambigüedad y es la configuración recomendada por defecto.
  • Canónico cruzado (cross-domain): una página puede canonicalizar a una URL en otro dominio; es aceptado por motores modernos siempre que la URL objetivo sea accesible.
  • Canonical a nivel de parámetro: sitúa la URL preferida cuando los parámetros solo afectan trazabilidad o filtrado, no el contenido relevante.

Cuándo usarla y cuándo evitarla

Casos donde la canonical tag aporta valor:

  • Variantes de URL que devuelven esencialmente el mismo contenido (p. ej. parámetros de tracking).
  • Contenido duplicado creado por CMS (p. ej. páginas imprimibles o rutas con y sin trailing slash).
  • Migraciones o consolidación de secciones donde quieres que una URL reciba señales históricas.

Situaciones donde suele evitarse o requerir precaución:

  • Canonicalizar páginas que ofrecen contenido único o valioso hacia una única URL (por ejemplo, canonicalizar todas las páginas de producto a la página principal) — esto borra señales de páginas con valor propio.
  • Canonical apuntando a páginas que devuelven estados no 200 (404, 410) o están bloqueadas por robots.txt; eso puede invalidar la sugerencia.

Implementación práctica y ejemplos

Buenas prácticas de implementación

  • Usa URL canónicas absolutas y completas (incluye https:// y dominio). Evita URLs relativas por consistencia.
  • Asegura que la URL objetivo responde con 200 y no está bloqueada por robots.txt ni por cabeceras X-Robots-Tag.
  • Mantén la coherencia entre canonical, hreflang y señales de enlazado interno. Señales contradictorias generan incertidumbre sobre la URL preferida.

Ejemplos de uso

Self-referencial (recomendado como estándar): <link rel="canonical" href="https://www.tusitio.com/mi-pagina/" />.

Canonical para variantes con parámetros: <link rel="canonical" href="https://www.tusitio.com/producto/sku123/" />

Cross-domain canonical (audita permisos y accesibilidad): <link rel="canonical" href="https://otra-web.com/articulo-equivalente/" />

Verificación y troubleshooting

Comprobaciones técnicas desde fuera del sitio

Si no eres propietario del dominio, usa herramientas que inspeccionen la página pública:

  1. Ver el HTML fuente (view-source) o la DOM renderizada en el Elements panel de Chrome DevTools para confirmar que la etiqueta aparece en el head y no se inyecta tarde por JavaScript.
  2. Inspeccionar cabeceras con curl para comprobar estado HTTP: curl -I https://example.com/pagina?utm=xyz (devuelve solo cabeceras).
  3. Para ver el HTML que un user-agent específico recibe, usa curl sin -I y con -A: curl -A "Googlebot/2.1 (+http://www.googlebot.com/bot.html)" https://example.com/pagina?utm=xyz — así inspeccionas la respuesta completa para ese agente.

Otros pasos útiles: comprobar la presencia de X-Robots-Tag en cabeceras, inspeccionar redirecciones y revisar que la URL canónica no devuelva códigos de error o redirect loops.

Comprobaciones desde tu propio sitio (propietario)

  • Google Search Console — URL Inspection muestra la canonical declarada por ti y la canonical seleccionada por Google; usa esa información para detectar discrepancias.
  • Registros de servidor (server logs) — confirma qué URL solicitó Googlebot y qué respuesta recibió para diagnosticar cadenas de canonical o redirecciones no deseadas.

Errores comunes y cómo resolverlos

  • Canonical a una URL que devuelve 404/410 o está bloqueada por robots.txt: revisa estado HTTP y accesibilidad antes de apuntar la canonical.
  • Conflicto entre canonical y noindex o X-Robots-Tag: si la página fuente tiene noindex, o la objetivo tiene noindex, los motores pueden ignorar la canonical o elegir otra URL; prioriza coherencia.
  • Canonical en el body o inyectada tardíamente por JavaScript: si el crawler no ve la etiqueta en el head al fetch, la sugerencia puede perder fuerza; implementa preferentemente desde el servidor.
  • Cadenas o bucles de canonical: A → B → C (o A → B → A) complican la selección de la URL preferida. Simplifica apuntando todas las variantes a la URL final deseada.

Checklist rápida antes de desplegar cambios

  1. Verifica que la URL canónica es absoluta y responde con 200.
  2. Confirma que el canonical aparece en el head del HTML renderizado y no solo después de la ejecución de scripts.
  3. Revisa coherencia con hreflang, noindex y redirecciones; evita señales contradictorias.
  4. Prueba cambios en un entorno controlado y monitoriza los efectos con URL Inspection y server logs antes de desplegar a todo el sitio.

FAQ

¿Puedo usar canonical entre distintos dominios?

Sí; los motores aceptan canonical cross-domain siempre que la URL objetivo sea accesible y devuelva 200. Ten en cuenta que sigue siendo una pista y que señales adicionales (enlaces, señales de contenido) influyen en la selección final.

¿Debería canonicalizar las páginas paginadas a la primera página?

No es la práctica recomendada si cada página paginada contiene contenido único. En la mayoría de casos es mejor que cada página sea self-referencial y mantener una navegación clara. Si existe una vista "ver todo" que presenta todo el contenido en una sola URL y esa vista es valiosa, puedes canonicalizar las páginas paginadas hacia esa vista en escenarios específicos, pero evalúa el impacto en experiencia y crawl antes de hacerlo.

¿Cómo sé si Google está usando mi canonical o ha elegido otra URL?

Para las páginas que administras, usa URL Inspection en Google Search Console: muestra la canonical declarada y la canonical seleccionada por Google. Para dominios que no administras, el operador site: y la inspección manual del HTML son indicativos pero no definitivos.

Si una página tiene rel="canonical" a otra y también recibe enlaces, ¿las señales se consolidan?

La intención de la canonical es precisamente consolidar señales. En la práctica, motores modernos intentan distribuir o consolidar señales según su algoritmo; la canonical ayuda a indicar tu preferencia, pero la combinación final depende de múltiples señales y no existe una regla pública que describa matemáticamente esa consolidación.

Artículos relacionados