SEO: contenido duplicado — evita confusión de URL y protege visibilidad
Guía práctica para identificar orígenes del contenido duplicado, aplicar canonical, redirecciones y noindex, y verificar que Google indexe la versión correcta.

Qué es el problema y por qué importa
El contenido duplicado ocurre cuando texto o recursos prácticamente idénticos aparecen en varias URL. Desde la perspectiva técnica de SEO la cuestión clave no es un castigo automático, sino la confusión que genera para crawling, indexación y elección de la URL que representará ese contenido en los resultados de búsqueda. Google usa la versión móvil como su base primaria para rastreo e indexación; desde julio de 2024, Google rastrea sitios para Search con Googlebot Smartphone por defecto. Por eso es importante asegurarse de que la versión móvil y la de escritorio tengan paridad de señales relevantes (links internos, canonical, meta robots).
Mecánicas: cómo surge el contenido duplicado
Las fuentes técnicas habituales son:
- URLs con parámetros que generan páginas muy similares (por ejemplo orden, filtros o tracking) y no están normalizadas.
- Versiones HTTP y HTTPS o www/no‑www sin redirección canónica consistente.
- Páginas de facetas/filtrado que generan grandes combinaciones indexables (faceted navigation).
- Versiones de impresión o 'printer-friendly' expuestas como URL separadas.
- Etiquetas, páginas de autor o categorías que repiten fragmentos de contenido.
- Copias por sindicación o scraping en otros dominios que replican artículos completos.
- Sitios de prueba o staging accesibles públicamente sin bloqueo, y versiones multiregión/multilenguaje mal gestionadas.
Estrategias para resolver duplicados (qué hacer y cuándo)
El objetivo es elegir una sola URL canónica por pieza de contenido y asegurarse de que tanto los motores como los usuarios encuentren y consuman esa versión. A continuación las tácticas más usadas y sus casos de aplicación:
1) Redirección 301 — cuando hay duplicados verdaderos
Si dos o más URLs exponen contenido duplicado y una debe reemplazar a las otras de forma permanente, implementa redirecciones 301 desde las versiones duplicadas a la URL canónica. Esto transfiere señales y evita que ambas URLs compitan en ranking. Ejemplo de encabezado de respuesta para una 301:
Respuesta HTTP: 301 Moved Permanently + Location: https://www.ejemplo.com/pagina-canónica
2) rel="canonical" — cuando quieres consolidar versiones sin redirigir
Usa una etiqueta rel="canonical" en la sección <head> para señalar la URL preferida. Esto es útil en colecciones, parámetros y versiones impresas donde no conviene redirigir. Ejemplo:
<link rel="canonical" href="https://www.ejemplo.com/pagina-canónica" />
Recuerda que rel="canonical" es una señal y Google puede elegir otra URL si lo considera más adecuada; por eso conviene que la canonical esté respaldada por redirecciones y enlaces internos coherentes cuando sea posible.
3) meta robots noindex — cuando la URL no aporta valor de búsqueda
Para páginas de bajo valor (p. ej. filtros irrelevantes, resultados vacíos) utiliza <meta name="robots" content="noindex">. Evita combinar noindex con un bloqueo por robots.txt, porque si Google no puede acceder a la página no verá la etiqueta noindex.
4) Hreflang — para control de duplicados por idioma o región
Si el contenido se distribuye en varias versiones lingüísticas, implementa hreflang correctamente para que las versiones no compitan en la misma búsqueda. Cada versión debe apuntar a sí misma y a las otras con atributos hreflang consistentes.
Verificación práctica: cómo diagnosticar duplicados
Usa una combinación de inspección del servidor, análisis del HTML y herramientas de Search Console para decidir la acción apropiada. Las comprobaciones varían según si la URL es tuya o de terceros; para páginas que controlas, URL Inspection en Google Search Console es la fuente más autoritativa para ver cómo Google conoce una página. Para páginas externas, emplea métodos que no requieren acceso a Search Console del publisher.
Comprobaciones rápidas (propias y externas)
- Curl para cabeceras: usa curl -I https://ejemplo.com/uri para ver el código de estado y redirecciones.
- Comprobar la página con un user‑agent diferente: curl -A "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" https://ejemplo.com/uri — útil para detectar diferencias de respuesta por agente; no lo uses en producción para servir distinto contenido a Googlebot (evita cloaking).
- Rendered DOM: abre Chrome DevTools → Elements para confirmar que el enlace o canonical están en el DOM renderizado y visibles.
- URL Inspection (Search Console): para confirmar indexación, canonical elegido por Google y problemas de rastreo en páginas que controlas.
- site:operator para indicios públicos (p. ej. site:ejemplo.com "frase única"). Es una señal útil pero no definitiva sobre indexación.
Comprobaciones de server logs y crawl budget
Analiza los registros de servidor para ver cuántas URLs similares rastrea Googlebot y con qué frecuencia. Si tu sitio tiene muchas versiones indexables de la misma página, puede provocar desperdicio de crawl budget y retrasos en la indexación de contenido nuevo. Prioriza la consolidación de estructuras repetidas (p. ej. parámetros) para optimizar el presupuesto de rastreo.
Errores comunes y cómo evitarlos
- Bloquear con robots.txt páginas que usas para consolidación: si bloqueas una URL que contiene rel="canonical" o meta robots, Google no podrá verla y la directiva perderá efecto.
- Usar rel="canonical" hacia una página inaccesible o redirigida — la canonical debe apuntar a una URL canonizable y accesible.
- No alinear enlaces internos y sitemap con la canonical: si tu sitemap y menús enlazan a versiones distintas, enviarás señales contradictorias.
- Ignorar las versiones móviles: si la versión móvil carece de enlaces internos o canonical, la indexación puede escoger la URL menos deseada.
Guía rápida de decisión: qué aplicar según el caso
- Contenido duplicado permanente entre URLs equivalentes: implementar 301 hacia la versión canonica.
- Variantes útiles para usuarios (p. ej. imprimir): usar rel="canonical" hacia la page principal o servir la versión imprimible dinámicamente sin exponer una URL indexable.
- Páginas de filtro/multifaceta con poco valor: aplicar noindex y bloquear parámetros en herramientas de gestión de parámetros si procede.
- Sindicaciones en otros dominios: pedir la inclusión de rel="canonical" hacia tu original o, si eso no es posible, solicitar que la versión republicada use rel="nofollow"/rel="sponsored" si es un acuerdo comercial. Ten en cuenta la política de Google sobre link spam: enlaces con la finalidad de manipular resultados deben marcarse como rel="sponsored" o rel="nofollow"; evita esquemas que intenten ocultar enlaces pagados.
Casos de prueba y pasos de verificación final
Antes de dar por cerrada una corrección, ejecuta estas pruebas:
- Comprobar cabeceras con curl -I y confirmar que las 301 devuelven Location correcto.
- Verificar el rel="canonical" en el DOM renderizado con Chrome DevTools Elements.
- Usar URL Inspection en Search Console para la versión que controlas y confirmar que Google selecciona la canonical esperada y que no existen errores de indexación.
- Revisar logs para confirmar la disminución de rastreo en URLs antiguas o duplicadas tras la corrección.
Preguntas frecuentes
¿El contenido duplicado provoca una 'penalización'?
No es correcto usar 'penalización' como término genérico. Google puede emitir una acción manual en casos evidentes de spam, pero lo más habitual es que el contenido duplicado cause ineficiencias: división de señales, indexación de la versión no deseada y desperdicio de crawl budget. Actúa sobre las señales técnicas (canonical, 301, noindex) para consolidar la URL que quieres posicionar.
¿Puedo usar robots.txt para evitar duplicados?
Robots.txt puede bloquear el rastreo, pero si bloqueas una página Google no podrá ver etiquetas rel="canonical" o meta robots en ella. Para controlar duplicados en la mayoría de los casos es preferible usar redirecciones 301, rel="canonical" accesible o meta robots noindex. Usa robots.txt solo cuando realmente no quieras exponer recursos al rastreo (p. ej. archivos internos).
¿Qué hago si otro sitio ha copiado mi artículo?
Primero intenta contactar con el propietario y pedir que añadan rel="canonical" hacia tu URL o retiren el contenido. Si es una republicación autorizada negocia marcadores adecuados (rel="canonical" o noindex en la copia). Si se trata de scraping malicioso, considera una solicitud de eliminación por copyright (DMCA) si aplica y monitoriza la indexación con site: y Search Console para tu dominio.
Artículos relacionados

Consejos SEO para mejorar rankings: estrategias prácticas
Consejos prácticos de SEO para mejorar visibilidad: prioriza intención, experiencia de usuario, técnica y enlaces verificados.

Los mejores servicios de SEO (optimización para motores de búsqueda)
Cómo comparar y elegir servicios de SEO: técnicos, de contenido y de enlaces, con listas de verificación y herramientas de comprobación prácticas.

Lista de verificación de SEO on-page para UX y posicionamiento
Checklist práctico de SEO on-page con pasos, herramientas y comprobaciones para mejorar la experiencia de usuario y la visibilidad en buscadores.
