El contenido duplicado ocurre cuando el mismo texto o textos muy similares existen en varias URL — en el mismo sitio o en sitios distintos — confundiendo a Google sobre qué versión posicionar.
El contenido duplicado existe cuando bloques sustanciales de texto idéntico o muy similar aparecen en varias direcciones web. Tipos internos: páginas de categoría con paginación (page/2, page/3), filtros de producto con el mismo contenido, URL con parámetros (product?sort=price), versiones http vs https o www vs sin www. Tipos externos: contenido copiado de otros sitios o distribuido en varios dominios propios sin canonicalización. Google intenta elegir una versión canónica — y puede equivocarse.
El contenido duplicado interno diluye la autoridad de posicionamiento entre versiones en lugar de consolidarla. Externamente, el contenido copiado puede penalizarse. La solución: etiquetas canónicas bien configuradas, redirecciones 301 y crear contenido único por página.
Fuente: Google Search Central — Duplicate ContentLa etiqueta canónica (rel="canonical") indica a Google cuál es la versión principal de una página cuando existen URL similares o duplicadas, evitando penalizaciones por contenido duplicado.
El SEO técnico abarca las optimizaciones de la infraestructura de tu sitio — rastreabilidad, indexación, velocidad de carga, HTTPS y estructura de datos — que permiten a Google encontrar y entender tus páginas.
El robots.txt es un archivo de texto colocado en la raíz del sitio que indica a los crawlers (Google, Bing, GPTBot) qué páginas pueden o no rastrear e indexar.
La rastreabilidad es la capacidad de los robots de Google de acceder, navegar y leer las páginas de tu sitio — un requisito previo esencial para la indexación y el posicionamiento.
Explora cómo aplicar este concepto a tu sector y tu ciudad.