Contenido duplicado
El contenido duplicado es contenido idéntico o muy parecido disponible en más de una URL, un problema frecuente en los sitios internacionales.
¿Qué es el contenido duplicado?
El contenido duplicado es contenido idéntico o muy parecido que está disponible en más de una URL, dentro del mismo sitio o en sitios distintos. Las causas típicas son los parámetros de URL, las versiones HTTP y HTTPS o con y sin www, las versiones para imprimir, las variantes de producto y, en los sitios internacionales, el mismo idioma para varios países.
Contrario a un mito muy extendido, Google no penaliza el contenido duplicado como tal. El problema es otro: el buscador elige una URL como original y filtra las demás. Puede que no sea la versión que quieres posicionar, las señales de los enlaces se reparten entre versiones y se desperdicia el presupuesto de rastreo.
A los sitios internacionales les pasa cuando, por ejemplo, México, Colombia y Argentina reciben casi la misma página en español. Las buenas prácticas son:
- Marcar cada versión de país con etiquetas hreflang para que los buscadores entiendan que se dirigen a mercados distintos.
- Darle a cada versión una etiqueta canonical que apunte a sí misma; no hagas que todas apunten a un solo país, o las demás desaparecerán del índice.
- Diferenciar donde importa para el usuario: precios y moneda, datos de contacto, condiciones de envío, ejemplos locales y vocabulario.
Fuera de los sitios internacionales, consolida los duplicados reales con redirecciones 301 o etiquetas canonical y mantén una sola URL indexable por contenido.
