Contenido duplicado y canibalización SEO: cómo corregirlos
Explico por qué el contenido duplicado y la canibalización SEO son problemas distintos, cómo detecto cada uno y qué corrijo primero.
¿Contenido duplicado y canibalización SEO son lo mismo? No. Hablo de contenido duplicado cuando varias URLs ofrecen una versión idéntica o muy parecida. Hablo de canibalización cuando dos páginas intentan resolver la misma intención de búsqueda y no queda claro cuál debe ocupar ese sitio.
¿Por qué importa distinguirlos? Porque no los arreglo igual. Una variante técnica puede necesitar una canonical. Dos artículos que hacen el mismo trabajo suelen necesitar una decisión editorial: fusionar, redirigir o dar a cada uno una función distinta. Aplicar la misma receta a todos los casos es una forma bastante rápida de arreglar una página y estropear otra.
Puntos clave
- Tener textos parecidos no implica que exista una penalización. Google explica que cierta duplicación es normal y agrupa las versiones para elegir una canonical.
- Repetir una palabra clave tampoco demuestra canibalización. Yo comparo la intención, el tipo de página y las consultas por las que aparece cada URL.
- Uso
rel="canonical"para versiones que deben seguir accesibles, no para esconder dos artículos que compiten por el mismo tema.- Si dos URLs cumplen la misma función, elijo una principal, incorporo lo útil de la otra y redirijo la que sobra.
- Si resuelven necesidades distintas, las mantengo y hago visible esa diferencia en el título, los encabezados, el contenido y los enlaces internos.
Contenido duplicado y canibalización SEO no son lo mismo
Google define la canonicalización como el proceso de elegir la URL representativa dentro de un grupo de páginas duplicadas o muy similares. Es decir, puede encontrar varias versiones, agruparlas y mostrar una como principal. La propia guía de canonicalización de Google aclara que parte del contenido duplicado es normal y no incumple sus políticas de spam.
Un caso típico aparece cuando una ficha de producto se abre con parámetros de filtro, cuando conviven HTTP y HTTPS o cuando una web sirve el mismo contenido con varias rutas.
La canibalización SEO es otra cosa. Es el nombre que usamos para describir un solapamiento de intención. Por ejemplo, publico una guía titulada “Cómo elegir zapatillas para correr” y meses después otra llamada “Guía para escoger zapatillas de running”. Las dos quieren responder a la misma persona, en el mismo momento y con una respuesta casi igual.
Yo lo resumo así:
| Situación | Qué se repite | Decisión habitual |
|---|---|---|
| URL con parámetros y ficha limpia | El contenido y la función | Canonical hacia la versión preferida |
| Dos guías sobre la misma pregunta | La intención de búsqueda | Fusionar, redirigir o reorientar |
| Servicio y guía sobre el mismo tema | El tema, pero no la intención | Mantener y diferenciar |
| Página antigua reemplazada por otra | La función, con una URL que ya sobra | Redirección permanente |
La palabra compartida no decide nada. Puedo tener una página de servicio sobre auditoría SEO y una guía que explique cómo hacer una auditoría. Una responde a quien quiere contratar. La otra, a quien quiere aprender. Comparten entidad, pero hacen trabajos distintos.
Cuándo dos URLs compiten de verdad
¿Cómo sé si tengo canibalización? No me basta con que una herramienta encuentre títulos parecidos. Busco varias señales juntas.
La primera es la intención. Leo ambas páginas y termino esta frase para cada una: “Esta URL existe para ayudar a alguien que quiere…”. Si la respuesta es la misma, sigo investigando. Si una página informa y otra vende un servicio, ya tengo una diferencia importante.
La segunda señal está en los resultados. Busco la consulta principal y reviso qué tipo de páginas muestra Google. Si aparecen guías y yo tengo dos guías casi intercambiables, el solapamiento es probable.
La tercera está en Search Console. En el informe de rendimiento filtro una consulta y abro la pestaña de páginas. La documentación oficial explica este recorrido en las tareas habituales del informe de rendimiento. Si dos URLs reciben impresiones para el mismo grupo de consultas, comparo fechas, clics y propósito.
Que aparezcan dos URLs no demuestra el problema por sí solo. Yo lo marco cuando persiguen la misma intención, se alternan sin una función clara y ninguna consolida una respuesta mejor.
Dos URLs con el mismo trabajo no son cobertura. Son dos personas editando la misma celda del Excel.
Cómo detecto el problema paso a paso
Cuando reviso una web, sigo este orden. La parte poco vistosa va primero porque es la que evita tomar decisiones a ciegas.
1. Hago un inventario de URLs indexables
Saco las páginas que Google puede indexar desde el sitemap, el CMS o un rastreo. No me quedo solo con el blog. Incluyo categorías, etiquetas, filtros, fichas, páginas de aterrizaje y cualquier versión que responda con código 200.
Después anoto título, H1, canonical, estado de indexación y enlaces internos. Si el problema parece más amplio, mi checklist de auditoría SEO técnica explica cómo revisar rastreo, indexación y arquitectura por orden.
2. Asigno una intención y una función a cada página
Agrupo las URLs por tema, pero decido por intención. Para cada una escribo una búsqueda principal, el problema que resuelve, el tipo de página y la acción que espero después de la lectura.
Aquí es donde suelen aparecer los duplicados editoriales. Dos títulos pueden ser diferentes y esconder el mismo artículo. También ocurre al revés: dos páginas repiten términos, pero una es una comparación y otra un tutorial. Por eso el criterio no se puede sustituir con una hoja llena de coincidencias.
Si todavía no tengo ese mapa, vuelvo al keyword research con IA y asigno una URL principal a cada grupo de intención. La IA me ayuda a ordenar términos. La decisión de crear, unir o mantener una página sigue siendo mía.
3. Compruebo consultas y páginas en Search Console
Filtro las consultas relacionadas con el tema y miro qué URLs han recibido impresiones. Comparo un periodo suficiente para evitar que un par de días me lleve a una conclusión precipitada.
Después invierto el análisis. Filtro cada página y observo su conjunto de consultas. Si ambas atraen búsquedas distintas, tengo una razón para mantenerlas. Si comparten casi todo y el contenido persigue el mismo objetivo, tengo una candidata a fusión.
Ten en cuenta una limitación. La documentación sobre dimensiones y agrupación de datos explica que Search Console no muestra todas las consultas y atribuye buena parte de los datos a la URL canonical. Lo uso como evidencia, no como oráculo. Completo el diagnóstico leyendo las páginas y revisando los resultados de búsqueda.
4. Inspecciono la canonical elegida por Google
En la herramienta de inspección comparo la canonical declarada por mí con la elegida por Google. Si no coinciden, reviso señales técnicas y similitud. Google recomienda comprobarlo de esta forma en su guía para resolver problemas de canonicalización.
Una canonical inesperada puede señalar versiones técnicas mal configuradas. También puede indicar que dos páginas se parecen tanto que Google las ha agrupado. La etiqueta no sustituye al diagnóstico.
Qué hago con cada caso
Después del inventario llega la parte importante: elegir. Estas son las cuatro decisiones que uso.
Mantengo ambas páginas y las diferencio
Elijo esta opción cuando cada URL resuelve una intención propia. Refuerzo la diferencia en el título, la introducción, los encabezados y los ejemplos. También reviso los textos ancla de los enlaces internos para que cada uno describa el trabajo concreto de su destino.
Por ejemplo, una guía sobre qué es el SEO para pymes explica el canal. Mi página de consultor SEO en Málaga presenta un servicio. No necesito eliminar una. Necesito que ninguna intente hacer el trabajo de la otra.
Fusiono el contenido y aplico una redirección
Lo hago cuando dos páginas responden a la misma intención y una no aporta una función propia. Elijo la URL que mejor representa el tema. Para decidir, reviso relevancia, contenido útil, enlaces, rendimiento y facilidad de mantenerla.
Incorporo en la página principal cualquier parte valiosa de la secundaria. Después aplico una redirección permanente desde la URL retirada, actualizo los enlaces internos y saco la antigua del sitemap. No dejo una cadena de redirecciones ni enlaces apuntando a la ruta que acabo de jubilar.
Uso rel="canonical" para variantes necesarias
Uso canonical cuando necesito mantener accesible una variante duplicada o muy parecida, pero quiero indicar cuál debe consolidar las señales. Puede pasar con parámetros, ordenaciones o formatos alternativos.
Google considera las redirecciones y rel="canonical" señales fuertes, mientras que incluir una URL en el sitemap es una señal más débil. Lo detalla en su guía para indicar una URL canonical. Mantengo las señales coherentes: canonical, enlaces internos y sitemap deben apuntar hacia la misma versión preferida.
No uso canonical para evitar decidir entre dos artículos que deberían ser diferentes. Tampoco mezclo noindex y canonical como si fueran dos votos para lo mismo. Google desaconseja usar noindex para elegir una canonical dentro de un sitio.
Retiro de Google una página que no debe aparecer
Elijo noindex cuando una página debe seguir disponible para personas o procesos, pero no tiene valor como resultado de búsqueda. No lo utilizo para una URL que ya tiene señales útiles y podría integrarse en otra. En ese caso estudio la fusión y la redirección.
Errores que evito al corregir la canibalización
El primero es borrar la página con menos clics sin mirar nada más. Puede ser una URL nueva, una pieza con enlaces valiosos o la que responde mejor a una intención secundaria.
El segundo es cambiar títulos y esperar que dos contenidos iguales pasen a ser distintos.
El tercero es publicar una pieza nueva antes de revisar las anteriores. Crear contenido es fácil. Mantener un mapa coherente cuesta más, y justo por eso da resultado.
Cómo evito crear el problema otra vez
En mi etapa in-house gestioné cinco webs de marca a la vez y coordiné contenidos entre blog, newsletter y LinkedIn. No es el mismo problema que competir dentro de Google, pero me dejó una lección útil: cada pieza necesita una función antes de producirla.
Ahora mantengo un mapa sencillo con tema, intención, tipo de página, URL principal, estado y enlaces relacionados. Antes de aprobar una idea busco el tema en la web y leo las piezas más cercanas. Si ya existe una URL que puede responder mejor con una actualización, no creo otra por cumplir el calendario.
También dejo por escrito lo que el nuevo contenido no debe cubrir. Ese límite evita que un artículo específico acabe creciendo hasta repetir el pilar completo. Enlazo hacia la página principal del tema y desde el contenido relacionado devuelvo un enlace contextual cuando aporta valor.
¿Hace falta una herramienta compleja? No. Una hoja bien mantenida sirve para empezar. Aquí lo importante es que una búsqueda tenga una respuesta principal y que la arquitectura la señale de forma coherente.
Preguntas frecuentes
¿El contenido duplicado provoca una penalización de Google?
No de forma automática. Google reconoce que cierta duplicación es normal y elige una URL representativa dentro del grupo. Demasiadas versiones dificultan la medición y pueden hacer que escoja una canonical distinta de la que prefiero.
¿Dos páginas posicionadas para la misma palabra clave siempre se canibalizan?
No. Compruebo si responden a la misma intención y si cumplen la misma función. Una guía y una página de servicio pueden aparecer para términos cercanos y seguir siendo necesarias. El problema llega cuando son intercambiables.
¿Qué página conservo al fusionar dos contenidos?
Conservo la que mejor pueda convertirse en la respuesta principal. Reviso su ajuste con la intención, la calidad del contenido, sus enlaces y su rendimiento. No decido solo por antigüedad o por número de clics.
¿Cuándo veré el cambio después de corregirlo?
No doy un plazo fijo. Google necesita volver a rastrear y procesar las señales. Cuando termino, compruebo sitemap y enlaces, solicito indexación para las URLs importantes y sigo las consultas en Search Console.
Qué revisaría ahora
No necesito borrar media web para resolver una canibalización. Necesito saber qué URL responde a cada intención y tomar una decisión coherente. Si dos páginas tienen trabajos distintos, las diferencio. Si hacen el mismo, concentro las señales en una sola.
Empieza con dos URLs, su consulta principal y su función. Paso a paso. Si prefieres que revise la arquitectura y te diga dónde se repiten las intenciones, puedes pedir mi diagnóstico SEO.