3 de octubre de 2026
Audita primero: 3 arreglos para duplicados bilingües
Arreglar el contenido duplicado en sitios bilingües implica tres cosas que trabajan en equipo: hreflang para marcar las relaciones entre idiomas, etiquetas canónicas o redirecciones para resolver las URLs idénticas, y localización de verdad en lugar de traducción literal. Los duplicados accidentales rara vez provocan penalizaciones manuales, pero sí diluyen las señales de posicionamiento y desperdician el presupuesto de rastreo. El resto de esta guía cubre las reglas técnicas, un checklist de auditoría por prioridades, y maneras de probar tus arreglos antes de dar el trabajo por terminado.
En resumen:
- Las etiquetas hreflang bien hechas deben ser recíprocas y coincidir con exactitud con los códigos de región o idioma del contenido, para evitar problemas de indexación y mejorar las señales de posicionamiento.
- Las etiquetas canónicas solo deben usarse para duplicados del mismo idioma, mientras que hreflang maneja las relaciones entre idiomas distintos; usarlas mal puede causar bucles canónicos y errores de indexación.
- La localización de verdad requiere reescribir ejemplos, ajustar fechas y moneda, y adaptar el contenido al contexto cultural de cada audiencia, no solo traducir palabras.
- La estructura de URLs influye en la complejidad del manejo: los subdirectorios ofrecen un mantenimiento más fácil y una mejor implementación de hreflang que los subdominios o los dominios por país.
- Prioriza arreglar primero los pares de duplicados con mucho tráfico usando redirecciones o canónicos, luego repara la reciprocidad del hreflang, y por último reescribe el contenido para obtener los mejores resultados.
Tabla de contenidos
- Por qué el contenido duplicado importa en sitios bilingües y multilingües
- Señales técnicas: cuándo usar hreflang, canónico, redirecciones y noindex
- Mejores prácticas de contenido y localización para evitar traducciones casi duplicadas
- Estructura de URLs y arquitectura del sitio para sitios bilingües
- Checklist de auditoría y arreglo: remediación paso a paso para páginas bilingües duplicadas
- Errores comunes y procedimientos de prueba para implementaciones multilingües
- Nota del autor y casos destacados de clientes
- Manejo de duplicados en contenido generado por usuarios entre idiomas
- Manejo de contenido duplicado en navegación dinámica o por facetas
- Impacto del contenido duplicado en el posicionamiento SEO de sitios bilingües y multilingües
- Uso de etiquetas de segmentación por idioma y región más allá de hreflang
- Estrategias de diferenciación de contenido para minimizar la duplicación
- Qué arreglar primero cuando los recursos son limitados
- Una opción administrada para consultorios que prefieren tercerizar esto
- Fuentes
- Preguntas frecuentes
Por qué el contenido duplicado importa en sitios bilingües y multilingües
Cuando Google encuentra varias URLs en tu sitio con contenido esencialmente igual, elige una como la versión canónica e ignora prácticamente el resto para efectos de posicionamiento. Suena inofensivo hasta que te das cuenta de lo que cuesta. La misma fuente señala que los duplicados por lo general no provocan una penalización manual, pero reparten la autoridad de enlaces entre versiones que debieron haberse consolidado en una sola, y queman el presupuesto de rastreo que pudo haber servido para indexar tus páginas más nuevas. Se estima que entre un cuarto y un tercio de todo el contenido web es duplicado de alguna forma, así que el problema es común, no raro.
Los sitios bilingües tienen su propia versión de este problema. Una página en español que en realidad no es más que una página en inglés pasada por un plugin de traducción, con la misma estructura, los mismos ejemplos y los mismos enlaces internos, Google la lee como un casi-clon en lugar de un recurso distinto para una audiencia distinta. El buscador tiene que adivinar cuál versión posicionar, y seguido adivina mal.
Para sitios bilingües con mucho contenido, los efectos colaterales aparecen en lugares predecibles:
- Páginas que deberían posicionar para búsquedas en español quedan por debajo de competidores más flojos pero con mejores señales.
- El contenido nuevo tarda más en rastrearse porque los bots gastan tiempo volviendo a visitar URLs casi idénticas.
- Los backlinks que gana una versión de idioma nunca fortalecen la otra, porque las dos páginas compiten en lugar de complementarse.
Nada de esto requiere mala intención. Pasa por default cuando un sitio bilingüe se construye sin un plan para señalar con claridad las relaciones entre idiomas.
Señales técnicas: cuándo usar hreflang, canónico, redirecciones y noindex
Cada una de estas cuatro herramientas resuelve un problema distinto, y usar la equivocada es la razón más común por la que los sitios bilingües rinden por debajo de lo esperado.
Hreflang le dice a Google qué página sirve qué idioma o región, y solo funciona cuando la relación es recíproca: si tu página en inglés apunta a tu página en español, la página en español debe apuntar de regreso. La guía de Google sobre sitios multirregionales es muy clara al respecto. Los códigos comunes incluyen en para inglés, es-419 para español latinoamericano y es-ES para el español de España, entre otros; no necesitas una lista exhaustiva, solo los códigos que correspondan a tus audiencias reales.
Las etiquetas canónicas resuelven un problema distinto: los duplicados del mismo idioma. Si tienes dos URLs en inglés con contenido casi igual (una landing de temporada y su gemela permanente, por ejemplo), la documentación de canonización de Google recomienda elegir una como la preferida y apuntar la otra hacia ella con rel=“canonical”, usándola junto con hreflang, no en su lugar.
Este es el orden de decisión:
- Mismo contenido, mismo idioma, URL distinta: usa rel=“canonical” para apuntar a la versión preferida.
- Mismo contenido, idioma distinto: usa hreflang recíproco, no hace falta canónico entre ellas.
- URL vieja reemplazada de forma permanente: usa una redirección 301, no una etiqueta canónica.
- Duplicado flojo o de poco valor sin razón de SEO para existir: ponle noindex en lugar de tratar de consolidar señales.
Las malas configuraciones son comunes: etiquetas hreflang que apuntan en un sentido pero no de regreso, códigos de idioma que no coinciden con el contenido real, etiquetas canónicas que apuntan a una página que a su vez canoniza hacia otra (un bucle canónico), y clústeres de hreflang que nunca se actualizaron después de que cambió una URL.
Tip profesional: Pasa una sola página por una herramienta de prueba de hreflang y verifica que cada URL alterna de la lista devuelva un estado 200 y apunte de regreso a la página desde la que empezaste.
Mejores prácticas de contenido y localización para evitar traducciones casi duplicadas
Las señales técnicas solo funcionan si el contenido debajo de ellas es genuinamente distinto. Si traduces las palabras pero dejas los mismos ejemplos, los mismos formatos de fecha y las mismas llamadas a la acción, Google aún puede tratar las páginas como duplicadas cuando el contenido principal no muestra variación significativa, un punto que la guía de canonización de Google deja claro directamente: traducir la interfaz dejando el cuerpo sin cambios sigue leyéndose como contenido duplicado.
La transcreación va más allá de la traducción. Una página en español dirigida a lectores hispanos debería usar sus propios ejemplos, sus propios modismos y sus propias referencias culturales, en lugar de ser un espejo palabra por palabra de la versión en inglés. Las fechas, las unidades de medida y las referencias de moneda deberían coincidir con lo que el lector realmente espera, no con lo que resultó cómodo copiar. La guía de la industria sobre sitios multilingües recomienda este tipo de localización precisamente para evitar páginas casi duplicadas y mejorar la experiencia de quien las lee.
Las etiquetas de título, las meta descripciones y los encabezados necesitan el mismo trato. Es común ver un sitio bilingüe con una página de cuerpo perfectamente traducida debajo de un título que lo autotraduje un plugin y nunca nadie revisó, lo que mata la tasa de clics en los resultados de búsqueda.
Un checklist corto para equipos de localización:
- Reescribe los ejemplos y las referencias de casos para la audiencia meta, no solo las oraciones alrededor de ellos.
- Localiza las etiquetas de título, las meta descripciones y los encabezados por separado del cuerpo del texto.
- Ajusta fechas, unidades y moneda para que coincidan con las expectativas del lector.
- Que un hablante nativo revise el tono, no solo la gramática.
Tip profesional: Pídele a tu traductor que marque cualquier oración que copió con solo sustituciones de palabras. Esas son las que más probablemente se lean como contenido duplicado.
Estructura de URLs y arquitectura del sitio para sitios bilingües
Tu estructura de URLs decide cuánto trabajo manual de señalización vas a estar haciendo por años. Los subdirectorios (ejemplo.com/es/) son los más fáciles de manejar, heredan la autoridad del dominio principal y funcionan de forma limpia con hreflang porque cada versión de idioma vive bajo una misma raíz. Los subdominios (es.ejemplo.com) separan las versiones de idioma de forma más limpia para organizaciones grandes, pero requieren su propio presupuesto de rastreo e impulso de construcción de enlaces, ya que Google puede tratarlos como propiedades semiindependientes. Los dominios de primer nivel por país (ejemplo.es) ofrecen la señal geográfica más fuerte, pero significan empezar de cero en autoridad de dominio para cada uno, y rara vez valen la pena a menos que operes negocios completamente separados por país.
- Subdirectorios: los más sencillos de mantener, el hreflang más fácil de configurar, comparten autoridad entre idiomas.
- Subdominios: separación más limpia para equipos grandes, pero dividen el presupuesto de rastreo y la autoridad de backlinks.
- ccTLDs: la señal de geosegmentación más fuerte, pero cada dominio empieza sin autoridad heredada.
La arquitectura también decide cuánto trabajo canónico necesitas. Una estructura de subdirectorios con patrones de URL consistentes (/en/servicios/ y /es/servicios/) hace que mantener el hreflang recíproco sea casi mecánico. Una arquitectura dispersa, donde parte del contenido vive en subdominios y parte en el dominio principal, multiplica la cantidad de clústeres de hreflang que tienes que rastrear y la cantidad de lugares donde un enlace recíproco se puede romper en silencio.
Para la mayoría de los sitios de servicios profesionales, los subdirectorios son la opción práctica. La excepción es un negocio que corre operaciones genuinamente separadas por país, con equipos distintos, calendarios de contenido distintos y entidades legales distintas, donde una división por ccTLD o subdominio puede reflejar cómo funciona el negocio de verdad.
Checklist de auditoría y arreglo: remediación paso a paso para páginas bilingües duplicadas
Empieza la detección con herramientas que probablemente ya tengas abiertas. Los reportes de cobertura e indexación de Search Console te mostrarán las páginas marcadas como duplicadas o como alternas con una etiqueta canónica correcta. Una búsqueda sencilla de site:tudominio.com en Google revela cuántas URLs están indexadas por idioma, lo que seguido deja ver un reparto desbalanceado. Las herramientas de rastreo que corren reportes de similitud (comparando el contenido de las páginas y marcando coincidencias de 85% de similitud o más) te dan una lista por prioridades sin tener que revisar página por página a mano.
Una vez que tengas la lista, arregla en este orden:
- Canoniza o redirige primero los pares de duplicados con más tráfico, ya que son los que más te cuestan en señal de posicionamiento desperdiciada.
- Repara la reciprocidad del hreflang en cada clúster que marque la auditoría, no solo en los que notaste a mano.
- Pon noindex a los duplicados de poco valor que no tienen razón real para estar indexados.
- Pasa a los arreglos a nivel de contenido: reescribe las páginas flojas o casi idénticas una vez que las señales técnicas estén estables.
Un flujo de auditoría práctico, en versión condensada:
- Saca el reporte de cobertura de Search Console y filtra por problemas de páginas duplicadas o alternas.
- Corre un rastreo de todo el sitio y marca las páginas por encima del umbral de similitud que permita tu herramienta.
- Verifica la reciprocidad del hreflang clúster por clúster.
- Prioriza los arreglos por tráfico y valor de posicionamiento, no por lo fácil que sean de arreglar.
Después de que los cambios estén en vivo, confírmalos con la herramienta de Inspección de URL de Search Console, una revisión en vivo de los encabezados HTTP para confirmar que las redirecciones devuelven el estado esperado, y una herramienta de prueba de hreflang para confirmar que los enlaces recíprocos se resuelven correctamente. Un recorrido corto de este proceso exacto está cubierto en esta guía de auditoría de hreflang, hecha específicamente para sitios profesionales bilingües que corren una auditoría ajustada con poco tiempo.
Errores comunes y procedimientos de prueba para implementaciones multilingües
La mayoría de los problemas de SEO bilingüe se rastrean hasta un puñado de culpables repetidos. El hreflang no recíproco, donde la página A apunta a la página B pero la página B nunca apunta de regreso, es el problema más común y el más fácil de pasar por alto sin una revisión dedicada. Los códigos de idioma o región incorrectos (usar es cuando el contenido es específicamente es-419) confunden la segmentación aunque la reciprocidad esté bien. Los bucles canónicos, donde una página canoniza hacia una página que canoniza de vuelta a la primera, dejan a Google sin una señal clara que seguir. Los desajustes entre móvil y escritorio, donde existen URLs separadas para cada uno pero las etiquetas hreflang o canónicas solo se actualizaron en una, crean huecos de indexación fáciles de pasar por alto en una revisión rápida, un riesgo que la documentación de indexación mobile-first de Google señala directamente.
Las pruebas después de un arreglo deberían ser rutina, no opcionales:
- Usa la herramienta de Inspección de URL en Search Console para confirmar qué URL trata Google como canónica.
- Corre un probador de hreflang en vivo sobre una muestra de páginas de cada clúster de idioma.
- Revisa las URLs con parámetros (filtros, parámetros de seguimiento) por separado, ya que generan contenido duplicado a gran escala si se dejan sin manejar.
Tip profesional: Revisa el contenido sindicado o republicado al final. Muchas veces el editor original ya lo canonizó correctamente, así que ir por él primero gasta tiempo que se aprovecha mejor en tus propios clústeres de duplicados.
Nota del autor y casos destacados de clientes
Soy Francisco, y esta guía refleja patrones que se ven una y otra vez en sitios bilingües de servicios profesionales: consultorios dentales, legales y médicos donde una presencia en español no es opcional pero seguido se implementa como ocurrencia de último minuto. Diazluna, una plataforma de recepción bilingüe para consultorios que atienden a clientes hispanos, construye sitios web bilingües, atención de llamadas con IA e integración con WhatsApp como un solo sistema conectado en lugar de tres herramientas desconectadas. Los propios logros operativos de Diazluna incluyen una indexación rápida tras el lanzamiento y una reducción en la pérdida de clientes ligada a las barreras del idioma, ambos dependen de la higiene técnica exacta que cubrimos arriba: hreflang limpio, canónicos resueltos y contenido que se lee como genuinamente localizado en vez de traducido. Un ejemplo aplicado de arreglos de páginas por prioridad para un sitio de consultorio profesional está cubierto en este caso de SEO dental, que refleja el orden de auditoría recomendado en esta guía.
Manejo de duplicados en contenido generado por usuarios entre idiomas
Las reseñas, los comentarios y las publicaciones en foros crean un tipo distinto de problema de duplicados. Cuando un cliente deja una reseña en español y tu sistema la autotraduce al inglés para la versión en inglés de la página, ahora tienes dos páginas con contenido de testimonio sustancialmente igual, solo que en idiomas distintos, sobre páginas que de otro modo serían distintas. No es el mismo riesgo que una landing clonada, pero se va acumulando a lo largo de docenas de reseñas.
El arreglo práctico es mantener el contenido generado por usuarios en su idioma original en la página donde se envió, y evitar traducirlo a máquina hacia un bloque duplicado en la página equivalente. Si quieres que ambas versiones de idioma muestren la misma reseña, enlázala o cita un extracto corto y claramente marcado como traducción, en lugar de republicar el texto completo como si fuera contenido original en esa página. Para testimonios de alto valor que valga la pena destacar en ambas versiones de idioma, escribe una localización corta revisada por una persona en lugar de depender de la capa de traducción por default del sitio.
Las plataformas tipo foro que soportan varios idiomas chocan con esto constantemente. Los hilos de discusión sobre clonar contenido entre idiomas describen el mismo patrón una y otra vez: las herramientas de clonado automático duplican la estructura y los metadatos junto con el texto, lo que multiplica la huella de contenido duplicado en lugar de resolverla. Trata cualquier función de autotraducción o autoclonado de tu CMS como un borrador de arranque, no como una decisión de publicación.
Manejo de contenido duplicado en navegación dinámica o por facetas
La navegación por facetas (filtros por precio, categoría, ubicación o tipo de servicio) multiplica las URLs rápido, y hacerlo en dos idiomas multiplica el problema otra vez. Un listado de productos filtrado en inglés y la misma combinación de filtros en español pueden generar cada uno docenas de variantes de URL con parámetros, la mayoría de las cuales no tienen valor único de posicionamiento ni razón para indexarse por separado.
El arreglo empieza por decidir cuáles vistas filtradas merecen indexarse siquiera. La mayoría no. Para las que se queden indexables, asegúrate de que la etiqueta canónica apunte a la versión limpia y sin filtros de la página en ese mismo idioma, y mantén las relaciones de hreflang apuntando entre las URLs limpias equivalentes de cada idioma, no entre variantes filtradas. La guía de Google sobre consolidar URLs duplicadas señala que Google favorece canonizar páginas que viven dentro de una red de hreflang consistente y recíproca, lo que solo funciona si tus URLs filtradas no son parte de esa red por accidente.

El manejo de parámetros a nivel de servidor o CMS, bloqueando de plano el rastreo de combinaciones de parámetros de poco valor, resuelve esto de forma más confiable que tratar de canonizar para salir de miles de variantes de URL después de que ya pasó. Pon la regla una vez a nivel de arquitectura en lugar de andar parchando URLs filtradas individuales conforme las vayas descubriendo.
Impacto del contenido duplicado en el posicionamiento SEO de sitios bilingües y multilingües
El impacto del contenido duplicado en el posicionamiento de sitios bilingües rara vez es una caída repentina. Es un bajo rendimiento lento, fácil de pasar por alto porque nada se ve obviamente roto. Las páginas posicionan, solo que no tan bien como deberían, y seguido el dueño del sitio asume que el contenido es flojo en lugar de reconocer un problema de división de señales.
El mecanismo real, como lo plantea la propia guía de SEO de Google, es ineficiencia técnica más que castigo: el presupuesto de rastreo se gasta volviendo a visitar URLs casi idénticas en lugar de descubrir contenido nuevo, y las señales de posicionamiento como enlaces e interacción se dividen entre páginas que debieron haberse consolidado en una sola versión fuerte. Para un sitio bilingüe, eso seguido significa que la versión en inglés posiciona razonablemente bien mientras la versión en español, tratada como un duplicado secundario en lugar de un recurso distinto, nunca tiene una oportunidad justa.
El arreglo se compone con el tiempo en lugar de producir resultados instantáneos. Un hreflang limpio y canónicos resueltos no garantizan por sí solos un salto en el posicionamiento, pero detienen la pérdida de señal que estaba frenando a la versión de idioma más débil, y liberan presupuesto de rastreo para que Google encuentre e indexe contenido nuevo más rápido.
Uso de etiquetas de segmentación por idioma y región más allá de hreflang
Hreflang hace la mayor parte del trabajo pesado para la segmentación por idioma y región, pero vale la pena ser claros sobre lo que no hace. La documentación de Google sobre versiones localizadas dice sin rodeos que hreflang no realiza canonización. Le dice a Google qué versión servir a qué audiencia, pero no le dice a Google qué versión tratar como la principal para efectos de posicionamiento. Los sitios que confían solo en hreflang para resolver duplicados del mismo idioma están resolviendo el problema equivocado con la herramienta equivocada.
Más allá de hreflang, el atributo lang en la etiqueta HTML ayuda a los navegadores y a la tecnología de asistencia a identificar correctamente el idioma de la página, lo cual es una señal de usabilidad y accesibilidad, no de posicionamiento. Los encabezados HTTP de content-language pueden reforzar la segmentación de idioma a nivel de servidor, aunque en la práctica cargan menos peso que hreflang. Ninguno de estos reemplaza a rel=“canonical” cuando la meta es elegir una URL preferida entre variantes del mismo idioma, una distinción que vale la pena tener presente para que no andes apilando señales de segmentación encima de un problema de duplicados sin resolver.
Estrategias de diferenciación de contenido para minimizar la duplicación
El arreglo más duradero para el contenido duplicado bilingüe no es una etiqueta para nada. Es construir cada versión de idioma alrededor de contenido que seguiría teniendo sentido escribir aunque la otra versión no existiera. Eso significa ejemplos distintos adecuados para cada audiencia, enlaces internos distintos a recursos relevantes para esa audiencia, y, donde encaje de forma natural, datos de apoyo o referencias de casos distintos.
Estrategias prácticas que funcionan:
- Escribe la versión en español desde un esquema nuevo en lugar de traducir el borrador en inglés oración por oración.
- Localiza los ejemplos de apoyo: la página de un consultorio legal debería referir escenarios relevantes para la base de clientes hispanos, no una traducción directa del caso de estudio en inglés.
- Varía los enlaces internos para que cada versión de idioma apunte a recursos genuinamente útiles para esa audiencia en lugar de una estructura de enlaces en espejo.
- Localiza las secciones de preguntas frecuentes de forma independiente, ya que las preguntas que hace un cliente hispanohablante no siempre son las mismas que hace un cliente angloparlante.
Los sitios bilingües de salud y legales se benefician especialmente de este enfoque, ya que las señales de confianza (el tono, los ejemplos, hasta la manera de dar tranquilidad) difieren de forma significativa entre audiencias. Una mirada más amplia a cómo se juega esto para audiencias específicas de salud está cubierta en este artículo sobre sitios de salud bilingües.
Qué arreglar primero cuando los recursos son limitados
Si solo puedes hacer tres cosas, hazlas en este orden: arregla primero las redirecciones y los canónicos en tus pares de duplicados con más tráfico, ya que ahí es donde la pérdida de señal cuesta más. Luego repara la reciprocidad del hreflang en cada clúster de idioma, no solo en los que notaste por accidente. Solo entonces pasa a reescribir el contenido flojo o casi idéntico, ya que ese trabajo rinde una vez que las señales técnicas que lo sostienen están estables. Después de desplegar los arreglos, vigila los conteos de páginas indexadas por idioma y el tráfico orgánico específicamente a la versión en español, ya que por lo general ese es el lado que absorbe la mayor pérdida de señal.
— Francisco
Una opción administrada para consultorios que prefieren tercerizar esto
Si esto se siente como más mantenimiento continuo del que tu equipo tiene tiempo para dar, esta plataforma se construyó para cerrar ese hueco, agrupando sitios web bilingües, recepción con IA e integración con WhatsApp en una sola solución administrada para consultorios profesionales que atienden a clientes hispanos.

Los planes van desde el nivel solo de sitio web Solo Sitio a $99 al mes hasta el paquete completo Sitio + María Pro a $349 al mes, con una cuota de activación única de $399 y facturación anual disponible en todos los niveles. Si quieres que la higiene técnica cubierta en esta guía te la manejen a ti, incluyendo contenido localizado que se lee como genuinamente bilingüe en lugar de traducido, revisa la disponibilidad de planes en el sitio de Diazluna.
Fuentes
Referencias clave: manejo de URLs duplicadas, guía de sitios multirregionales, documentación de canonización y una guía práctica de auditoría de contenido duplicado. Para apoyo práctico en auditorías, los servicios de SEO de marca blanca de BabyLoveGrowth y esta guía para arreglar contenido duplicado ofrecen ángulos prácticos adicionales.
- URL duplicada - Ayuda de Search Console
- Administrar sitios multirregionales y multilingües | Google Search Central
- Contenido duplicado: por qué pasa y cómo arreglarlo (Semrush)
Preguntas frecuentes
¿Qué es un sitio web disponible en varios idiomas?
Un sitio web disponible en varios idiomas sirve el mismo contenido (o equivalentes localizados) a lectores en idiomas distintos, normalmente a través de URLs separadas para cada versión. Se organizan por subdirectorio, subdominio o a veces dominios de país separados, y cada uno requiere su propia configuración de hreflang y canónicos.
¿Qué es la duplicación de contenido?
La duplicación de contenido ocurre cuando varias URLs de un sitio contienen contenido esencialmente igual, obligando a los buscadores a elegir una versión canónica e ignorar prácticamente el resto. Por lo general no provoca una penalización manual, pero desperdicia presupuesto de rastreo y divide las señales de posicionamiento entre páginas que debieron haberse consolidado.
¿Por qué un sitio web aparece en otro idioma?
Esto suele pasar cuando las etiquetas hreflang faltan, no son recíprocas o están mal configuradas, lo que hace que un buscador le sirva la versión de idioma equivocada a un usuario. También puede pasar cuando la configuración de navegador o de ubicación anula la página prevista, algo que una implementación correcta de hreflang está diseñada para prevenir.
¿Cómo revisar el contenido duplicado en un sitio web?
Empieza con el reporte de cobertura de Search Console para ver las páginas marcadas como duplicadas o alternas con un canónico, luego corre un rastreo de todo el sitio usando una herramienta que marque las páginas por encima de un umbral de similitud establecido, como 85% o más. Una búsqueda sencilla de site: también revela cuántas páginas por idioma están realmente indexadas, lo que seguido deja al descubierto un desbalance que vale la pena investigar.