
Por Joshua Hardwick
Antiguo responsable de contenido en Ahrefs
Las etiquetas canonical no son nada nuevo. Han estado por ahí desde 2009.
Google, Microsoft y Yahoo se unieron para crearlas. ¿Su objetivo? Proporcionar a los propietarios de sitios web una forma de resolver los problemas de contenido duplicado de forma rápida y sencilla.
¿Funcionan? Sí, perfectamente... ¡pero sólo si sabes cómo usarlas!
En esta guía, aprenderás:
Una etiqueta canonical (rel="canonical") es un fragmento de código HTML que define la versión principal para páginas duplicadas, casi duplicadas y similares. En otras palabras, si tienes el mismo (o similar) contenido disponible en diferentes URLs, puedes usar etiquetas canonical para especificar qué versión es la principal y por lo tanto, la que debería ser indexada.
Las etiquetas canonical utilizan una sintaxis simple y consistente, y se ubican dentro de la sección <head> de una página web:
<link rel="canonical" href="https://ejemplo.com/pagina-ejemplo/" />
Esto es lo que significa cada parte de ese código:
A Google no le gusta el contenido duplicado. Hace que sea más difícil para ellos elegir:
Demasiado contenido duplicado también puede afectar a tu "crawl budget". Esto significa que Google puede acabar perdiendo el tiempo rastreando varias versiones de la misma página en lugar de descubrir otro contenido importante en tu sitio web.
La verdad sobre el crawl budget
Las etiquetas canonical resuelven todos estos problemas. Permiten indicar a Google qué versión de una página deben indexar y posicionar, y dónde consolidar "link equity".
Si no se especifica una URL canonical, Google se encargará de estos asuntos con sus propias manos.
Confiar en Google de esta manera no es una gran idea; puede que seleccionen una versión de tu página que no quieras que sea canonical.
NOTA IMPORTANTE
Dado que probablemente no has estado publicando las mismas entradas y páginas varias veces, es fácil asumir que tu sitio web no tiene contenido duplicado.
Pero los motores de búsqueda rastrean las URLs, no las páginas web.
Esto significa que ven ejemplo.com/producto y ejemplo.com/producto?color=red como páginas únicas, aunque sean la misma página web con contenido idéntico o similar.
Se denominan URLs parametrizadas y son una causa común de contenido duplicado, especialmente en sitios de ecommerce con navegación facetada/filtrada.
Por ejemplo, Brown Bag Clothing vende camisetas. Esta es la URL para su página principal de categoría:
https://www.bbclothing.co.uk/en-gb/clothing/shirts.html
Si filtras sólo para camisetas XL, se añade un parámetro a la URL:
https://www.bbclothing.co.uk/en-gb/clothing/shirts.html?Size=XL
Si entonces también aplicas el filtro sólo para camisetas azules, se añade otro parámetro:
https://www.bbclothing.co.uk/en-gb/clothing/shirts.html?Size=XL&color=Blue
Todas estas son páginas separadas a los ojos de Google, aunque el contenido sea sólo marginalmente diferente.
Pero no son sólo los sitios de comercio electrónico los que caen víctimas de contenido duplicado.
Aquí hay algunas otras causas comunes de contenido duplicado que se aplican a todos los tipos de sitios web:
En estas situaciones, el uso adecuado de las etiquetas canonical es crucial.
Además, los problemas de contenido duplicado entre dominios cruzados también son un problema. Si estás sindicando contenido, la mejor práctica es utilizar una etiqueta canonical autorreferencial en tu artículo y hacer que el contenido sindicado señale tu versión como la canonical con una etiqueta canonical de un dominio a otro.
Esto no siempre impide que el contenido sindicado aparezca en los resultados de búsqueda, pero ayuda a reducir el riesgo de superar a la original.
— Danny Sullivan (@dannysullivan) September 18, 2019If people deliberately chose to syndicate their content, it makes it difficult to identify the originating source. That's why we recommend the use of canonical or blocking. The publishers syndicating can require this. https://t.co/hblGLsD0ir pic.twitter.com/yjtx43II8j
(Si la gente elige deliberadamente sindicar su contenido, se hace difícil identificar la fuente de origen. Por eso recomendamos el uso de canonicals o el bloqueo. Los editores pueden exigirlo).
Nota al margen
Las etiquetas canonical son fáciles de implementar. Discutiremos cuatro maneras diferentes de hacerlo en un momento. No importa el método que elijas, hay cinco reglas de oro que deberías recordar en todo momento.
John Mueller de Google afirma que es una buena práctica no usar caminos relativos con el elemento de enlace rel="canonical".
— 🍌 John 🍌 (@JohnMu) October 24, 2018You can use either, but I'd recommend using absolute URLs so that you're sure they're interpreted correctly.
(Puedes usar cualquiera de los dos, pero te recomiendo que uses las URLs absolutas para que estés seguro de que se interpretan correctamente).
Así que deberías utilizar la siguiente estructura:
<link rel="canonical" href="https://ejemplo.com/ejemplo-pagina/" />
Al contrario de:
<link rel="canonical" href="/ejemplo-pagina/" />
Dado que Google puede tratar las URLs en mayúsculas y en minúsculas como dos URL diferentes, primero debes asegurarte de forzar URLs en minúsculas en tu servidor y luego usar URLs en minúsculas para tus etiquetas canonical.
Si has cambiado a SSL, asegúrate de no declarar ninguna URL no-SSL (es decir, HTTP) en tus etiquetas canonical. Hacerlo puede teóricamente llevar a confusión y a resultados inesperados. Si estás en un dominio seguro, asegúrate de utilizar la siguiente versión de tu URL:
<link rel="canonical" href="https://ejemplo.com/ejemplo-pagina/" />
Al contrario de:
<link rel="canonical" href="http://ejemplo.com/ejemplo-pagina/" />
Nota al margen
John Mueller de Google dice que aunque no es obligatorio, las etiquetas canonical autorreferenciales son recomendadas.

John Mueller, Webmaster Trends Analyst Google
En caso de que no estés seguro de cómo funciona una canonical autorreferencial, se trata básicamente de una etiqueta canonical en una página que apunta a sí misma. Por ejemplo, si la URL fuera https://ejemplo.com/ejemplo-pagina, entonces una canonical autorreferencial en esa página sería:
<link rel="canonical" href="https://ejemplo.com/ejemplo-pagina" />
La mayoría de los CMS modernos y populares añaden automáticamente URLs autorreferenciales, pero necesitarás que tu desarrollador lo codifique si utilizas un CMS personalizado.
Si una página tiene múltiples etiquetas canonical, Google ignorará todas.
En caso de que haya varias declaraciones de rel=canonical, es probable que Google ignore todos esos indicios de rel=canonical.
Hay cinco formas conocidas de especificar URLs canonical. Estas son las llamadas señales de canonicalización:
Para pros y contras de cada método, mira la documentación oficial de Google.
El uso de una etiqueta rel=canonical es la forma más simple y obvia de especificar una URL canonical.
Simplemente añade el siguiente código a la sección <head> de cualquier página duplicada
<link rel="canonical" href="https://ejemplo.com/pagina-canonical/" />
Digamos que tienes un sitio web de ecommerce de venta de camisetas. Quieres que https://tutienda.com/camisetas/camisetas-negras/ sea la URL canonical, aún cuando el contenido de esa página sea accesible a través de otras URLs (por ejemplo, https://tutienda.com/ofertas/camisetas-negras/)
Simplemente añade la siguiente etiqueta canonical a cualquier página duplicada:
<link rel="canonical" href="https://tutienda.com/camisetas/camisetas-negras/" />
Ten en cuenta que si estás utilizando un CMS, no es necesario que te metas con el código de tu página. Hay una forma más fácil.
Instala Yoast SEO y las etiquetas canonical autorreferenciales se añadirán automáticamente. Para establecer canonicals personalizados utiliza la sección "Avanzado" en cada post o página.
Shopify añade de forma predeterminada URLs canonical autorreferenciales para productos y publicaciones de blog. Para establecer URLs canonical personalizadas necesitarás editar los archivos de la plantilla (.liquid) directamente.
Este hilo tiene algo de información sobre cómo hacerlo.
Squarespace añade también, por defecto, URLs autorreferenciales. Pero, como en el caso de Shopify, necesitas editar el código directamente si quieres añadir una URL canonical personalizada.
Para documentos como PDFs no hay manera de colocar etiquetas canonical en la cabecera de una página porque no hay una sección <head> en una página. En tales casos, necesitarás usar el HTTP header para establecer las canonicals. Puedes también usar una canonical en HTTP header de páginas web estándar.
Imagina que creamos una versión PDF de este post y lo ubicamos en una subcarpeta de nuestro blog (ahrefs.com/blog/*).
Así es cómo se vería nuestra cabecera HTTP para ese archivo:
HTTP/1.1 200 OKContent-Type: application/pdf
Link: <http://ahrefs.com/blog/canonical-tags/>; rel="canonical"
Lectura recomendada: Cómo agregar la etiqueta canonical a cabeceras HTTP (en inglés)
Google afirma que las páginas no-canonical no deberían ser incluidas en sitemaps. Sólo las URLs canonical deberían estar listadas. Esto es así porque Google entiende a las páginas listadas en el sitemap como canonicals sugeridas.
De todas formas. No siempre seleccionarán URLs en sitemaps como canonicals.
No garantizamos que consideremos a las URLs de los sitemaps como canonicals, pero es una forma sencilla de definirlas para un sitio grande, y los sitemaps son una forma útil de indicar a Google qué páginas consideras más importantes en tu sitio.
Utiliza redirecciones 301 cuando quieras desviar el tráfico de una URL duplicada y hacia la versión canonical.
Supón que se puede acceder a tu página a través de estas URLs:
Elige una URL como la canonical y redirecciona las otras URLs hacia allí.
Deberías hacer lo mismo para asegurar las versiones HTTPS/HTTP y www/no-www de tu sitio. Elige una versión canonical y redirecciona las otras hacia ella.
Por ejemplo, la versión canonical de ahrefs.com es la URL con HTTPS y no-www (https://ahrefs.com). Todas las siguientes URLs redireccionan hacia allí:
La forma en que se enlaza de una página a otra a través de tu sitio es una señal de canonicalización.
El webmasters analista de tendencias de Google, John Mueller, cubre las señales utilizadas para determinar las URLs canonical en este video #AskGoogleWebmasters:
Cuanto más consistente seas con todas estas señales, más fácil será para los motores de búsqueda determinar tu URL canonical preferida. Tal y como menciona John en el vídeo, Google también tiene preferencia por las URLs HTTPS sobre las HTTP, y por las URLs más bonitas.
La canonicalización es de alguna manera un tópico complejo. Como tal, hay muchos malentendidos y conceptos erróneos sobre cómo canonicalizar correctamente.
Aquí hay algunos errores comunes que la gente comete al tratar de hacerlo:
Bloquear una URL en robots.txt impide que Google lo rastree, lo que significa que no podrán ver ninguna etiqueta canonical en esa página. Esto, a su vez, impide que transfieran “link equity" de la página no-canonical a la canonical.
Nunca mezcles noindex y rel=canonical. Son instrucciones contradictorias.
Google suele dar prioridad a la etiqueta canonical sobre la etiqueta 'noindex', como afirma John Mueller aquí. Pero sigue siendo una mala práctica. Si no quieres indexar y a la vez canonicalizar una URL, usa una redirección 301. De lo contrario, usa rel=canonical.
Establecer un código de estado HTTP 4XX para una URL canonicalizada tiene el mismo efecto que usar la etiqueta 'noindex': Google no podrá ver la etiqueta canonical y transferirá "link equity" a la versión canonical.
Las páginas paginadas no deben ser canonicalizadas a la primera página paginada de la serie. En su lugar, se deben usar canonicals autorreferenciales en todas las páginas paginadas.
¿Por qué? Como John Mueller de Google declaró en Reddit, este es un uso inapropiado de la rel=canonical.

John Mueller, Webmaster Trends Analyst Google
También deberías utilizar etiquetas rel=prev/next para la paginación. Estas ya no son usadas por Google, pero Bing las sigue utilizando.
Las etiquetas hreflang se utilizan para especificar el idioma y el objetivo geográfico de una página web.
Google afirma que cuando se usa hreflang, se debe "especificar una página canonical en el mismo idioma, o el mejor idioma sustituto posible si no existe una canonical para el mismo idioma".
El hecho de tener múltiples etiquetas rel=canonicals hará que probablemente sean ignoradas por Google. En muchos casos esto ocurre porque las etiquetas se insertan en un sistema en diferentes puntos como por ejemplo por el CMS, el tema, y el/los plugin(s). Es por esto que muchos plugins tienen una opción de sobreescritura para asegurarse de que son la única fuente de etiquetas canonical.
Otra área en la que esto puede ser un problema es en las canonicals añadidas con JavaScript. Si no tienes una URL canonical especificada en la respuesta HTML y luego agregas una etiqueta rel=canonical con JavaScript entonces debería ser respetada cuando Google renderice la página. Sin embargo, si tienes una canonical especificada en HTML e intercambias la versión preferida con JavaScript, estás enviando señales confusas a Google.
Rel=canonical debería aparecer solo en la <head> de un documento. Una etiqueta canonical en la sección <body> de una página será ignorada.
Donde esto puede convertirse en un problema es con el análisis sintáctico de un documento. Mientras que el código fuente de una página puede tener la etiqueta rel=canonical en la ubicación correcta, cuando la página se construye realmente en un navegador o se renderiza por un motor de búsqueda, muchas cosas diferentes como etiquetas no cerradas, JavaScript inyectado, o <iframes> en la sección <head> pueden causar que el <head> termine prematuramente mientras se renderiza. En estos casos, una etiqueta canonical puede ser accidentalmente lanzada al <body> de una página renderizada donde no será respetada.
Es fácil cometer errores con la canonicalización, por lo que vale la pena auditar regularmente tu sitio web para los problemas relacionados con las etiquetas canonical y arreglarlos lo antes posible.
Para ello, puede utilizar la herramienta Site Audit de Ahrefs.
Site Audit rastrea tu sitio web por más de 100 problemas SEO, incluyendo aquellos relacionados con las etiquetas canonical.
Aquí hay doce problemas relacionados con el etiquetado canonical que Site Audit puede encontrar, y cómo arreglarlos:
Esta advertencia se activa cuando una o más páginas son canonicalizadas a una URL 4XX.
Los motores de búsqueda no indexan páginas 4XX porque no funcionan. Como resultado, ignoran cualquier etiqueta canonical que apunte a tales páginas y a menudo terminan indexando la versión incorrecta (no canonical) de la página.
Revisa las páginas afectadas y reemplaza los enlaces canonicals muertos (4XX) por enlaces a páginas que funcionen (200) que desees indexar.
Esta advertencia se activa cuando una o más páginas son canonicalizadas a una URL 5XX.
Los códigos de estado HTTP 5XX indican problemas en el servidor, que dan como resultado una página canonical inaccesible. Es poco probable que Google indexe páginas inaccesibles, por lo que podría ignorar el código canonical.
Reemplazar cualquier URL canonical errónea con URL válidas. Comprueba si hay configuraciones erróneas en el servidor si el canonical especificado parece correcto. Ten en cuenta que esto puede ser un problema temporal si el rastreo se produjo cuando tu sitio se estaba caído por mantenimiento o el servidor de tu sitio estaba sobrecargado.
Esta advertencia se activa cuando una o más páginas son canonicalizadas a una URL redireccionada.
Las canonicals deben siempre señalar la versión con mayor autoridad de una página. Este no es el caso con la redirección de URLs. Como resultado, los motores de búsqueda pueden malinterpretar o ignorar la etiqueta.
Reemplazar los enlaces canonicals por enlaces directos a la versión con mayor autoridad de la página (es decir, una que devuelva un código de estado HTTP 200 y no redireccione).
Esta advertencia se activa cuando existen una o más páginas duplicadas o muy similares que no especifican una versión canonical.
Dado que no se especifica ninguna canonical, Google intentará identificar la versión más adecuada para mostrarla en los propios resultados de búsqueda. Es posible que esta no sea la versión que quieres indexar.
Revisa los grupos de duplicados. Elige una versión canonical que debería ser indexada en los resultados de búsqueda. Especifica ésta como la versión canonical en todos los duplicados (y añade una etiqueta canonical autorreferencial a la versión canonical).
Esta advertencia se activa cuando una o más páginas especifican una URL no canonical en sus anotaciones de hreflang.
Los enlaces en las etiquetas hreflang siempre deben apuntar a las páginas canonicals. Enlazar a una versión no-canonical de una página desde las anotaciones de hreflang puede confundir y despistar a los motores de búsqueda.
Sustituir los enlaces en las anotaciones de hreflang de las páginas afectadas por su canonical.
Esta advertencia se activa cuando una o más URLs canonical especificadas no tienen enlaces entrantes internos.
Las URLs canonical sin enlaces internos son inaccesibles para los visitantes del sitio web. En algún lugar del sitio se las dirige a una versión no-canonical de la página en su lugar.
Reemplazar cualquier enlace interno a páginas canonicalizadas con enlaces directos a la canonical.
Esta advertencia se activa cuando una o más páginas no-canonical aparecen en el sitemap.
Google establece que no debes incluir URLs no-canonical en tu sitemap; la razón es que ven las páginas de los sitemaps como sugerencias canonical. Sólo deberías incluir en los sitemaps las páginas que desees que se indexen.
Elimina URLs no-canonical de tu sitemap..
Esta advertencia se activa cuando una o más páginas especifican una URL canonical que también es canonicalizada a una página diferente. Esto crea una "cadena de canonicals" en la que la página A es canonicalizada a la página B, que a su vez es canonicalizada a la página C.
Las cadenas canonicals pueden confundir y engañar a los motores de búsqueda. Como resultado, pueden malinterpretar o ignorar sus especificaciones.
Sustituir los enlaces no canonical en las etiquetas canonical de las páginas afectadas por enlaces directos a la canonical. Por ejemplo, si la página A es canonicalizada a la página B, que a su vez es canonicalizada a la página C, reemplaza el enlace canonical de la página A por un enlace a la página C.
Esta advertencia se dispara cuando hay un desajuste entre la canonical especificada y la URL de Open Graph en una o más páginas.
Si la URL del Open Graph no coincide con la URL canonical, entonces se compartirá una versión no canonical de una página en redes sociales.
Reemplaza la URL de Open Graph en las páginas afectadas por la URL canonical. Asegúrate de que las dos URLs sean las mismas.
Nota al margen
Esta advertencia se activa cuando una o más páginas seguras (HTTPS) especifican una versión no segura (HTTP) como la canonical.
HTTPS es un factor de posicionamiento, por lo que tiene sentido especificar versiones seguras de las páginas como canonicals cuando sea posible.
Redirigir la página HTTP al equivalente HTTPS. Si no es posible, añade un enlace rel="canonical" de la versión HTTP de la página a la HTTPS.
Nota al margen
Esta advertencia se activa cuando una o más páginas no seguras (HTTP) especifican una versión segura (HTTPS) como la canonical.
Se prefiere HTTPS a HTTP. Tener una versión HTTP de una página y luego especificar la versión HTTPS como canonical es ilógico.
Nota al margen
Implementar una redirección 301 de HTTP a HTTPS. También deberías reemplazar cualquier enlace interno a la versión HTTP de la página con enlaces directamente a la versión HTTPS.
Esta advertencia se activa cuando una o más páginas no-canonicals aparecen en los resultados de búsqueda y obtienen tráfico de búsqueda orgánico (lo cual no debería suceder).
O bien las etiquetas canonical están configuradas de forma incorrecta o bien Google ha optado por ignorar la canonical especificada.
Comprueba que las etiquetas rel=canonical estén configuradas correctamente en todas las páginas reportadas. Si no es así, utiliza la herramienta de inspección de URL de Google Search Console para comprobar si consideran que la URL canonical especificada es canonical realmente. Si hay una incompatibilidad, investiga por qué es así.
Las etiquetas canonical no son tan complicadas. Es difícil en un principio hasta que le encuentras la vuelta.
Sólo recuerda que las etiquetas canonical no son una directiva sino una señal para los motores de búsqueda. En otras palabras, podrían elegir una canonical diferente a la que has declarado.
Puedes usar la herramienta de inspección de URLs en Google Search Console para ver tanto la canonical declarada por el usuario como la seleccionada por Google.
Estas son las clasificaciones que Google utiliza en su Informe del índice de cobertura de Google Search Console relacionadas con las URLs canonical:
¿Alguna pregunta? Déjala en los comentarios o escribeme por Twitter.
Traducido por Agencia Eleven. Desde Argentina, hacemos que te encuentren.

Anterior responsable de contenido en Ahrefs (o, para que nos entendamos, soy el encargado de asegurarme de que cada entrada del blog que publicamos sea ÉPICA).