Canonical tag (canonical URL)
Et canonical tag er en kodemarkering, som fortæller søgemaskiner hvilken URL der er den primære eller foretrukne version af en side, når det samme eller næsten identisk indhold findes på flere webadresser. Tagget placeres i sidens kildekode og peger fra dubletsiderne hen på den side, ejeren ønsker skal blive vist og indekseret i søgeresultaterne. På den måde fungerer canonical tagget som en anbefaling til søgemaskinen om, hvordan flere ens sider skal behandles samlet.
Behovet for canonical tags opstår, fordi et website teknisk set kan gøre den samme side tilgængelig via mange forskellige URL’er, selvom en almindelig besøgende kun opfatter det som én side. Et klassisk eksempel er en webshop, hvor det samme produkt kan tilgås både via en almindelig produktside og via en URL med filterparametre for eksempelvis størrelse eller farve. Uden en tydelig markering af, hvilken udgave der er den “rigtige”, er det søgemaskinen selv, der må gætte sig frem til, hvilken version der skal vises i søgeresultaterne.
Hvordan løser canonical tag problemer med duplicate content?
Duplicate content (duplikeret indhold) opstår, når flere URL’er på et website — eller på tværs af flere websites — viser identisk eller næsten identisk indhold. Det kan for eksempel ske, hvis en side kan tilgås både med og uden “www”, både med “http” og “https”, eller hvis det samme indhold genbruges på tværs af sprogversioner uden reelle indholdsmæssige forskelle. Et canonical tag løser ikke problemet ved at fjerne dubletterne, men ved at samle deres SEO-signaler ét sted.
Når søgemaskinen støder på flere sider med canonical tag rettet mod samme URL, kan den konsolidere faktorer som indgående links og anden linkværdi på den valgte hovedside i stedet for at sprede dem tyndt ud over flere adresser. Det bidrager til, at den foretrukne side står stærkere i søgeresultaterne, og at søgemaskinens crawl-ressourcer i højere grad bruges på nyt eller opdateret indhold frem for på sider, der reelt gentager noget, der allerede findes andetsteds.
Sådan implementeres et canonical tag korrekt
Et canonical tag indsættes som et link-element i <head>-sektionen af en sides HTML og peger på den URL, som skal betragtes som den primære. Et typisk eksempel ser sådan ud:
<link rel="canonical" href="https://www.eksempel.dk/produkt/" />
Tagget skal sættes på alle dubletsiderne og pege på hovedsiden, mens hovedsiden selv typisk får et såkaldt selvrefererende canonical tag, der peger på sin egen URL. Det gøres for at fjerne enhver tvivl om, hvilken version der er den kanoniske, også selvom siden i udgangspunktet ikke er en dublet. I mange content management-systemer, herunder WordPress med et SEO-plugin, kan denne markering sættes automatisk eller pr. side uden manuel kodning.
For filer der ikke indeholder en HTML head-sektion, som for eksempel PDF-dokumenter, kan canonical-oplysningen i stedet angives via en HTTP-header eller gennem et XML-sitemap, hvor de foretrukne URL’er listes. Uanset metode bør man undgå såkaldte kæder af canonical tags, hvor side A peger på side B, som igen peger på side C — det kan gøre signalet uklart for søgemaskinen og svække effekten.
Canonical tag er et signal, ikke en garanti
Det er værd at have in mente, at et canonical tag opfattes som en anbefaling og ikke en bindende instruks. Hvis søgemaskinen finder tydelige tegn på, at en anden side end den angivne canonical-side reelt bør vises — for eksempel fordi den har markant flere indgående links — kan den vælge at se bort fra markeringen. Korrekt og konsekvent brug af canonical tags øger dog sandsynligheden for, at den ønskede side bliver valgt, og reducerer risikoen for at få indekseret en uhensigtsmæssig version af en side.
Canonical tag bør ses som ét redskab blandt flere i det tekniske SEO-arbejde. Hvor et 301 redirect permanent flytter både brugere og søgemaskiner til en ny adresse, lader canonical tagget de oprindelige URL’er forblive tilgængelige, mens det alene styrer hvilken version der prioriteres i indekset. På samme måde kan en robots.txt-fil bruges til at blokere crawling af hele stier eller filtyper, mens canonical tag i stedet arbejder på side-niveau og lader indholdet blive crawlet, men konsoliderer signalerne ét sted. Mange tekniske SEO-tjek kombinerer desuden canonical tags med structured data, så søgemaskinen både forstår hvilken side der er den primære, og hvad indholdet på siden konkret handler om.
Typiske faldgruber ved canonical tags
En almindelig fejl er at lade filtrerings- eller sorteringsparametre på kategorisider generere nye URL’er uden et korrekt canonical tag, så webshoppen uforvarende opbygger et stort antal tekniske dubletter. En anden fejl er at glemme canonical tagget på forsiden, som ofte kan tilgås via flere varianter af samme adresse. Det anbefales derfor at validere opsætningen løbende, blandt andet ved at tjekke, hvordan søgemaskinen faktisk har opfattet canonical-markeringen på de enkelte sider.