Duplicate content i webshops opstår, når identiske eller næsten identiske sideversioner er tilgængelige på flere URL'er, og det kan svække din SEO, spilde crawl-budgettet og forvirre både brugere og Googles algoritme. I denne guide får du en praktisk gennemgang af de typiske kilder og de vigtigste tekniske løsninger.
- Facetterede kategorisider kan generere en ny URL for hver kombination af filtre, hvilket kan skabe hundredvis af næsten ens sider.
- En canonical tag placeres i HTML-head og fortæller Google, hvilken URL der er den foretrukne version.
- 301-redirects sender brugere og crawleren permanent videre til en ny URL og bør bruges, når to sider lægges sammen.
Indholdsfortegnelse
- Hvad er duplicate content i en webshop?
- Typiske kilder til duplicate content i webshops
- Sådan bruger du canonical tags og 301-redirects
- Sådan håndterer du URL-parametre og XML-sitemap
- Sådan forebygger du duplicate content løbende
- Sådan undgår du dubletter i Shopify, WooCommerce og Magento
- Ofte stillede spørgsmål
For mere, se vores Crawza-side.
Hvad er duplicate content i en webshop?
Duplicate content i webshops opstår, når samme eller næsten samme indhold findes på flere URL'er, og det kan føre til lavere synlighed og spildt crawl-budget.
Duplicate content betyder, at det samme eller næsten samme indhold er tilgængeligt på flere forskellige URL'er. I webshops opstår det typisk, når produktsider, kategorier eller tags genererer nye adresser uden reelt unikt indhold. Det kan forvirre både brugere og Googles algoritme.
Når Google finder flere versioner af samme side, skal det beslutte, hvilken URL der skal vises i søgeresultaterne. Den beslutning kan ændre sig over tid, hvis dine signaler er uklare. Det betyder, at du mister kontrol over, hvilken side der rangerer. Samtidig bruger Google unødvendig tid på at crawle dubletter.
Derfor er duplicate content et teknisk og strategisk problem for enhver webshop. Det påvirker ikke kun din synlighed, men også din troværdighed hos Google. Hvis du vil konkurrere på relevante søgeord, skal du sikre, at hver side har ét klart formål og én kanonisk URL.
Typiske kilder til duplicate content i webshops
De mest almindelige kilder til duplicate content er facetterede kategorisider, produktvarianter, tags og URL-parametre, som hver især kan skabe mange næsten ens sider.
Facetterede kategorisider er en af de største kilder til duplicate content. Når kunder kan filtrere på størrelse, farve, pris eller mærke, opretter systemet en ny URL for hver kombination. Hvis du ikke markerer den oprindelige kategori som den foretrukne, ser Google hundredvis af næsten ens sider.
Produktvarianter er også en klassisk udfordring. En t-shirt i tre farver og fire størrelser kan hurtigt få tolv URL'er. Hvis variant-siderne kun indeholder en billedfil og en kort beskrivelse, risikerer du tyndt indhold. I mange tilfælde er det bedre at samle varianterne på én produktside med en konfigurator.
Derudover kan tags, kategorier, sorteringsparametre og sporingsparametre skabe utilsigtede dubletter. For eksempel opstår der ofte nye URL'er, når kunder sorterer efter pris eller tilføjer ?utm_source= til linket. Uden en klar URL-politik vokser antallet af dubletter hurtigt.
Sådan bruger du canonical tags og 301-redirects
Canonical tags og 301-redirects er de vigtigste tekniske løsninger, fordi de fortæller Google, hvilken URL der er den foretrukne version.
En canonical tag er et HTML-element, der fortæller Google, hvilken URL der er den foretrukne version. Den placeres i head på alle dublet-sider og peger tilbage til den oprindelige side. På den måde konsoliderer du linkjuice og undgår, at Google selv gætter.
Ved egentlige dubletter, hvor to sider ikke bør eksistere, er et 301-redirect ofte en bedre løsning. Det sender både brugere og crawleren permanent videre til en ny URL. Brug redirects, når du fjerner et produkt, lægger kategorier sammen eller ændrer din URL-struktur.
Husk også at sætte en selvhenvisende canonical på alle vigtige sider. Det beskytter mod dubletter, der opstår, når sporingsparametre eller andre session-parametre tilføjes. En kombination af canonical tags, 301-redirects og en ren intern linkstruktur giver et solidt fundament mod duplicate content.
Sådan håndterer du URL-parametre og XML-sitemap
En solid opsætning kræver, at URL-parametre ikke opretter indekserbare dubletter, og at dit XML-sitemap kun indeholder de kanoniske URL'er.
URL-parametre som ?sort= og ?farve= bør ikke få deres egne indekserbare sider. En god tommelfingerregel er at lade den parameterfri URL stå som kanonisk version. Dermed undgår du, at Google skal bruge tid på at crawle uendelige kombinationer af filtre og sorteringer.
Dit XML-sitemap bør kun indeholde de URL'er, du ønsker at få indekseret. Hvis du inkluderer facetterede sider eller sorterings-URL'er, sender du modstridende signaler til Google. Det får crawleren til at bruge sit budget på sider med lav værdi frem for dine unikke produktsider.
Sørg for at opdatere sitemap'et, hver gang du tilføjer eller fjerner sider. Brug gerne et værktøj til at crawle webshoppen og finde dubletter automatisk. Hos et bureau som Crawza arbejder man ofte med teknisk SEO og kan hjælpe med at rydde op i indekseringsproblemer.
Sådan forebygger du duplicate content løbende
Løbende forebyggelse kræver en klar URL-politik, faste redirect-regler og regelmæssige crawl-rapporter for at opdage dubletter, før de skader din trafik.
Det er ikke nok at fjerne duplicate content én gang. Webshops vokser konstant med nye produkter, kampagner og filtre, og hvis du ikke har en klar politik, vil problemet vende tilbage. Sørg for at have faste regler for, hvordan nye URL'er oprettes.
Overvåg din webshop med jævne mellemrum ved hjælp af crawl-rapporter. Du kan blandt andet kigge efter sider med manglende canonical, tyndt indhold eller dubletter. Brug også logfilerne til at se, hvilke sider Google faktisk besøger. Det giver dig et tidligt varsel om potentielle problemer.
Hvis du vil have hjælp til den løbende optimering, kan du læse flere guides på Crawzas blog og se priserne for Crawza. God teknisk SEO handler om at give Google et rent og tydeligt billede af din webshop. Så undgår du både dubletter og spildt crawl-budget.
Sådan undgår du dubletter i Shopify, WooCommerce og Magento
Byg din butik op med en konsistent URL-struktur, undgå auto-genererede tags og test nye apps, så platformen ikke selv opretter dubletter.
Shopify opretter ofte dubletter via tags og kollektioner. Du kan dog styre det ved at fjerne tags fra sitemap og undgå at linke til dem internt. WooCommerce har derimod ofte problemer med kategorier og produktvarianter, hvis du ikke aktiverer kanoniske tags korrekt.
Magento er kendt for at generere mange facetterede URL'er, især hvis du aktiverer filtre i lag. Her er det vigtigt at konfigurere canonical tags og eventuelt bruge noindex på filtre med lav værdi. Uanset platform bør du teste ændringer i et staging-miljø, før du går live.
Uanset hvilket system du bruger, er det vigtigste at have en fast struktur. Tænk over, hvilke sider der skal indekseres, og hvilke der bare er hjælpesider. Så undgår du duplicate content og skaber et stærkt fundament for din SEO.
Du kan udforske se priserne for Crawza.
Ofte stillede spørgsmål
Hvad er forskellen mellem duplicate content og tyndt indhold?
Duplicate content handler om samme eller næsten samme indhold på flere URL'er. Tyndt indhold er derimod en side med meget lidt værdi for brugeren, selvom indholdet teknisk set er unikt. Begge dele kan skade din SEO, men løsningerne er forskellige.
Skal jeg bruge noindex eller canonical på facetterede sider?
Det afhænger af situationen. Hvis en facet giver værdi for brugerne, så brug canonical til den oprindelige kategori. Hvis siden er en ren dublet uden værdi, kan noindex eller et 301-redirect være bedre.
Hvordan håndterer jeg produktvarianter som størrelser og farver?
Den bedste løsning er ofte at holde variantinformationen på én produktside med en konfigurator. Hvis du alligevel har separate variant-URL'er, skal de bruge canonical til hovedproduktet.
Kan duplicate content give en straf fra Google?
Google straffer sjældent duplicate content med en manuel handling, men problemet kan give lavere synlighed, fordi Google vælger én version og nedprioriterer resten. Det kan også spilde dit crawl-budget.