Duplicate content

Duplicate content

Heb je ooit twee bijna gelijke pagina’s op je site gevonden en gedacht: gaat Google me nu straffen? Je bent niet de enige. Duplicate content komt vaker voor dan je denkt, zeker bij webshops, categoriepagina’s en technische URL varianten. In dit artikel leg ik je helder uit wat het precies is, wanneer het echt een probleem wordt en wanneer je je niet druk hoeft te maken. Je krijgt praktische manieren om dubbele content op te sporen en op te lossen, inclusief mijn voorkeur voor canonical tags, redirects en slim consolideren. Zodat jij weer grip krijgt op je indexatie en rankings.

Wat is duplicate content precies?

Duplicate content betekent dat identieke of sterk overlappende inhoud via meerdere URL’s beschikbaar is. Dat kan binnen één domein gebeuren of tussen verschillende websites. Google heeft het zelf over “substantiële blokken content” die grotendeels hetzelfde zijn. Het gaat dus niet om een paar gelijke zinnen in je footer, maar om pagina’s waarvan de hoofdinformatie grotendeels overeenkomt.

Wat ik belangrijk vind om meteen recht te zetten: duplicate content is zelden een “penalty ding”. In de meeste gevallen is het een selectieprobleem. Google wil niet twee keer hetzelfde resultaat tonen en kiest daarom een versie om te tonen en dempt de rest.

Wanneer is iets wél en niet duplicate?

In de praktijk kijk ik altijd naar de vraag: is de pagina voor een gebruiker duidelijk anders en nuttig, of is het vooral een kopie met een andere URL? Een paar overlappende elementen zijn normaal. Denk aan navigatie, USP blokken, garantievoorwaarden of een FAQ die op meerdere pagina’s terugkomt.

  1. Meestal geen probleem: herhaalde boilerplate zoals menu’s, footers, juridische tekst en kleine standaardblokken.
  2. Vaak wél relevant: bijna dezelfde product of landingspagina’s met minimale variatie, of meerdere URL’s naar exact hetzelfde product.
  3. Zeker opletten: identieke artikelen op verschillende domeinen zonder duidelijke bronvermelding of canonical.

Interne versus externe duplicate content

Je kunt duplicate content grofweg opdelen in intern en extern. Dat onderscheid is handig, omdat de oplossingen vaak anders zijn.

Interne duplicate content

Interne duplicate content ontstaat binnen je eigen website. Dit zie ik het meest bij webshops en bij technische URL varianten. Een productpagina die via meerdere paden bereikbaar is, levert snel meerdere URL’s op met dezelfde content. Dat is niet “fout” van jou als mens, maar wel iets waar je technisch richting aan moet geven.

  • WWW en non WWW varianten die allebei werken
  • HTTP en HTTPS varianten die allebei indexeerbaar zijn
  • Parameters zoals ?sort=, ?filter=, ?utm= die nieuwe URL’s maken
  • Paginatie en faceted navigation in categorieën

Externe duplicate content

Externe duplicate content is dezelfde of bijna dezelfde inhoud op meerdere domeinen. Denk aan leveranciersbeschrijvingen die tientallen webshops letterlijk overnemen, of blogs die worden doorgeplaatst zonder canonical. Soms is het onschuldig, soms is het ronduit content scraping.

Mijn mening: als je structureel leunt op teksten die ook elders staan, dan geef je Google weinig reden om jou te kiezen. Zelfs als je niet “gestraft” wordt, maak je het jezelf onnodig moeilijk.

Is duplicate content slecht voor SEO?

Niet automatisch, maar het kan wel degelijk je SEO resultaten remmen. Ik zou het zo samenvatten: je wordt meestal niet “gepakt”, maar je kunt wel kansen verliezen doordat signalen versnipperen en Google de verkeerde URL als hoofdversie kiest.

Wat Google in de praktijk doet: canonicalisatie

Als Google meerdere varianten ziet, probeert het een “canonieke” versie te bepalen. Die versie wordt bij voorkeur geïndexeerd en getoond. De andere varianten kunnen dan als Duplicate, Google chose different canonical in Search Console terugkomen. Dat is frustrerend, maar ook een signaal dat je meer sturing moet geven.

De belangrijkste risico’s

  • Verdunning van linkwaarde: backlinks kunnen verdeeld raken over meerdere URL’s, waardoor geen enkele versie echt sterk wordt.
  • Indexatie-ruis: Google indexeert soms net de variant die jij niet wilt laten ranken.
  • Crawl budget verspilling: bots besteden tijd aan duplicaten in plaats van aan je unieke pagina’s. Lees ook: wat is crawl budget.
  • Lagere relevantie: je pagina’s concurreren intern met elkaar en dat geeft verwarring in je eigen structuur.

In zeldzame gevallen kan er wél sprake zijn van een sanctie, maar dat is vooral wanneer duplicate content onderdeel is van duidelijke manipulatie of misleiding.

Veelvoorkomende oorzaken die ik in audits zie

Duplicate content klinkt vaak als een contentprobleem, maar in SEO audits is het verrassend vaak technisch. Hieronder de oorzaken die ik het vaakst tegenkom.

URL varianten door techniek en instellingen

Denk aan een site die bereikbaar is op zowel http als https, of met en zonder www. Of URLs die zowel met als zonder trailing slash werken. Als dat allemaal indexeerbaar is, heb je al snel dubbele pagina’s. Dit los je niet op met herschrijven, maar met canonical en redirects.

Filters en sorteringen in webshops

Filters zijn top voor gebruikers, maar ze kunnen honderden of duizenden URL combinaties genereren. Als die allemaal crawlbaar en indexeerbaar zijn, creëer je een duplicatiebom. Hier moet je bewust kiezen: welke filterpagina’s wil je wél laten ranken en welke niet?

Categorie en tag pagina’s die dezelfde posts tonen

Bij blogs zie ik geregeld dat categoriepagina’s en tagpagina’s nagenoeg hetzelfde lijstje content tonen, soms zelfs met lange excerpts. Dat hoeft geen ramp te zijn, maar je moet voorkomen dat deze pagina’s de zoekresultaten overnemen van je echte artikelen. Dit valt vaak onder bredere SEO fouten in structuur en indexatie. Handig overzicht: SEO fouten.

Standaard leveranciersteksten

Voor webshops is dit de klassieker. Ik snap het: het is efficiënt. Maar precies daarom is het competitief zwak. Wat ik indrukwekkend vind bij partijen die wél winnen, is dat ze leveranciersinfo gebruiken als basis, maar er daarna eigen uitleg aan toevoegen: voor wie is dit product, wat zijn de echte verschillen, welke alternatieven zijn er?

Hoe detecteer je duplicate content?

Je hoeft dit niet op gevoel te doen. Met een paar checks kom je al ver. Ik pak het meestal in deze volgorde aan, omdat je dan snel zowel symptomen als oorzaken ziet.

1. Google Search Console

Check in Search Console rapporten zoals Indexering en pagina’s met meldingen rond duplicaten en canonicals. Dit is vaak de snelste manier om te zien waar Google jouw voorkeur niet volgt.

2. Handmatig zoeken met een exacte frase

Kopieer een opvallende zin van je pagina en zoek in Google met aanhalingstekens. Voeg eventueel site:jouwdomein.nl toe om interne duplicaten te vinden. Simpel, maar effectief.

3. Crawlen met tools zoals Screaming Frog of Sitebulb

Voor interne duplicate content is een crawltool ideaal. Je ziet dan snel exact duplicates en near duplicates, plus technische oorzaken zoals parameters, paginatie en canonicals. Dit is ook de plek waar je issues zoals duplicate titles en descriptions ziet, die vaak samenhangen met dubbele pagina’s.

4. Externe checks met Copyscape achtige tools

Als je vermoedt dat je content is overgenomen, gebruik dan een externe checker. Verwacht niet dat elke herschreven kopie gevonden wordt, maar het helpt om duidelijke 1 op 1 kopieën te spotten.

Oplossingen: wat werkt echt en wanneer?

Er is geen één magische fix. De beste oplossing hangt af van je doel: wil je varianten samenvoegen, wil je één pagina laten winnen, of wil je juist meerdere pagina’s laten ranken met echte differentiatie?

Oplossing 1: maak content uniek waar het telt

Als twee pagina’s allebei moeten blijven bestaan en allebei moeten kunnen ranken, dan ontkom je niet aan unieke content. Mijn praktische richtlijn: zorg dat de bovenkant van de pagina echt anders is. Dat is het deel waar Google en gebruikers als eerste context uit halen.

  • Unieke intro en unieke H1 en H2 structuur
  • Andere invalshoek: toepassingen, advies, stappenplan of vergelijking
  • Unieke visuals met eigen bestandsnamen en alt attributen
  • Eigen FAQ die past bij die specifieke pagina

Bij lokale landingspagina’s is dit extra belangrijk. Alleen een plaatsnaam vervangen is vaak te dun. Soms kom je ermee weg als de concurrentie zwak is, maar als strategie vind ik het kwetsbaar.

Oplossing 2: rel canonical inzetten

De canonical tag is in mijn ogen de meest “schone” oplossing wanneer je meerdere URL’s hebt die inhoudelijk hetzelfde blijven, maar waarvan je één versie wilt laten meetellen. Op duplicaten zet je dan:

<link rel="canonical" href="https://www.domein.nl/voorkeurs-url/">

Belangrijk: canonical is een signaal, geen harde instructie. Als je site intern inconsistent linkt, of als de canonical niet logisch is, kan Google alsnog een andere keuze maken.

Oplossing 3: 301 redirects voor echte dubbele varianten

Als een URL variant eigenlijk niet hoort te bestaan, redirect hem dan. Dit is ideaal voor http naar https, non www naar www (of andersom) en dubbele paden die niemand nodig heeft. Voor WordPress is dit vaak goed te regelen. Handleiding: 301 redirects instellen.

Mijn voorkeur: redirect waar mogelijk, canonical waar nodig. Redirects zijn duidelijker en verminderen ruis.

Oplossing 4: noindex voor pagina’s die nuttig zijn maar niet hoeven te ranken

Sommige pagina’s zijn handig voor gebruikers, maar niet bedoeld voor Google. Denk aan interne zoekresultaten, bepaalde filtercombinaties of tijdelijke campagnevarianten. Dan kan noindex slim zijn. Let wel op: noindex is geen oplossing voor linkwaarde versnippering als je intern nog overal naar die URL’s linkt.

Oplossing 5: consolideer pagina’s die elkaar kannibaliseren

Als twee pagina’s hetzelfde onderwerp behandelen en allebei matig presteren, is samenvoegen vaak de snelste winst. Maak één sterke pagina, redirect de andere, en bundel interne links. Dit is vooral effectief bij blogs en kennisbanken.

Praktische aanpak: zo zou ik het stap voor stap doen

Als ik een website met duplicate content moet opschonen, werk ik met een simpele prioritering: eerst technische basis, dan structuur, dan content. Dat voorkomt dat je weken gaat herschrijven terwijl het echte probleem een URL variant is.

  1. Stel je voorkeursdomein en protocol vast en redirect alle varianten.
  2. Check canonicals op templates, productpagina’s en categoriepagina’s.
  3. Beperk indexatie van filters en parameters die geen zoekvraag bedienen.
  4. Los interne link inconsistentie op zodat je site altijd naar de voorkeurs URL linkt.
  5. Herschrijf alleen de pagina’s die echt moeten blijven en echt moeten ranken.

Specifieke situaties en wat ik zou adviseren

Duplicate content is zelden een theoretisch probleem. Het zit altijd in concrete situaties. Hieronder de meest herkenbare, met mijn advies erbij.

Webshop: hetzelfde product onder meerdere categorieën

Dit is bijna standaard. Mijn advies: zorg dat er één product URL is en dat categoriepaden geen nieuwe product URLs maken. Als dat technisch niet kan, gebruik canonicals naar de primaire product URL. En let op interne links: link vanuit categorieën consequent naar dezelfde versie.

Webshop: productvarianten zoals kleur en maat

Hier zie ik vaak parameters of aparte URLs per variant. Als varianten geen eigen zoekvolume hebben, houd het op één pagina en laat gebruikers kiezen via selectors. Als sommige varianten wél zoekwaarde hebben, kun je dedicated pagina’s maken, maar dan moet de content echt anders zijn en moet je variantpagina’s niet allemaal identiek opbouwen.

Blogs: doorplaatsen op andere websites

Als je een artikel doorplaatst, wil je idealiter dat de doorplaatsende partij een canonical terugzet naar jouw originele artikel. Dat is netjes en SEO technisch het meest logisch. Als dat niet kan, zou ik kiezen voor een sterk herschreven versie, met een andere intro en andere koppen. Anders loop je het risico dat het grotere domein met meer autoriteit de credits pakt.

Internationale sites: dezelfde content voor landen

Voor landen en talen is hreflang vaak de juiste route, niet noindex. Als het echt dezelfde taal is maar ander land, dan moet je ook nadenken of de content voldoende lokaliseert. Alleen .nl kopiëren naar .be is bijna altijd vragen om cannibalisatie, tenzij je bewust aanpast naar de doelgroep.

Lokale landingspagina’s met alleen plaatsnaam wissel

Dit is een bekende tactiek. Soms werkt het, vaak is het dun. Mijn zorg is vooral strategisch: je bouwt een fragiel contentfundament dat afhankelijk is van lage concurrentie. Als je dit doet, voeg dan per plaats echte lokale bewijslast toe: cases, aanpak, levertijden, lokale vragen, foto’s, team, reviews, route en servicegebied.

Hoe voorkom je duplicate content structureel?

Oplossen is één ding. Voorkomen bespaart je later veel gedoe. Ik kijk hierbij naar proces en techniek.

Technische basis op orde

  • Eén versie van je domein en protocol met redirects
  • Consistente interne links naar de voorkeurs URL
  • Bewuste indexatiekeuzes voor filters, tags en interne zoekpagina’s
  • Sitemap met alleen canonieke URLs

Contentproces met kwaliteitsdrempel

Maak intern een simpele regel: nieuwe pagina’s krijgen pas groen licht als ze een eigen doel hebben en eigen waarde leveren. Als iemand een pagina wil maken die “lijkt op die andere”, is dat precies het moment om te vragen: wat wordt hier uniek aan?

Als je meer wilt snappen over wat Google als waarde ziet, helpt het om het grotere plaatje van SEO te kennen. Overzicht: wat is SEO.

Veelgestelde vragen

Wat is Duplicate content en krijg je daar een penalty voor?

Duplicate content is identieke of sterk overlappende inhoud op meerdere URL’s. Meestal krijg je geen penalty. Google kiest vaak één versie om te tonen en dempt de rest. Alleen bij duidelijke manipulatie of misleiding kan er in zeldzame gevallen een sanctie of de indexatie van pagina’s volgen.

Hoeveel overlap mag er zijn voordat het Duplicate content is?

Er is geen officieel percentage. Google spreekt over “substantiële blokken” die grotendeels hetzelfde zijn. In de praktijk is een gedeelde alinea geen probleem, maar pagina’s die voor het grootste deel gelijk zijn wel. Als de main content nauwelijks verschilt, moet je canonical, redirect of herschrijven overwegen.

Is boilerplate tekst zoals footer en disclaimer ook Duplicate content?

Meestal niet. Boilerplate content zoals menu’s, footers, disclaimers en copyright komt op veel pagina’s terug en Google kan dat doorgaans goed plaatsen. Het wordt pas een probleem als het grootste deel van je pagina’s uit dezelfde blokken bestaat en er te weinig unieke hoofdcontent overblijft om een pagina onderscheidend te maken.

Wat is de beste oplossing: canonical of 301 redirect bij Duplicate content?

Een 301 redirect is het beste als een duplicaat URL eigenlijk niet nodig is en je één echte versie wilt behouden. Een canonical is handig als meerdere URLs moeten blijven bestaan, bijvoorbeeld door parameters of categoriepaden, maar je toch één voorkeurs URL wilt laten meetellen. Vaak combineer je beide strategieën.

Hoe kan ik Duplicate content snel opsporen op mijn website?

Begin met Google Search Console en kijk naar meldingen rond duplicaten en canonicals. Gebruik daarna een crawltool zoals Screaming Frog voor interne duplicaten en controleer titles, headings en near duplicates. Voor externe kopieën kun je een tool zoals Copyscape gebruiken of een unieke zin uit je tekst met aanhalingstekens googelen.

Conclusie

Duplicate content is meestal geen reden tot paniek, maar wel iets dat je serieus moet nemen als je stabiel wilt groeien in SEO. Het grootste risico zit niet in een straf, maar in verloren kansen: versnipperde linkwaarde, onnodige crawl budget verspilling en Google die net de verkeerde URL kiest. Mijn advies is simpel: fix eerst de technische oorzaken met redirects en canonicals, maak daarna scherpe indexatiekeuzes voor filters en tags, en investeer pas dan in herschrijven waar pagina’s echt moeten blijven ranken. Zo maak je je site duidelijker voor Google én prettiger voor je bezoekers.

Deel deze content:

Jasper schrijft over SEO, linkbuilding en online marketing vanuit de praktijkervaring van JG Webmarketing. Zijn focus ligt op heldere uitleg, concrete tips en inzichten waar ondernemers direct mee verder kunnen.

Verstuur reactie