Duplicate content is dezelfde of vrijwel dezelfde tekst die op meer dan één URL te vinden is. Dat kan binnen je eigen site zijn of tussen sites onderling. Google moet dan kiezen welke versie hij toont, en die keuze valt niet altijd op de pagina die jij bedoelde.
Het is zelden opzet. In de meeste gevallen maakt je eigen systeem de kopieën zonder dat iemand het doorheeft.
Krijg je er een straf voor?
Nee. Dit is het hardnekkigste misverstand in de zoekmachine optimalisatie, en Google zegt al jaren hetzelfde: er is geen boete voor dubbele tekst.
Wat er wél gebeurt is subtieler en soms vervelender. Google kiest zelf één versie om te tonen en negeert de rest. Staat er een verwijzing naar versie A en toont Google versie B, dan komt die waarde niet goed terecht — je link equity raakt verdeeld over pagina’s die elkaar beconcurreren. En je verbruikt crawlbudget aan pagina’s die niets toevoegen.
Alleen als je op grote schaal andermans teksten kopieert om zoekresultaten te vullen, komt er wel degelijk een handmatige maatregel. Dat is een ander verhaal: dat is spam, geen dubbele content.
Waar het vandaan komt
Vijf oorzaken zijn samen goed voor bijna alles wat ik tegenkom.
- Meerdere adressen voor dezelfde pagina — met en zonder www, http en https, met en zonder afsluitende schuine streep.
- Parameters in de URL — filters, sorteringen en herkomstlabels als
?utm_source= maken technisch elke keer een nieuw adres.
- Productvarianten — dezelfde schoen in vijf kleuren, met vijf pagina’s die op één zin na identiek zijn.
- Overzichtspagina’s — pagina 2 en 3 van een categorie met dezelfde inleiding erboven.
- Sjabloonteksten — dezelfde alinea over levertijd en garantie op driehonderd productpagina’s.
Hoe je het opspoort
Begin in Google Search Console, bij het rapport over pagina-indexering. Kijk naar de categorieën “Dubbele content, Google koos een andere canonieke versie dan de gebruiker” en “Alternatieve pagina met correcte canonieke tag”. Dat eerste is waar het misgaat: jij wees naar A, Google koos B.
Wil je het uitputtend, dan crawl je je site met Screaming Frog. Sorteer op titel en op meta description: identieke titels zijn vrijwel altijd het spoor naar identieke pagina’s. Voor externe kopieën zoek je een letterlijke zin uit je tekst tussen aanhalingstekens in Google.
Hoe je het oplost
Er zijn drie gereedschappen en de volgorde doet ertoe.
De canonical tag. Een regel in de broncode die zegt: dit is een kopie, de echte staat daar. Dit is bijna altijd het juiste antwoord bij productvarianten en filterpagina’s. Yoast SEO en vergelijkbare plug-ins zetten canonical tags standaard goed, maar controleer wel wat er gebeurt zodra je zelf filters toevoegt.
Een 301-omleiding. Als de dubbele pagina niet hoeft te blijven bestaan, stuur je hem door. Dat is definitiever dan een canonical en geeft de opgebouwde waarde volledig door. Doe dit voor oude URL’s en voor de www-variant die je niet gebruikt.
Herschrijven. Bij twee pagina’s die over hetzelfde onderwerp gaan maar allebei bestaansrecht hebben, is samenvoegen meestal beter dan kiezen. Voeg ze samen tot één goede pagina en stuur de ander door.
Wat je níet doet is de dubbele pagina’s op noindex zetten als eerste reflex. Dat haalt ze uit de index maar laat de waarde verdampen — een canonical of een omleiding houdt hem vast.
Het geval dat vaker voorkomt: bijna-dubbel
Gevaarlijker dan letterlijke kopieën zijn pagina’s die elkaar overlappen zonder identiek te zijn. Drie artikelen over “SEO tips”, “SEO checklist” en “SEO basis” die alle drie hetzelfde vertellen in andere woorden.
Daar helpt geen canonical, want het zijn technisch verschillende pagina’s. Google moet toch kiezen, en jouw eigen artikelen houden elkaar uit de top tien. Dit heet kannibalisatie en het is bij de meeste sites die jaren geblogd hebben het grootste onbenutte gat.
Opsporen doe je zo: zoek in Search Console per zoekopdracht welke pagina vertoond wordt. Wisselt dat tussen twee of drie van je eigen URL’s, dan concurreren ze. Kies er één als hoofdartikel, verwerk het beste uit de andere daarin en stuur ze door met een 301.
Wanneer je het kunt laten
Niet elke dubbele tekst is een probleem. Een standaardalinea over verzendkosten op honderd productpagina’s kost je niets, zolang de rest van de pagina uniek is. Ook een gedeelde inleiding boven een categorie is geen ramp.
De vuistregel: is het overgrote deel van de pagina uniek en heeft de pagina een eigen reden om te bestaan, dan kun je de herhaalde stukken laten staan. Is de hele pagina op één regel na hetzelfde, dan niet.
Waar je begint
Open Search Console, ga naar Indexering en kijk hoeveel pagina’s er onder “Dubbele content” vallen. Is dat een handvol, dan is het opgelost met een paar canonicals. Loopt het in de honderden, dan zit het in je systeem — meestal in filters of parameters — en is dat de plek om aan te pakken.
Zoek daarna in Search Console je vijf belangrijkste zoekopdrachten op en controleer of er per zoekopdracht steeds dezelfde pagina van je verschijnt. Zo niet, dan heb je kannibalisatie en dat is de winst die het snelst binnenkomt.
Wil je dat dit doorwerkt in je posities in Google? Lees dan hoe ik zoekmachineoptimalisatie aanpak.