Customer Impact

SEO

Index bloat opschonen

Kopieer voor AI

Index bloat is wanneer Google veel meer URL’s van je site indexeert dan er waardevolle pagina’s bestaan. Denk aan dunne pagina’s zonder eigen inhoud, dubbele varianten van dezelfde content en eindeloze parameter-URL’s uit filters of sorteeropties. Op het eerste gezicht lijkt een grote index goed: meer pagina’s, meer kansen om gevonden te worden. In de praktijk is het omgekeerd. Een opgeblazen index verdunt je autoriteit, verspilt het budget waarmee Google je site crawlt en stuurt zoekers soms naar je zwakste pagina. Index bloat opschonen draait dus niet om groter, maar om scherper.

Direct toepassen: vertaal rankings naar euro’s met onze SEO-ROI-calculator.

Wat is index bloat precies?

Index bloat is het verschil tussen het aantal URL’s dat Google heeft geindexeerd en het aantal pagina’s dat je daadwerkelijk in de zoekresultaten wilt hebben. Elke geindexeerde URL is een belofte aan Google: dit is het waard om aan een zoeker te tonen. Als die belofte voor honderden pagina’s niet klopt, verzwakt het signaal voor je hele domein.

Het is een onderdeel van technische SEO, maar de oorzaak ligt zelden in techniek alleen. Vaak ontstaat bloat door hoe een CMS of webshop standaard werkt: elke filtercombinatie krijgt een eigen URL, elke tag een eigen archiefpagina, elke print- of taalvariant een aparte versie. Wil je het bredere fundament eerst begrijpen, lees dan onze pillar over wat SEO is en hoe het werkt. Index bloat is in feite het tegenovergestelde van een schone, doelgerichte structuur.

De drie grote bronnen van bloat

In B2B-sites zie je telkens dezelfde drie categorieen terugkomen. Herken je ze, dan weet je waar je het mes in zet.

Thin pages. Pagina’s met weinig of geen unieke inhoud: lege tag-archieven, automatisch gegenereerde locatiepagina’s zonder eigen tekst, of dunne blogberichten van een paragraaf. Ze concurreren met je echte content om aandacht en autoriteit, en geven Google weinig reden om je site als diepgaand te zien.

Dubbele varianten. Dezelfde inhoud onder meerdere URL’s. Klassiekers zijn de versie met en zonder slash, http naast https, www naast non-www, paginatie die de eerste pagina dupliceert, of een aparte print- en mobiele variant. Zonder duidelijke voorkeur weet Google niet welke versie de canonieke is en verdeelt het de waarde over kopieen.

Parameter-URL’s. Het grootste risico op schaal. Filters, sorteringen, sessie-id’s en tracking-parameters genereren oneindig veel URL-combinaties die in essentie dezelfde of een triviaal andere pagina tonen. Eén productoverzicht met vijf filters kan zo honderden geindexeerde varianten opleveren die geen enkele zoeker ooit intypt.

Waarom een opgeblazen index je pijn doet

Het abstracte gevaar wordt concreet op drie manieren.

Ten eerste verdunt het je autoriteit. Interne links en externe signalen verdelen zich over al je URL’s. Hoe meer zwakke pagina’s meedelen in die koek, hoe minder kracht er overblijft voor de pagina’s waarmee je echt wilt ranken.

Ten tweede verspilt het crawlbudget. Google besteedt per site een eindige hoeveelheid aandacht aan crawlen. Gaat die op aan duizenden parameter-URL’s, dan worden je belangrijke pagina’s minder vaak bezocht en duren updates langer voor ze doorwerken in de resultaten. Op grote sites is dit geen randdetail maar een directe rem op snelheid.

Ten derde tast het je relevantiesignaal aan. Een site die voor 80 procent uit dunne ruis bestaat, oogt voor een zoekmachine minder als een betrouwbare bron. En soms toont Google bij een merkzoekopdracht een zwakke parameter-URL in plaats van je sterke landingspagina, wat een slechte eerste indruk geeft aan precies de bezoeker die jou al zocht.

Index bloat opschonen in vier stappen

Snoeien is geen eenmalige knip maar een gestructureerd proces. Werk in deze volgorde.

Stap 1: inventariseer. Begin in Google Search Console, bij het rapport Pagina-indexering. Daar zie je hoeveel URL’s geindexeerd zijn en welke categorieen Google buiten de index houdt. Vergelijk dat met het aantal pagina’s dat je werkelijk waardevol vindt. Vul aan met een volledige crawl van je site, zodat je per URL-patroon ziet welke parameters en sjablonen de bloat veroorzaken. Het doel van deze stap is een lijst met patronen, niet met losse URL’s.

Stap 2: beslis per type. Voor elk patroon kies je één van vier routes. Verbeteren als de pagina een echt doel kan dienen maar nu te dun is: voeg unieke inhoud toe of voeg ze samen. Samenvoegen als meerdere pagina’s hetzelfde onderwerp dekken: kies één sterke URL en gebruik een 301-redirect of canonical naar het origineel. Noindex voor pagina’s die voor gebruikers nuttig zijn maar niet in de zoekresultaten thuishoren, zoals interne filterresultaten. Verwijderen met een 410-status voor pagina’s die geen waarde meer hebben en niet hoeven terug te keren.

Stap 3: voer uit met het juiste signaal. Het verschil tussen de instrumenten is belangrijk. Een canonical is een hint waarmee je dubbele varianten naar de hoofdversie wijst. Een noindex haalt een pagina uit de index maar laat de link bestaan. Een robots.txt-blokkade voorkomt crawlen maar niet per se indexeren, dus combineer die niet met noindex op dezelfde URL, want dan ziet Google de noindex nooit. Parameter-URL’s pak je het schoonst aan bij de bron: laat je CMS ze niet aanmaken of niet linken, en zet canonicals naar de schone versie.

Stap 4: houd het schoon. Zet de controle op je hygiene-kalender. Check elk kwartaal het indexeringsrapport in GSC op nieuwe pieken, en let bij elke CMS- of webshopwijziging op nieuwe parameterpatronen. Bloat sluipt er terug in zodra je niet kijkt.

Wat je niet moet doen

Twee fouten zien we vaak. De eerste is per ongeluk je belangrijke pagina’s mee snoeien, omdat een te brede regel in robots.txt of een verkeerd geplaatste noindex hele secties uitsluit. Test elke regel voor je hem live zet. De tweede is doorslaan in paniek en alles wat dun lijkt meteen verwijderen, terwijl een deel van die pagina’s met wat unieke inhoud juist sterke landingspagina’s worden. Snoeien is selectief, niet rigoureus om het rigoureuze.

Hou ook in gedachten dat een kleiner indexcijfer geen doel op zich is. Het draait om de verhouding: elke pagina die overblijft, moet een rol spelen in de reis van zoeker naar klant. Twijfel je over welk signaal je per geval inzet, lees dan onze gids over noindex versus canonical versus robots-directives. Speelt bloat vooral op een grote site, dan helpt ook crawlbudget optimaliseren, want dezelfde discipline ligt eronder.

Waar het echt om gaat

Index bloat opschonen is geen schoonheidsoefening voor je crawlstatistieken. Het is een manier om de volledige kracht van je domein achter de pagina’s te zetten die omzet opleveren. Bij ons hoort dit binnen één georkestreerde groeimotor, waarin SEO de acquisitielaag is die niet stuurt op ijdele indexcijfers maar op pipeline. Een schone index is pas waardevol als ze elke potentiele klant sneller bij de juiste landings- en contactpagina brengt.

Wil je je index laten doorlichten en snoeien door een team dat seo marketing inzet om gevonden én geciteerd te worden, dan kijken we daar graag samen naar. Neem contact op en we brengen in kaart welke pagina’s je site verzwaren en welke je laten groeien.

Onderdeel van de gids Wat is SEO? Uitleg, werking en waarom het werkt

Gratis website-scan

Geef je website in en krijg binnen enkele minuten een automatische scan met concrete technische en SEO-verbeterpunten. Geen verkooppraatje.

Waar mogen we je rapport naartoe sturen?

Je gegevens gebruiken we alleen voor je scan. Geen spam, uitschrijven kan altijd.