Een pagina die niet in de index staat, rankt niet slecht — die rankt helemaal niet. Dit artikel legt uit waarom crawlbudget, ontdekking en indexering drie afzonderlijke fasen zijn, en hoe de Indexing Hub van het Semalt-paneel die blinde vlek meetbaar maakt.

De meeste SEO-trajecten in Rotterdam en de rest van de Randstad beginnen bij content, zoekwoorden en links. Dat is begrijpelijk: daar is het werk zichtbaar. Wat wordt overgeslagen, is de stap ervoor — de vraag of de zoekmachine uw pagina's überhaupt kent en of ze die heeft willen bewaren. Zolang die vraag openstaat, optimaliseert u aan iets dat voor de zoekmachine niet bestaat.

Het probleem beperkt zich niet tot grote portalen. Een webshop met achtduizend artikelen, een makelaar met duizend objecten, een uitgever met twintig jaar archief: overal groeit het aantal URL's sneller dan iemand het kan bijhouden. De achterstand wordt pas zichtbaar wanneer het organische verkeer stagneert ondanks een gestage publicatiestroom.

Waar dit artikel niet over gaat. Niet over rankingfactoren en niet over contentstrategie. Het onderwerp is technische vindbaarheid: ontdekking, download, acceptatie — en de instrumenten die die drie waarneembaar maken.
Basis · Technische SEO

Crawlbudget, ontdekking en indexering zijn niet hetzelfde

De meest voorkomende denkfout behandelt indexering als één gebeurtenis. Het zijn drie opeenvolgende fasen met elk een eigen logica, en een probleem dat in de eerste fase ontstaat, valt in de derde niet te repareren. Wie dat onderscheid vasthoudt, stelt de juiste vraag: bij welke stap loopt het vast?

Dat een URL wordt ontdekt, dat een bot hem daadwerkelijk ophaalt en dat de zoekmachine besluit hem te bewaren, zijn drie losse handelingen die weken uit elkaar kunnen liggen. Een breed overzicht van alle modules staat op de pagina over het vernieuwde Semalt-paneel; hier gaat het alleen over het indexeringsdeel.

Fase Wat er gebeurt Typische blokkade Passende maatregel
Ontdekking De zoekmachine verneemt dat een URL bestaat: via interne links, sitemap, externe links of een melding. Weespagina, ontbreekt in de sitemap, te grote klikdiepte. Interne verwijzingen, schone sitemap, actieve indiening.
Crawlen De bot haalt de URL echt op. Het aantal ophaalacties binnen een periode heet crawlbudget. Trage server, 5xx-fouten onder belasting, parametervarianten zonder waarde. Infrastructuur, correcte statuscodes, opruimen van URL-varianten.
Indexering De opgehaalde pagina wordt beoordeeld en bewaard — of juist niet. Dit besluit gaat over inhoud. Dunne content, duplicaten, tegenstrijdige canonicals. Inhoudelijke substantie, heldere canonieke URL's, consistente signalen.

Crawlbudget is geen post op een factuur. Het volgt uit de prestaties van uw server, de kwaliteit van eerdere antwoorden en de ingeschatte waarde van het domein. Een server die op piekmomenten fouten teruggeeft of er drie seconden over doet om de eerste byte te leveren, krijgt minder ophaalacties: de zoekmachine remt af om de site niet te overbelasten.

Praktijktip. Bepaal eerst de fase, voordat u ook maar één indieningsinstrument aanraakt. Staat een URL in geen enkele sitemap en verwijst er geen link naar, dan is het een ontdekkingsprobleem; wordt hij wél opgehaald maar niet bewaard, dan is het een inhoudelijk probleem. Dat zijn twee volstrekt verschillende werkzaamheden.
Diagnose · Terugkerende patronen

Zes redenen waarom pagina's buiten de index blijven

Bij audits herhalen de oorzaken zich met opvallende regelmaat. De zes patronen hieronder dekken het overgrote deel, geordend naar de fase waarin ze ontstaan.

Ontdekking

Weespagina's

De URL antwoordt netjes, maar geen enkele pagina op de site verwijst ernaar: er is geen route naartoe.

  • Herziene categorieën, verwijderde filters
  • Campagnepagina's uit de navigatie gehaald
  • Online, maar onvindbaar
Ontdekking

Zwakke interne links

Formeel gelinkt, praktisch onbereikbaar. Klikdiepte wordt gelezen als een signaal van belang.

  • Een product op paginanummer veertien
  • Twaalf kliks vanaf de homepage
  • Onzichtbaar voor bezoeker én bot
Indexering

Dubbele content

Webshops produceren duplicaten helemaal zelf. De zoekmachine kiest één variant, niet per se de uwe.

  • Eén product via drie categoriepaden
  • Sorteer-, filter- en sessieparameters
  • Printversies, met of zonder slotstreep
Indexering

Foutieve canonicals

Een goed middel tegen duplicaten, maar het wordt geregeld tegen de eigen site gekeerd.

  • Alle paginering wijst naar pagina één
  • Het doel redirect, heeft noindex of bestaat niet
  • Een canonical is een advies, geen bevel
Crawlen

robots.txt tegenover noindex

Twee mechanismen die stelselmatig worden verward, met dure gevolgen bij een livegang.

  • Een geblokkeerde URL wordt niet gelezen, de noindex dus ook niet
  • Uit de index komen vraagt toegang plus noindex
  • Een vergeten noindex uit de staging kost weken
Crawlen

Trage levering

De responstijd begrenst het aantal ophaalacties per uur. Doorslaggevend zodra het volume groeit.

  • Tweehonderd milliseconden tegenover twee seconden
  • Bij dertigduizend URL's: dagen of maanden
  • Serverfouten stralen af op het hele domein

Nederland voegt daar een verzwarende factor aan toe: de tweede taal. Een webshop die zijn artikelen in het Nederlands en in het Engels publiceert, verdubbelt zijn URL-voorraad — en internationale klanten van een Rotterdamse toeleverancier zoeken nu eenmaal in het Engels. Het crawlbudget verdubbelt niet mee. Wie grote volumes beheert zonder de responstijd onder controle te hebben, begint daar: de technische basis gaat voor.

Instrument · Indexing Hub

De Indexing Hub en zijn expliciete grenzen

De Indexing Hub bundelt het indienen van URL's, het verwerken van sitemaps en de waarneming die daarop volgt. De grenzen zijn bepalend voor uw planning: ze leggen vast wat haalbaar is en binnen welke termijn, en dat is bruikbaarder dan welke belofte ook.

1.000
URL's per dag per account
10.000
URL's per batch
3
niveaus sitemapdiepte
1.000
sitemaps per taak
2 / 20
gelijktijdig / in de wachtrij

Het interessantste getal is het kleinste. Duizend URL's per dag klinkt royaal voor een bedrijfssite van zestig pagina's; bij een catalogus van tienduizenden URL's is het een budget dat u plant zoals u een advertentiebudget plant. Daar zit de eigenlijke opbrengst: de limiet dwingt u te beslissen welke pagina's ertoe doen — een beslissing die in de dagelijkse praktijk moeiteloos wordt ontweken.

Parameter Waarde Praktische betekenis
Dagbudget URL-tracker 1.000 URL's per dag per account De echte doorvoerlimiet. Duizend gekozen URL's zijn meer waard dan duizend willekeurige.
Massa-indiening tot 10.000 URL's per batch De lijst gaat in één handeling weg. De verwerking blijft aan het dagbudget gebonden.
Bron van de sitemap bestand uploaden of URL opgeven U kunt een sitemap controleren die nog niet publiek is, bijvoorbeeld vóór een livegang.
Recursieve verwerking tot 3 niveaus diep Een index die naar een andere index verwijst, wordt uitgeklapt. Dieper: structuur platslaan.
Sitemaps per taak tot 1.000 Dekt in één ronde de sets die per categorie of taal zijn opgesplitst.
Gelijktijdige taken maximaal 2 Twee domeinen of twee sitemapsets parallel; de rest wacht.
Wachtrij maximaal 20 taken Genoeg voor een bureau met een handvol klanten, maar niet onbeperkt.
Logboek per URL tijdstempel, status, foutdetail Bewijst of een URL is opgehaald, en hoe dat afliep.
Modules · Indiening

Twee ingangen: de batch en de sitemap

De hub biedt twee ingangen: de ene begint bij een lijst concrete URL's, de andere bij een bestaande sitemapstructuur. Beide monden uit in dezelfde waarneming en delen hetzelfde dagbudget.

Indexing Hub · Module 1

Massa-indiening van URL's

Voor situaties waarin veel URL's tegelijk veranderen.

tot 10.000 URL's per batch
  • Eén handeling in plaats van tien. De volledige lijst gaat in één keer weg; het handmatig opknippen vervalt.
  • De rem blijft het dagbudget. Een batch van tienduizend URL's wordt afgewerkt met duizend per dag.
  • De volgorde is een besluit. Omdat het budget krap is, bepaalt de rangschikking van de lijst wat de eerste week oplevert.
  • Voor uitzonderingen, niet voor de routine. Restyling, migratie, seizoenscategorie, nieuw assortiment of een blokkade die achteraf is opgeheven.
10.000
URL's in één verzending
1.000
werkelijke dagdoorvoer
3
livetellers per taak
Indexing Hub · Module 2

Sitemapverwerking

Voor grote verzamelingen die al in sitemap-indexen zijn georganiseerd.

3 niveaus · 1.000 sitemaps per taak
  • Bestand of URL. U uploadt het bestand of geeft het adres op, waardoor u een structuur kunt controleren voordat die live gaat.
  • Recursief tot drie niveaus. Een index die naar een andere index verwijst, wordt uitgeklapt; dieper genest vraagt om een plattere opzet.
  • Tot 1.000 sitemaps per taak. Eén ronde verwerkt de sets die per taal of contenttype zijn opgesplitst.
  • Twee taken parallel, twintig in de wachtrij. Genoeg voor meerdere klanten, maar het dwingt tot een bewuste volgorde: de livegang van vrijdag gaat vóór routineonderhoud.
3
nestniveaus
1.000
sitemaps per taak
2
gelijktijdige taken
20
plaatsen in de wachtrij

In beide gevallen loopt de verzending via de IndexNow-koppeling, richting GoogleBot en BingBot. Hoe de indexeringsmodule van Semalt zich verhoudt tot de rest van het paneel, staat in het platformoverzicht beschreven.

Mechaniek · IndexNow en logboek

Duwen in plaats van wachten, en wat het logboek daarna vertelt

IndexNow als actieve melding

Indexering werkt van oudsher volgens het haalprincipe: de zoekmachine bepaalt zelf wanneer hij terugkomt, en op een weinig actief domein wachten diepe pagina's daar weken op. IndexNow draait die richting om — de site meldt zelf dat een URL is gewijzigd.

De winst zit in de doorlooptijd bij wijzigingen. Een gecorrigeerde omschrijving, een geactualiseerde prijs, een geopende categorie: in plaats van te hopen dat het volgende routinebezoek het opmerkt, geeft u een signaal af. Voor seizoensgebonden branches is dat het verschil tussen zichtbaarheid tijdens het seizoen en zichtbaarheid erna.

Een URL indienen is niet hetzelfde als geïndexeerd worden. De melding is een duwtje, geen toezegging: de zoekmachine beslist nog steeds zelf of hij de URL ophaalt en of hij hem bewaart. Geen enkele melding, hoe snel ook, krijgt een dunne pagina, een duplicaat of een pagina met noindex in de index. Wie na een massa-indiening honderd procent acceptatie verwacht, komt bedrogen uit — niet door een gebrek in het instrument, maar omdat het mechanisme zo niet in elkaar zit.

Het duwtje verkort dus de tijd tot ontdekking en vervangt een onbeantwoordbare vraag — kent de zoekmachine deze pagina? — door een vraag die u wél kunt oplossen: waarom houdt hij haar buiten de deur?

Het botbezoeklogboek als diagnose-instrument

Het waardevolste deel van de hub is niet de indiening maar het logboek dat per URL wordt bijgehouden: het tijdstip van het botbezoek, de behaalde status en het foutdetail. Daarnaast lopen live tellers mee voor ingediende, gevonden en mislukte URL's, zodat een lopende actie niet blind hoeft te worden gevolgd.

Het nut ontstaat uit de combinatie: het tijdstempel zegt of het ophalen heeft plaatsgevonden, de status scheidt techniek van inhoud, en het foutdetail wijst de reparatie aan.

  • Geen bezoek ondanks indiening. Wel gemeld, niet opgehaald. Controleer robots.txt, de serverbelasting en een eventuele afremming van het domein.
  • Bezoek met serverfout. De bot liep tegen een 5xx aan. Een infrastructuurkwestie die op het hele domein drukt.
  • Bezoek met status 404 of 410. Verouderde sitemap of een interne link naar verwijderde content. Opruimen, niet opnieuw indienen.
  • Bezoek dat uitkomt op een redirect. U hebt een tussenstap ingediend. Dien altijd de eind-URL in.
  • Geslaagd bezoek zonder opname. Het technische deel is rond. De oorzaak ligt bij de inhoud, de canonisering of de interne verwijzingen.
Vermoeden wordt vastgelegde toestand. Deze systematiek maakt een einde aan de discussie die in veel projecten blijft hangen — dat Google een bepaalde pagina "niet mag". Met een tijdstempel en een statuscode wordt dat een takenlijst.
Planning · Rekenvoorbeeld

40.000 URL's bij duizend per dag

De volgende berekening is illustratief: ze maakt de ordegrootte tastbaar, het is geen meting aan een bestaand project.

Een webshop heeft 40.000 URL's in zijn sitemap staan, Nederlandse en Engelse versies bij elkaar. Bij een dagbudget van 1.000 URL's levert dat veertig dagen op, en dan nog alleen als de limiet elke dag volledig wordt benut en niets opnieuw hoeft. Met correctierondes komt de realistische termijn op zes tot acht weken. De batch van tienduizend URL's verkort daar niets aan; die bespaart alleen het handmatige opknippen.

40.000
URL's in de sitemap
40
dagen bij blinde indiening
5.400
werkelijk relevante URL's
6
dagen voor het commerciële deel

Zes weken is te lang voor een seizoenscampagne. De conclusie is niet dat het instrument tekortschiet, maar dat er gesorteerd moet worden. Een plausibele verdeling ziet er zo uit.

  • Ongeveer 12.000 varianten en parameterpagina's. Kleuren, maten, filters, sorteringen. Dit is een canoniseringsvraagstuk; verbruikt budget: nul.
  • Ongeveer 6.000 definitief uitverkochte artikelen. Die vragen om een redirect of om verwijdering, niet om indiening.
  • Ongeveer 400 categorie- en adviespagina's. Zij dragen het leeuwendeel van de omzet: een halve dag budget.
  • Ongeveer 5.000 gezochte artikelen die op voorraad zijn. Die volgen in vijf dagen en dekken de lopende handel.
  • Ongeveer 16.000 longtailpagina's. Die lopen daarna op de achtergrond mee, zonder deadline.

Van veertig dagen blinde indiening blijft zo minder dan zes dagen over voor alles wat commercieel telt. Het verschil zit in de volgorde, niet in de techniek. In Nederland komt er één criterium bij: het volume verdeelt zich over het Nederlands en het Engels, en soms bedient hetzelfde domein ook Vlaanderen. Een analyse op landniveau verhult dan precies wat u zou moeten zien. Snijd daarom per taal; de zichtbaarheidsrapportages van hetzelfde platform zitten in hetzelfde account, zonder aparte export.

Onderhoud · Sitemaps

Sitemaphygiëne en een werkbare procedure

Een sitemap is geen inventaris van bestaande URL's, maar een aanbeveling: elke regel stelt dat die pagina het indexeren waard is. Bestaat dertig procent van het bestand uit redirects, foutpagina's en URL's met noindex, dan daalt het vertrouwen in het geheel — en daarmee het nut van het bestand voor de pagina's die er terecht in staan.

Wel opnemen

Indexeerbare doelpagina's

Uitsluitend canonieke URL's die met status 200 antwoorden, in hun definitieve schrijfwijze.

  • Eerlijke lastmod-waarden, geen nachtelijke herdatering
  • Opsplitsing naar categorie, product en taal
  • Een sitemap-index als dak, passend bij de recursie
Niet opnemen

Alles wat niet indexeerbaar is

Elke URL die toch wordt afgewezen, verzwakt de strekking van het bestand.

  • Noindex, in robots.txt geblokkeerde URL's, redirects
  • Gefilterde varianten, interne zoekresultaten
  • Winkelwagen, klantomgeving, testhosts, foutpagina's

Daaruit volgt een werkvolgorde die begint met opruimen. Eerst saneert u de sitemap, daarna laat u die verwerken — via bestandsupload of via het adres, afhankelijk van de vraag of het bestand al publiek is. Het resultaat levert een eerste stand van zaken op: gevonden URL's, mislukte URL's en de statuscodes die zich opstapelen.

Die foutenlijst werkt u af voordat er één dagbudget aan wordt uitgegeven. Pas daarna begint de gerangschikte indiening, met de beslissende pagina's vooraan. Na een week levert het logboek genoeg meetpunten op: bezocht en bewaard, bezocht en afgewezen, nooit opgehaald. De derde groep wijst op technische oorzaken, de tweede op inhoudelijke.

Maandelijkse vergelijking. De sitemap naast de werkelijke stand van de site leggen kost weinig tijd en voorkomt dat er in de loop der jaren een bestand ontstaat waar niemand nog op vertrouwt. De sitemapverwerking in het Semalt-paneel is voor die routine even geschikt als voor de grote eerste ronde. Onze overige technische analyses staan gebundeld op het blog.

Veelgestelde vragen

Hoe lang duurt het voordat een ingediende URL is geïndexeerd?

Daar valt geen termijn voor te beloven; elk genoemd getal is een schatting. De indiening verkort de tijd tot ontdekking en tot het eerste ophalen. Of en wanneer opname in de index volgt, hangt af van het oordeel van de zoekmachine. Het logboek laat in elk geval zien of het ophalen heeft plaatsgevonden — dat is de helft van het antwoord.

Zijn duizend URL's per dag genoeg voor een middelgrote webshop?

Voor de lopende exploitatie vrijwel altijd: nieuwe en gewijzigde pagina's blijven ook bij een actieve shop ruim onder die grens. Het budget wordt pas krap bij de eerste registratie van grote verzamelingen, bij een restyling of bij een migratie. Juist dan betaalt het voorsorteren zich terug, omdat het werkelijk relevante deel van een catalogus vaak een fractie van het totaal is.

Hoe pakt u een site aan die zowel Nederlands als Engels bedient?

Elke taalversie is een eigen URL en verbruikt haar deel van het dagbudget. Splits de sitemaps per taal onder één gemeenschappelijke index — dat verwerkt de recursie moeiteloos — en beslis daarna welke versie voorgaat. De beschreven functies werken op Google-data en kennen geen eigen taalherkenning: het onderscheid komt uit uw sitemaps en prioriteiten, niet uit het instrument.

Wat gebeurt er als ik dezelfde URL meerdere keren indien?

Dan verbruikt u budget zonder er iets voor terug te krijgen: een ongewijzigde pagina opnieuw aanmelden versnelt geen enkel besluit. Opnieuw indienen heeft alleen zin als de inhoud, de canonisering of een technische blokkade daadwerkelijk is veranderd, bijvoorbeeld nadat een ongewenste noindex is verwijderd.

Hoeveel sitemaptaken kunnen tegelijk lopen?

Twee tegelijk, met twintig taken in de wachtrij. Voor een bureau met een handvol klanten is dat voldoende, maar het vraagt om een bewuste planning: zet tijdkritische gevallen zoals een livegang vóór routineonderhoud, anders blokkeert een grote doorloop de taak die haast heeft.

Slot: zichtbaarheid begint bij vindbaarheid

Indexering is een onderschat knelpunt omdat het onzichtbaar blijft wanneer het goed gaat en niet op een storing lijkt wanneer het misgaat. Geen melding, geen rode balk, alleen pagina's zonder vertoningen. Wie het niet meet, werkt maandenlang aan teksten en links terwijl de oorzaak een fase eerder ligt.

De Indexing Hub verandert dat niet op magische wijze. Hij brengt drie dingen bij elkaar: een heldere doorvoerlimiet die tot prioriteren dwingt, een actieve melding die de tijd tot ontdekking verkort, en een logboek dat vermoedens vervangt door tijdstempels en statuscodes. De grenzen horen bij het beeld: duizend URL's per dag is een eindig getal, twee gelijktijdige taken ook, en een indiening blijft een indiening.

Juist die nuchterheid maakt het vakgebied planbaar. Wie weet dat 40.000 URL's bij vol budget veertig dagen vragen, plant anders dan wie op een knop drukt en hoopt. Wilt u nagaan hoeveel van uw pagina's daadwerkelijk worden meegenomen, dan kunt u het Semalt-dashboard openen en beginnen met één sitemapronde. Die eerste stand van zaken is doorgaans leerzamer dan verwacht.

Klaar om Uw SEO te Verbeteren?

Ontvang een gratis SEO audit en ontdek hoe we uw Rotterdam bedrijf kunnen laten groeien.

Gratis SEO Audit Aanvragen