Over het crawlen door Googlebot
Wat ziet Googlebot daadwerkelijk?
Googlebot is het programma dat pagina’s ophaalt zodat Google ze kan indexeren. Het ervaart een pagina niet zoals een bezoeker dat doet: er is geen lay-out, geen kleur, geen typografie en niets wat alleen gebeurt wanneer iemand scrolt of klikt.
Wat het behoudt, is de tekst en de structuur eromheen: de titel, de beschrijving, de koppen, de leesbare woorden en de links die het kan volgen. Al het andere is steigerwerk dat het onderweg naar die elementen weggooit.
Daar is een Googlebot-simulator voor. Je pagina kan er afgewerkt uitzien en toch vrijwel leeg zijn zodra het ontwerp wordt weggelaten, en dat kun je onmogelijk opmerken door er alleen maar naar te kijken.
Rendering en waarom dit hier belangrijk is
Googlebot is al jaren geen eenvoudige tekstcrawler meer. Het voert de pagina eerst uit in een echte browserengine, waardoor content die met JavaScript wordt opgebouwd over het algemeen wel wordt gezien. De moderne fout is subtieler dan: ‘de bot kan JavaScript niet lezen’.
Deze tool geeft de pagina op dezelfde manier weer voordat er iets wordt geëxtraheerd. Wat u hieronder ziet, is dus de pagina nadat de scripts zijn uitgevoerd. Als hier iets ontbreekt, is dat niet het gevolg van een vertraging bij het weergeven: het staat daadwerkelijk niet in het document.
De dingen die nog steeds verdwijnen, zijn wel het vermelden waard: content achter een klik, tekst die in afbeeldingen is ingebakken, alles wat alleen wordt geladen wanneer een element in beeld komt tijdens het scrollen, en alles wat door een cookiebanner wordt geblokkeerd totdat deze wordt gesloten.
Zo leest u de uitvoer
In de onderstaande panelen zijn vijf dingen het controleren waard:
- Of de titel en beschrijving degene zijn die je bedoeld hebt, in plaats van de standaardtekst uit een template.
- Of de koppenstructuur op zichzelf gelezen een zinvolle samenvatting van de pagina vormt.
- Of de platte tekst je daadwerkelijke betoog bevat, of voornamelijk navigatie en standaardteksten.
- Of de meest voorkomende woorden het onderwerp van de pagina zijn – of de woorden uit je menu.
- Of het aantal woorden ongeveer overeenkomt met wat je op basis van de pagina zou verwachten.
Die vierde zorgt vaker voor problemen dan alle andere. Op een pagina met weinig inhoud is de navigatie vaak de meest herhaalde tekst op de pagina, en dat is precies wat een crawler meeweegt.
Waarom dit inzicht belangrijk is in 2026
Alles wat na het indexeren komt, is op dit inzicht gebaseerd. Rankings, snippets en de bronnen waar AI-assistenten uit putten, beginnen allemaal met de tekst die een crawler heeft kunnen extraheren. Wat hier ontbreekt, ontbreekt dus ook in al die andere onderdelen.
AI-antwoorden hebben de lat hoger gelegd, omdat ze sterker leunen op machineleesbare structuur dan een gerangschikte lijst ooit deed. Een duidelijke koppenstructuur en op zichzelf staande alinea’s zijn gemakkelijker te citeren dan dezelfde inhoud die over een interactieve lay-out is verspreid.
Dat pleit allemaal niet voor eenvoudige pagina’s. Het pleit ervoor ervoor te zorgen dat de versie die een machine leest nog steeds de inhoud bevat, ongeacht hoe de versie die een persoon leest wordt gepresenteerd.
Wat deze tool controleert
Voer een URL in en de tool haalt de pagina op en geeft deze weer. Vervolgens rapporteert de tool wat een crawler overhoudt: de titel, metabeschrijving, canonieke URL en opgegeven taal; de koppenstructuur; de leesbare tekst; de meest voorkomende woorden; en het aantal interne en externe links dat is gevonden.
Het tekstpaneel wordt afgekapt bij zeer lange pagina's, en dit betreft één URL in plaats van een crawl van de website. Het is een simulatie van wat Googlebot extraheert, geen registratie van wat Google daadwerkelijk heeft geïndexeerd.
Waar je nu verder kunt gaan
De pagina kunnen zien is één helft; toestemming krijgen om deze te bekijken is de andere. Controleer met de
crawlbaarheid-test of niets een crawler blokkeert, bekijk met de
gerenderde inhoud-checker hoeveel van de pagina na het renderen overblijft en zorg ervoor dat de
title-tag zijn werk doet.