SEO-vriendelijke website bouwen:
checklist voor Google en AI.
Gevonden worden in Google en genoemd worden in een AI-antwoord vragen grotendeels hetzelfde: pagina's die een crawler zonder JavaScript kan lezen, die de vraag echt beantwoorden, en waarvan controleerbaar is wie ze schreef. Hieronder de checklist, plus drie adviezen die het niet meer doen.
Drie adviezen die het niet meer doen
Advies over vindbaarheid in AI-antwoorden veroudert sneller dan de rest van de technische SEO. Drie dingen die vorig jaar nog rondgingen en nu anders liggen:
- llms.txt is voor Google geen signaal. Google schrijft in de eigen documentatie dat het bestand genegeerd wordt en dat er geen speciale markup voor AI nodig is. Publiceren mag, maar reken het niet mee als vindbaarheidsmaatregel.
- FAQ-rich-results zijn bij Google gestopt in mei 2026. De uitklapbare vragen onder een zoekresultaat zijn verdwenen, dus FAQ-schema levert daar geen groter resultaat meer op. Een goede vraag met een direct antwoord op de pagina blijft wel nuttig, voor wie hem leest.
- Eén regel voor "AI-crawlers" bestaat niet. OpenAI documenteert OAI-SearchBot voor zoek- en citatiefuncties en GPTBot voor het verzamelen van materiaal waarop modellen getraind kunnen worden. Wie die twee op één hoop gooit, maakt de keuze niet.
Wat wel overeind blijft is saaier en houdbaarder: een pagina die op te halen en te indexeren is, die de vraag van de bezoeker beantwoordt, en waarvan te controleren valt wie hem schreef en wanneer. Dat is de checklist hieronder.
De checklist in veertien punten
- Server-rendered of statisch gegenereerde HTML, zodat de inhoud in de respons staat en niet pas na het uitvoeren van JavaScript.
- Eén canonical per pagina, expliciet in
<link rel="canonical">, en overal dezelfde domeinvariant (www of niet, altijd https). - Sitemap.xml die uit de routes zelf wordt afgeleid en dus niet achterloopt op de site, met een verwijzing ernaar in robots.txt.
- Robots.txt waarin crawlers per doel zijn gegroepeerd: zoeken en citeren apart van trainingsdata.
noindexop pagina's die niet in een zoekresultaat horen, zoals een login of een bedankpagina. Een blokkade in robots.txt werkt daar averechts: een crawler die de pagina niet mag ophalen, leest die noindex-regel ook niet.- Per pagina een eigen title en meta description die de scope samenvatten, met de merknaam één keer.
- Semantische HTML: één h1, koppen die geen niveau overslaan, landmarks die kloppen.
- De vraag van de bezoeker als kop, met het antwoord in de eerste alinea eronder. Dat leest prettiger en het is meteen het stuk dat geciteerd kan worden.
- Interne links met beschrijvende ankertekst, zodat de samenhang tussen je pagina's zichtbaar is.
- Beschrijvende alt-tekst op inhoudelijke afbeeldingen; decoratief beeld krijgt een leeg alt-attribuut.
- Breadcrumb-navigatie zichtbaar op de pagina, plus BreadcrumbList in JSON-LD.
- Structured data die beschrijft wat er zichtbaar op de pagina staat: Organization, Person, Article, BreadcrumbList.
- Core Web Vitals in het groen (LCP < 2,5 s, INP < 200 ms, CLS < 0,1), gemeten op mobiel met veldcijfers.
- Auteur, herzieningsdatum en een bron bij elk cijfer, zodat een lezer kan nagaan waar het vandaan komt.
Hreflang komt erbij zodra je in meer dan één taal publiceert; zolang je site alleen Nederlands is, levert het niets op. Voor de snelheidskant van punt 13 staat er een apart stuk over sub-seconde laadtijden.
Crawlers: kies per doel, niet per merk
Bots die je pagina's ophalen doen niet allemaal hetzelfde met wat ze vinden. Dat verschil is de hele keuze:
- Zoeken en citeren. Deze bots halen een pagina op om hem te kunnen tonen in een zoekresultaat of in een antwoord, met bronvermelding erbij. OAI-SearchBot hoort in deze groep. Wil je in AI-antwoorden verschijnen, dan is dit de groep die je toelaat.
- Trainingsdata. Deze bots verzamelen materiaal waarop een model getraind kan worden. GPTBot hoort in deze groep. Toelaten of weigeren is een losse afweging; weigeren hoeft je zichtbaarheid in de zoekfuncties van dezelfde leverancier niet te raken, want die lopen via een andere bot.
De indeling verschilt per leverancier en verandert. Iedere grote aanbieder publiceert zijn eigen lijst met crawlernamen en wat ze doen; dat is de bron die telt, en die kijk je opnieuw na zodra je robots.txt een jaar oud is. Onze eigen regels staan op doel gegroepeerd in robots.txt, met per groep de reden erbij.
Houd daarbij in gedachten wat robots.txt is: een verzoek aan bots die zich eraan houden, geen slot. Materiaal dat niet openbaar mag zijn, hoort achter een login.
Structured data en llms.txt
Wat structured data wel doet
Structured data beschrijft wat er zichtbaar op je pagina staat, in een vorm die een machine kan lezen zonder te gokken. Organization en Person maken duidelijk wie er achter de site zit en wie er schrijft. Article koppelt een stuk aan een auteur, een publicatiedatum en een herzieningsdatum. BreadcrumbList geeft de plek in de structuur. Dat is geen truc, het is het leesbaar maken van wat je toch al beweert.
De regel die daarbij hoort: markeer alleen wat een bezoeker ook ziet. Schema dat iets anders zegt dan de pagina zelf is een reden voor een handmatige maatregel bij Google, en het valt op zodra iemand het naast elkaar legt.
Wat het niet doet
Structured data is op zichzelf geen rankingfactor en geen toegangsbewijs tot een AI-antwoord. Er bestaat geen aparte markup waarmee je een model vertelt dat het jou moet citeren; Google zegt in de eigen documentatie dat die er niet is. FAQ-schema is daar het voorbeeld van: sinds mei 2026 levert het bij Google geen uitgeklapt zoekresultaat meer op. Wij houden vraag-en-antwoordsecties op pagina's omdat mensen zo zoeken, niet om een resultaatweergave.
llms.txt: een bestand, geen knop
llms.txt is een markdownbestand in de root met links en korte omschrijvingen van je site. Het is geen standaard die zoekmachines volgen, en Google gebruikt het niet. Onderhoud je het toch, zie het dan voor wat het is: een leesbaar overzicht voor wie het opvraagt, dat klopt met de site. Die van ons staat op /llms.txt. Dat het overzicht actueel is, is de enige belofte die we eraan hangen.
Kost het onderhoud tijd die je beter in je pagina's steekt, laat het dan staan zoals het is of weg. Een verouderd overzicht van je diensten is slechter dan geen overzicht.
Zelf controleren, in vijf stappen
Je hoeft hiervoor geen SEO-bureau in te huren. Vijf controles die je op een middag kunt doen, in de volgorde waarin ze het meeste opleveren.
1Leest een crawler je pagina?+
curl) of zet JavaScript uit in DevTools. Zoek je h1, je hoofdtekst en je interne links terug in de uitvoer. Staan ze er niet, dan begint je werk daar en niet bij de markup.2Is hij geïndexeerd?+
3Wat staat er in robots en meta robots?+
4Klopt je structured data met de pagina?+
5Wat merkt een echte bezoeker?+
Waar je begint, hangt af van je vertrekpunt
Begin bij de structuur. URL's die je daarna niet meer wijzigt, één canonical per pagina, een sitemap die uit de routes volgt, en per pagina één vraag die hij beantwoordt. Zet de techniek goed vóór je publiceert: achteraf herstellen kost meer dan het vooraf doen. Publiceer pas als je hoofdtekst zonder JavaScript in de broncode staat.
Begin bij indexering, niet bij markup. Controleer in Search Console welke URL's bekend zijn, welke canonical Google koos, en of er een noindex of een robots-blokkade in de weg zit. Pas als de pagina's netjes geïndexeerd zijn, is inhoud de volgende vraag: beantwoordt de pagina de vraag waarop je gevonden wilt worden, of gaat hij ergens omheen?
Kijk naar leesbaarheid en antwoord. Drie dingen op volgorde: laat je robots.txt de zoek- en citatiebots toe, is je pagina zonder JavaScript te lezen, en staat het antwoord in de eerste alinea in plaats van na vier alinea's aanloop? Wat geciteerd wordt, is doorgaans een zin die op zichzelf klopt. Schrijf er een paar die dat doen.
Checklist: vóór je live gaat
Veelgestelde vragen
Q1Is llms.txt verplicht?+
Q2Moet ik AI-crawlers blokkeren?+
Q3Heeft FAQ-schema nog zin?+
Q4Welke structured data zet ik er dan wel op?+
Q5Hoe weet ik of dit werkt?+
Wil je dit laten nakijken op je eigen site, dan begint dat met een gesprek. Je stuurt het formulier of een appje; binnen 24 uur krijg je van Nick zelf twee of drie momenten voorgesteld, geen agenda-link. Wat we dan doen staat op de marketingpagina: nulmeting eerst, daarna pas werk.