Rotterdam · 51°55′N · 4°28′O · Atelier nr. 004
1 plek · start Q4 2026Klantportaal →MMXXVI
Pillar · Maatwerk11 min lezenEditie 2026Bijgewerkt: 11 september 2026

SEO-vriendelijke website bouwen:
checklist voor Google en AI.

Gevonden worden in Google en genoemd worden in een AI-antwoord vragen grotendeels hetzelfde: pagina's die een crawler zonder JavaScript kan lezen, die de vraag echt beantwoorden, en waarvan controleerbaar is wie ze schreef. Hieronder de checklist, plus drie adviezen die het niet meer doen.

Architectonische blueprint van een maatwerk-website
PLAN · DOORSNEDE · DETAILMAATWERK · SEO-checklist

Drie adviezen die het niet meer doen

Advies over vindbaarheid in AI-antwoorden veroudert sneller dan de rest van de technische SEO. Drie dingen die vorig jaar nog rondgingen en nu anders liggen:

  1. llms.txt is voor Google geen signaal. Google schrijft in de eigen documentatie dat het bestand genegeerd wordt en dat er geen speciale markup voor AI nodig is. Publiceren mag, maar reken het niet mee als vindbaarheidsmaatregel.
  2. FAQ-rich-results zijn bij Google gestopt in mei 2026. De uitklapbare vragen onder een zoekresultaat zijn verdwenen, dus FAQ-schema levert daar geen groter resultaat meer op. Een goede vraag met een direct antwoord op de pagina blijft wel nuttig, voor wie hem leest.
  3. Eén regel voor "AI-crawlers" bestaat niet. OpenAI documenteert OAI-SearchBot voor zoek- en citatiefuncties en GPTBot voor het verzamelen van materiaal waarop modellen getraind kunnen worden. Wie die twee op één hoop gooit, maakt de keuze niet.

Wat wel overeind blijft is saaier en houdbaarder: een pagina die op te halen en te indexeren is, die de vraag van de bezoeker beantwoordt, en waarvan te controleren valt wie hem schreef en wanneer. Dat is de checklist hieronder.

De checklist in veertien punten

  1. Server-rendered of statisch gegenereerde HTML, zodat de inhoud in de respons staat en niet pas na het uitvoeren van JavaScript.
  2. Eén canonical per pagina, expliciet in <link rel="canonical">, en overal dezelfde domeinvariant (www of niet, altijd https).
  3. Sitemap.xml die uit de routes zelf wordt afgeleid en dus niet achterloopt op de site, met een verwijzing ernaar in robots.txt.
  4. Robots.txt waarin crawlers per doel zijn gegroepeerd: zoeken en citeren apart van trainingsdata.
  5. noindex op pagina's die niet in een zoekresultaat horen, zoals een login of een bedankpagina. Een blokkade in robots.txt werkt daar averechts: een crawler die de pagina niet mag ophalen, leest die noindex-regel ook niet.
  6. Per pagina een eigen title en meta description die de scope samenvatten, met de merknaam één keer.
  7. Semantische HTML: één h1, koppen die geen niveau overslaan, landmarks die kloppen.
  8. De vraag van de bezoeker als kop, met het antwoord in de eerste alinea eronder. Dat leest prettiger en het is meteen het stuk dat geciteerd kan worden.
  9. Interne links met beschrijvende ankertekst, zodat de samenhang tussen je pagina's zichtbaar is.
  10. Beschrijvende alt-tekst op inhoudelijke afbeeldingen; decoratief beeld krijgt een leeg alt-attribuut.
  11. Breadcrumb-navigatie zichtbaar op de pagina, plus BreadcrumbList in JSON-LD.
  12. Structured data die beschrijft wat er zichtbaar op de pagina staat: Organization, Person, Article, BreadcrumbList.
  13. Core Web Vitals in het groen (LCP < 2,5 s, INP < 200 ms, CLS < 0,1), gemeten op mobiel met veldcijfers.
  14. Auteur, herzieningsdatum en een bron bij elk cijfer, zodat een lezer kan nagaan waar het vandaan komt.

Hreflang komt erbij zodra je in meer dan één taal publiceert; zolang je site alleen Nederlands is, levert het niets op. Voor de snelheidskant van punt 13 staat er een apart stuk over sub-seconde laadtijden.

Crawlers: kies per doel, niet per merk

Bots die je pagina's ophalen doen niet allemaal hetzelfde met wat ze vinden. Dat verschil is de hele keuze:

  • Zoeken en citeren. Deze bots halen een pagina op om hem te kunnen tonen in een zoekresultaat of in een antwoord, met bronvermelding erbij. OAI-SearchBot hoort in deze groep. Wil je in AI-antwoorden verschijnen, dan is dit de groep die je toelaat.
  • Trainingsdata. Deze bots verzamelen materiaal waarop een model getraind kan worden. GPTBot hoort in deze groep. Toelaten of weigeren is een losse afweging; weigeren hoeft je zichtbaarheid in de zoekfuncties van dezelfde leverancier niet te raken, want die lopen via een andere bot.

De indeling verschilt per leverancier en verandert. Iedere grote aanbieder publiceert zijn eigen lijst met crawlernamen en wat ze doen; dat is de bron die telt, en die kijk je opnieuw na zodra je robots.txt een jaar oud is. Onze eigen regels staan op doel gegroepeerd in robots.txt, met per groep de reden erbij.

Houd daarbij in gedachten wat robots.txt is: een verzoek aan bots die zich eraan houden, geen slot. Materiaal dat niet openbaar mag zijn, hoort achter een login.


In detail

Structured data en llms.txt

Wat structured data wel doet

Structured data beschrijft wat er zichtbaar op je pagina staat, in een vorm die een machine kan lezen zonder te gokken. Organization en Person maken duidelijk wie er achter de site zit en wie er schrijft. Article koppelt een stuk aan een auteur, een publicatiedatum en een herzieningsdatum. BreadcrumbList geeft de plek in de structuur. Dat is geen truc, het is het leesbaar maken van wat je toch al beweert.

De regel die daarbij hoort: markeer alleen wat een bezoeker ook ziet. Schema dat iets anders zegt dan de pagina zelf is een reden voor een handmatige maatregel bij Google, en het valt op zodra iemand het naast elkaar legt.

Wat het niet doet

Structured data is op zichzelf geen rankingfactor en geen toegangsbewijs tot een AI-antwoord. Er bestaat geen aparte markup waarmee je een model vertelt dat het jou moet citeren; Google zegt in de eigen documentatie dat die er niet is. FAQ-schema is daar het voorbeeld van: sinds mei 2026 levert het bij Google geen uitgeklapt zoekresultaat meer op. Wij houden vraag-en-antwoordsecties op pagina's omdat mensen zo zoeken, niet om een resultaatweergave.

llms.txt: een bestand, geen knop

llms.txt is een markdownbestand in de root met links en korte omschrijvingen van je site. Het is geen standaard die zoekmachines volgen, en Google gebruikt het niet. Onderhoud je het toch, zie het dan voor wat het is: een leesbaar overzicht voor wie het opvraagt, dat klopt met de site. Die van ons staat op /llms.txt. Dat het overzicht actueel is, is de enige belofte die we eraan hangen.

Kost het onderhoud tijd die je beter in je pagina's steekt, laat het dan staan zoals het is of weg. Een verouderd overzicht van je diensten is slechter dan geen overzicht.

Zelf controleren, in vijf stappen

Je hoeft hiervoor geen SEO-bureau in te huren. Vijf controles die je op een middag kunt doen, in de volgorde waarin ze het meeste opleveren.

1Leest een crawler je pagina?+
Haal de pagina op zonder browser (curl) of zet JavaScript uit in DevTools. Zoek je h1, je hoofdtekst en je interne links terug in de uitvoer. Staan ze er niet, dan begint je werk daar en niet bij de markup.
2Is hij geïndexeerd?+
Search Console, URL-inspectie: is de pagina bekend, is hij geïndexeerd, en welke canonical koos Google? Wijkt die af van die van jou, dan ziet Google elders een sterkere variant van dezelfde pagina.
3Wat staat er in robots en meta robots?+
Open je eigen /robots.txt en lees hem regel voor regel: staan zoek- en citatiebots in de ene groep en trainingsbots in de andere, en heb je van beide bewust gekozen? Controleer daarna per sjabloon of er een meta robots-regel staat die je niet bedoelde.
4Klopt je structured data met de pagina?+
Draai de Rich Results Test en de Schema Markup Validator. Lees daarna je JSON-LD naast je scherm: staat er iets in het schema dat een bezoeker nergens ziet, haal het eruit. Let op verwijzingen naar een @id die op die pagina niet bestaat.
5Wat merkt een echte bezoeker?+
PageSpeed Insights toont veldcijfers uit CrUX, van echte bezoekers. Een site met weinig verkeer heeft die data niet: CrUX toont alleen wat op genoeg bezoeken berust. Zie je geen veldcijfers, werk dan met de labcijfers als beste beschikbare benadering en zeg erbij dat het een labmeting is.

Waar je begint, hangt af van je vertrekpunt

Begin bij de structuur. URL's die je daarna niet meer wijzigt, één canonical per pagina, een sitemap die uit de routes volgt, en per pagina één vraag die hij beantwoordt. Zet de techniek goed vóór je publiceert: achteraf herstellen kost meer dan het vooraf doen. Publiceer pas als je hoofdtekst zonder JavaScript in de broncode staat.

De leesbaarheidsregel voor vindbaarheid
Wat een crawler zonder JavaScript niet kan lezen, bestaat voor die crawler niet. Markup repareert dat niet, en llms.txt ook niet. Zolang je hoofdtekst pas na het uitvoeren van scripts verschijnt, is elke volgende maatregel een pleister op een pagina die voor een deel van je lezers niet bestaat.
Toets het in één handeling: haal je pagina op zonder browser en zoek je eigen h1 in de uitvoer. Staat hij er, dan mag de rest van de checklist aan de beurt komen.

Checklist: vóór je live gaat

Veelgestelde vragen

Q1Is llms.txt verplicht?+
Nee, en Google gebruikt het niet: de documentatie zegt dat het bestand genegeerd wordt. Zie het als een onderhouden overzicht van je site voor wie het opvraagt, zonder rankingverwachting. Kost het bijhouden meer tijd dan het oplevert, besteed die dan aan je pagina's zelf.
Q2Moet ik AI-crawlers blokkeren?+
Splits de vraag per doel. Wil je in AI-antwoorden verschijnen, laat dan de zoek- en citatiebots toe, waaronder OAI-SearchBot. Of je GPTBot toelaat, die materiaal verzamelt voor mogelijke modeltraining, is een losse afweging: dat hoeft je zichtbaarheid in de zoekfuncties niet te raken, want die lopen via een andere bot. Onze eigen keuze staat leesbaar in robots.txt.
Q3Heeft FAQ-schema nog zin?+
Voor een groter zoekresultaat bij Google niet meer: die weergave is in mei 2026 beëindigd. Voor je bezoeker wel. Een concrete vraag met een direct antwoord leest prettiger dan een alinea, en het is het soort tekst dat geciteerd kan worden. Schrijf de vragen dus voor mensen en beschouw het schema als bijvangst.
Q4Welke structured data zet ik er dan wel op?+
Wat zichtbaar op de pagina staat: wie het bedrijf is (Organization), wie het schreef (Person), wat het stuk is (Article, met publicatie- en herzieningsdatum) en waar het hangt (BreadcrumbList). Meer typen toevoegen dan de pagina waarmaakt, levert eerder een handmatige maatregel op dan een resultaat.
Q5Hoe weet ik of dit werkt?+
Meet drie dingen los van elkaar: indexering in Search Console, vertoningen en posities per zoekvraag, en aanvragen uit organisch verkeer. Zichtbaarheid in AI-antwoorden is lastiger te meten. Wat je wel kunt doen is verwijzingsverkeer uit die bronnen apart bijhouden en in je intakeformulier vragen waar iemand je gevonden heeft. Spreek vooraf af wat je meet, in plaats van achteraf een cijfer te zoeken dat goed uitkomt.

Wil je dit laten nakijken op je eigen site, dan begint dat met een gesprek. Je stuurt het formulier of een appje; binnen 24 uur krijg je van Nick zelf twee of drie momenten voorgesteld, geen agenda-link. Wat we dan doen staat op de marketingpagina: nulmeting eerst, daarna pas werk.

Van lezen naar bouwen

Speelt dit bij jou?
Dan is dit de volgende stap.

Een handgecodeerde Next.js-site, Lighthouse 95+, in jouw eigen repo 1–6 weken, vaste prijs na een gratis gesprek. 45 minuten, gratis. Eerstvolgende start: Q4 2026.

01Reactie binnen 24 uur
02Vaste offerte binnen 48 uur
03A-01 · Maatwerk websites