Kan het model erbij
Staat er een AI-crawler geblokkeerd in robots.txt, is er een robots.txt, draait de site op https. Dit is de laag waar de meeste mensen aan denken.
Wat 601 sites ons vertelden over de vraag of een AI-model ze kan lezen. Met de volledige methode erbij, zodat je de cijfers kunt narekenen.
Gescand op 13 augustus 2026. Alleen publieke pagina's, geen inlog en geen tracking.
Per site haalden we drie publieke bronnen op: de homepage, robots.txt en llms.txt. Geen inlog, geen tracking, geen scripts uitgevoerd. Precies wat een zoekmachine ook ophaalt. Daarop keken we naar drie groepen kenmerken.
Staat er een AI-crawler geblokkeerd in robots.txt, is er een robots.txt, draait de site op https. Dit is de laag waar de meeste mensen aan denken.
Is er een kop die als vraag geformuleerd is, staat er FAQ-schema op de pagina, is er een datum in het schema. Dit is de laag waar het in de praktijk misgaat.
Schema markup in welke vorm dan ook, een meta description, een sitemap en een sitemapregel in robots.txt.
706 domeinen, gescand op 13 augustus 2026. 601 sites waren bereikbaar, 85 procent. De rest gaf een time-out, een foutmelding of bestaat niet meer. Alle percentages op deze pagina gaan over die 601.
Dit is geen aselecte steekproef van de Nederlandse markt. Het is een eigen selectie van 706 domeinen, dus de cijfers zeggen iets over deze groep en niet over Nederland als geheel. Er worden geen bedrijfsnamen genoemd, in geen enkele vorm.
Wat we ook niet gemeten hebben: of een model deze sites daadwerkelijk citeert. Dat is met de huidige tooling niet betrouwbaar vast te stellen, en wie doet alsof dat wel kan, verkoopt je iets.
Wij verwachtten geblokkeerde crawlers en rommelige sites. Dat vonden we niet. De techniek staat er grotendeels goed bij; het gat zit in wat er op de pagina staat.
601 sites
| Bevinding | Aantal | Aandeel |
|---|---|---|
| Blokkeert een AI-crawler | 22 | 4% |
| Geen robots.txt | 44 | 7% |
| Draait niet op https | 1 | 0% |
Van de 601 sites houden er 22 een AI-crawler tegen. Bij een deel daarvan is dat vermoedelijk niet eens een keuze geweest, maar iets dat meekwam met een securityplugin.
Het echte probleem
| Wat we misten | Aantal | Aandeel |
|---|---|---|
| Geen FAQ-schema | 588 | 98% |
| Geen llms.txt | 527 | 88% |
| Geen datum in schema | 318 | 53% |
| Geen enkele kop als vraag geformuleerd | 297 | 49% |
FAQ-schema is precies het formaat waarin je een vraag aan een antwoord koppelt op een manier die een machine begrijpt. Dertien sites van de 601 gebruiken het.
Ook nog open
| Bevinding | Aantal | Aandeel |
|---|---|---|
| Geen schema markup, in welke vorm dan ook | 213 | 35% |
| Geen sitemapregel in robots.txt | 179 | 30% |
| Geen sitemap.xml | 174 | 29% |
| Geen meta description | 141 | 23% |
Dit is geen AI-verhaal. Dit staat al tien jaar in elke SEO-checklist.
Hier is de spreiding het grootst, en daarmee ook het meest bruikbaar. Eén kenmerk laat het verschil het duidelijkst zien: is er op de homepage ook maar één kop die als vraag geformuleerd is?
Let op de aantallen achter de labels. Bouw en professionele training zitten rond de twintig sites, dus daar schuift een enkele site het percentage al merkbaar op. De richting is bruikbaar, de exacte procenten zijn dat voor die twee niet.
Niet omdat bouwbedrijven minder om hun website geven, maar omdat een bouwsite doorgaans is opgezet om te laten zien wat je kunt, met projectfoto's en referenties. Dat werkt prima voor een mens die rondkijkt, en slecht voor een model dat een vraag probeert te beantwoorden.
| Sector | Sites | Geen vraagkop | Geen FAQ | Geen schema | Geen llms.txt |
|---|---|---|---|---|---|
| Alle sites | 601 | 49% | 98% | 35% | 88% |
| B2B-sectoren samen | 146 | 53% | 99% | 29% | 83% |
| Software en IT | 46 | 35% | 96% | 35% | 72% |
| Professionele training | 19 | 42% | 95% | 37% | 95% |
| Retail | 30 | 43% | 100% | 37% | 93% |
| Automotive | 31 | 61% | 100% | 26% | 87% |
| Bouw | 22 | 68% | 100% | 27% | 82% |
95 procent van de gescande homepages heeft geen zichtbare auteur. Dat klinkt dramatisch, maar een homepage hoort ook geen byline te hebben. Op blogs en kennisartikelen weegt auteurschap wel mee, maar dat hebben we hier niet gemeten. We zetten het erbij omdat het in de data staat, niet omdat we er een conclusie aan verbinden.
Op volgorde van opbrengst per uur werk. Alle drie zijn ze uit te voeren zonder je site opnieuw te laten bouwen.
Direct onder de titel een blok van veertig tot zestig woorden dat de vraag van die pagina beantwoordt. Geen inleiding over hoe belangrijk het onderwerp is. De mediane homepage in onze meting telt 666 woorden, dus de ruimte is er. Het gaat om de volgorde, niet om de lengte.
"Onze aanpak" wordt "Hoe verloopt zo'n traject?". Dit is de helft van het probleem: bij 49 procent van de sites is geen enkele kop als vraag geformuleerd.
Vijf vragen die klanten echt stellen, met een eerlijk antwoord, en FAQPage-schema eronder. Daarmee zit je meteen bij de 2 procent die dit wel heeft.
Vier pagina's met alle tabellen: de volledige methode, de uitsplitsing per sector, en wat we bewust niet gemeten hebben. Je krijgt het rapport direct na het invullen.
| Meetdatum | 13 augustus 2026 |
| Domeinen aangeboden | 706 |
| Bereikbaar en meegenomen | 601 (85%) |
| Bron van de domeinen | eigen selectie, geen aselecte steekproef |
| Opgehaald per site | homepage, robots.txt, llms.txt |
| Niet gemeten | of een model de site daadwerkelijk citeert |
| Publicatie van namen | geen, in geen enkele vorm |
| Volgende meting | maart 2027 |
Overnemen mag. Vermeld Addmark en link naar deze pagina, dan kan iedereen de methode nalezen.
We haalden per site de homepage, robots.txt en llms.txt op en keken naar drie dingen: of de crawlers erin mogen, of er structuur is die een model kan gebruiken zoals schema markup en FAQ-schema, en of de koppen aansluiten op de manier waarop mensen vragen stellen.
Niet automatisch. Een model kan je ook noemen op basis van vermeldingen elders, bijvoorbeeld in vakmedia of op Wikipedia. Deze meting gaat over de vraag of jouw eigen site bruikbaar is als bron.
Dat is precies het punt. De aanname is meestal dat je iets moet openzetten. In werkelijkheid staat het al open en is er niets te halen.
Omdat het dan over 601 sites vergelijkbaar en herhaalbaar blijft. De homepage is bovendien de pagina die het vaakst wordt opgehaald. Voor een individuele site is een diepere analyse zinvoller, maar dan meet je iets anders dan wat hier staat.
Nee, en daarom publiceren we ook geen namen. We haalden alleen publieke pagina's op, net zoals een zoekmachine dat doet.
Ja. Vermeld Addmark en link naar deze pagina, dan kan iedereen de methode nalezen. Wil je de onderliggende tabellen, gebruik dan het rapport.
Ja, in maart 2027. Dan is het een reeks en kunnen we zeggen of Nederland vooruitgaat.
Boek een vrijblijvende RevOps-scan. In 30 minuten zie je waar jouw grootste hefboom zit, en wat het je oplevert.
Ontdek in een paar minuten waar je omzetmotor haakt en waar je nog kunt verbeteren.
Doe de gratis scan →