---
title: Je website zichtbaar en begrijpelijk maken voor LLM's
description: >-
  AI-vindbaarheid is de nieuwe SEO. Of ChatGPT, Claude en Perplexity jouw site
  citeren, hangt af van wat je eromheen bouwt.
language: Dutch
url: >-
  https://www.voorhoede.nl/nl/blog/je-website-zichtbaar-en-begrijpelijk-maken-voor-llms/
---

Blog

# Je website zichtbaar en begrijpelijk maken voor LLM's

Door [James](/nl/team/james.md)

22 July 2026

## Categorieën

* [Web performance](/nl/blog/tag/web-performance.md)
* [Strategie](/nl/blog/tag/strategie.md)

- [Hoe AI-search eigenlijk werkt](#hoe-ai-search-eigenlijk-werkt)
- [Maak je site bereikbaar en leesbaar](#maak-je-site-bereikbaar-en-leesbaar)
- [Kunnen de bots je überhaupt bereiken?](#kunnen-de-bots-je-berhaupt-bereiken-)
- [Voeg structured data toe (schema)](#voeg-structured-data-toe-schema-)
- [Serveer markdown-alternatieven voor je pagina's](#serveer-markdown-alternatieven-voor-je-pagina-s)
- [Laat gebruikers chatten met je pagina](#laat-gebruikers-chatten-met-je-pagina)
- [llms.txt: de moeite waard?](#llms-txt-de-moeite-waard-)
- [Maak je content het citeren waard](#maak-je-content-het-citeren-waard)
- [Schrijf chunk-vriendelijke content](#schrijf-chunk-vriendelijke-content)
- [Beantwoord de vraag eerst](#beantwoord-de-vraag-eerst)
- [Publiceer originele data](#publiceer-originele-data)
- [Houd content vers](#houd-content-vers)
- [Scheid informatie van sales](#scheid-informatie-van-sales)
- [Verdien autoriteit buiten je eigen site](#verdien-autoriteit-buiten-je-eigen-site)
- [Hoe je weet of het werkt](#hoe-je-weet-of-het-werkt)
- [Tot slot](#tot-slot)

Dit vakgebied verandert snel. Ik ben de afgelopen jaren vooral bezig geweest met bijblijven: onderzoek lezen en dingen testen op onze eigen site om te zien waarmee we geciteerd worden. Voor websites heb ik op een rijtje gezet wat het beste werkt om ze goed te laten samenwerken met LLM's. Dat staat hieronder.

Steeds meer mensen stellen hun vragen aan een LLM in plaats van ze in Google te typen, en de meeste websites zijn daar nog niet op ingericht. SEO-best-practices helpen nog steeds, maar LLM's stellen hun eigen eisen. Of je de site nu bouwt of ervoor schrijft, er zijn concrete dingen die je kunt doen om je content makkelijker vindbaar, leesbaar en citeerbaar te maken. Weet wel dat het meeste hiervan is wat we nú weten: het blijft waarschijnlijk relevant, maar een deel klopt over een paar maanden niet meer, dus check het altijd even voordat je iets aanpast.

## Hoe AI-search eigenlijk werkt

Als we nieuwe klanten bij De Voorhoede vragen hoe ze ons gevonden hebben, was het antwoord vroeger hun netwerk of Google. Nu horen we "Chat raadde jullie aan." Hoe werkt dat dan?

Het antwoord van een LLM komt uit één van twee bronnen: wat het model tijdens de training al geleerd heeft, of een live zoekopdracht op het web die het op dat moment uitvoert voor actuelere informatie. Als het zoekt, pakt het een handvol pagina's uit zijn vooraf opgebouwde index, schrijft op basis daarvan één antwoord en citeert de bronnen die het gebruikt heeft. Die live-zoekroute is degene die jij kunt beïnvloeden, en die heeft een naam: retrieval-augmented generation, oftewel RAG. Elke grote AI-search draait erop.

De grote verandering is de resultatenpagina: die is er niet. Geen lijst van tien blauwe links waarin je kunt stijgen. Het model leest een paar bronnen, schrijft één antwoord, en je pagina haalt het of niet. Er is geen positie #2.

Het doel verschuift dus van op nummer één staan naar één van de bronnen zijn die het model kiest. Alles hieronder gaat daarover: zorgen dat het model je pagina's kan bereiken, ze schoon kan lezen, en je genoeg vertrouwt om jou te citeren en niet iemand anders.

Elk model heeft ook zijn eigen index. Google, OpenAI en Anthropic crawlen het web zelf en bouwen aparte indexen, dus wat een model kan zien, en hoe vers dat is, komt niet altijd overeen met de Google-resultaten die je gewend bent.

## Maak je site bereikbaar en leesbaar

Eerst de technische kant. Kan het model je pagina's daadwerkelijk ophalen en lezen zonder dat er rommel in de weg zit? Dit deel is vooral werk voor developers.

## Kunnen de bots je überhaupt bereiken?

Voordat de rest ertoe doet, moeten de AI-crawlers je pagina's kunnen ophalen, en veel sites blokkeren ze zonder het te weten. Je kunt al het andere goed doen en alsnog onzichtbaar zijn.

Er zijn twee dingen die je moet checken. Begin bij je`robots.txt` en zorg dat niets de AI-bots blokkeert. Check daarna je CDN of firewall, want tools als Cloudflare kunnen AI-bots aan de edge blokkeren, soms standaard, wat er ook in `robots.txt` staat. Wil je zeker weten dat ze binnenkomen, kijk dan in je serverlogs of de bots daadwerkelijk langskomen.\
\
Het helpt ook om te weten dat er niet één "AI-bot" bestaat. Er zijn drie soorten:

* **Trainingscrawlers** (`GPTBot, ClaudeBot`) verzamelen data voor toekomstige modellen.
* **Zoekcrawlers** (`OAI-SearchBot, Claude-SearchBot`) bouwen de index die het model doorzoekt als het antwoordt. Dit is degene die je citaties oplevert.
* **Live fetchers** (`ChatGPT-User, Claude-User`) halen een pagina op als de prompt van een gebruiker erom vraagt.

Ze worden apart aangestuurd, dus je kunt de trainingscrawler blokkeren en zichtbaar blijven in AI-search. Zo ziet dat eruit in `robots.txt`:

```
# Blokkeer de trainingscrawler van OpenAI
User-agent: GPTBot
Disallow: /

# Maar laat de zoekcrawler wel door
User-agent: OAI-SearchBot
Disallow:
```

## Voeg structured data toe (schema)

Structured data is markup die machines vertelt waar je pagina over gaat zonder dat ze hoeven te gokken. Het zet de feiten op een rij in een formaat dat gebouwd is om te parsen: dit is een artikel, dit is de auteur, dit is het bedrijf, dit is de publicatiedatum.

De makkelijkste start is JSON-LD, het formaat dat Google aanraadt en het eenvoudigst is om toe te voegen. Voeg de types toe die bij je content passen:`Article` of `BlogPosting` voor posts, `Organization` voor je bedrijf, `Person` voor auteurs, `FAQPage` voor Q\&A. Koppel je entiteiten met `sameAs`, zodat het model je merk aan zijn profielen kan verbinden en kan vaststellen wie je bent. Het volledige vocabulaire staat op [schema.org](https://schema.org/).

Voor traditionele zoekmachines is het bewezen, en het geeft modellen schone entiteitsdata om te lezen. Hoeveel elk model het meeweegt voor citaties is eigenlijk nooit gemeten, maar het is goedkoop en standaard, dus het toevoegen waard.

## Serveer markdown-alternatieven voor je pagina's

Serveer van elke pagina een schone markdown-versie. Die geeft het model alleen de content: geen navigatie, geen footer, geen ongelabelde afbeeldingen, geen markup om doorheen te graven. Dat betekent minder tokens om te verwerken en een schonere leeservaring, dus het model besteedt zijn aandacht aan wat je daadwerkelijk schreef. We doen dit op onze eigen site. Zet `.md` achter een pagina-URL en je krijgt de schone versie, ook van deze post.

Om hem vindbaar te maken doe je drie dingen

* Serveer hem met het juiste content type, `text/markdown; charset=utf-8`, zodat hij als markdown rendert in plaats van als bestand te downloaden.

* Voeg een `rel="alternate"`-link toe in de head van de pagina die naar de `.md` wijst.

* Zet een zichtbare link op de pagina zodat mensen en agents hem kunnen vinden.

Voor de volledige opzet, inclusief content negotiation en headers, gaat de [Website Specification](https://specification.website/spec/agent-readiness/markdown-source-endpoints/) er dieper op in. Anthropic, Stripe, Vercel en Cloudflare serveren allemaal markdown-versies van hun docs.

## Laat gebruikers chatten met je pagina

Deze helpt vooral je lezers in plaats van je zichtbaarheid, maar hij is het kopiëren waard, en je hebt hem vrijwel zeker al gezien. Docs-sites hebben tegenwoordig een klein "Copy page"-menu: kopieer de pagina als markdown, open de ruwe markdown, of start er een chat over in ChatGPT of Claude. De docs van Claude zelf en Vercel hebben het allebei.

Het bouwt direct voort op het markdown-werk hierboven. De chat-optie opent een AI met een vooraf ingevulde prompt die naar de markdown van je pagina wijst, zodat een lezer met één klik vragen kan stellen. Zowel ChatGPT als Claude nemen de prompt uit de URL (`chatgpt.com/?q=...`). Waarom alleen die twee? We zouden Mistrals Le Chat en Protons Lumo er graag bij zetten, maar geen van beide ondersteunt dit op het moment van schrijven.

We hebben dit op al onze blogposts staan, ook op degene die je nu leest.

## llms.txt: de moeite waard?

Voor citaties waarschijnlijk niet, maar het is goedkoop en sommige tools lezen het. `llms.txt` is een voorgesteld bestand in de root van je site, een markdown-overzicht van je content dat je zelf samenstelt, gepresenteerd als "AI-sitemap" naast `sitemap.xml`.

Het bewijs is niet gunstig. [SE Ranking onderzocht 300.000 domeinen](https://seranking.com/blog/llms-txt/) en vond geen verband tussen het hebben van een `llms.txt` en geciteerd worden, slechts zo'n 10% van de sites gebruikt het, en Google heeft gezegd geen plannen te hebben om het te ondersteunen. Waar het wél gebruikt wordt, is developer tooling. Het is een schone manier om je docs aan AI-coding-assistants te geven. LangChain publiceert bijvoorbeeld een [llms.txt voor zijn eigen docs](https://docs.langchain.com/llms.txt) en bouwde een server om deze bestanden aan IDE-agents te geven. Dus heb je developer-docs en gebruikt je publiek die tools, dan is het de moeite waard.

Voeg er een toe als je toch al markdown serveert, het is snel gedaan en kan geen kwaad. Reken er alleen niet op voor je zichtbaarheid, en zet het niet vóór de dingen die wel werken.

## Maak je content het citeren waard

Nu de redactionele kant. Is je content het citeren eigenlijk waard? Dit deel is vooral contentwerk.

## Schrijf chunk-vriendelijke content

Retrieval (RAG) pakt niet je hele pagina. Het knipt de pagina in chunks en haalt de paar op die bij de vraag passen, dus elke chunk moet op zichzelf te begrijpen zijn.

Schrijf elke sectie zo dat hij werkt zonder de rest van de pagina eromheen. Geef hem een duidelijke kop, houd hem gefocust op één punt, en beantwoord dat punt binnen de sectie zelf in plaats van te leunen op iets van drie alinea's eerder. Korte, op zichzelf staande secties werken beter dan één lang betoog, want het model ziet er misschien maar één.

Daarom helpt die markdown-versie ook: schone structuur geeft schone chunks.

## Beantwoord de vraag eerst

Zet het antwoord in de eerste zin en leg het daarna uit. De lezer heeft het punt meteen, en het model ook.

Formuleer je koppen als de vragen die mensen echt stellen, en beantwoord elke vraag in de openingszin. Het model matcht je content met een vraag, dus een sectie die met het antwoord begint is makkelijk op te pakken en te citeren. Alles na die eerste zin is onderbouwing: het waarom, de kanttekeningen, het voorbeeld.

Deze post doet hetzelfde: de eerste zin beantwoordt de kop, de rest onderbouwt hem.

## Publiceer originele data

Doe je eigen onderzoek, enquêtes of benchmarks en publiceer de cijfers. Als een model een feit gebruikt, moet het een bron noemen, en als dat feit van jou komt, ben jij de bron.

Originele data is zo'n beetje de meest citeerbare content die je kunt maken. Modellen vertrouwen op verifieerbare feiten met een bron, en bij een cijfer dat alleen op jouw pagina staat, kunnen ze niemand anders noemen. Herhaal je wat iedereen al zegt, dan ben je één van de vele inwisselbare bronnen.

## Houd content vers

Werk je belangrijke pagina's bij en laat zien wanneer je dat voor het laatst deed. AI-search heeft een voorkeur voor recente content, dus een pagina die duidelijk vorige maand is bijgewerkt heeft een voorsprong op een pagina die er vijf jaar oud uitziet.

Zet een zichtbare update-datum op de pagina en vul `dateModified` in je schema. Loop je kernpagina's op een vast schema na, repareer wat verouderd is, en werk de datum bij als je dat doet.

Het is een ongelijk signaal, sterker in ChatGPT en Perplexity, lichter in Claude. Maar het is één van de weinige die je zelf direct kunt aanpassen, dus maak er een gewoonte van.

## Scheid informatie van sales

Houd je informatieve pagina's gericht op antwoorden, niet op verkopen. Modellen geven de voorkeur aan content die informeert boven content die pitcht, dus een pagina vol salescopy en call-to-actions wordt minder geciteerd dan een pagina die gewoon de vraag beantwoordt.

Leg het conversiewerk ergens anders neer. Laat je guides, docs en uitlegpagina's het uitleggen doen, en houd de "plan een demo"- en "koop nu"-pagina's apart. De verkoop krijg je nog steeds, het model heeft alleen een schone pagina om onderweg te citeren.

## Verdien autoriteit buiten je eigen site

Een deel van wat je citaties oplevert staat helemaal niet op je eigen site. Modellen wegen mee hoe vaak je genoemd wordt op andere vertrouwde plekken, dus dat er over je gepraat wordt telt ook, niet alleen het werk op je eigen pagina's.

Verdien vermeldingen waar het telt: vakwebsites, reviews en actieve communities. Reddit weegt hier flink mee, deels omdat [Google](https://blog.google/company-news/inside-google/company-announcements/expanded-reddit-partnership/) en OpenAI betaalde [licentiedeals](https://redditinc.com/news/reddit-and-google-expand-partnership) hebben voor zijn data, die zowel gebruikt wordt om modellen te trainen als om Reddit in hun antwoorden te laten zien. Als betrouwbare bronnen naar je verwijzen, vertrouwt het model je meer en citeert het je pagina's eerder. Soms citeert het de andere site in plaats van jou, en op termijn voeden die vermeldingen wat het model over je weet, zonder dat er gezocht hoeft te worden.

Let wel, dit is correlatie, geen garantie. Merken waarover gepraat wordt, worden vaker geciteerd, maar één vermelding doet het niet. Zie het als reputatie die je in de loop van de tijd opbouwt, geen quick win.

## Hoe je weet of het werkt

Begin bij je analytics. Komen er mensen binnen via `chatgpt.com`, `perplexity.ai` en dergelijke, dan laten AI-tools je pagina's zien en sturen ze je verkeer. Het is het makkelijkste signaal, en je kunt het vandaag checken.

Het nadeel: referral-verkeer telt alleen kliks. Een groot deel van AI-gebruik is zero-click: het model beantwoordt de vraag op basis van jouw pagina en de lezer komt nooit langs. Je kunt dus vaak geciteerd worden en toch kleine cijfers zien.

Voor het vollere beeld houd je je share of answer bij. Neem een vaste set vragen die je publiek zou stellen, stel ze aan de LLM's, en tel hoe vaak je genoemd wordt. Draai elke vraag een paar keer, want antwoorden variëren, en check elke engine apart. Met de hand is het een klus, dus tools als [Promptwatch](https://promptwatch.com/) kunnen het voor je draaien.

## Tot slot

Niets hiervan is magie, en je hebt het ook niet allemaal nodig. Het meeste is gewoon goede webhygiëne met een nieuw doel: de bron zijn die een model kiest. Zorg dat de bots je kunnen bereiken, serveer schone content en wees het citeren waard, en je hebt het grootste deel gedekt.

Dit voorwerk levert ook voor je eigen site wat op. Dezelfde opzet maakt het makkelijker om features toe te voegen als AI-zoeken of een chat-assistent: je content staat al in schone chunks, en je `llms.txt` dient meteen als redactionele leidraad voor welke pagina's het belangrijkst zijn.

De details blijven verschuiven. Nieuwe conventies zoals `llms.txt` worden voorgesteld, crawlers veranderen hun regels, en wat in het ene model helpt, telt in het andere minder. Maar de richting blijft dezelfde: heldere, bereikbare, betrouwbare content is wat gekozen wordt. Begin bij de basis en pas aan als de tools veranderen.

## Gerelateerde blog posts

* ### [Maak je design system agent-ready](/nl/blog/je-design-system-agent-ready-maken.md)
  30 Jun 2026

  Door Sjoerd
* ### [Hoe dichtbij de gebruiker moet jouw code draaien?](/nl/blog/hoe-dichtbij-de-gebruiker-moet-jouw-code-draaien.md)
  30 Oct 2025

  Door Jasper
* ### [Digitale Soevereiniteit Heroveren op Europese Infrastructuur](/nl/blog/digitale-soevereiniteit-heroveren-op-europese-infrastructuur.md)
  29 Jan 2026

  Door Luuk

[← Alle blogposts](/nl/blog.md)

[Terug naar boven](#top)
