Een llms.txt-bestand is een platte-tekstsamenvatting van je website op /llms.txt die AI-systemen direct kunnen inlezen en citeren. Samen met JSON-LD structured data, citeerbare feiten en server-side rendering vormt het de technische basis van AI-vindbaarheid — deze checklist behandelt alle zeven bouwstenen, met 22labs.nl zelf als praktijkvoorbeeld.
Wat is technische GEO — en waarom een checklist?
De technische kant van GEO (Generative Engine Optimization) bestaat uit zeven bouwstenen: een robots.txt die AI-crawlers toelaat, een llms.txt-bestand, JSON-LD structured data, semantische HTML, citeerbare feiten, FAQ-content en server-side rendering. Samen bepalen die zeven of AI-zoekmachines zoals ChatGPT, Perplexity, Gemini en Claude je website kunnen ophalen, begrijpen en citeren in hun antwoorden.
Wat GEO precies is en hoe het zich verhoudt tot klassieke SEO, lees je in wat is GEO? en SEO vs. GEO: waarom ranken in Google niet meer genoeg is. Dit artikel is het praktische vervolg: de complete technische checklist, punt voor punt, telkens met wat het is, waarom het werkt en hoe je het aanpakt. Bij elk punt gebruiken we 22labs.nl zelf als praktijkvoorbeeld — alles wat hieronder staat, draait live op onze eigen site, dus je kunt elk voorbeeld gewoon nakijken. Meer over onze aanpak vind je op SEO & AI-vindbaarheid.
1. robots.txt: laat AI-crawlers expliciet toe
Wat: robots.txt is het bestand op de hoofdmap van je website dat crawlers vertelt welke pagina's ze mogen bezoeken. AI-bedrijven gebruiken eigen crawlers met eigen namen: GPTBot en OAI-SearchBot (OpenAI/ChatGPT), ClaudeBot (Anthropic/Claude), PerplexityBot (Perplexity), Google-Extended (Google/Gemini) en Meta-ExternalAgent (Meta).
Waarom: een crawler die je blokkeert, kan je content niet ophalen — en wat niet in de bronnen van een AI zit, wordt nooit geciteerd. Veel websites blokkeren AI-crawlers ongemerkt: via een security-plugin, de botbescherming van een CDN of een oude robots.txt die alles behalve Googlebot weert.
Hoe: neem de AI-crawlers expliciet op in je robots.txt:
User-agent: GPTBot
Allow: /
User-agent: ClaudeBot
Allow: /
User-agent: PerplexityBot
Allow: /Op 22labs.nl staan veertien AI-crawlers expliciet op de toegangslijst — naast de drie hierboven onder meer OAI-SearchBot, Claude-SearchBot, Google-Extended, Applebot-Extended, Amazonbot en CCBot. Alleen de admin- en klantomgevingen zijn uitgesloten. Let bij Google-Extended op de nuance: die regelt alleen of Google je content mag gebruiken voor Gemini. Je positie in de gewone zoekresultaten en in AI Overviews verandert er niet door — die draaien op de normale Googlebot.
2. llms.txt: je website samengevat in platte tekst
Wat: llms.txt is een platte-tekstbestand (in markdown) op /llms.txt dat je hele website samenvat: wie je bent, wat je doet, voor wie, met links naar je belangrijkste pagina's. Het formaat is in september 2024 voorgesteld door Answer.AI en wordt sindsdien door steeds meer websites en tools gebruikt.
Waarom: AI-systemen werken met beperkte contextvensters en hebben weinig aan navigatiemenu's, cookiebanners en scripts. Een llms.txt geeft ze in één bestand de kern, in een vorm die direct te citeren is. Eerlijk is eerlijk: het is een jong, onofficieel voorstel en geen enkele AI-zoekmachine garandeert dat het bestand wordt gebruikt. Maar het maken kost hooguit een uur, er is geen nadeel, en het dwingt je om je propositie in citeerbare vorm op te schrijven — precies de oefening die ook de rest van je site beter maakt.
Hoe: de basisstructuur ziet er zo uit:
# Bedrijfsnaam
> Eén alinea: wat je doet, voor wie en waar.
## Diensten
- [Dienst 1](https://www.jouwsite.nl/dienst-1): wat het is, plus een concreet feit
- [Dienst 2](https://www.jouwsite.nl/dienst-2): wat het is, plus een concreet feit
## Contact
E-mail, telefoon, locatie, KvK-nummerIn de llms.txt van 22labs.nl staan onze diensten, werkwijze, contactgegevens en ons KvK-nummer — maar ook meetbare resultaten, zoals de scores van websites die we bouwden. Precies de feiten waarvan wij willen dat een AI ze correct overneemt.
3. JSON-LD structured data: vertel machines ondubbelzinnig wie je bent
Wat: structured data is een machine-leesbare beschrijving van je pagina in het schema.org-vocabulaire, meegeleverd als JSON-LD in een script-tag. De drie belangrijkste types voor een MKB-website: Organization (wie je bent), Service (wat je levert) en FAQPage (vraag en antwoord).
Waarom: zonder structured data moet een machine uit lopende tekst afleiden hoe je heet, waar je zit en wat je doet. Met structured data ligt dat ondubbelzinnig vast. Google bouwt er rich results mee, en AI-zoekmachines gebruiken dezelfde gestructureerde gegevens om je bedrijf als entiteit te herkennen en aan het juiste onderwerp te koppelen.
Hoe: een minimaal FAQPage-schema ziet er zo uit:
{
"@context": "https://schema.org",
"@type": "FAQPage",
"mainEntity": [{
"@type": "Question",
"name": "Wat is GEO?",
"acceptedAnswer": {
"@type": "Answer",
"text": "GEO (Generative Engine Optimization) is het optimaliseren van je website zodat AI-zoekmachines je bedrijf noemen en citeren."
}
}]
}22labs.nl rendert op elke pagina server-side een Organization-schema (gecombineerd met ProfessionalService) met adres, e-mail, het KvK-nummer als officiële identifier en een knowsAbout-lijst met expertisegebieden. Dienstpagina's krijgen daarnaast een Service-schema en pagina's met een FAQ een FAQPage-schema. Gouden regel: structured data beschrijft wat zichtbaar op de pagina staat — nooit meer, nooit iets anders.
4. Semantische HTML: een koppenstructuur die als samenvatting leesbaar is
Wat: semantische HTML betekent dat je de juiste elementen gebruikt voor de juiste inhoud: één H1 per pagina, H2's voor de hoofdsecties, H3's daaronder, en lijsten als echte lijsten in plaats van losse regels.
Waarom: AI-modellen knippen lange pagina's op in stukken en gebruiken daarbij je koppenstructuur. Als elke kop de inhoud eronder dekt, kan zo'n stuk op zichzelf staan als antwoord op een vraag — en dat is exact wat een AI-engine zoekt.
Hoe: doe de outline-test: lees alleen je koppen. Begrijp je dan nog waar de pagina over gaat en welke vraag elk blok beantwoordt? Formuleer koppen waar het kan als de vraag die je klant letterlijk stelt ("Wat kost een website?" in plaats van "Investering") en geef in de eerste zin eronder direct het antwoord. Dit artikel is zelf zo opgebouwd: elk checklistpunt is een H2 die meteen zegt wat je moet doen.
5. Citeerbare feiten: schrijf zinnen die op zichzelf staan
Wat: een citeerbaar feit is een zin met een onderwerp, een concrete bewering, een getal en een bron of datum — een zin die klopt zonder de context eromheen.
Waarom: AI-engines citeren geen sfeerteksten. "Wij helpen ambitieuze ondernemers groeien" bevat niets wat een AI kan overnemen. Vergelijk dat met een feit uit onze eigen llms.txt: bij een meting op 19 augustus 2026 werd feliciatiebosch.nl — een website die TwentyTwo Labs bouwde — bij 60 klantvragen aan vier AI-zoekmachines in 35 antwoorden genoemd: 14 van de 15 keer in Perplexity, 13 van de 15 in Gemini, 5 van de 15 in ChatGPT en 3 van de 15 in Claude. Die zin kan een AI (of een journalist) letterlijk overnemen, inclusief datum en aantallen.
Hoe: loop je belangrijkste pagina's na en zorg dat elke pagina minstens drie van zulke zinnen bevat, met de sterkste in de eerste alinea — juist het begin van een pagina wordt vaak als samenvatting opgepikt. Gebruik echte cijfers uit je eigen praktijk (doorlooptijden, meetresultaten, aantallen) en zet er een datum bij, zodat een citaat verifieerbaar blijft.
6. FAQ-content: beantwoord de vragen die klanten echt stellen
Wat: een FAQ-sectie met vragen zoals klanten ze letterlijk formuleren, elk beantwoord in circa 40 tot 80 woorden, gekoppeld aan het FAQPage-schema uit punt 3.
Waarom: een AI-antwoord ís een vraag-antwoordpaar. Content die al in die vorm staat, hoeft niet eerst vertaald te worden. Kanttekening: Google toont FAQ-rich-results sinds 2023 vrijwel alleen nog bij overheids- en gezondheidswebsites — maar daar doe je het niet voor. Je doet het voor de AI-engines, die vraag-antwoordparen direct kunnen hergebruiken.
Hoe: verzamel de vragen uit je mailbox, telefoongesprekken en WhatsApp — dat zijn de formuleringen die mensen ook aan ChatGPT stellen. Antwoord in de eerste zin, nuanceer daarna. Op 22labs.nl staan de vragen en antwoorden van een pagina in één databestand, waaruit zowel de zichtbare FAQ als het FAQPage-schema wordt opgebouwd. Dat kost eenmalig wat inrichting, maar voorkomt de klassieke fout waarbij iemand de zichtbare tekst aanpast en het schema vergeet.
7. Server-side rendering: zorg dat je content in de bron staat
Wat: bij server-side rendering (SSR) of statische generatie (SSG) stuurt de server complete HTML naar de bezoeker. Bij client-side rendering stuurt hij een vrijwel lege pagina die pas na het uitvoeren van JavaScript inhoud krijgt.
Waarom: de meeste AI-crawlers voeren geen JavaScript uit. Googlebot rendert JavaScript wel, maar crawlers als GPTBot, ClaudeBot en PerplexityBot lezen wat er in de kale HTML staat. Een volledig client-side gerenderde website is voor hen praktisch leeg — hoe mooi hij er in de browser ook uitziet.
Hoe: de simpelste test: open je website, bekijk de paginabron (Ctrl+U) en zoek een zin uit je hoofdtekst. Staat die er niet in, dan zien AI-crawlers hem ook niet. 22labs.nl is gebouwd met Next.js en rendert elke pagina server-side — ook dit artikel is volledige HTML, zonder dat er JavaScript nodig is om de tekst te tonen.
De zeven fouten die we het vaakst tegenkomen
- AI-crawlers per ongeluk blokkeren. De botbescherming van een CDN of security-plugin weert GPTBot en ClaudeBot zonder dat je het doorhebt. Controleer je serverlogs op de user-agents uit punt 1.
- llms.txt eenmalig maken en nooit bijwerken. Verouderde diensten of tarieven in dat bestand worden verouderd geciteerd.
- Structured data die niet klopt met de zichtbare pagina. Validators en AI-engines prikken erdoorheen, en het ondermijnt het vertrouwen in ál je data.
- Sfeerkoppen in plaats van informatieve koppen. "Wij gaan verder waar anderen stoppen" zegt een AI niets; "Wat kost een website voor het MKB?" wel.
- Teksten zonder één concreet getal. Geen feiten betekent niets om te citeren — dan wint de concurrent die wél cijfers noemt.
- FAQ's vullen met keyword-varianten. Tien keer dezelfde vraag in andere woorden helpt niemand; tien échte klantvragen wel.
- Pas na livegang ontdekken dat de site client-side rendert. Toets het renderen vóór de bouw, niet erna — een SSR-migratie achteraf is de duurste fout op deze lijst.
Veelgestelde vragen
Is llms.txt verplicht om vindbaar te zijn in AI-zoekmachines?
Nee. llms.txt is een voorstel uit 2024, geen officiële standaard, en geen enkele AI-zoekmachine heeft toegezegd het bestand altijd te gebruiken. Toch raden we het aan: het kost hooguit een uur, heeft geen nadelen en dwingt je om je bedrijf citeerbaar samen te vatten. De fundamenten blijven toegankelijkheid (punt 1 en 7) en citeerbare content (punt 5 en 6).
Werkt structured data ook voor AI-zoekmachines of alleen voor Google?
Beide. Structured data is ontstaan voor klassieke zoekmachines, maar AI-engines profiteren van dezelfde ondubbelzinnigheid: je naam, locatie, diensten en FAQ's liggen machine-leesbaar vast. Bovendien leunen AI-antwoorden zoals Google AI Overviews en ChatGPT-zoekresultaten op bestaande zoekindexen, waarin structured data al meeweegt.
Hoe controleer ik of AI-crawlers mijn website bezoeken?
Kijk in je serverlogs of hostingstatistieken en filter op user-agents als GPTBot, ClaudeBot en PerplexityBot. Zie je die langskomen, dan wordt je site opgehaald. Kijk daarnaast in je analytics naar bezoekers met chatgpt.com, perplexity.ai of gemini.google.com als verwijzende site: dat zijn mensen die via een AI-antwoord naar je doorklikten.
Hoe snel zie ik resultaat van technische GEO?
De techniek zelf implementeer je in dagen, maar AI-engines moeten je site daarna opnieuw ophalen en verwerken. Reken op weken tot enkele maanden voordat je vermeldingen in AI-antwoorden ziet veranderen. Doe daarom eerst een nulmeting, zodat je het verschil straks kunt aantonen — bijvoorbeeld met de gratis SEO/GEO-scan.
Zelf doen of laten doen?
Alle zeven punten uit deze checklist kun je zelf implementeren, of samen met een technische partner. Begin in elk geval met meten: de gratis SEO/GEO-scan laat in 2 minuten zien hoe je website nu scoort in Google én in ChatGPT, Claude, Perplexity en Gemini, met concrete verbeterpunten per onderdeel van deze checklist.
Wil je het liever uitbesteden, of eerst sparren over wat er uit de scan komt? Plan dan een gratis adviesgesprek van 30 minuten waarin we je scanrapport samen doornemen: wat gaat al goed, waar zit de grootste kans en wat zouden wij als eerste aanpakken. Vrijblijvend, in gewone taal — en je weet daarna precies waar je aan toe bent. Hoe wij SEO en GEO voor het MKB aanpakken, lees je op SEO & AI-vindbaarheid.
Wil je weten hoe AI jouw bedrijf kan helpen? Neem vrijblijvend contact op.
Neem contact op

