In het kort
llms.txt is een Markdown-bestand in de root van je website met een gecureerde lijst van je belangrijkste pagina’s voor AI-tools. Het vervangt robots.txt niet: robots.txt regelt toegang, llms.txt is een handmatig startpunt voor systemen die de conventie ondersteunen. Het is een voorgestelde conventie, geen standaard: niet elke AI-tool leest het bestand, dus het is een aanvulling op leesbare pagina’s, geen vervanging.
In dit artikel
llms.txt is een Markdown-bestand in de root van je website dat AI-tools een gecureerde lijst geeft van je belangrijkste pagina’s. Het is geen vervanging van robots.txt, het is een aanvulling: robots.txt regelt toegang, llms.txt biedt systemen die de conventie ondersteunen een handmatig samengesteld startpunt. Hieronder lees je wat erin hoort, hoe je hem maakt en welke AI-tools er nu wel en niet naar kijken.
AI-systemen lezen websites anders dan mensen. Ze halen content op via geautomatiseerde bezoekers, knippen pagina’s op in losse passages en proberen daaruit antwoorden samen te stellen. Een pagina die voor een menselijke bezoeker glashelder is, kan voor een AI-systeem juist verwarrend of onbruikbaar zijn. Begrijpen hoe AI je site leest is de basis van AI-vindbaarheid.
Waarom zou je een llms.txt maken?
AI-systemen baseren hun antwoorden op patronen die ze in tekst herkennen. Heldere structuur, expliciete bedrijfsinformatie, korte zelfstandig leesbare passages en consistente signalen verhogen de kans dat je site wordt geciteerd. Onduidelijke structuur, content alleen in afbeeldingen, of informatie die alleen klopt in combinatie met andere pagina’s, verlaagt die kans.
Daarnaast spelen toegangsregels een rol. AI-crawlers lezen je robots.txt en houden zich, als ze netjes zijn, aan wat jij daar verbiedt; staat er niets, dan mogen ze alles. Sommige sites hebben deze toegang ongewild dicht staan, andere staan juist te wijd open voor crawlers waarvan je liever geen content laat oogsten. Beide kanten verdienen aandacht.
Wat gaat er mis bij llms.txt?
Drie patronen zien we vaak terug. Belangrijke bedrijfsinformatie staat verspreid over een over-pagina, een footer, een contactpagina en een algemene-voorwaarden-pagina, zonder dat AI deze tot één coherent profiel kan combineren. Antwoorden op klantvragen staan in lange artikelen waaruit AI geen zelfstandig leesbare passage kan losweken. En toegangsregels voor AI-systemen ontbreken volledig, waardoor de website per platform wisselend behandeld wordt.
Wat zet je wel en niet in je llms.txt?
Een llms.txt is geen tweede homepage en geen verkooppraatje. Het is een kort, feitelijk overzicht dat een AI-systeem dat de conventie ondersteunt in één keer kan inlezen. Dat werkt alleen als de inhoud klopt, actueel is en overeenkomt met wat er daadwerkelijk op je website staat.
Wel opnemen
- Bedrijfsfeiten: wie je bent, wat je doet, voor wie en waar. Eén alinea die zonder verdere context begrijpelijk is.
- Een paginalijst met korte beschrijvingen: je belangrijkste pagina’s, elk met één zin die uitlegt wat daar te vinden is. Zo kan een systeem dat de conventie ondersteunt makkelijker inschatten welke pagina bij welke vraag hoort.
- Een actualiteitsdatum: wanneer het bestand voor het laatst is bijgewerkt. Verouderde informatie is erger dan geen informatie.
Liever weglaten
- Geheimen of interne informatie: het bestand is volledig openbaar. Zet er niets in dat je niet ook op je drukst bezochte pagina zou zetten.
- Marketing-jargon: termen als “toonaangevend” of “passie voor kwaliteit” zeggen een AI-systeem niets. Feiten zijn bruikbaarder als bron dan slogans.
- Dingen die niet op je site staan: claims die nergens anders op je website terugkomen, creëren tegenstrijdige signalen en ondermijnen je geloofwaardigheid als bron.
Wil je zien hoe dat er in de praktijk uitziet? Ons eigen bestand staat live op /llms.txt. Dat is meteen het eerlijkste voorbeeld dat we kunnen geven: zo bieden wij onszelf aan aan systemen die de conventie ondersteunen. Of ChatGPT, Copilot, Perplexity of Gemini het bestand gebruiken, is niet publiek bevestigd.
Hoe gebruiken AI-tools llms.txt nu?
Eerlijk antwoord: de adoptie is nog jong. Het is een open voorstel, geen officiële standaard, en de grote AI-platforms hebben niet publiek bevestigd dat ze het bestand structureel inlezen. Behandel llms.txt dus niet als garantie op vermelding, maar als een laagdrempelige manier om AI-systemen op weg te helpen. Dat is ook het verschil met robots.txt. Dat is een gevestigde afspraak die crawler-toegang regelt, terwijl llms.txt hoogstens een aanvullend, experimenteel overzicht biedt aan systemen die de conventie ondersteunen.
Waarom zou je het dan toch doen? Omdat de investering klein is en het nadeel afwezig. Het bestand zit niemand in de weg, en als de adoptie groeit ben je er klaar voor. Het grootste voordeel is misschien wel onverwacht: het schrijven dwingt je om je bedrijfsverhaal scherp te krijgen. Wie niet in één alinea kan opschrijven wat het bedrijf doet en voor wie, kan er niet op rekenen dat een AI-systeem dat wel uit losse pagina’s destilleert. Die oefening alleen al levert vaak verbeteringen op voor de rest van je website.
Wat beoordeelt Citeerbaar aan je llms.txt?
We kijken naar de leesbaarheid van je website voor AI-systemen. Dat omvat technische toegankelijkheid, content-structuur, bedrijfsprofiel-consistentie en hoe antwoordklaar de inhoud is. We vertalen dat naar concrete verbeteringen die we op je site live zetten.
Waarom is dit per site anders?
Welke verbeteringen het grootste effect hebben, hangt af van je sector, je doelgroep en de huidige technische staat van je website. Een restaurant heeft andere AI-leesbaarheid nodig dan een SaaS-bedrijf, en een lokale dienstverlener andere dan een nationale webshop. Daarom doen we eerst een Scan of Fix voordat we uitvoering plannen.
Veelgestelde vragen
De korte antwoorden.
Wat is llms.txt?
Een voorgestelde conventie: een tekstbestand in de root van je website met een gecureerd overzicht van je belangrijkste pagina's voor AI-tools. Geen vervanging van robots.txt: dat regelt toegang, llms.txt biedt een aanvullend overzicht aan systemen die het ondersteunen.
Hoe lezen AI-tools je website?
AI-crawlers zoals GPTBot, ClaudeBot en PerplexityBot halen openbare pagina's op via HTTP en lezen vooral je zichtbare content en structured data. Google-Extended is geen crawler maar een robots.txt-instelling voor Gemini-training en het onderbouwen van Gemini-antwoorden. Brede ondersteuning van llms.txt is niet bevestigd.



